필터를 알면 Hub의 분류법이 보여
/models 페이지와 API는 같은 축으로 모델을 나눠. task(pipeline_tag), library, language, license, provider, size, format을 조합하고, 인기·다운로드·좋아요·수정일·생성일 순으로 정렬할 수 있어. 이 필터를 단순한 화면 장식이 아니라 Hub의 분류 체계로 이해하면 후보를 찾는 시간이 크게 줄어.
이름에는 용도가 묻어 있어
모델 ID는 대체로 {org}/{base}-{size}-{variant} 형태를 따라. 강제 규칙은 아니지만 다음 표기는 빠르게 후보를 가르는 데 유용해.
meta-llama/Llama-3.1-8B는 instruction tuning을 하지 않은 베이스 모델이야.meta-llama/Llama-3.1-8B-Instruct는 대화형 지시 수행에 맞춘 변형이야.TheBloke/Llama-2-7B-Chat-GGUF는 llama.cpp나 Ollama에서 쓰는 GGUF 양자화 모델이야.-AWQ,-GPTQ,-bnb-4bit는 보통 추론용 양자화 방식을 나타내.-Matryoshka,-Distill은 임베딩 축소나 지식 증류 같은 특수 변형을 암시해.
다만 이름은 힌트일 뿐이야. 확정적인 계보는 모델 카드의 base_model과 base_model_relation처럼 기계가 읽을 수 있는 메타데이터에서 확인해야 해.