Llama가 차지한 자리
Meta의 Llama가 모든 벤치마크에서 늘 1등인 건 아니야. 그래도 오픈 가중치 생태계에서 가장 영향력 있는 Dense 백본 가운데 하나야. 2024~2026년에 나온 수많은 미세 조정 모델, RAG 시스템, 에이전트 스택이 Llama 계열 위에 세워졌어. 이 계보를 읽으면 Dense를 교과서가 아니라 실제 생태계로 이해할 수 있어.
Llama 3
2024년 4월 공개된 8B와 70B는 GQA(8 KV 헤드), 128K 어휘, RoPE 위치 인코딩, SwiGLU 활성화를 썼어. 특히 70B는 ‘쓸 만한 오픈 가중치 70B급 Dense’의 사실상 기준점이 됐고, 이후 작은 미세 조정 모델들이 넘으려는 표적이 됐지.
Llama 3.1
2024년 7월에는 공개 Dense 모델 가운데 손꼽히게 큰 405B가 더해졌고, 패밀리의 컨텍스트 창도 128K로 늘었어. 405B는 연산 비용 때문에 대규모 서빙이 쉽지 않지만, 프런티어 규모에서 Dense 확장이 얼마나 비싸지는지 선명하게 보여줬어.
Llama 3.2와 3.3
3.2는 1B·3B 소형 모델과 11B·90B 멀티모달 변형을 추가했어. 3.3은 70B-Instruct의 후속 학습을 다듬어 405B에 가까운 행동을 훨씬 적은 연산량으로 노렸지. 2025~2026년 실무에서 70B-Instruct가 높은 활용도를 보이는 이유야.
Llama 4의 MoE 전환
2025년 4월의 Llama 4 Scout, Maverick, Behemoth는 Meta의 첫 MoE 세대야. 그렇다고 Llama 3.x Dense가 사라진 건 아니야. 예측 가능한 서빙이 필요한 팀은 여전히 Llama 3.3 70B를 쓰고, 더 큰 용량이 필요한 자리를 Llama 4가 채워. Dense는 폐기된 게 아니라 역할이 또렷해졌어.