에이전트는 배선이 아니라 반복문이야
AI 에이전트는 관찰하고, 생각하고, 행동하고, 다시 관찰하는 반복문 안에 LLM을 넣은 시스템이야. LangChain, LangGraph, CrewAI, AutoGen, OpenAI Agents SDK, Claude Agent SDK는 표준 모델 호출 둘레에서 상태를 관리해. 매 회차는 잘 구성된 프롬프트와 평범한 모델 호출 하나이고, 모델은 자신이 에이전트 안에 있다는 사실을 따로 알지 못해.
짧은 오케스트레이션 코드로 만들 수 있어
에이전트 반복문을 수십 줄의 코드로 구현할 수 있다면 그 기능은 백본 아키텍처가 아니라 시스템 배관이야. 모델은 그대로고 바깥 코드가 상태와 행동을 이어 줘.
긴 컨텍스트도 보통 같은 백본 안의 확장이야
컨텍스트를 4K에서 128K나 1M 이상으로 늘릴 때는 다음 선택을 주로 써.
- RoPE 주파수 스케일링: NTK 계열이나 YaRN으로 학습 범위 너머의 위치를 표현해.
- 연속 학습: 새 위치 설정으로 긴 시퀀스를 더 학습해.
- 어텐션 구현 개선: 긴 KV 캐시를 감당하도록 메모리와 커널을 다듬어.
트랜스포머 백본을 통째로 바꾸기보다 위치 인코딩과 학습 길이, 실행 구현을 조정하는 경우가 많아.
광고된 길이와 실제로 쓰는 길이는 달라
1M 토큰을 입력할 수 있다고 1M 전체에서 정보를 똑같이 잘 꺼내는 건 아니야. Needle in a Haystack, MECW, RULER 같은 평가는 광고 한계보다 훨씬 이른 지점에서 성능이 떨어지는 모델을 보여줘. 숫자는 받아들일 수 있는 용량이지 회상 능력의 보증서가 아니야.
가중치 안과 밖을 나눠
에이전트, RAG, 안전장치, 시스템 프롬프트처럼 고정된 모델을 소프트웨어로 감싸는 기능은 제품 계층에 있어. 긴 컨텍스트는 주로 위치 인코딩과 학습의 변화야. 네트워크의 뼈대는 가중치 파일에 있고 나머지는 그 주위를 둘러싼 시스템이야.