본문 바로가기
C.W.K.
Stream
Lesson 04 of 05 · published

업데이트 규율

~14 min · ops, updates

Level 0Downloader
0 XP0/41 lessons0/11 achievements
0/120 XP to next level120 XP to go0% complete

Drift하는 것들

  • Ollama daemon — Major 버전이 기능 (OpenAI compat, Apple의 MLX backend)을 얹고, 가끔 default까지 바꿔.
  • 모델 tagqwen2.5:7b가 한 달 뒤엔 전혀 다른 GGUF를 가리킬 수도 있어.
  • Capability — Tool을 지원 안 하던 모델이 새 release에서 갑자기 지원하게 되기도 해.
  • System prompt template — Template이 조금만 바뀌어도 어제 멀쩡했던 Modelfile이 오늘은 쓰레기를 뱉어.

업데이트 전략

  1. 정해둔 주기로 (월 1회쯤) Ollama 자체를 업데이트해. release note에 breaking change가 있는지 훑어보고.
  2. Production에선 모델 tag를 pin해. qwen2.5 말고 ollama pull qwen2.5:7b-instruct-q5_K_M처럼. 끝까지 적은 tag는 밑에서 조용히 갈릴 일이 훨씬 적어.
  3. Daemon 업데이트 후 벤치마크 suite 다시 돌려. Ship 전에 perf regression 잡아.
  4. "Last-known-good" 모델 디스크에 유지. 새 pull이 prompt 깨면 이전 tag로 fallback.

Code

업데이트 + verify·bash
# Ollama 자체 업데이트 (Homebrew)
brew upgrade ollama

# 설치된 각 모델을 최신 tag로 업데이트
for m in $(ollama list | tail -n +2 | awk '{print $1}'); do
  echo "=== updating $m ==="
  ollama pull "$m"
done

# 벤치마크 다시 돌려 — 아무것도 안 변했다고 가정하지 마
python3 ~/scripts/ollama_bench.py

# 깨졌으면 Ollama downgrade하고 이전 모델 tag pin
Production 코드에서 tag pin·python
# 잘못 — 움직이는 tag, 밑에서 변할 수 있음
adapter = OllamaAdapter(model="qwen2.5:7b")

# 옳음 — 끝까지 적은 tag, pin됨
adapter = OllamaAdapter(model="qwen2.5:7b-instruct-q5_K_M")

External links

Exercise

ollama list를 돌려서 짧은 tag로 (예: qwen2.5:7b) 받은 것과 끝까지 적은 tag로 (qwen2.5:7b-instruct-q4_K_M) 받은 것을 가려내. 짧은 tag로 받은 것들은 끝까지 적은 tag로 다시 pull해. ollama show가 안정적인 tag를 보고하는지 확인하고.

Progress

Progress is local-only — sign in to sync across devices.
이 페이지에서 버그를 발견하셨거나 피드백이 있으세요?문제 신고

댓글 0

🔔 답글 알림 (로그인 필요)
로그인댓글을 남기려면 로그인해 주세요.

아직 댓글이 없어요. 첫 댓글을 남겨보세요.