컨텍스트 엔지니어링
Context Engineering
지시문 한 줄을 넘어, AI에게 「무엇을 보여줄지」 전체를 설계하는 일. 프롬프트 엔지니어링의 다음 단계.
쉽게 말하면
지시문 한 줄을 잘 쓰는 게 프롬프트 엔지니어링이라면, 컨텍스트 엔지니어링은 AI에게 「무엇을 보여줄지」 전체를 설계하는 일입니다. 어떤 문서를 넣고, 어떤 이전 대화를 유지하고, 어떤 도구를 쥐여 주고, 무엇을 빼서 창(컨텍스트 윈도우)을 아낄지까지.
에이전트가 길게 일하는 시대가 되면서 떠오른 말입니다 — 한 번의 질문이 아니라 몇 시간짜리 작업에서는 「지금 AI 책상 위에 뭘 올려 둘 것인가」가 성패를 가르기 때문입니다.
깊이 알아보기
AI의 실력은 질문 한 줄보다, 답하기 직전 책상 위에 무엇이 놓여 있느냐에 더 크게 좌우됩니다.
컨텍스트 엔지니어링은 문서, 대화 기록, 도구 결과, 규칙을 필요한 순간에 골라 AI에게 건네는 설계입니다. 많이 넣는 기술이 아니라, 지금 판단에 필요한 정보를 선명하게 유지하는 기술입니다.
3분 요약
- 프롬프트 엔지니어링이 지시문의 표현을 다듬는 일이라면, 컨텍스트 엔지니어링은 AI가 작업 중 보게 될 정보 환경 전체를 설계하는 일입니다.
- 좋은 컨텍스트는 관련성이 높고, 출처와 시점이 분명하며, 서로 충돌하지 않습니다. 긴 자료를 전부 넣는 것보다 현재 단계에 필요한 부분만 꺼내 주는 편이 낫습니다.
- 에이전트가 검색하고 도구를 쓰며 오래 일할수록 컨텍스트는 계속 변합니다. 무엇을 추가하고, 요약하고, 버릴지를 관리해야 작업이 끝까지 일관됩니다.
왜 지금 알아야 하나
대화형 AI가 작업형 AI로 바뀌었다
한 번 묻고 한 번 답하던 챗봇은 짧은 지시만으로도 충분했습니다. 이제 AI는 여러 파일을 읽고, 검색하고, 코드를 고치며 수십 단계를 이어 갑니다. 매 단계에서 필요한 정보가 달라지므로 처음 작성한 프롬프트만 잘 고쳐서는 품질을 지키기 어렵습니다.
긴 창이 곧 좋은 기억은 아니다
컨텍스트 창이 커져도 불필요한 기록, 오래된 지시, 중복 문서가 섞이면 중요한 단서가 묻힐 수 있습니다. 저장 용량이 늘어난 것과 책상이 정돈된 것은 다른 문제입니다. 그래서 정보의 양보다 선택, 배치, 갱신 방식이 중요해졌습니다.
어떻게 작동하나
1. 작업의 현재 단계를 정한다
조사, 작성, 검토처럼 지금 해야 할 판단을 한 문장으로 좁힙니다. 단계가 분명해야 어떤 정보가 필요한지도 결정할 수 있습니다.
2. 필요한 근거를 찾는다
문서 검색, 데이터베이스 조회, 도구 실행으로 현재 판단과 직접 관련된 자료를 가져옵니다. 제목만 비슷한 자료보다 실제 질문에 답하는 구절을 우선합니다.
3. 역할별로 정리해 넣는다
변하지 않는 규칙, 사용자의 요청, 참고 자료, 방금 나온 도구 결과를 구분합니다. 출처와 작성 시점을 함께 적으면 충돌이 생겼을 때 무엇을 믿어야 할지 판단하기 쉽습니다.
4. 오래된 정보를 압축하거나 뺀다
끝난 단계의 세부 대화는 결정과 결과만 남기고 줄입니다. 실패한 시도나 중복 자료를 계속 들고 다니지 않아야 다음 판단의 신호가 또렷해집니다.
5. 결과를 확인하고 다시 구성한다
출력이 요구사항을 놓쳤다면 표현만 바꾸기 전에 필요한 근거가 실제로 들어 있었는지 확인합니다. 빠진 자료를 보충하거나 충돌하는 자료를 정리한 뒤 다음 단계의 컨텍스트를 새로 만듭니다.
흐름 한눈에 보기
사용자 목표 → 현재 단계 정의 → 관련 자료 검색 → 규칙·근거·도구 결과 선별 → AI의 판단과 출력 → 결과 검증 → 핵심 결정만 보존 → 다음 단계에 맞게 컨텍스트 재구성
도입 전과 후
이전: 한 번에 모두 붙여 넣기
사용자는 긴 회의록, 제품 문서, 과거 대화를 통째로 넣고 ‘요약해 줘’라고 요청합니다. AI는 최신 결정과 폐기된 안을 구분하지 못하고, 그럴듯하지만 현재 상황과 어긋난 답을 만들 수 있습니다.
이후: 목적에 맞춰 필요한 조각만 제공하기
먼저 ‘다음 분기 출시 범위 확정’이라는 목표를 밝히고, 최종 결정이 표시된 회의 구절과 최신 제품 제약만 제공합니다. 과거 안은 비교가 필요할 때만 별도로 불러옵니다. 답은 짧아져도 근거와 현재성이 더 분명해집니다.
예시로 이해하기
고객 문의 답변 에이전트
한 쇼핑몰이 배송 지연 문의에 답하는 AI를 운영한다고 가정해 봅시다. 고객이 ‘내 주문은 언제 와요?’라고 물었을 때 전체 운영 매뉴얼을 넣는 대신 주문 번호로 최신 배송 상태를 조회하고, 지연 보상 규정의 해당 조항과 고객이 이미 받은 안내만 가져옵니다.
컨텍스트가 답을 바꾸는 지점
배송 조회 결과가 ‘집화 전’, 보상 규정이 ‘예정일보다 3일 초과 시 쿠폰 지급’, 고객 안내 기록이 ‘어제 예정일 변경 통보’라면 AI는 현재 상태와 다음 확인 시점만 정확히 설명할 수 있습니다. 주문 정보가 갱신되면 이전 조회 결과는 버리고 다시 가져와야 합니다. 같은 모델이어도 이 정보 흐름을 어떻게 설계하느냐에 따라 답의 정확성과 신뢰도가 달라집니다.
직접 해보기
1. 작은 판단 하나를 고른다
예를 들어 ‘회의에서 확정된 할 일만 뽑기’처럼 결과를 확인하기 쉬운 작업을 정합니다.
2. 자료를 세 묶음으로 나눈다
반드시 지킬 규칙, 판단에 필요한 원문, 참고만 할 배경으로 구분합니다. 각 묶음에는 날짜나 출처를 표시합니다.
3. 전체 자료와 선별 자료를 각각 넣어 본다
먼저 회의록 전체로 답을 받고, 다음에는 최종 결정이 담긴 구절과 담당자 표만 넣어 같은 요청을 합니다. 누락, 오래된 결정의 혼입, 답변 길이를 비교합니다.
4. 다음 단계용 메모를 만든다
대화 전문을 보존하는 대신 확정된 일, 담당자, 기한, 미해결 질문만 짧게 정리해 새 대화에 제공합니다. 이 메모만으로 작업을 이어 갈 수 있는지 확인합니다.
한계와 주의점
좋은 정보가 없으면 설계도 구할 수 없다
원문이 틀렸거나 최신 데이터에 접근할 수 없다면 컨텍스트를 잘 정리해도 정답은 나오지 않습니다. 중요한 결과는 반드시 원출처와 실제 시스템에서 확인해야 합니다.
선별 과정에도 판단 오류가 생긴다
검색기가 중요한 문서를 놓치거나 요약 과정에서 예외 조건이 사라질 수 있습니다. 특히 법률, 의료, 재무처럼 빠진 한 문장이 큰 차이를 만드는 분야에서는 원문 인용과 사람의 검토가 필요합니다.
비용과 지연의 균형이 필요하다
매 단계마다 검색하고 재정리하면 정확도는 높아질 수 있지만 응답 시간과 비용도 늘어납니다. 모든 정보를 항상 불러오기보다 실패했을 때의 영향에 맞춰 조회와 검증 수준을 정해야 합니다.
자주 묻는 질문
프롬프트 엔지니어링과 무엇이 다른가요?
프롬프트 엔지니어링은 주로 지시를 어떻게 표현할지 다룹니다. 컨텍스트 엔지니어링은 그 지시와 함께 어떤 문서, 대화, 도구 결과, 기억을 언제 보여줄지까지 다룹니다. 둘은 경쟁 개념이 아니라 포함 관계에 가깝습니다.
자료를 많이 넣을수록 정확해지나요?
항상 그렇지는 않습니다. 관련 없는 내용과 충돌하는 기록이 늘면 중요한 정보가 묻힐 수 있습니다. 현재 판단에 필요한 근거를 충분히 주되, 중복과 오래된 정보는 줄이는 것이 핵심입니다.
검색 증강 생성, 즉 RAG와 같은 말인가요?
RAG는 외부 자료를 검색해 답변에 보태는 대표적인 방법입니다. 컨텍스트 엔지니어링은 검색뿐 아니라 고정 규칙, 대화 기록, 도구 출력, 요약, 정보 삭제와 갱신까지 포함하는 더 넓은 개념입니다.
일반 사용자도 직접 해볼 수 있나요?
가능합니다. 요청 앞에 목표와 판단 기준을 적고, 최신 원문만 첨부하며, 긴 대화가 이어질 때는 확정 사항과 미해결 질문을 새로 요약하는 것만으로도 효과를 볼 수 있습니다.
출처
- Effective context engineering for AI agents — Anthropic
- Retrieval-Augmented Generation for Knowledge-Intensive NLP Tasks — Meta AI Research
- Lost in the Middle: How Language Models Use Long Contexts — Stanford University, UC Berkeley, and Samaya AI
함께 볼 용어
이 용어가 나온 기사
아직 이 용어를 다룬 기사가 없습니다. 새 기사가 나오면 여기 자동으로 붙습니다.