작동 원리
한 턴 안에서 실제로 일어나는 일 — 검색, 기억, 도구, 컨텍스트, 채널, 그리고 밖으로 나가지 않는 것.
근거 있는 답변
문서가 에이전트가 답할 수 있는 무언가가 되는 과정 — 청킹, 컨텍스트 헤더, 쿼리 재작성, 그리고 관련성 하한선.
고객별 메모리
대화가 고객에 대한 지속되는 사실이 되는 방법 — 파생, 중복 제거, 중요도, 그리고 무엇이 회상되는지.
도구와 MCP
에이전트가 답변에서 행동으로 나아가는 방법 — 도구 루프, 컨텍스트 예산, 그리고 MCP로 당신의 시스템을 연결하기.
하나의 에이전트, 모든 채널
웹 위젯, Telegram, WhatsApp이 동일한 메모리로 동일한 에이전트에 도달하는 방식 — 신원 해석, 공유 제어 흐름, 그리고 무엇이 채널별로 남는지.
Why agents get worse as context grows
Context rot, in concrete terms. Every turn is one self-contained request to the model; a long or tool-heavy one measurably lowers the accuracy of the answer. What that request contains, what gets dropped when it does not fit, and why the platform re-renders it before writing the answer instead of summarising tool results.
Where a conversation lives between turns
If every turn is one self-contained request, where does the rest of the conversation sit? What gets stored per turn and what never does, the verbatim window, how older turns are folded into a rolling summary exactly once, what happens when a single turn still overflows, and which facts outlive the session.
예약된 후속 조치
에이전트가 나중을 위한 작업을 예약하고 결과를 요청이 온 채널로 되돌려 전달하는 방법 — 지속되는 작업, 원자적 클레임, 그리고 복구.
설계에 의한 프라이버시
데이터베이스에서 강제되는 격리, 사용자별 키를 쓰는 필드 수준 암호화, 그리고 종단 간 레이어가 무엇을 주고 무엇을 주지 않는지에 대한 정직한 설명.
오픈 모델에서 실행하기
모델 레이어가 에이전트 레이어와 어떻게 분리된 채로 유지되는지 — 능력 프로빙, 멀티 백엔드 라우팅, 그리고 작은 오픈 모델이 도구 호출에서 깨지는 네 가지 방식을 게이트웨이가 대신 처리하는 방법.