DocumentaciónCómo funciona

Cómo funciona

Lo que ocurre de verdad dentro de un turno: recuperación, memoria, herramientas, contexto, canales y qué permanece privado.

Respuestas fundamentadas

Cómo un documento se convierte en algo desde lo que un agente puede responder — fragmentación, cabecera de contexto, reescritura de la consulta y umbral de relevancia.

Memoria por cliente

Cómo las conversaciones se convierten en hechos duraderos sobre un cliente — derivación, deduplicación, importancia y qué se recuerda.

Herramientas y MCP

Cómo un agente pasa de responder a actuar — el bucle de herramientas, los presupuestos de contexto y la conexión con sus propios sistemas mediante MCP.

Un agente, todos los canales

Cómo el widget web, Telegram y WhatsApp llegan al mismo agente con la misma memoria — resolución de identidad, flujo de control compartido y qué queda propio de cada canal.

Why agents get worse as context grows

Context rot, in concrete terms. Every turn is one self-contained request to the model; a long or tool-heavy one measurably lowers the accuracy of the answer. What that request contains, what gets dropped when it does not fit, and why the platform re-renders it before writing the answer instead of summarising tool results.

Where a conversation lives between turns

If every turn is one self-contained request, where does the rest of the conversation sit? What gets stored per turn and what never does, the verbatim window, how older turns are folded into a rolling summary exactly once, what happens when a single turn still overflows, and which facts outlive the session.

Seguimientos programados

Cómo un agente programa trabajo para más tarde y entrega el resultado en el canal por el que llegó — tareas duraderas, reclamación atómica y recuperación.

Privado por diseño

Aislamiento impuesto en la base de datos, cifrado por campo con claves por usuario y una explicación honesta de lo que la capa extremo a extremo sí le da y lo que no.

Funcionar sobre modelos abiertos

Cómo la capa de modelo se mantiene separada de la capa de agentes — consulta de capacidades, enrutado entre varios backends y las cuatro formas en que los modelos abiertos pequeños fallan al invocar herramientas, que la pasarela resuelve por usted.