DocumentaciónCómo funciona

Cómo funciona

Lo que ocurre de verdad dentro de un turno: recuperación, memoria, herramientas, contexto, canales y qué permanece privado.

Respuestas fundamentadas

Cómo un documento se convierte en algo desde lo que un agente puede responder: segmentación, encabezado de contexto, reescritura de consultas y umbral de relevancia.

Memoria por cliente

Cómo las conversaciones se convierten en hechos duraderos sobre un cliente — derivación, deduplicación, importancia y qué se recuerda.

Herramientas y MCP

Cómo un agente pasa de responder a actuar: el ciclo de herramientas, los presupuestos de contexto y la conexión de tus propios sistemas a través de MCP.

Qué pasa cuando alguien escribe «investígalo»

Escribir una petición debería dar lo mismo que elegirla en el menú. Hacerlo con una lista de palabras clave falla en siete idiomas; hacerlo con un modelo en cada mensaje es lento y caro. Qué medimos, por qué el enrutador tiene dos pasos y por qué la misma frase se enruta distinto cuando hay un documento abierto.

Por qué los agentes empeoran a medida que crece el contexto

El deterioro del contexto (context rot) en términos concretos. Cada turno es una única petición autocontenida al modelo; una petición larga o cargada de herramientas reduce de forma medible la precisión de la respuesta. Qué contiene esa petición, qué se descarta cuando no cabe, y por qué la plataforma la vuelve a componer antes de escribir la respuesta en lugar de resumir los resultados de las herramientas.

Dónde vive una conversación entre turnos

Si cada turno es una petición autocontenida, ¿dónde está el resto de la conversación? Qué se guarda en cada turno y qué no se guarda nunca, la ventana literal, cómo los turnos antiguos se pliegan exactamente una vez en un resumen acumulado, qué pasa cuando un solo turno aún desborda, y qué hechos sobreviven a la sesión.

Un agente, todos los canales

Cómo el widget web, Telegram y WhatsApp llegan al mismo agente con la misma memoria — resolución de identidad, flujo de control compartido y qué queda propio de cada canal.

Seguimientos programados

Cómo un agente programa trabajo para más tarde y entrega el resultado en el canal por el que llegó — tareas duraderas, reclamación atómica y recuperación.

Privado por diseño

Aislamiento impuesto en la base de datos, cifrado por campo con claves por usuario y una explicación honesta de lo que la capa extremo a extremo sí le da y lo que no.

Funcionar sobre modelos abiertos

Cómo la capa de modelo se mantiene separada de la capa de agentes — consulta de capacidades, enrutado entre varios backends y las cuatro formas en que los modelos abiertos pequeños fallan al invocar herramientas, que la pasarela resuelve por usted.

Cómo se escribe de verdad un documento largo

Un informe de cuarenta páginas no es una respuesta muy larga. Es un trabajo en segundo plano con una máquina de estados — esquema, preguntas, investigación, escritura sección a sección — donde cada paso se puede repetir tras una caída sin duplicar trabajo ni quemar presupuesto, donde los desplazamientos de una edición los calcula el código y no los elige el modelo, y donde se conserva cada versión.

Gráficos en la respuesta

Cuando una respuesta contiene un conjunto de números comparables, el agente los dibuja — sin que se le pida, durante la conversación. Nueve tipos de gráficos con un ejemplo práctico de cada uno, el filtro de contención que rechaza un gráfico cuyos números no estén en tu material, y por qué las cifras derivadas se calculan en código en lugar de por el modelo.

Watching a source over months

Continuous monitoring — the agent researches which pages to watch, you confirm, and it reports only what actually changed and actually matters to you.

Investigar una respuesta que no tiene

Investigación profunda: una pregunta se convierte en varias búsquedas ordenadas, cada afirmación lleva la fuente de la que proviene, y todo lo que la búsqueda no estableció se rechaza en lugar de completarse con base en la memoria.

Habilidades y cómo se eligen

Cómo un paquete de capacidades llega al modelo: la biblioteca de plataforma compartida, la recuperación por intención, las herramientas que llegan solo con el procedimiento y la solicitud de aclaración cuando la petición es ambigua.

Comprobaciones sobre la respuesta

Las comprobaciones que se ejecutan sobre una respuesta terminada antes de enviarla — qué detecta cada una, con qué frecuencia se dispara y por qué una comprobación que se dispara a menudo es un error, no una virtud.