Cómo funciona

Investigar una respuesta que no tiene

Investigación profunda: una pregunta se convierte en varias búsquedas ordenadas, cada afirmación lleva la fuente de la que proviene, y todo lo que la búsqueda no estableció se rechaza en lugar de completarse con base en la memoria.

Algunas preguntas no pueden responderse con tu material porque la respuesta no está en el material de nadie todavía — quién más vende lo que nosotros vendemos, qué publicó este regulador este trimestre, cómo se compara la oferta de este proveedor con la nuestra. Necesitan que alguien vaya y lo averigüe.

Esa es la investigación profunda. No es una sola búsqueda: es una pequeña investigación ordenada, ejecutada dentro de un turno, donde cada afirmación en la respuesta lleva la fuente de la que proviene — y cualquier cosa que la búsqueda no logró establecer se rechaza en lugar de escribirse desde la memoria.

Cómo se ve un turno

1. Plan

La pregunta se divide en pasos ordenados, cada uno buscando una cosa. Los pasos pueden depender de los anteriores — el segundo puede decir "la categoría que encontró el primer paso".

2. Search

Cada paso se convierte en una búsqueda web real, y se obtienen los resultados más prometedores. Las páginas se seleccionan de los resultados reales en lugar de ser recordadas: una URL recordada que está equivocada en un carácter no es nada.

3. Extract

Las oraciones que responden al paso se extraen de la página obtenida, cada una vinculada a la página de la que proviene. Esto es citar, no razonar — las conclusiones llegan después, a partir de los hechos recopilados.

4. Report a stage

Cuando un paso termina, el agente dice lo que ese paso encontró, en una o dos oraciones, mientras la investigación aún está en curso.

5. Re-plan

Antes de continuar, los pasos restantes se reconsideran contra lo que realmente se ha encontrado. El plan original se escribió cuando el agente no sabía nada sobre el tema.

6. Answer

Solo ahora se escribe la respuesta, a partir de los hechos recopilados y nada más, con un marcador numerado en cada afirmación que apunta a la página de la que proviene.

Re-planear es el paso que evita que una primera suposición incorrecta cueste toda la investigación.

Por qué son varios pasos y no una sola búsqueda

Una pregunta como "quiénes son mis competidores" no puede buscarse directamente, y la razón no es que el motor de búsqueda sea débil. Hasta que no sabes lo que esta empresa vende realmente y en qué categoría opera, no hay forma de juzgar quién cuenta como competidor — lo mejor que puedes hacer es poner el nombre de la empresa en una caja de búsqueda y esperar.

Así que el primer paso establece el sujeto, y el segundo usa lo que el primero encontró. Ese segundo paso es el que tiene que existir: una investigación que solo busca el sujeto y nunca busca la categoría a la que pertenece ha terminado medio cuadro, y la conclusión que se le pidió no está disponible a partir de esa mitad.

Los pasos también están escritos para pedir cosas que una página afirma explícitamente, no para la conclusión que deseas. "Qué funciones admiten X y Y cada una" se puede responder a partir de una tabla de funciones; "cuál de X y Y es mejor" es un juicio, y ninguna página lo contiene. El juicio se hace al final, a partir de los hechos — no es algo para buscar.

Por qué informa mientras trabaja

Una investigación que ejecuta seis rondas y luego produce una sola respuesta larga es un minuto de pantalla en blanco para la persona que espera, aunque las conclusiones se estuvieran acumulando todo el tiempo. Así que cada paso informa lo que encontró al terminar, y esas notas en proceso permanecen en la conversación después — son parte de la respuesta, no barras de progreso que desaparecen.

Alcanzando páginas que no quieren ser leídas

Un resultado de búsqueda es inútil si la página no se puede obtener, y una gran parte de la web útil está detrás de algo — una verificación de bots, una cadena de redirecciones, una página que solo se ensambla en un navegador. La obtención por lo tanto escala: una solicitud directa primero, luego una proxy, luego un navegador real. Una página que falla en todas ellas se descarta y se registra como encontrada pero no leída, lo cual es un grado diferente de evidencia de una página que fue realmente leída — y las dos se dibujan de manera diferente cuando miras las fuentes.

Nada se responde desde la memoria, incluyendo las partes que nadie preguntó

Esta es la parte que vale la pena leer dos veces, porque es donde los asistentes de investigación suelen fallar en silencio.

Pide una comparación entre tu empresa y una empresa que no existe, y el fallo obvio no es un rechazo — es una respuesta. La investigación encuentra mucho sobre la empresa real, no encuentra nada sobre la otra, y luego escribe ambas mitades en el mismo párrafo con la misma voz segura. La mitad que vino de fuentes y la mitad que vino de la memoria del modelo son indistinguibles para la persona que lee.

Así que antes de que se escriba la respuesta, la plataforma hace dos cosas en secuencia:

  1. Un modelo lista lo que la pregunta nombra — las empresas específicas, productos, regulaciones o mercados que tienen que establecerse antes de que la pregunta pueda responderse en absoluto. Solo lo que la pregunta realmente nombra: preguntado "quiénes son mis competidores", el sujeto es tu empresa, y los competidores son el resultado, no una premisa.
  2. El software verifica cada uno contra los hechos que realmente se recopilaron. No el modelo — software. Pedirle a un modelo que confirme que hizo la investigación es hacerle una pregunta para la que tiene todas las razones para responder .

Luego:

  • Todo establecido → una respuesta ordinaria.
  • Parte de ello establecido → la respuesta se escribe, y las partes que no se establecieron se nombran en ella como no establecidas. Una comparación que falta un lado se informa como una comparación que no se pudo hacer, no como una descripción del lado que se encontró.
  • Nada de ello establecido → no se escribe ninguna respuesta. Se te dice lo que se buscó y no se encontró nada, y se te pregunta si el nombre está escrito de manera diferente o si puedes señalar un sitio.

El mismo principio atraviesa el producto: una verificación que una máquina puede realizar no se deja a un prompt. Pedirle a un modelo que sea cuidadoso es un deseo; verificar su salida es una garantía.

Los enlaces inventados no sobreviven el turno

Un modelo que acaba de leer seis páginas a veces escribe una séptima URL que nunca ha visto — la dirección plausible de una empresa que acaba de conocer. Cada enlace en una respuesta terminada se verifica por lo tanto contra las páginas que el turno realmente obtuvo, y cualquier otra cosa se detecta antes de que se envíe la respuesta.

Lo que sucede entonces no es una reejecución del mismo modelo con un regaño adjunto. Decirle que inventó algo cambia muy poco; ese turno se gasta, y la persona que espera ha pagado por él. En su lugar, el turno se escala a un modelo más fuerte, una vez por nivel, hasta que la respuesta vuelva limpia. Es una configuración por agente, porque los agentes que más lo necesitan son los que se ejecutan en un modelo autoalojado pequeño donde el primer intento es barato.

Qué significa esto en la práctica

  • Cada afirmación es atribuible. Un marcador numerado en una oración apunta a la página de la que proviene, y puedes abrirla.
  • Una pregunta que no pudo responder vuelve como una pregunta que no pudo responder, nombrando lo que faltaba — en lugar de como un párrafo confiable sin nada detrás.
  • El visitante puede detenerlo. Es un minuto de trabajo, visible mientras sucede, interrumpible.
  • La investigación profunda es una capacidad en el menú del agente. Si no está habilitada, un visitante que la pida obtiene una respuesta ordinaria — ver Decidiendo qué quiere un mensaje.