Modelo agentivo
Comprende la resolución de proveedores, el uso de herramientas, los límites, los rastreos y las citas.
El entorno de ejecución utiliza la abstracción de proveedor del Vercel AI SDK. Los adaptadores de proveedores actuales incluyen Anthropic, OpenAI, Google y un endpoint compatible con OpenAI.
Límites generativos
El entorno de ejecución realiza una llamada al modelo únicamente dentro de una acción generativa o de una clasificación de intención (Intent Classification). Las acciones deterministas no hacen pasar su contenido por un modelo.
La respuesta básica utiliza una sola llamada de chat y ninguna herramienta. Search knowledge utiliza un bucle de herramientas acotado.
Bucle de búsqueda en la base de conocimiento
- El modelo recibe las instrucciones del asistente y las descripciones de las herramientas disponibles.
- El modelo busca en Knowledge o lee una ventana Source seleccionada.
- El entorno de ejecución registra los eventos del ciclo de vida de la herramienta.
- El modelo puede repetir la búsqueda dentro del límite de pasos.
- El tiempo de ejecución genera la respuesta final y las citas con nombre.
El panel Thinking muestra estos eventos registrados de progreso y de herramientas. El pensamiento simplificado reescribe el texto de progreso para la pantalla del Visitor.
Enrutamiento previo a la ejecución
El pre-flight es una decisión opcional que se ejecuta una vez por cada mensaje del Visitor, antes de la Intent Classification. Responde a siete preguntas fijas en una sola llamada. Las preguntas son el Flow, las FAQ, una solicitud de una persona, el help desk, el nivel de razonamiento, el nivel de frustración y el idioma.
Cada respuesta lleva asociado un valor de confianza. Cuando una respuesta está por encima de su umbral, el tiempo de ejecución actúa sobre ella sin la llamada de clasificación:
- Un Flow por encima del umbral se ejecuta directamente.
- Una FAQ coincidente que esté por encima del umbral devuelve la respuesta de la FAQ almacenada textualmente, con la FAQ como su Source.
- Cuando una solicitud de una persona está por encima del umbral, se abre el menú de escalamiento en el help desk recomendado.
Por debajo del umbral, el turno se ejecuta como lo haría sin el pre-flight. A continuación, el panel Thinking muestra una frase fija para el resultado en el idioma del mensaje. La oración nunca contiene el nombre de un Flow.
El pre-flight está desactivado de forma predeterminada. La variable de entorno
PREFLIGHT_SHADOW establecida en 1 registra las decisiones sin actuar sobre
ellas. La variable de entorno PREFLIGHT_ROUTING establecida en 1 actúa sobre
ellas. Una tarea nocturna reproduce un conjunto de mensajes etiquetados y genera
una alerta cuando cambia una decisión.
Herramientas de integración de API
Un asistente puede registrar un catálogo de API. El catálogo describe su URL base, su credencial protegida y sus endpoints disponibles.
El modelo puede inspeccionar los detalles de la API y consultar un endpoint registrado. El entorno de ejecución valida cada ruta frente al catálogo antes de la salida de red.
Los lectores por ventanas devuelven el intervalo de contenido solicitado y la longitud total. Este contrato permite al modelo inspeccionar cargas útiles grandes de API y de Knowledge sin truncamiento silencioso.
Comportamiento en caso de fallo
El enrutador de palabras clave se encarga de la clasificación cuando no hay ningún modelo clasificador disponible o cuando la clasificación falla. La búsqueda en Knowledge puede utilizar el recurso léxico de respaldo sin embeddings.
Un transporte de correo electrónico no configurado devuelve un resultado de error sincero. No genera un mensaje de entrega correcta.
Regla de extensión
Añade una nueva herramienta de agente a través del registro de herramientas y su envoltorio de ciclo de vida. Mantén las comprobaciones de autorización, propiedad, validación de entradas y salidas fuera del control del modelo.