Agente de IA con RAG que reconoce lo que no sabe
Consulta el conocimiento de la empresa, responde con fuentes, reconoce cuándo no tiene información suficiente y deriva a una persona.
Un agente útil no es el que responde a todo: es el que sabe qué puede hacer, reconoce cuándo no tiene información suficiente y pasa la conversación a una persona antes de inventar algo.
Un piloto sin estas cinco respuestas termina en una demo bonita que nadie pone en producción.
Una tarea concreta y medible, no «atender clientes». Si no se puede describir en una frase, tampoco se puede evaluar.
Qué documentos, qué sistemas y quién los mantiene actualizados. La calidad del agente es la de sus fuentes.
Consultar un pedido es distinto de modificarlo. Las acciones con efecto se limitan en el código, nunca solo en las instrucciones.
Qué dispara la derivación y con qué contexto llega. Sin esto, el agente se convierte en un muro.
Alcance
Responden sobre tu documentación citando la fuente, y admiten cuándo no encuentran respaldo suficiente.
Consultan el estado de un pedido, una factura o un ticket en el sistema real, con permisos mínimos.
Ver integraciones : Agentes conectados a tus sistemasWeb, WhatsApp o el propio producto. El canal es lo último que se decide, no lo primero.
Un conjunto de casos reales con la respuesta esperada, para saber si el cambio de ayer mejoró o empeoró las cosas.
Reglas explícitas de escalamiento y aprobación humana en las acciones que tienen consecuencias.
Registro de conversaciones, errores y consumo de modelos, para que el gasto no sea una sorpresa a fin de mes.
El piloto existe para decidir con datos si conviene seguir, no para dejar algo a medias en producción.
El piloto se cotiza por alcance tras definir la tarea y las fuentes. La construcción, el hosting y el consumo de modelos se presentan como tres líneas separadas para que puedas compararlas.
Costos recurrentes de terceros: Consumo de los modelos por conversación, hosting e infraestructura, y licencias de los canales (por ejemplo, la API de WhatsApp).
Evidencia
Una consulta válida con fuentes, una consulta sin información suficiente donde el agente lo admite, y una derivación a una persona.
Consulta el conocimiento de la empresa, responde con fuentes, reconoce cuándo no tiene información suficiente y deriva a una persona.
Sí, y quien diga lo contrario no está siendo honesto. Por eso el trabajo se concentra en acotar lo que puede hacer, medir con un conjunto de evaluación y derivar a una persona cuando no hay respaldo suficiente. No publicamos porcentajes de acierto ni ahorros: sin una línea base comparable no significan nada.
Depende del volumen de conversaciones y del modelo elegido. Lo estimamos antes del piloto con tu volumen real y lo presentamos separado del desarrollo: construcción, hosting y consumo son tres líneas distintas.
Ayuda mucho, pero no hace falta que esté perfecta. Parte del piloto es descubrir qué falta. Lo que sí es imprescindible es que exista y que alguien se haga cargo de mantenerla: un agente sobre documentación desactualizada repite errores con mucha seguridad.
Sí, con límites definidos en el código y no en las instrucciones. Las acciones con efecto se restringen explícitamente y las que tienen consecuencias pasan por aprobación humana.
Sincronización entre sistemas con manejo de errores, reintentos, control de duplicados y monitoreo.
Sistemas y plataformas propias cuando ninguna herramienta del mercado resuelve tu proceso.
Cuéntanos qué debería resolver el agente, con qué información y qué debería poder hacer. Te decimos si un piloto tiene sentido.