1. Defina el trabajo antes de elegir el modelo

“Atender clientes” es demasiado amplio. Defina qué solicitudes podrá resolver, qué datos necesita, qué acciones está autorizado a ejecutar y qué resultado confirma que terminó bien. Un primer agente debería dominar un recorrido estrecho —por ejemplo, responder preguntas sobre pedidos y crear un caso cuando no pueda resolverlas— antes de asumir más responsabilidad.

2. Separe conocimiento, razonamiento y acciones

El conocimiento debe venir de fuentes identificables y actualizadas. El modelo interpreta la solicitud y propone el siguiente paso. Las herramientas consultan sistemas o ejecutan acciones. Separar estas capas permite cambiar una fuente, una política o un modelo sin reconstruir todo el producto y ayuda a investigar por qué ocurrió una respuesta.

3. Conceda el menor permiso posible

Leer un pedido y emitir un reembolso son capacidades con riesgos distintos. Cada herramienta debe validar identidad, parámetros y límites fuera del modelo. Para acciones irreversibles o costosas, pida confirmación explícita o aprobación humana. El agente nunca debería poder ampliar sus propios permisos.

4. Diseñe la salida hacia una persona

El escalamiento no es un fracaso; es parte del producto. Defina señales como baja confianza, solicitud fuera de alcance, cliente molesto, datos contradictorios o impacto económico alto. La persona debe recibir el contexto, las fuentes consultadas y las acciones ya realizadas, no una conversación opaca que deba reconstruir.

5. Evalúe tareas, no impresiones

Una demostración convincente no prueba confiabilidad. Construya un conjunto de casos normales, ambiguos, adversariales y con datos incompletos. Mida resolución correcta, uso adecuado de herramientas, citas válidas, escalamiento oportuno, latencia y costo. Cada cambio de instrucciones, modelo o fuente debe volver a pasar esa evaluación.

Lista mínima antes de publicar
  • Un trabajo y un usuario claramente definidos
  • Fuentes de conocimiento con propietario y fecha
  • Herramientas con permisos mínimos y validación
  • Reglas de confirmación y escalamiento
  • Evaluaciones repetibles y trazabilidad

Fuentes primarias

Convierta la guía en un proyecto concreto

Podemos definir la versión útil más pequeña y un plan de entrega medible.

Explorar bots y agentes con IA