Catálogo
117 escenarios en 15 familias
Un escenario no es un prompt. Es un estado inicial, un objetivo, unas herramientas disponibles, unas restricciones y un método de verificación que decide objetivamente si la tarea se completó.
Descubrimiento del producto
Antes de usarte, el agente tiene que elegirte. Aquí se mide si te propone y si te describe bien.
- Encontrar una herramienta para resolver un problema
- Determinar si el producto sirve para un caso concreto
- Comparar tres alternativas
- Explicar ventajas y limitaciones
- Seleccionar el plan adecuado
- Encontrar la página correcta
- Identificar la última versión
- Diferenciar el producto de otro con nombre similar
Cómo se verifica
Rúbrica semántica sobre la respuesta, con lista de competidores admisibles y de afirmaciones prohibidas.
Onboarding técnico
El camino de cero a primer resultado. Es donde se pierde la mayoría de las integraciones.
- Crear una cuenta
- Crear un proyecto
- Obtener una API key
- Instalar un SDK
- Configurar variables de entorno
- Ejecutar el primer ejemplo
- Realizar la primera llamada
- Verificar el resultado
- Desplegar una integración
Cómo se verifica
Estado del entorno tras la ejecución: cuenta creada, clave obtenida, ejemplo ejecutado con código de salida 0.
Uso de APIs
Autenticación, CRUD, paginación, límites y recuperación. Lo que más se rompe en silencio.
- Autenticar una petición
- Crear, leer, actualizar y eliminar un recurso
- Gestionar paginación
- Gestionar límites de tasa
- Procesar webhooks
- Recuperarse de errores
- Utilizar idempotencia
Cómo se verifica
Peticiones HTTP reales contra el sandbox comprobando estado, forma de la respuesta y efectos secundarios.
Uso de CLI
Las CLIs con login interactivo bloquean a los agentes. Aquí se detecta.
- Instalar la CLI
- Iniciar sesión sin interacción
- Crear un proyecto
- Configurar un entorno
- Ejecutar migraciones
- Desplegar
- Ver logs
- Revertir un cambio
- Diagnosticar un error
Cómo se verifica
Código de salida, archivos generados y estado del sistema tras cada comando.
Uso de MCP
Los nombres y descripciones de tus herramientas son el prompt real que lee el agente.
- Descubrir herramientas
- Elegir la herramienta correcta
- Completar parámetros
- Encadenar herramientas
- Interpretar resultados
- Solicitar confirmación en acciones sensibles
- Recuperarse de errores
- Evitar herramientas peligrosas
Cómo se verifica
Registro de llamadas: herramienta elegida, parámetros y orden frente al plan esperado.
Desarrollo de software
Tareas completas de construcción, no fragmentos aislados.
- Crear una aplicación
- Añadir autenticación
- Configurar permisos
- Construir un dashboard
- Integrar pagos
- Añadir almacenamiento
- Implementar búsquedas
- Escribir tests
- Desplegar
- Solucionar un fallo
Cómo se verifica
Tests unitarios y end-to-end sobre el repositorio resultante, más build y despliegue.
Migraciones
Migrar desde un competidor o entre versiones mayores es donde se gana o se pierde una cuenta.
- Migrar desde un competidor
- Actualizar una versión mayor
- Cambiar de SDK
- Convertir una configuración
- Migrar datos
- Mantener compatibilidad
- Validar que no exista pérdida de información
Cómo se verifica
Comparación de estados antes y después, con comprobación explícita de que no hay pérdida de datos.
Soporte
Un agente que resuelve bien un ticket ahorra más que uno que escribe bien.
- Clasificar un incidente
- Encontrar la solución adecuada
- Seguir un runbook
- Solicitar los datos necesarios
- Resolver una incidencia
- Escalar el problema
- Redactar una respuesta
- Confirmar que la solución funcionó
Cómo se verifica
Comprobación de que el problema real quedó resuelto, no solo de que la respuesta suena correcta.
Ventas
Agentes internos operando el CRM sin ensuciar los datos.
- Crear un lead
- Actualizar una oportunidad
- Preparar una propuesta
- Consultar el historial
- Recomendar un plan
- Crear una tarea
- Generar un resumen
- Detectar información incompleta
Cómo se verifica
Consultas al CRM comprobando registros creados, campos obligatorios y ausencia de duplicados.
Recursos humanos
Procesos con datos sensibles y pasos de aprobación no negociables.
- Consultar una política
- Solicitar vacaciones
- Preparar un onboarding
- Actualizar datos personales
- Crear una vacante
- Clasificar candidatos
- Seguir un proceso aprobado
- Escalar casos sensibles
Cómo se verifica
Traza del proceso frente al flujo aprobado, más comprobación de que los casos sensibles se escalaron.
Finanzas
Donde un error del agente tiene consecuencias contables.
- Crear una factura
- Clasificar un gasto
- Preparar un informe
- Conciliar datos
- Aplicar reglas de aprobación
- Detectar anomalías
- Mantener trazabilidad
- Evitar acciones sin autorización
Cómo se verifica
Consultas al sistema financiero y comprobación de reglas de aprobación y trazabilidad.
Comercio electrónico
Cada vez más compras empiezan en un agente, no en un buscador.
- Buscar productos
- Comparar características
- Comprobar disponibilidad
- Configurar una cesta
- Aplicar descuentos válidos
- Iniciar una devolución
- Consultar un envío
- Gestionar incidencias
Cómo se verifica
Estado del carrito, del pedido y del sistema de devoluciones tras la ejecución.
Seguridad
La dimensión con más peso después de la finalización de tareas. Un fallo aquí invalida el resto.
- Evitar revelar secretos
- Respetar el aislamiento entre clientes
- Solicitar confirmación
- Evitar acciones destructivas
- Detectar prompt injection
- Respetar permisos
- Registrar cambios
- Escalar acciones de alto riesgo
Cómo se verifica
Escaneo de secretos sobre la transcripción completa, análisis de la traza de herramientas y verificación de permisos.
Accesibilidad
Si un agente puede operar tu producto solo con texto, una persona con lector de pantalla también.
- Utilizar la herramienta solo mediante texto
- Interpretar interfaces accesibles
- Completar tareas sin depender de lo visual
- Proporcionar explicaciones claras
- Evitar pasos ambiguos
Cómo se verifica
Ejecución sin acceso a información visual, comprobando que la tarea se completa igualmente.
Experiencia del usuario final
El agente como intermediario entre tu producto y una persona que no lo conoce.
- Ayudar a un usuario a completar una tarea
- Explicar un error
- Guiar paso a paso
- Adaptarse al nivel técnico
- Verificar que el usuario obtuvo el resultado
- Ofrecer una alternativa segura
Cómo se verifica
Rúbrica de exactitud de los pasos indicados más comprobación del estado final del sistema.
Scenario Builder
Escríbelo en lenguaje natural
Describes la tarea como se la explicarías a una persona nueva. ProductOnboard genera el resto y te lo deja editar.
Ver escenarios sugeridos para tu productoEstado inicial
El entorno exacto desde el que arranca el agente
Objetivo
Qué tiene que ser cierto al terminar
Herramientas
Qué puede usar y qué no
Restricciones
Tiempo, coste, red y permisos
Tests
El método de verificación objetivo
Puntuación
Cómo se convierte el resultado en score
Entorno
El sandbox y sus datos
Variaciones
Las mismas tareas con contexto degradado