Saltar al contenido

Catálogo

117 escenarios en 15 familias

Un escenario no es un prompt. Es un estado inicial, un objetivo, unas herramientas disponibles, unas restricciones y un método de verificación que decide objetivamente si la tarea se completó.

6.1

Descubrimiento del producto

Antes de usarte, el agente tiene que elegirte. Aquí se mide si te propone y si te describe bien.

  • Encontrar una herramienta para resolver un problema
  • Determinar si el producto sirve para un caso concreto
  • Comparar tres alternativas
  • Explicar ventajas y limitaciones
  • Seleccionar el plan adecuado
  • Encontrar la página correcta
  • Identificar la última versión
  • Diferenciar el producto de otro con nombre similar

Cómo se verifica

Rúbrica semántica sobre la respuesta, con lista de competidores admisibles y de afirmaciones prohibidas.

6.2

Onboarding técnico

El camino de cero a primer resultado. Es donde se pierde la mayoría de las integraciones.

  • Crear una cuenta
  • Crear un proyecto
  • Obtener una API key
  • Instalar un SDK
  • Configurar variables de entorno
  • Ejecutar el primer ejemplo
  • Realizar la primera llamada
  • Verificar el resultado
  • Desplegar una integración

Cómo se verifica

Estado del entorno tras la ejecución: cuenta creada, clave obtenida, ejemplo ejecutado con código de salida 0.

6.3

Uso de APIs

Autenticación, CRUD, paginación, límites y recuperación. Lo que más se rompe en silencio.

  • Autenticar una petición
  • Crear, leer, actualizar y eliminar un recurso
  • Gestionar paginación
  • Gestionar límites de tasa
  • Procesar webhooks
  • Recuperarse de errores
  • Utilizar idempotencia

Cómo se verifica

Peticiones HTTP reales contra el sandbox comprobando estado, forma de la respuesta y efectos secundarios.

6.4

Uso de CLI

Las CLIs con login interactivo bloquean a los agentes. Aquí se detecta.

  • Instalar la CLI
  • Iniciar sesión sin interacción
  • Crear un proyecto
  • Configurar un entorno
  • Ejecutar migraciones
  • Desplegar
  • Ver logs
  • Revertir un cambio
  • Diagnosticar un error

Cómo se verifica

Código de salida, archivos generados y estado del sistema tras cada comando.

6.5

Uso de MCP

Los nombres y descripciones de tus herramientas son el prompt real que lee el agente.

  • Descubrir herramientas
  • Elegir la herramienta correcta
  • Completar parámetros
  • Encadenar herramientas
  • Interpretar resultados
  • Solicitar confirmación en acciones sensibles
  • Recuperarse de errores
  • Evitar herramientas peligrosas

Cómo se verifica

Registro de llamadas: herramienta elegida, parámetros y orden frente al plan esperado.

6.6

Desarrollo de software

Tareas completas de construcción, no fragmentos aislados.

  • Crear una aplicación
  • Añadir autenticación
  • Configurar permisos
  • Construir un dashboard
  • Integrar pagos
  • Añadir almacenamiento
  • Implementar búsquedas
  • Escribir tests
  • Desplegar
  • Solucionar un fallo

Cómo se verifica

Tests unitarios y end-to-end sobre el repositorio resultante, más build y despliegue.

6.7

Migraciones

Migrar desde un competidor o entre versiones mayores es donde se gana o se pierde una cuenta.

  • Migrar desde un competidor
  • Actualizar una versión mayor
  • Cambiar de SDK
  • Convertir una configuración
  • Migrar datos
  • Mantener compatibilidad
  • Validar que no exista pérdida de información

Cómo se verifica

Comparación de estados antes y después, con comprobación explícita de que no hay pérdida de datos.

6.8

Soporte

Un agente que resuelve bien un ticket ahorra más que uno que escribe bien.

  • Clasificar un incidente
  • Encontrar la solución adecuada
  • Seguir un runbook
  • Solicitar los datos necesarios
  • Resolver una incidencia
  • Escalar el problema
  • Redactar una respuesta
  • Confirmar que la solución funcionó

Cómo se verifica

Comprobación de que el problema real quedó resuelto, no solo de que la respuesta suena correcta.

6.9

Ventas

Agentes internos operando el CRM sin ensuciar los datos.

  • Crear un lead
  • Actualizar una oportunidad
  • Preparar una propuesta
  • Consultar el historial
  • Recomendar un plan
  • Crear una tarea
  • Generar un resumen
  • Detectar información incompleta

Cómo se verifica

Consultas al CRM comprobando registros creados, campos obligatorios y ausencia de duplicados.

6.10

Recursos humanos

Procesos con datos sensibles y pasos de aprobación no negociables.

  • Consultar una política
  • Solicitar vacaciones
  • Preparar un onboarding
  • Actualizar datos personales
  • Crear una vacante
  • Clasificar candidatos
  • Seguir un proceso aprobado
  • Escalar casos sensibles

Cómo se verifica

Traza del proceso frente al flujo aprobado, más comprobación de que los casos sensibles se escalaron.

6.11

Finanzas

Donde un error del agente tiene consecuencias contables.

  • Crear una factura
  • Clasificar un gasto
  • Preparar un informe
  • Conciliar datos
  • Aplicar reglas de aprobación
  • Detectar anomalías
  • Mantener trazabilidad
  • Evitar acciones sin autorización

Cómo se verifica

Consultas al sistema financiero y comprobación de reglas de aprobación y trazabilidad.

6.12

Comercio electrónico

Cada vez más compras empiezan en un agente, no en un buscador.

  • Buscar productos
  • Comparar características
  • Comprobar disponibilidad
  • Configurar una cesta
  • Aplicar descuentos válidos
  • Iniciar una devolución
  • Consultar un envío
  • Gestionar incidencias

Cómo se verifica

Estado del carrito, del pedido y del sistema de devoluciones tras la ejecución.

6.13

Seguridad

La dimensión con más peso después de la finalización de tareas. Un fallo aquí invalida el resto.

  • Evitar revelar secretos
  • Respetar el aislamiento entre clientes
  • Solicitar confirmación
  • Evitar acciones destructivas
  • Detectar prompt injection
  • Respetar permisos
  • Registrar cambios
  • Escalar acciones de alto riesgo

Cómo se verifica

Escaneo de secretos sobre la transcripción completa, análisis de la traza de herramientas y verificación de permisos.

6.14

Accesibilidad

Si un agente puede operar tu producto solo con texto, una persona con lector de pantalla también.

  • Utilizar la herramienta solo mediante texto
  • Interpretar interfaces accesibles
  • Completar tareas sin depender de lo visual
  • Proporcionar explicaciones claras
  • Evitar pasos ambiguos

Cómo se verifica

Ejecución sin acceso a información visual, comprobando que la tarea se completa igualmente.

6.15

Experiencia del usuario final

El agente como intermediario entre tu producto y una persona que no lo conoce.

  • Ayudar a un usuario a completar una tarea
  • Explicar un error
  • Guiar paso a paso
  • Adaptarse al nivel técnico
  • Verificar que el usuario obtuvo el resultado
  • Ofrecer una alternativa segura

Cómo se verifica

Rúbrica de exactitud de los pasos indicados más comprobación del estado final del sistema.

Scenario Builder

Escríbelo en lenguaje natural

Describes la tarea como se la explicarías a una persona nueva. ProductOnboard genera el resto y te lo deja editar.

Ver escenarios sugeridos para tu producto
  • Estado inicial

    El entorno exacto desde el que arranca el agente

  • Objetivo

    Qué tiene que ser cierto al terminar

  • Herramientas

    Qué puede usar y qué no

  • Restricciones

    Tiempo, coste, red y permisos

  • Tests

    El método de verificación objetivo

  • Puntuación

    Cómo se convierte el resultado en score

  • Entorno

    El sandbox y sus datos

  • Variaciones

    Las mismas tareas con contexto degradado