IA y WhatsApp · Guía práctica
Evaluar un asistente de IA: preguntas difíciles antes de producción
Prepara una colección de casos que represente preguntas normales, ambiguas y fuera de alcance.
Retrospectiva editorial de 2026. Criterios y prácticas compatibles con el contexto tecnológico de ese período. Ver el archivo ↗
La respuesta breve
Prepara una colección de casos que represente preguntas normales, ambiguas y fuera de alcance. Define qué respuesta o derivación sería aceptable. Compara versiones con el mismo conjunto y revisa errores de mayor impacto.
El problema en la operación
Un asistente puede funcionar en preguntas preparadas y fallar cuando falta información o cambia el contexto. La evaluación necesita observar exactitud, acciones y continuidad, además del estilo.
Tres decisiones para resolverlo
- Recoge ejemplos anonimizados y agrega casos de excepción relevantes.
- Define criterios de respuesta, uso de fuentes y derivación.
- Repite la evaluación cuando cambien instrucciones, modelos o herramientas.
El error que conviene evitar
No califiques solo por lo natural que suena. Una respuesta amable puede contener un precio incorrecto o ejecutar una acción equivocada.
Cómo comprobar que quedó resuelto
Registra fallos por tipo y compara correcciones con casos previos. La decisión de publicar debe considerar errores restantes y su tratamiento operativo.
Preguntas frecuentes
¿Sirve probar solo conversaciones exitosas?
No. Los límites y fallos son parte del comportamiento que el negocio necesita conocer antes de usar el asistente.