Un nuevo estudio realizado por investigadores de la Universidad de Arizona ha demostrado que los chatbots de inteligencia artificial (IA), incluyendo ChatGPT 3.5, pueden terminar aceptando información falsa si se les expone repetidamente a ella.
Los investigadores probaron siete modelos diferentes, sometiéndolos a conversaciones en las que se les proporcionaba información incorrecta hasta 50 veces. El estudio reveló que ChatGPT 3.5 fue el más vulnerable, aceptando afirmaciones falsas en el 12,3% de las interacciones.
Otros modelos, como Claude 3.5 Sonnet, mostraron una resistencia mayor, pero ninguno fue completamente inmune. Este comportamiento tiene implicaciones importantes para la confiabilidad y seguridad de los chatbots en entornos donde la desinformación puede ser un problema.
TE PUEDE INTERESAR: Meta lanza Muse Spark 1.3: su IA más potente hasta la fecha
Qué debes saber
- Los chatbots de IA pueden terminar aceptando información falsa si se les expone repetidamente.
- ChatGPT 3.5 fue el modelo más vulnerable, aceptando afirmaciones falsas en el 12,3% de las interacciones.
- Ninguno de los siete modelos probados fue completamente inmune a la desinformación repetida.
- La oscuridad informativa del tema aumenta la vulnerabilidad de los chatbots a la desinformación.
- Algunos modelos, como GPT-4o, corrigieron todos sus errores previos cuando se les dio una nueva oportunidad.
Especificaciones técnicas
- Modelos probados: GPT-3.5, GPT-4o, GPT-4o-mini, Claude 3.5 Sonnet, Gemini 1.5 Pro, Llama 3 70B, DeepSeek-R1
- Tasa de aceptación de desinformación (ChatGPT 3.5): 12,3%
- Tasa de aceptación de desinformación (Claude 3.5 Sonnet): 0,08%
- Tasa de corrección de errores (GPT-4o, GPT-4o-mini, Gemini 1.5 Pro, DeepSeek-R1): 100%
- Tasa de corrección de errores (GPT-3.5): 32%
Contenido generado con IA y editado por el equipo editorial.
Foto: Archivo FOLOU.