
La evaluación de chatbots: un desafío metodológico en la búsqueda de información confiable
PoloSur
Un análisis inicial con estudiantes
En los últimos años, los chatbots se han consolidado como una herramienta común para la obtención de información, con un 10% de la población argentina empleándolos para mantenerse al tanto de las noticias, según el reciente Digital News Report del Reuters Institute. Ante este auge, desde Chequeado decidimos unir fuerzas con Natalí Schejtman* y un grupo de estudiantes de la Universidad Torcuato Di Tella para realizar un análisis preliminar sobre la calidad de la información que proporcionan estos sistemas.
Durante los meses de mayo y junio de 2025, llevamos a cabo un ejercicio donde, en un lapso de cinco días, los estudiantes interrogaron a ChatGPT, Grok y Gemini sobre temas de actualidad, como el caso Libra o la tensión internacional entre Estados Unidos e Irán. Cada participante formuló preguntas a su manera, incluyendo en algunas de ellas errores intencionales para evaluar la capacidad de los chatbots para detectarlos y corregirlos. Con los datos obtenidos, creamos una matriz de análisis basada en diez variables, inspirada en los lineamientos de Krippendorff (2019), que abarcaba aspectos como la precisión, claridad y fuentes de información.


Aprendizajes y proyecciones futuras
Aunque este primer análisis fue limitado en cuanto a cantidad de datos y tiene un enfoque exploratorio, los resultados nos brindaron importantes indicios sobre posibles líneas de investigación. Observamos que los chatbots a menudo fallaban al responder preguntas que carecían de un contexto temporal claro. Además, notamos una gran disparidad en la cantidad y calidad de las fuentes citadas, con algunas respuestas respaldadas por hasta veinticinco referencias, mientras que otras no presentaban ninguna, lo que generaba confusión sobre la veracidad de la información. En ocasiones, los errores introducidos en las preguntas no eran corregidos, lo que resultaba en respuestas incorrectas.
Este primer ejercicio nos proporcionó valiosas lecciones metodológicas que han orientado nuestra investigación en curso. En abril de 2026, analizamos las respuestas de diversos chatbots a afirmaciones del presidente Javier Milei durante la apertura de sesiones del 1° de marzo. Este proyecto sigue evolucionando, con el próximo objetivo de investigar cómo se comportan los chatbots a lo largo de un intercambio conversacional. Cada etapa del proceso se enriquece con la colaboración del grupo de estudiantes que participaron en el ejercicio piloto, quienes aportaron diversas perspectivas en la evaluación de las respuestas, un aspecto que seguimos valorando en cada fase de esta investigación.


El mercado inmobiliario argentino: un panorama dual entre alta actividad y caída del crédito

Nuevas medidas del Gobierno para facilitar el acceso a créditos hipotecarios


Datilia, la innovadora herramienta ganadora que transforma datos en conocimiento

Reclamo a la Corte Suprema: YPF debe revelar sus gastos publicitarios y garantizar el derecho a la información




Neymar podría perderse otro encuentro con Santos por el césped sintético de Palmeiras

Hansi Flick se pronuncia sobre el interés en Julián Álvarez a días del cierre del mercado de fichajes

La Justicia Federal interviene Vorterix Rosario por vínculos con el narcotráfico

Dólar Oficial a $1530 y Dólar Blue a $1560 en la Apertura del 26 de Agosto de 2026

Dólar Oficial a $1530 y Dólar Blue a $1560 en la apertura del 26 de agosto de 2026



