Chatbots distorsionan las noticias, impactando incluso a los usuarios pagados

¿Por qué es esto importante? Si los chatbots no pueden ni siquiera recuperar noticias tan bien como Google, es difícil confiar en que interpreten y citen esas noticias con precisión. Esto hace que el contenido de sus respuestas, incluso cuando están vinculadas, sea mucho menos confiable.
Dando Respuestas Incorrectas con Confianza
Los investigadores señalaron que los chatbots devolvieron respuestas incorrectas con una "confianza alarmante", raramente calificando sus resultados o admitiendo lagunas en su conocimiento. ChatGPT, por ejemplo, "nunca se negó a proporcionar una respuesta", a pesar de que 134 de sus 200 respuestas fueron incorrectas. De las ocho herramientas, Copilot fue la única que se negó a responder más consultas de las que contestó.
"Todas las herramientas fueron consistentemente más propensas a proporcionar una respuesta incorrecta que a reconocer limitaciones", aclaró el informe.
Los Niveles Pagados No Son Más Confiables
Incluso los modelos premium como Grok-3 Search y Perplexity Pro, aunque más precisos que sus contrapartes gratuitas, aún dieron respuestas incorrectas con confianza. Esto plantea preguntas sobre el valor de sus a menudo altos costos de suscripción.
"Esta contradicción proviene principalmente de la tendencia de [los bots] a proporcionar respuestas definitivas, pero incorrectas, en lugar de negarse a responder la pregunta directamente", explica el informe. "La preocupación fundamental va más allá de los errores factuales de los chatbots hacia su tono conversacional autoritativo, que puede dificultar que los usuarios distingan entre información precisa e imprecisa."
"Esta confianza inmerecida presenta a los usuarios una ilusión potencialmente peligrosa de fiabilidad y precisión", añadió el informe.
Fabricando Enlaces
Los modelos de IA son notorios por alucinar, pero el estudio de Tow encontró que Gemini y Grok 3 lo hicieron con mayor frecuencia, más de la mitad del tiempo. "Incluso cuando Grok identificó correctamente un artículo, a menudo vinculó a una URL fabricada", señaló el informe, lo que significa que Grok podía encontrar el título y el editor correctos pero luego fabricar el enlace real del artículo.
Un análisis de los datos de tráfico de Comscore por Generative AI in the Newsroom, una iniciativa de la Universidad de Northwestern, confirmó este patrón. Su estudio de julio a noviembre de 2024 mostró que ChatGPT generó 205 URLs rotas en sus respuestas. Aunque las publicaciones ocasionalmente eliminan historias, lo que puede resultar en errores 404, los investigadores notaron que la falta de datos de archivo sugería que "el modelo ha alucinado enlaces de apariencia plausible a medios de comunicación autoritativos al responder a consultas de usuarios."
Dada la creciente adopción de motores de búsqueda de IA—Google cayó por debajo del 90% de cuota de mercado en el cuarto trimestre de 2024 por primera vez en 10 años—estos hallazgos son preocupantes. La compañía también lanzó el Modo IA para ciertos usuarios la semana pasada, reemplazando su búsqueda normal con un chatbot a pesar de la impopularidad desenfrenada de sus AI Overviews.
Con alrededor de 400 millones de usuarios acudiendo a ChatGPT semanalmente, la falta de fiabilidad y la distorsión de sus citas convierten a esta y otras herramientas de IA populares en posibles motores de desinformación, incluso cuando extraen contenido de sitios de noticias rigurosamente verificados.
El informe de Tow concluyó que las herramientas de IA que atribuyen incorrectamente fuentes o representan erróneamente su trabajo podrían perjudicar la reputación de los editores.
Ignorando Rastreadores Bloqueados
La situación empeora para los editores, ya que el informe de Tow encontró que varios chatbots aún podían recuperar artículos de editores que habían bloqueado sus rastreadores usando el Protocolo de Exclusión de Robots (REP), o robots.txt. Sin embargo, paradójicamente, los chatbots no lograron responder correctamente a consultas sobre sitios que les permiten acceder a su contenido.
"Perplexity Pro fue el peor infractor en este sentido, identificando correctamente casi un tercio de los noventa extractos de artículos a los que no debería haber tenido acceso", afirma el informe.
Esto sugiere que no solo las empresas de IA siguen ignorando el REP—como Perplexity y otras fueron descubiertas haciéndolo el año pasado—sino que los editores en cualquier tipo de acuerdo de licencia con ellos no tienen garantizado ser citados correctamente.
El informe de Columbia es solo un síntoma de un problema mayor. El informe de Generative AI in the Newsroom también descubrió que los chatbots rara vez dirigen tráfico a los sitios de noticias de los que extraen información, lo que confirman otros informes. De julio a noviembre de 2024, Perplexity pasó el 7% de las referencias a sitios de noticias, mientras que ChatGPT pasó solo el 3%. En comparación, las herramientas de IA tendieron a favorecer recursos educativos como Scribd.com, Coursera y aquellos asociados con universidades, enviando hasta un 30% de tráfico hacia ellos.
La conclusión: El periodismo original sigue siendo una fuente de noticias más confiable que lo que las herramientas de IA regurgitan. Siempre verifica los enlaces antes de aceptar lo que te dicen como hecho, y usa tus habilidades de pensamiento crítico y alfabetización mediática para evaluar las respuestas.
Artículo relacionado
CEO de DeepMind, Hassabis: Duermo seis horas al día y generalmente me siento con energía alrededor de la 1 a. m.
Fortune ha presentado recientemente una entrevista con Demis Hassabis, director ejecutivo de Google DeepMind, en la que revela su enfoque poco convencional para el descanso y la productividad. Hassabis ha revelado que duerme muy poco, estructurando s
OpenAI y Anthropic compiten por la cuota de mercado a pesar de la caída de los ingresos
A pesar de los recientes informes que sugieren que OpenAI no ha alcanzado sus objetivos de ingresos —lo que ha generado presión sobre las acciones tecnológicas este martes—, los inversores privados en
Cumplimiento de la normativa sobre vehículos autónomos en California: una nueva era de multas, geovallas y 1 millón de millas
Guident opera un servicio de transporte de AuveTech en el sur de Florida, gestionando una ruta de cuatro millas en West Palm Beach y otra de una milla en Boca Ratón mediante su tecnología de monitoriz
Recomendaciones de temas especiales relacionados
comentario (52)
0/500
Paying for premium AI news and still getting misinformation? That's like buying a fancy umbrella that leaks in the rain. 🤦♂️ This study just confirms my biggest fear about AI in journalism—it's not just about errors, it's about the confidence with which it spreads them. Makes you wonder if we're outsourcing our critical thinking to machines that can't even get basic facts straight.
Paying for premium AI chatbots and still getting fake news? That's a rip-off! 😡 This study just proves we can't trust these bots to get the facts straight.
프리미엄 버전을 구입했는데 뉴스 정확도가 형편없네요. confidently 잘못된 정보를 내뱉는 모습을 보면서 웃음이 나왔어요. 😂 돈 아깝네요. 사람 손으로 쓴 뉴스가 더 나을 것 같아요.
Paguei pela versão premium achando que teria notícias precisas, mas que erro! Ele dá informações erradas com tanta confiança que parece um pastor pregando. 😅 Não vale o dinheiro. Talvez seja melhor ficar com notícias escritas por humanos.

¿Por qué es esto importante? Si los chatbots no pueden ni siquiera recuperar noticias tan bien como Google, es difícil confiar en que interpreten y citen esas noticias con precisión. Esto hace que el contenido de sus respuestas, incluso cuando están vinculadas, sea mucho menos confiable.
Dando Respuestas Incorrectas con Confianza
Los investigadores señalaron que los chatbots devolvieron respuestas incorrectas con una "confianza alarmante", raramente calificando sus resultados o admitiendo lagunas en su conocimiento. ChatGPT, por ejemplo, "nunca se negó a proporcionar una respuesta", a pesar de que 134 de sus 200 respuestas fueron incorrectas. De las ocho herramientas, Copilot fue la única que se negó a responder más consultas de las que contestó.
"Todas las herramientas fueron consistentemente más propensas a proporcionar una respuesta incorrecta que a reconocer limitaciones", aclaró el informe.
Los Niveles Pagados No Son Más Confiables
Incluso los modelos premium como Grok-3 Search y Perplexity Pro, aunque más precisos que sus contrapartes gratuitas, aún dieron respuestas incorrectas con confianza. Esto plantea preguntas sobre el valor de sus a menudo altos costos de suscripción.
"Esta contradicción proviene principalmente de la tendencia de [los bots] a proporcionar respuestas definitivas, pero incorrectas, en lugar de negarse a responder la pregunta directamente", explica el informe. "La preocupación fundamental va más allá de los errores factuales de los chatbots hacia su tono conversacional autoritativo, que puede dificultar que los usuarios distingan entre información precisa e imprecisa."
"Esta confianza inmerecida presenta a los usuarios una ilusión potencialmente peligrosa de fiabilidad y precisión", añadió el informe.
Fabricando Enlaces
Los modelos de IA son notorios por alucinar, pero el estudio de Tow encontró que Gemini y Grok 3 lo hicieron con mayor frecuencia, más de la mitad del tiempo. "Incluso cuando Grok identificó correctamente un artículo, a menudo vinculó a una URL fabricada", señaló el informe, lo que significa que Grok podía encontrar el título y el editor correctos pero luego fabricar el enlace real del artículo.
Un análisis de los datos de tráfico de Comscore por Generative AI in the Newsroom, una iniciativa de la Universidad de Northwestern, confirmó este patrón. Su estudio de julio a noviembre de 2024 mostró que ChatGPT generó 205 URLs rotas en sus respuestas. Aunque las publicaciones ocasionalmente eliminan historias, lo que puede resultar en errores 404, los investigadores notaron que la falta de datos de archivo sugería que "el modelo ha alucinado enlaces de apariencia plausible a medios de comunicación autoritativos al responder a consultas de usuarios."
Dada la creciente adopción de motores de búsqueda de IA—Google cayó por debajo del 90% de cuota de mercado en el cuarto trimestre de 2024 por primera vez en 10 años—estos hallazgos son preocupantes. La compañía también lanzó el Modo IA para ciertos usuarios la semana pasada, reemplazando su búsqueda normal con un chatbot a pesar de la impopularidad desenfrenada de sus AI Overviews.
Con alrededor de 400 millones de usuarios acudiendo a ChatGPT semanalmente, la falta de fiabilidad y la distorsión de sus citas convierten a esta y otras herramientas de IA populares en posibles motores de desinformación, incluso cuando extraen contenido de sitios de noticias rigurosamente verificados.
El informe de Tow concluyó que las herramientas de IA que atribuyen incorrectamente fuentes o representan erróneamente su trabajo podrían perjudicar la reputación de los editores.
Ignorando Rastreadores Bloqueados
La situación empeora para los editores, ya que el informe de Tow encontró que varios chatbots aún podían recuperar artículos de editores que habían bloqueado sus rastreadores usando el Protocolo de Exclusión de Robots (REP), o robots.txt. Sin embargo, paradójicamente, los chatbots no lograron responder correctamente a consultas sobre sitios que les permiten acceder a su contenido.
"Perplexity Pro fue el peor infractor en este sentido, identificando correctamente casi un tercio de los noventa extractos de artículos a los que no debería haber tenido acceso", afirma el informe.
Esto sugiere que no solo las empresas de IA siguen ignorando el REP—como Perplexity y otras fueron descubiertas haciéndolo el año pasado—sino que los editores en cualquier tipo de acuerdo de licencia con ellos no tienen garantizado ser citados correctamente.
El informe de Columbia es solo un síntoma de un problema mayor. El informe de Generative AI in the Newsroom también descubrió que los chatbots rara vez dirigen tráfico a los sitios de noticias de los que extraen información, lo que confirman otros informes. De julio a noviembre de 2024, Perplexity pasó el 7% de las referencias a sitios de noticias, mientras que ChatGPT pasó solo el 3%. En comparación, las herramientas de IA tendieron a favorecer recursos educativos como Scribd.com, Coursera y aquellos asociados con universidades, enviando hasta un 30% de tráfico hacia ellos.
La conclusión: El periodismo original sigue siendo una fuente de noticias más confiable que lo que las herramientas de IA regurgitan. Siempre verifica los enlaces antes de aceptar lo que te dicen como hecho, y usa tus habilidades de pensamiento crítico y alfabetización mediática para evaluar las respuestas.
CEO de DeepMind, Hassabis: Duermo seis horas al día y generalmente me siento con energía alrededor de la 1 a. m.
Fortune ha presentado recientemente una entrevista con Demis Hassabis, director ejecutivo de Google DeepMind, en la que revela su enfoque poco convencional para el descanso y la productividad. Hassabis ha revelado que duerme muy poco, estructurando s
OpenAI y Anthropic compiten por la cuota de mercado a pesar de la caída de los ingresos
A pesar de los recientes informes que sugieren que OpenAI no ha alcanzado sus objetivos de ingresos —lo que ha generado presión sobre las acciones tecnológicas este martes—, los inversores privados en
Paying for premium AI news and still getting misinformation? That's like buying a fancy umbrella that leaks in the rain. 🤦♂️ This study just confirms my biggest fear about AI in journalism—it's not just about errors, it's about the confidence with which it spreads them. Makes you wonder if we're outsourcing our critical thinking to machines that can't even get basic facts straight.
Paying for premium AI chatbots and still getting fake news? That's a rip-off! 😡 This study just proves we can't trust these bots to get the facts straight.
프리미엄 버전을 구입했는데 뉴스 정확도가 형편없네요. confidently 잘못된 정보를 내뱉는 모습을 보면서 웃음이 나왔어요. 😂 돈 아깝네요. 사람 손으로 쓴 뉴스가 더 나을 것 같아요.
Paguei pela versão premium achando que teria notícias precisas, mas que erro! Ele dá informações erradas com tanta confiança que parece um pastor pregando. 😅 Não vale o dinheiro. Talvez seja melhor ficar com notícias escritas por humanos.





Hogar






