ChatGPT en Español - ChatGPT México

El “Prompt de Verdad” de ChatGPT: ¿Solución o Ilusión?

Un protocolo de "verdad" para ChatGPT busca mejorar la precisión, pero no elimina errores, subrayando la importancia de verificar información crítica con fuentes externas confiables.

Un investigador introduce el nombre de un autor, el título de una revista y una fecha de publicación en ChatGPT. La respuesta es clara y confiada: exactamente la cita necesaria. Sin embargo, al buscar en Google, descubre que el documento no existe. El autor es real, pero nunca escribió nada parecido. Este es el problema principal: ChatGPT está optimizado para sonar útil, no para ser preciso. Un “prompt de verdad” que circula en comunidades de Forbes y Reddit afirma solucionar esto, aunque tiene limitaciones que no deben ignorarse. Los usuarios que exploran páginas web impulsadas por IA pueden encontrar herramientas alternativas que valen la pena para cotejar los resultados de ChatGPT.

ChatGPT genera texto prediciendo la palabra más probable basada en patrones de datos de entrenamiento. No tiene un verificador de hechos interno ni consulta una base de datos de verdad en tiempo real. El proceso de aprendizaje por refuerzo que moldeó el modelo, conocido como RLHF, recompensa las respuestas que suenan útiles y completas, lo que significa que el modelo puede preferir una respuesta plausible a una admisión honesta de incertidumbre. Es como un editor de Wikipedia excesivamente confiado que nunca cita fuentes pero siempre parece seguro de cada afirmación.

Los “protocolos de verdad” compartidos públicamente suelen incluir instrucciones como priorizar “No sé” sobre una conjetura confiada, nunca inventar fuentes, URLs, estudios o estadísticas, etiquetar cualquier cosa no verificada como incierta, mostrar pasos de cálculo o citar una fuente creíble para cada número, y realizar una segunda verificación: listar cada afirmación, verificar individualmente y reescribir usando solo las verificadas. Este último punto merece atención, ya que un prompt de seguimiento pide al modelo que descomponga su respuesta en afirmaciones atómicas, etiquetando cada una como Soportada, No Verificada o Falsa, citando una fuente específica con fecha.

Sin embargo, las investigaciones muestran que la precisión de verificación de hechos del modelo está mucho más cerca de un lanzamiento de moneda de lo que la mayoría de los usuarios supone. Un estudio de 2024 de la Universidad Brigham Young encontró que el rendimiento de verificación de hechos de ChatGPT era “bajo y no muy diferente de conjeturas al azar”. Cambiar el redactado del prompt modificó la confianza en la respuesta más que su precisión real, lo que significa que una respuesta que suena más asertiva no es necesariamente más correcta.

El prompt de verdad hace que los errores sean más visibles y menos frecuentes, pero no los elimina. Los usuarios deberían guardar este prompt en la Configuración de ChatGPT bajo Instrucciones Personalizadas para que se ejecute automáticamente en cada sesión. Debe tratarse como el cinturón de seguridad, no el piloto automático. Las afirmaciones sobre salud, legales y financieras todavía requieren ser cotejadas con fuentes externas autorizadas, porque el momento en que la máquina suena más segura es precisamente cuando la escrutinio es más importante.

En un contexto donde la tecnología avanza rápidamente y la inteligencia artificial se integra cada vez más en nuestra vida diaria, es crucial que los usuarios comprendan las limitaciones de herramientas como ChatGPT. Aunque estas tecnologías pueden ofrecer respuestas rápidas y aparentemente bien fundamentadas, es esencial mantener un enfoque crítico y confirmar la información con fuentes confiables. La confianza ciega en las respuestas generadas por inteligencia artificial puede llevar a errores significativos, especialmente en áreas donde la precisión es fundamental.