ChatGPT en Español - ChatGPT México

OpenAI lanza ChatGPT Agent: la nueva herramienta que automatiza tareas complejas para usuarios

OpenAI presenta ChatGPT agent, una herramienta versátil que automatiza tareas complejas como la gestión de calendarios y la creación de presentaciones, combinando navegación web y síntesis de información en un solo sistema.
OpenAI lanza ChatGPT Agent: la nueva herramienta que automatiza tareas complejas para usuarios

OpenAI ha dado un paso significativo en el desarrollo de agentes de inteligencia artificial con el lanzamiento de un nuevo agente dentro de ChatGPT. Este nuevo agente de propósito general promete realizar una amplia gama de tareas computacionales en nombre de los usuarios, desde la gestión de calendarios hasta la generación de presentaciones editables y la ejecución de código.

El agente ChatGPT, como se le ha denominado, es una combinación de varias capacidades de herramientas anteriores desarrolladas por OpenAI. Entre estas se encuentran la habilidad de “Operator” para interactuar autónomamente en sitios web y la capacidad de “Deep Research” para sintetizar información de múltiples fuentes en un informe de investigación conciso. Los usuarios podrán comunicarse con este agente mediante el uso de lenguaje natural en ChatGPT.

Inicialmente, ChatGPT agent estará disponible para los suscriptores de los planes Pro, Plus y Team de OpenAI. Para activarlo, los usuarios deben seleccionar el “modo agente” en el menú de herramientas de ChatGPT. Este avance representa el intento más audaz de OpenAI hasta la fecha para convertir a ChatGPT en un producto capaz de realizar acciones y delegar tareas, en lugar de limitarse a responder preguntas.

A lo largo de los últimos años, varias empresas de Silicon Valley, entre ellas OpenAI, Google y Perplexity, han introducido múltiples agentes de inteligencia artificial con promesas similares. No obstante, estas versiones tempranas han demostrado tener dificultades para llevar a cabo tareas complejas, y sus capacidades reales han parecido menos impresionantes en comparación con las visiones ambiciosas que los ejecutivos del sector tecnológico han proyectado sobre los agentes de IA.

OpenAI asegura que el agente ChatGPT es considerablemente más competente que sus ofertas anteriores. La nueva herramienta puede conectarse a aplicaciones como Gmail y GitHub mediante conectores de ChatGPT, lo que le permite encontrar información relevante en respuesta a las solicitudes de los usuarios. Además, el agente tiene acceso a un terminal y puede utilizar APIs para interactuar con ciertas aplicaciones.

Entre las tareas que OpenAI sugiere que el agente puede realizar se incluyen “planificar y comprar ingredientes para preparar un desayuno japonés para cuatro personas” y “analizar a tres competidores y crear una presentación de diapositivas”. Estas capacidades requieren que el agente no solo navegue por sitios web, sino que también planifique acciones y utilice herramientas, abordando tareas más complejas de las que OpenAI había intentado previamente con sus agentes.

El modelo subyacente del agente ChatGPT ofrece un rendimiento de vanguardia en varios parámetros de evaluación. Según OpenAI, el modelo alcanza un 41.6% en el examen “Humanity’s Last Exam”, un test riguroso compuesto por miles de preguntas en más de cien materias, casi duplicando los resultados de modelos anteriores como el o3 y o4-mini. En el “FrontierMath”, uno de los benchmarks matemáticos más difíciles, el agente logra un 27.4% cuando tiene acceso a herramientas, superando significativamente al o4-mini, que solo alcanzó un 6.3%.

OpenAI ha desarrollado el agente ChatGPT con una especial atención a la seguridad, ya que presenta nuevas capacidades que podrían ser peligrosas en manos equivocadas. En un informe de seguridad, la compañía clasifica al modelo como de “alta capacidad” en los ámbitos de armas biológicas y químicas, lo que indica su potencial para amplificar vías existentes hacia daños severos. Aunque OpenAI no tiene evidencia directa de este riesgo, ha optado por implementar salvaguardias preventivas.

Estas medidas de seguridad incluyen un monitor que opera en tiempo real mientras los usuarios interactúan con el producto. Cada solicitud al agente se analiza para determinar si está relacionada con biología, y en caso afirmativo, se verifica si el contenido podría representar una amenaza biológica. Además, OpenAI ha desactivado la función de memoria de ChatGPT en este agente para prevenir el uso indebido, aunque considera la posibilidad de reactivar esta opción en el futuro.

Si bien las capacidades del agente ChatGPT son impresionantes, aún queda por ver cómo se desempeñará en el mundo real. Hasta el momento, la tecnología de agentes ha demostrado ser relativamente frágil al interactuar con el entorno real. Sin embargo, OpenAI confía en que ha desarrollado un modelo más competente que pueda cumplir con las promesas de los agentes de inteligencia artificial.