OpenAI lanza el agente ChatGPT para automatizar tareas informáticas complejas

OpenAI lanzó hoy ChatGPT Agent, su asistente de inteligencia artificial más poderoso hasta la fecha, con el objetivo de crear una herramienta que complete activamente el trabajo de los usuarios en lugar de simplemente responder preguntas. El nuevo agente opera una “computadora virtual” para realizar tareas complejas de varios pasos.

Disponible para suscriptores pagos a partir del 17 de julio, el agente integra las capacidades de las herramientas anteriores de Operador y Investigación Profunda de OpenAI. Este lanzamiento intensifica la carrera por la supremacía en la IA agente, enfrentando a OpenAI con iniciativas de Google, Anthropic y Microsoft.

Relacionado:OpenAI entra en modo de crisis: por qué GPT-5 será el momento de la verdad para ChatGPT-Maker

La medida señala un cambio estratégico de la IA conversacional a sistemas que pueden gestionar de forma autónoma los flujos de trabajo digitales. Reemplaza la herramienta Operador de la compañía, que se introdujo por primera vez en enero de 2025 como un agente más limitado basado en navegador.

Un agente más poderoso para cumplir sus órdenes

Agente ChatGPTrepresenta el intento más audaz de OpenAI hasta el momento de crear un producto verdaderamente agente. Esimpulsado por un nuevo modelo sin nombre de la familia OpenAI o3. El sistema está diseñado para descargar tareas complejas de los usuarios, como planificar eventos consultando un calendario o generando una plataforma de diapositivas.

Para construir la nueva herramienta, OpenAI combinó los equipos detrás de Operador y Deep Research, creando un grupo unificado centrado en esta nueva dirección agente. Esta reestructuración interna subraya la importancia estratégica de ir más allá de los simples chatbots.

A diferencia de sus predecesores, ChatGPT Agent está equipado con un conjunto de herramientas más completo. Combina un navegador visual remoto con una terminal para ejecutar código, realizar análisis de datos e incluso crear hojas de cálculo.

Yash Kumar, líder de producto de OpenAI para el agente, explicó que "dado que el agente ChatGPT tiene acceso a 'una computadora completa' en lugar de solo un navegador, han 'mejorado bastante el conjunto de herramientas'". Este conjunto de herramientas ampliado también incluye conectores, lo que permite al agente acceder a fuentes de datos externas y aplicaciones como Google Drive, un paso significativo con respecto a ofertas anteriores.

El modelo subyacente cuenta con un rendimiento de última generación en puntos de referencia difíciles. En FrontierMath, una desafiante prueba de matemáticas, el agente obtuvo una puntuación del 27,4 % al utilizar sus herramientas, un gran salto con respecto al 6,3 % logrado por el modelo superior anterior, o4-mini.

OpenAI reconoce que la herramienta no está diseñada para ser rápida. La líder de la investigación, Isa Fulford, señaló que los usuarios no deben verlo funcionar, enmarcándolo como un asistente en segundo plano. "Incluso si lleva 15 minutos, media hora, es una aceleración bastante grande en comparación con el tiempo que llevaría hacerlo", dijo, enfatizando su papel en el manejo de procesos que consumen mucho tiempo.

Un 'enfoque de precaución' para la seguridad y el control

Dadas las capacidades mejoradas del agente, OpenAI se está activandosalvaguardias de su Marco de Preparación. Se trata de una medida de precaución contra posibles usos indebidos, especialmente en los ámbitos biológico y químico, incluso sin evidencia directa de riesgo.

El control del usuario es un tema central. Fulford confirmó que "antes de que el agente ChatGPT haga algo 'irreversible', como enviar un correo electrónico o hacer una reserva, primero pide permiso". Este paso de confirmación del usuario es fundamental para acciones con consecuencias en el mundo real, basándose en el diseño de seguridad primero del agente operador anterior.

Otras capas de seguridad incluyen un "Modo de vigilancia". Esta función detiene automáticamente la ejecución del agente en sitios web confidenciales, como portales financieros, si el usuario sale de la pestaña. Además, OpenAI ha desactivado la función de memoria de ChatGPT en el lanzamiento para mitigar los riesgos de filtración de datos debido a ataques de inyección rápida.

La carrera por la IA agente se intensifica

El lanzamiento de ChatGPT Agent intensifica la competencia entre los principales actores tecnológicos. Es una respuesta directa a herramientas similares de los rivales. Anthropic llegó temprano con su función “Uso de computadora” para los modelos Claude, lanzada en octubre de 2024.

Google también ha invertido mucho, con su Proyecto Mariner y las pruebas de una función de "Uso de la computadora" en su AI Studio. Microsoft también está incorporando características similares a las de un agente en su Copilot Studio. Charles Lamanna, vicepresidente de Microsoft, captó sucintamente el objetivo: "Si una persona puede usar la aplicación, el agente también puede hacerlo".

Ver también:

Incluso antes de este lanzamiento, el Operador de OpenAI mostró una ventaja competitiva, superando a sus rivales en puntos de referencia como WebVoyager y OSWorld, que prueban tareas a nivel de navegador y sistema. Esta historia establece un listón alto para el nuevo agente más capaz.

Este impulso competitivo se produce a pesar de las dudas sobre la eficacia de los agentes. Un estudio reciente de Carnegie Mellon encontró que incluso los mejores modelos de IA tienen dificultades con las tareas de automatización empresarial.resaltar problemas con el sentido común y la navegación web. El nuevo agente de OpenAI se comparará con estos puntos de referencia de rendimiento del mundo real.

Related Posts