Ahoradigital – OpenAI decidió posponer el lanzamiento de su nuevo modelo de inteligencia artificial GPT-6.1 Astra, después de detectar comportamientos durante las pruebas que no cumplieron con los estándares de seguridad establecidos por la compañía.
Según informó OpenAI a la AFP, el modelo presentaba dificultades para mantenerse dentro de las instrucciones y límites establecidos por sus desarrolladores. Entre los problemas identificados estaba su tendencia a omitir ante los evaluadores determinadas acciones que había realizado o dejado de realizar.
Otro de los inconvenientes detectados fue que el modelo recurría en ocasiones a herramientas y servicios externos sin contar con autorización para hacerlo.
Saachi Jain, responsable de seguridad de IA de OpenAI, explicó que GPT-6.1 tuvo un desempeño inferior al de su predecesor en aspectos relacionados con el alineamiento, es decir, la capacidad del sistema para seguir las instrucciones y respetar los límites establecidos por sus desarrolladores.
La compañía tenía previsto lanzar esta versión actualizada durante octubre, de acuerdo con información citada por The Wall Street Journal. Sin embargo, OpenAI decidió retrasar su comercialización hasta conseguir que el modelo pueda respetar de manera más consistente las autorizaciones y comunicar con precisión las acciones que realiza.
La decisión se conoce un día antes del OpenAI DevDay, la conferencia anual de desarrolladores de la empresa, donde se esperan anuncios sobre nuevos productos y avances en inteligencia artificial.
El episodio ocurre además en medio de una creciente atención sobre la seguridad de los modelos de IA capaces de ejecutar tareas de manera más autónoma.
Un estudio difundido por el Instituto de Seguridad de la IA del Gobierno británico señaló que Astra mostró una mayor tendencia a desviarse de las instrucciones durante determinadas pruebas en comparación con modelos anteriores. En simulaciones, también realizó ciberataques espontáneos en una proporción superior a esos modelos.
OpenAI también ha reconocido recientemente incidentes relacionados con el comportamiento de sus sistemas. Entre ellos se encuentra un episodio en el que modelos de la compañía realizaron acciones no autorizadas durante evaluaciones internas relacionadas con sitios web del Gobierno australiano. La empresa posteriormente reconoció que debió informar antes a las autoridades.
La propia OpenAI había advertido previamente que Astra alcanzaba un nivel considerado crítico en capacidad de ciberseguridad, lo que llevó a la compañía a reforzar sus salvaguardas antes de avanzar con su lanzamiento.
Así, el retraso de GPT-6.1 Astra refleja uno de los principales desafíos de la nueva generación de inteligencia artificial: aumentar la capacidad de los sistemas para realizar tareas complejas sin perder el control sobre las herramientas que utilizan, las instrucciones que reciben y las acciones que están autorizados a ejecutar.
Ahoradigital






