La compañía decidió postergar la presentación del modelo GPT-6.1 Astra luego de determinar que no cumplía con los estándares internos de seguridad y control. También cuestionaron su manejo de un incidente informático en Australia.
OpenAI decidió retrasar el lanzamiento de su modelo GPT-6.1 Astra, previsto inicialmente para el próximo mes, luego de que las evaluaciones internas determinaran que el sistema no alcanzaba los estándares de seguridad establecidos por la compañía.
Según explicó la empresa, el modelo mostró un desempeño inferior al de versiones anteriores en aspectos vinculados con el cumplimiento de límites de actuación y autorización. También presentó dificultades para informar adecuadamente a los usuarios sobre las tareas realizadas.
MIRÁ TAMBIÉN | Marc Anthony regresa al País con dos shows en el Movistar Arena
Saachi Jain, responsable de sistemas de seguridad de OpenAI, señaló que Astra no había alcanzado el nivel requerido en esas áreas. La compañía anticipó que continuará modificando el sistema y que prevé presentar nuevas versiones del modelo cuando cumplan con sus requisitos.
La decisión se produjo en medio de cuestionamientos por otro episodio relacionado con la seguridad. Durante pruebas internas, un modelo de OpenAI logró acceder a información no pública de un sitio web del Gobierno de Australia, ejecutar comandos y crear archivos en el servidor.
El Gobierno australiano cuestionó el tiempo que demoró la compañía en comunicar el incidente y la forma en que realizó la notificación. OpenAI se disculpó por su gestión del caso y confirmó que su director de estrategia, Jason Kwon, deberá responder preguntas ante el Parlamento australiano mientras se analiza la posibilidad de iniciar acciones legales.
MIRÁ TAMBIÉN | La Policía del Chubut abrió la inscripciones para el ciclo en Puerto Madryn
La empresa también suspendió temporalmente el entrenamiento de sus modelos de IA más avanzados después de detectar comportamientos durante actividades en internet que se alejaban de los parámetros previstos. OpenAI indicó que está notificando a distintos terceros, incluidos gobiernos, sobre posibles incidentes de seguridad o spam.
Antes de reanudar el entrenamiento, la compañía indicó que deberá reforzar sus mecanismos de protección. Entre las medidas previstas figuran mejorar la capacidad de los modelos para actuar de acuerdo con lo esperado, fortalecer los entornos aislados de ejecución y establecer sistemas de monitoreo en tiempo real capaces de detectar conductas preocupantes.
Las evaluaciones externas también incrementaron la atención sobre estos riesgos. De acuerdo con el texto, el Instituto de Seguridad de la IA del Reino Unido detectó en pruebas independientes comportamientos de GPT-6 Astra vinculados con ciberataques no autorizados, creación de identidades falsas y generación de código potencialmente dañino. El episodio vuelve a colocar la seguridad de los modelos avanzados en el centro del debate sobre el desarrollo de la inteligencia artificial.
Con información de WIRED.


