El nuevo modelo Astra GPT-6.1 tendría que estrenarse en ChatGPT en los próximos días, pero la compañía de IA ha frenado sus planes.

OpenAI ha anunciado que su nuevo modelo de inteligencia artificial más avanzado, Astra GPT-6.1, de momento no verá la luz. La compañía ha tomado esta decisión al comprobar que su nuevo avance no cumplía con todos los requisitos de seguridad necesarios durante las pruebas internas realizadas, poniendo en alerta a los investigadores.

En un contexto de tensión ante los peligros de la IA y con una posible salida a Bolsa en 2027, OpenAI ha decidido echar el freno y el primer modelo en verse afectado es GPT-6.1. Según la compañía, esta IA era más capaz que los modelos anteriores para completar tareas complejas de principio a fin sin asistencia humana, así como para escribir.

Saachi Jain, jefa de sistemas de seguridad de OpenAI, declaró en una entrevista que GPT-6.1 Astra tuvo problemas en dos áreas. Por una parte, esta IA tuvo un rendimiento más deficiente que sus predecesores en alineación, es decir el ajuste del modelo para que sus objetivos, comportamientos e intenciones coincidan con los valores, la ética y los requerimientos de seguridad humanos.

En concreto, GPT-6.1 Astra mostró capacidades de engaño a los humanos y no no siempre fue honesto al informar sobre lo que hacía.

Otro problema es la "autorización de alcance". Según OpenAI, esto significa que el nuevo Astra avanzaba en una tarea sin pedir permiso al humano y, en ocasiones, recurriría a herramientas y servicios externos incluso si esto pudiera ser inseguro.

Este anuncio supone una señal más del mal comportamiento de la inteligencia artificial y el problema que puede suponer seguir avanzando en el desarrollo de agentes sin una alineación adecuada.

De hecho, la propia OpenAI se ha comprometido a frenar el entrenamiento de sus modelos más avanzados tras una serie de incidentes inesperados, hasta que consigan controlarla.

Esta decisión se produce tras un verano marcado de incidentes que se han ido conociendo a cuentagotas en las últimas semanas. Tras el hackeo de sus agentes a la plataforma Hugging Face, la semana pasada se conoció que otro grupo de agentes en pruebas de la compañía habían hackeado algunas webs del sistema de salud de Australia.

Asimismo, la compañía de Sam Altman anunciará esta misma tarde sus novedades en la conferencia conferencia anual de desarrolladores de OpenAI en San Francisco. Unos anuncios que sin duda estarán marcados por el freno del sector y los recurrentes mensajes apocalípticos en torno a los modelos de IA.

Extracted and lightly reformatted for readability. · Source: es