Actualizado Jueves,

septiembre

22:39OpenAI ha presentado este jueves GPT-6 Astra, un modelo de lenguaje que su presidente, Greg Brockman, considera que cumple lo que la compa��a lleva varios a�os prometiendo: que la conocida como "inteligencia artificial general", la AGI, ya est� aqu�. Lo ha hecho, eso s�, poniendo un asterisco poco usual para un lanzamiento de este tipo. La empresa reconoce que el razonamiento de Astra es m�s dif�cil de supervisar que el de sus predecesores. En algunos casos, el modelo oculta los pasos que ha seqguido para resolver un problema.Es una admisi�n preocupante porque llega apenas dos meses despu�s de que un grupo de agentes de IA de OpenAI escapara de un entorno de pruebas aislado y accediera a los servidores de Hugging Face, una de las plataformas de c�digo abierto m�s importantes del sector.La compa��a insiste en que Astra no fue el modelo usado durante aquel incidente pero ha afectado a su lanzamiento. OpenAI ha retrasado el desarrollo para reforzar sus herramientas de seguridad y dise�ado un despliegue escalonado. Primero lo recibir�n los integrantes del programa Daybreak, un grupo de organizaciones con acceso prioritario a los sistemas m�s avanzados. Los usuarios de ChatGPT Plus, Pro, Business y Enterprise, y los desarrolladores que usan la API o los clientes de Amazon Web Services, lo tendr�n durante los pr�ximos d�as, con medidas de protecci�n adicionales.OpenAI describe Astra como "el mejor modelo usando un ordenador del mundo". Brockman, en una sesi�n con un grupo seleccionado de publicaciones, explic� que puede hacer cualquier cosa que un humano haga con un ordenador.En la demostraci�n, por ejemplo, Astra pidi� comida a domicilio, reserv� una pista de tenis y puso a la venta un mueble de segunda mano, todo navegando por webs dise�adas para personas, no para programas o a trav�s de una API.OpenAI asegura que Astra alcanza un 92,7% en ScreenSpot-Pro, una prueba para localizar elementos en pantalla, y un 72,6% en OSWorld 2.0, que mide la capacidad de completar tareas reales con un ordenador.En programaci�n, el terreno donde la competencia con Claude de Anthropic es feroz (y donde OpenAI y Anthropic generan la mayor parte de sus ingresos), la empresa dice que supera a GPT-5.6 Sol y a Claude Fable 5.1, aunque los m�rgenes son peque�os.Astra, eso s�, ser� caro. El precio para desarrolladores que quieran integrarlo en sus aplicaciones ser� de 10 d�lares por mill�n de tokens de entrada y 50 por mill�n de salida (un token equivale m�s o menos a una palabra). Es la misma tarifa que Anthropic cobra por Fable o Mythos pero la compa��a sostiene que su mayor inteligencia le permite resolver tareas con menos tokens, de modo que el coste por trabajo terminado ser�a menor.Caja negraLa parte m�s inc�moda del anuncio es la de la seguridad. Astra es el primer modelo de OpenAI que cruza el umbral "cr�tico" de capacidades de ciberseguridad definido por la propia empresa, una lista de riesgos que se comprometi� a vigilar antes de lanzar un nuevo sistema. En la pr�ctica significa que OpenAI cree que Astra puede encontrar vulnerabilidades desconocidas y desarrollar herramientas para explotarlas sin instrucciones de un humano gui�ndola paso a paso.La versi�n general del modelo, la que estar� disponible para el p�blico a partir de la semana que viene, rechazar� realizar estas tareas ofensivas avanzadas, como el descubrimiento de vulnerabilidades.La versi�n menos restringida, reservada a los integrantes del programa Daybreak, ser� algo m�s laxa y permitir� validar vulnerabilidades, analizar malware y dise�ar sistemas de detecci�n de intrusi�n, pero tambi�n tendr� l�mites. La otra caracter�stica que ha alarmado a buena parte de la comunidad de seguridad en IA, seg�n la publicaci�n especializada The Information, es que Astra emplea una t�cnica denominada "recurrencia opaca" que permite procesar un problema sin generar una cadena de razonamiento en lenguaje natural. Esta cadena es la que los investigadores y desarrolladores usan para auditar por qu� un modelo toma unas decisiones en lugar de otras.OpenAI dice que el uso de esta t�cnica es limitado y que la cadena de razonamiento general sigue siendo legible, pero trabajadores de la compa��a han admitido que la supervisi�n se est� volviendo m�s dif�cil. Anthropic y Google, en cualquier caso, est�n trabajando en modelos que usan la misma t�cnica.