El nuevo modelo de OpenAI supera los estándares y admite que es mejor para ocultar.

El nuevo modelo de OpenAI supera los estándares y admite que es mejor para ocultar.

      OpenAI ha lanzado GPT-6 Astra, el modelo que toma el relevo de GPT-5.6 Sol en la parte superior de su gama. La empresa lo describe como su sistema más inteligente y alineado hasta la fecha, construido sobre avances en preentrenamiento, aprendizaje por refuerzo e investigación de alineación.

      Se lanzará en etapas. Un conjunto limitado de organizaciones tiene acceso ahora; los usuarios de ChatGPT Plus, Pro, Business y Enterprise seguirán en unos días, y hay una variante separada Astra Pro para los niveles de pago, con acceso a la API a través de OpenAI directamente y a través de AWS Bedrock.

      Astra también es el modelo cuya capacidad cibernética hizo que OpenAI retrasara este lanzamiento a principios de año. El marco de lanzamiento ha estado más enfocado en la llegada que en la aritmética, y la afirmación de AGI adjunta ha acaparado la mayor parte de la atención.

      El video de lanzamiento de OpenAI para GPT-6 Astra. Fuente: Introducing GPT-6 Astra (OpenAI, YouTube)

      Además, OpenAI ha presentado algunos números sorprendentes detrás de GPT-6 Astra, incluyendo un puntaje del 99.9% en ARC-AGI-3, un estándar de razonamiento abstracto donde su predecesor obtuvo solo un 7.8%.

      Las cifras publicadas por OpenAI muestran ganancias igualmente grandes en otros lugares. Astra obtiene un 97.6% en FrontierMath Nivel 4, frente al 83.0% de GPT-5.6 Sol, mientras que Terminal-Bench 4.0 sube del 37.3% al 57.9%. En un estándar de flujo de trabajo científico, el puntaje salta del 22.4% al 64.6%.

      Esos números han sido algo opacados por la forma en que OpenAI ha presentado el lanzamiento. La empresa ha sugerido que Astra marca un paso importante hacia la AGI, y esa afirmación ha atraído mucha atención. La evidencia más concreta sigue estando en los estándares que OpenAI publicó junto con el modelo.

      Astra también es más rápida. En OSWorld 2.0, que prueba la capacidad de un modelo para operar una computadora, obtuvo un 72.6% y completó tareas un 47% más rápido que Sol, tardando alrededor de 40 minutos en comparación con 75.

      Los cambios también están dirigidos a trabajos bastante ordinarios. OpenAI dice que Astra puede crear documentos, presentaciones y hojas de cálculo utilizando plantillas comerciales. Su sistema Codex también puede mantener notas buscables entre ventanas de contexto y hacer preguntas de manera asincrónica en lugar de detenerse cada vez que necesita una respuesta.

      Greg Kamradt de la Fundación ARC Prize describió los resultados de razonamiento en términos menos abstractos. Astra “superó nuestra línea base de eficiencia de acción humana en el 96% de los niveles, alcanzando efectivamente la paridad humana en el estándar”, dijo.

      Los resultados de ciberseguridad son más difíciles de tratar como solo otro estándar. Astra obtuvo un 100% en ExploitBench, en comparación con el 78.5% de Sol, y encontró dos vulnerabilidades de día cero previamente desconocidas durante las pruebas.

      Ese rendimiento cruza una línea en el propio marco de seguridad de OpenAI. Astra cumple con el umbral "Crítico" para la capacidad cibernética, el nivel que llevó a la empresa a ralentizar su lanzamiento en primer lugar.

      OpenAI ha puesto restricciones en la versión que se está implementando. Astra se niega a escribir exploits de prueba de concepto, los sistemas de seguridad pueden pausar o detener el trabajo que parece involucrar seguridad ofensiva, y el acceso empresarial está desactivado por defecto hasta que un administrador lo habilite.

      Los investigadores de seguridad obtendrán un tipo diferente de acceso. OpenAI planea expandir su programa Daybreak en las próximas semanas, dando acceso a equipos de seguridad verificados a una versión del modelo diseñada para rechazar menos solicitudes defensivas legítimas.

      Algunos de los resultados de seguridad también han mejorado. OpenAI dice que Astra no intentó ir más allá de su alcance autorizado en las pruebas, en comparación con el 48% de Sol sin salvaguardias. Su tasa de alucinaciones también cayó del 12.2% al 4.2%.

      Pero las mismas pruebas descubrieron algo que OpenAI no considera resuelto. El razonamiento de Astra fue más difícil de monitorear que el de Sol en situaciones donde intentó evadir la supervisión. La empresa enumera esto como una prioridad de investigación abierta.

      Esa es una calificación importante a la afirmación de que Astra es el modelo más alineado de OpenAI. Hacer que un modelo sea menos propenso a comportarse mal es un problema. Saber cuándo se está comportando mal se vuelve más difícil si el modelo también es mejor en ocultar lo que está haciendo.

      El costo de monitoreo ya es alto. OpenAI ha agregado un 20% de sobrecarga computacional para el monitoreo de seguridad, y los modelos más capaces probablemente harán que ese proceso sea más exigente.

      Astra tiene un precio acorde. La API cuesta $10 por millón de tokens de entrada y $50 por millón de tokens de salida. Un modo rápido cuesta el doble por el doble de velocidad, con acceso disponible a través de la API de OpenAI y AWS Bedrock.

      El despliegue ocurrirá en etapas. Un grupo limitado de organizaciones obtiene acceso primero, seguido en unos días por los usuarios de ChatGPT Plus, Pro, Business y Enterprise. Una versión Pro estará disponible para los niveles de pago.

      Hay una limitación importante para todos estos números: provienen de OpenAI. Ninguno había sido reproducido de forma independiente cuando se lanzó el modelo, y OpenAI está comparando Astra con su propio sistema anterior en lugar de con los últimos modelos de Anthropic o Google.

      Las afirmaciones más interesantes pueden tardar mucho más en verificarse. OpenAI dice que Astra contribuyó al trabajo en problemas matemáticos abiertos, incluyendo la reducción de un límite en los huecos primos de 246 a 186. A diferencia de un puntaje de estándar, ese tipo de resultado tendrá que resistir el escrutinio de los matemáticos.

Otros artículos

DeepSeek planea un gran pedido de chips de Huawei para el nuevo centro de datos de Mongolia Interior DeepSeek planea un gran pedido de chips de Huawei para el nuevo centro de datos de Mongolia Interior DeepSeek está preparando un gran pedido de chips de IA de Huawei para suministrar un nuevo centro de datos, según Bloomberg. El tamaño del pedido, el modelo de chip y el calendario de entrega no se han divulgado y DeepSeek no ha confirmado el plan. OpenAI invierte $1 mil millones en defensa cibernética para servicios de agua y bancos comunitarios. OpenAI invierte $1 mil millones en defensa cibernética para servicios de agua y bancos comunitarios. OpenAI se ha comprometido a destinar $1 mil millones en acceso subsidiado a sus herramientas cibernéticas Daybreak para operadores de infraestructura crítica sin presupuesto de seguridad, anunció el mismo día en que envió un modelo que cumple con su propio umbral crítico cibernético. DeepSeek planea un gran pedido de chips de Huawei para el nuevo centro de datos en Mongolia Interior. DeepSeek planea un gran pedido de chips de Huawei para el nuevo centro de datos en Mongolia Interior. DeepSeek está preparando un gran pedido de chips de IA de Huawei para abastecer un nuevo centro de datos, según Bloomberg. El tamaño del pedido, el modelo de chip y el cronograma de entrega no se han divulgado y DeepSeek no ha confirmado el plan. BASF demanda a Apple por patentes de Face ID en el tribunal federal de Texas BASF demanda a Apple por patentes de Face ID en el tribunal federal de Texas BASF ha demandado a Apple en un tribunal federal en Texas, alegando que docenas de modelos de iPhone y iPad infringen sus patentes de autenticación facial. La empresa química no ha dicho qué patentes se están reclamando ni qué es lo que busca. Corea del Sur confirma conversaciones sobre inversión en chips con EE. UU. a medida que crece la amenaza de aranceles Corea del Sur confirma conversaciones sobre inversión en chips con EE. UU. a medida que crece la amenaza de aranceles Seúl ha confirmado que la inversión en semiconductores es parte de sus conversaciones con Washington, ya que EE. UU. señala aranceles específicos para los chips. El acuerdo de Corea promete términos arancelarios no menos favorables que los de sus competidores, lo que equivale a paridad en lugar de exención. Jane Street firma un acuerdo de $13 mil millones por cinco años de nube de IA con Crusoe Jane Street firma un acuerdo de $13 mil millones por cinco años de nube de IA con Crusoe Jane Street ha firmado un contrato de cinco años de IA en la nube con Crusoe por un valor de aproximadamente $13 mil millones, llevando el gasto comprometido en computación de la firma de trading a través de dos proveedores a aproximadamente $19 mil millones.

El nuevo modelo de OpenAI supera los estándares y admite que es mejor para ocultar.

OpenAI ha publicado referencias para GPT-6 Astra que muestran grandes saltos sobre GPT-5.6 Sol, un 100% en un benchmark de explotación y dos vulnerabilidades de día cero encontradas en las pruebas, junto con una admisión de que el razonamiento del modelo es más difícil de monitorear cuando intenta evadir.