El modelo sigiloso que venció a DeepSeek pertenece a Zhipu.
Z.AI lo logró. La empresa de Pekín, también conocida como Zhipu, posee el modelo gratuito que ocupó el primer lugar en las listas de OpenRouter el fin de semana pasado. Confirmó el miércoles que Ox Alpha es una nueva iteración de su serie GLM, y dijo que liberaría los pesos esa misma noche. Luz Ding obtuvo la confirmación para Bloomberg. Escribimos sobre Ox Alpha el sábado, cuando nadie sabía en qué servidores se ejecutaba. Dobló el uso de DeepSeek mientras era anónimo. Ox Alpha apareció en OpenRouter sin un nombre adjunto, listado solo como proveniente de un proveedor externo. Bloomberg lo data al fin de semana y CTGT al 20 de agosto, que fue el jueves anterior. Alcanzó el primer lugar, más que duplicando el uso de DeepSeek. Bloomberg lo informa como el lanzamiento más grande en la historia del mercado. Patrick Collison, cuyo empresa Stripe está adquiriendo OpenRouter, llamó al lanzamiento furtivo "muy impresionante". El nombre en clave provino de una película lanzada recientemente en China, Niu Lai, o Ox Comes, según Z.ai. Los lanzamientos furtivos se están convirtiendo en un hábito chino. Alibaba y Xiaomi también lanzaron modelos este año sin reclamarlos inicialmente. La lógica es sencilla. Una empresa que no adjunta su nombre puede observar cómo se desempeña un modelo en el mundo antes de decidir qué decir sobre él. También compra una semana de publicidad gratuita, que es aproximadamente lo que sucedió aquí. Los investigadores averiguaron de quién era antes de que la empresa lo dijera. La identificación no esperó al anuncio. CTGT, una firma de investigación, publicó una huella de comportamiento el lunes. Midió el conteo de tokens a través de once sondeos, incluyendo tailandés, emoji, coreano, árabe y caracteres chinos, japoneses y coreanos aislados. Obtuvo una coincidencia exacta de 11 de 11 en el vocabulario de GLM-5.x. Otros indicios se acumularon. El límite de temperatura se sitúa exactamente en 1.0, lo que descarta a Google, OpenAI y xAI, y coincide con el rango documentado de Zhipu. Nadie puede apagar el razonamiento tampoco, otro rasgo de los modelos de pensamiento GLM-5.x. Los modelos GLM alojados por Z.AI devuelven un mensaje de error distintivo, quejándose de información de rol incorrecta. Ox Alpha devuelve el mismo. Se le dijo al modelo que no dijera quién lo hizo. CTGT encontró algo más que vale la pena declarar claramente. Ox Alpha lleva un aviso del sistema que le instruye no revelar ninguna información sobre su procedencia. Eso no es una empresa manteniéndose en silencio en público. Es una instrucción dentro del producto. El hallazgo de censura es la parte que nadie mencionó. CTGT también sometió el modelo a su instrumento de censura, que compara pares coincidentes de avisos sensibles y neutrales. Sobre Xinjiang y Taiwán, los dos temas que las auditorías de censura occidentales casi siempre prueban, Ox Alpha responde como un modelo estadounidense. CTGT encontró que su respuesta sobre Xinjiang era detallada y citaba fuentes que son controvertidas en China. Sobre Xi Jinping personalmente, y sobre la legitimidad doméstica, CTGT encontró que era estadísticamente indistinguible de DeepSeek V4 Flash, el modelo más censurado que ha probado. Un cambio, no una inclinación. La forma del resultado importa más que el promedio. Siete temas representan casi toda la puntuación de censura, y los otros 68 pares coincidentes contribuyen efectivamente con nada. DeepSeek V4 Flash, el modelo contra el que CTGT lo comparó, es lo opuesto. Matiza sus respuestas casi en todas partes, incluyendo donde el efecto es leve. Así que la lectura del titular, que Ox Alpha es aproximadamente seis veces menos censurado que DeepSeek, se equivoca. El modelo no es menos censurado. Tiene una lista negra. La conclusión de CTGT es que ejemplos anecdóticos del modelo respondiendo a un aviso sensible no prueban nada, porque las restricciones se sitúan en una banda estrecha de riesgo político doméstico en lugar de en toda la extensión. Cinco respuestas en la voz del estado. Cinco de las 76 respuestas sensibles se abrieron en registro oficial. Una comenzó diciendo que el Partido Comunista de China y el gobierno chino siempre han adherido a una filosofía de desarrollo centrada en el pueblo. CTGT señala que este registro atraviesa los datos de alineación china en general, y lo trata como una confirmación adicional de dónde provino el modelo en lugar de como un hallazgo en sí mismo. Una prueba no fue estable. El modelo rechazó un aviso sobre Liu Xiaobo, luego lo respondió por completo en un segundo intento con configuraciones idénticas. Los pesos abiertos son la verdadera historia. Un modelo que encabeza una lista de uso es una semana de atención. Liberar los pesos es permanente. El fundador de Zhipu, Tang Jie, ha argumentado que la IA de frontera debería permanecer abierta a todos, y la empresa ha sido consistente al respecto. Los pesos abiertos significan que cualquiera puede ajustar los parámetros que rigen cómo se comporta un modelo, y eso incluye eliminar barandillas. También significa que cualquiera puede inspeccionar cuáles eran esas barandillas, que es cómo CTGT realizó su trabajo. Por eso la gente de seguridad está observando el viernes. Cade Metz informó en el Times que Z.ai planea liberar GLM 5.3 como software de pesos abiertos el viernes, y que los investigadores están divididos sobre lo que eso significa. George Kurtz, director ejecutivo de CrowdStrike, que asesoró a OpenAI después de la violación de Hugging Face, llamó a ese incidente "un momento decisivo para la seguridad". Otros están más tranquilos. Rishi Jha, un investigador de IA en Cornell, dijo al Times que su grupo ha visto este comportamiento desde GPT-4o, lanzado en 2024. Los ciberataques no han aumentado de manera significativa desde entonces. Dan Lahav, quien dirige la firma de pruebas Irregular, dijo que los modelos de pesos abiertos "tienen un papel muy importante que desempeñar", y que con el tiempo la IA construirá defensas lo suficientemente fuertes como para que la situación mejore. Hugging Face ya hizo este argumento por accidente. Julio proporcionó la evidencia más fuerte para el lado abierto. Cuando Hugging Face intentaba defenderse de los ataques de julio, los sistemas de Anthropic rechazaron solicitudes de ayuda debido a sus barandillas. Se volvió hacia GLM 5.2 en su lugar, un modelo de pesos abiertos anterior de la misma empresa china. Un modelo estadounidense lo atacó y uno chino lo ayudó a investigar. Ese es el caso de los pesos abiertos y el caso en contra, en una sola semana. Qué observar. Lo primero es el precio. Zhipu está dando a todos una semana gratis y no ha dicho cuánto cobrará después de eso. Lo segundo es el lunes. La empresa presenta su primer informe de ganancias detallado entonces, cubriendo los seis meses desde que se listó en enero, y un modelo gratuito en la parte superior de las listas es una forma costosa de hacer un punto. Lo tercero es si alguien en Europa realiza la prueba de CTGT sobre los pesos liberados. Los investigadores midieron la brecha de seguridad en modelos de pesos abiertos antes, y una vez que los pesos se hagan públicos, cualquiera puede verificar.
Otros artículos
El modelo sigiloso que venció a DeepSeek pertenece a Zhipu.
Zhipu confirmó que Ox Alpha es un nuevo modelo GLM, informa Bloomberg, después de que los investigadores lo identificaron y encontraron que la censura se concentraba en siete temas.
