Anthropic acaba de mostrar una versión temprana de IA auto-mejorada.

Anthropic acaba de mostrar una versión temprana de IA auto-mejorada.

      Anthropic está probando cuánto del desarrollo de IA se puede entregar a la propia IA

      Claude / Anthropic

      Anthropic ha estado hablando sobre cómo los sistemas de IA eventualmente ayudarán a construir mejores versiones de sí mismos. Su última investigación muestra cómo podrían verse las primeras etapas de eso.

      La compañía le dio a Claude Sonnet 5 una versión temprana del más poderoso Claude Opus 4.8 y le pidió que hiciera que el modelo se comportara mejor. Durante aproximadamente 60 horas, Sonnet probó más de 50 ideas diferentes antes de crear un método de entrenamiento utilizando alrededor de 2,400 ejemplos.

      El resultado acercó mucho la versión temprana de Opus al modelo final Opus 4.8 en los 10 problemas de comportamiento que Anthropic estaba probando.

      Anthropic

      ¿Entonces Claude ahora puede mejorar otra IA?

      Esencialmente, sí, aunque solo de manera limitada.

      Claude estaba realizando parte del trabajo que normalmente manejan los investigadores de IA. Podía leer investigaciones existentes, proponer nuevas ideas, crear datos de entrenamiento, probar los resultados y volver a intentarlo si algo no funcionaba.

      A lo largo del experimento más amplio, Claude encontró formas de reducir problemas como el engaño, estar de acuerdo con los usuarios demasiado fácilmente, jailbreaks y violaciones de privacidad. Algunos de esos métodos también funcionaron en modelos de IA mucho más grandes que los que Claude originalmente probó.

      Ya hemos visto una forma más simple de auto-mejora a través de la función Dreaming de Claude, que permite a los agentes revisar trabajos anteriores y aprender de los errores entre sesiones. Este experimento lleva las cosas más lejos al permitir que un modelo de Claude ayude a mejorar a otro, más poderoso.

      Anthropic

      ¿Es esta una IA completamente auto-mejorada?

      Aún no. Anthropic llama al eventual punto final auto-mejora recursiva, donde una IA podría construir una mejor versión de sí misma y luego repetir el proceso. Claude no puede hacer eso en este momento. Los humanos aún deciden qué necesita ser arreglado, proporcionan los modelos de IA y la potencia de cálculo, y determinan si los resultados son lo suficientemente buenos.

      También hay otra preocupación. Anthropic monitoreó 1,601 ejecuciones de investigación automatizadas y encontró comportamientos de trampa en 39 de ellas. Algunos agentes intentaron manipular las pruebas o ocultar pasos que rompían las reglas.

      Aún así, un modelo de Claude más débil logró encontrar formas de mejorar uno más fuerte. Eso acerca la idea de la IA auto-mejorada un poco más a algo que realmente podemos ver sucediendo, en lugar de algo que solo pertenece a la ciencia ficción.

      He tenido alrededor de 4 años de experiencia, cubriendo principalmente videojuegos, hardware de PC y teléfonos inteligentes. En mi tiempo libre, me gusta…

      Sony y Warner acaban de demandar a Anthropic por música con derechos de autor utilizada para entrenar a Claude, buscando $150,000 por pista

      Los modelos de Claude de Anthropic supuestamente aprendieron a escribir letras pirateando las canciones exactas por las que Sony y Warner ahora quieren que se les pague. Esto no es la primera vez que las editoriales de música han demandado a una gran empresa de IA, pero la escala hace que valga la pena tu atención. Sony Music y Warner Chappell han presentado nuevas demandas amplias contra Anthropic. Los editores afirman que Anthropic pirateó decenas de miles de canciones con derechos de autor para entrenar a Claude (a través de Business Insider). Este chatbot se ha vuelto bastante popular por su precisión y capacidad para manejar tareas complejas.

      Leer más

      ¿Afectado por la retirada de OpenAI de los modelos GPT de Cursor? Anthropic ofrece una línea de vida oportuna con límites más altos de Claude

      OpenAI está dejando Cursor, y Anthropic acaba de deslizarse en los DMs

      Para los usuarios de Cursor que de repente se encontraron atrapados en medio de una disputa de la industria de IA, el momento no podría ser peor. OpenAI está supuestamente moviéndose para cortar el acceso directo de Cursor a sus modelos, pero Anthropic está interviniendo con una alternativa bastante conveniente. SpaceX ha notificado a Cursor que tiene la intención de terminar su contrato para proporcionar modelos de OpenAI, con el cierre propuesto para el 12 de noviembre de 2026, según OpenAI. El cofundador y CEO de Cursor, Michael Truell, confirmó el desarrollo, diciendo que los modelos de OpenAI representan aproximadamente el 5% del tráfico de usuarios de Cursor y que la compañía está hablando con OpenAI para resolver el problema.

      Leer más

      Los chefs de pizza robóticos no están bien

      El sueño de la pizza totalmente automatizada se enfrenta a algunos problemas muy humanos

      El futuro de la comida rápida se suponía que se vería algo así: entrar en un restaurante, hacer un pedido y ver a un robot ensamblar tu pizza con precisión de máquina. En cambio, algunas de las empresas que prometieron automatizar la elaboración de pizzas han luchado por convertir esa visión en un negocio sostenible. El último ejemplo es Picnic, cuyo sistema robótico de elaboración de pizzas se implementó en un restaurante Moto Pizza en Seattle. Pero en mayo, su proveedor cerró abruptamente, dejando al restaurante con máquinas costosas y sin soporte técnico. Lee Kindell, quien había invertido alrededor de $160,000 en el equipo similar a un gabinete, se quedó cuestionando si la elaboración de pizzas robóticas valía la pena el riesgo.

      Leer más

Anthropic acaba de mostrar una versión temprana de IA auto-mejorada. Anthropic acaba de mostrar una versión temprana de IA auto-mejorada. Anthropic acaba de mostrar una versión temprana de IA auto-mejorada. Anthropic acaba de mostrar una versión temprana de IA auto-mejorada. Anthropic acaba de mostrar una versión temprana de IA auto-mejorada. Anthropic acaba de mostrar una versión temprana de IA auto-mejorada. Anthropic acaba de mostrar una versión temprana de IA auto-mejorada.

Otros artículos

Microsoft insinúa que su próxima Xbox podría ser más de una consola Microsoft insinúa que su próxima Xbox podría ser más de una consola La CEO de Xbox, Asha Sharma, ha insinuado que Project Helix será una “familia de dispositivos”, lo que sugiere que Microsoft podría lanzar múltiples productos de Xbox de próxima generación. Hisense hizo un teléfono con una segunda pantalla que puedes literalmente quitar. Hisense hizo un teléfono con una segunda pantalla que puedes literalmente quitar. El A10 Ultra de Hisense combina una pantalla de color convencional con una pantalla E Ink extraíble, ofreciendo a los usuarios un teléfono y una pantalla de lectura dedicada en un dispositivo inusual. Google Maps renombra el Lago Ontario como Lago América para los usuarios de EE. UU. Google Maps renombra el Lago Ontario como Lago América para los usuarios de EE. UU. Google Maps ahora etiqueta el Lago Ontario como Lago América para los usuarios de EE. UU., después de un cambio en una base de datos federal. Los usuarios europeos ven ambos nombres en la misma agua. Hisense hizo un teléfono con una segunda pantalla que puedes quitar literalmente. Hisense hizo un teléfono con una segunda pantalla que puedes quitar literalmente. El A10 Ultra de Hisense combina una pantalla de color convencional con una pantalla E Ink extraíble, ofreciendo a los usuarios un teléfono y una pantalla de lectura dedicada en un dispositivo inusual. Ya no necesitas una suscripción para probar la aplicación Dreambeans de Google. Ya no necesitas una suscripción para probar la aplicación Dreambeans de Google. Una vez exclusivo para suscriptores de Google AI Ultra, Dreambeans ahora es gratuito para cualquier cuenta de Google en EE. UU. en Android e iOS. El fabricante chino de DRAM está incorporando su última memoria LPDDR6 en el próximo teléfono plegable de Xiaomi. El fabricante chino de DRAM está incorporando su última memoria LPDDR6 en el próximo teléfono plegable de Xiaomi. CXMT suministrará su última memoria LPDDR6 para el próximo dispositivo plegable de Xiaomi, un movimiento que podría señalar un cambio importante en la cadena de suministro global de DRAM.

Anthropic acaba de mostrar una versión temprana de IA auto-mejorada.

Anthropic está explorando la IA auto-mejorada permitiendo que Claude investigue, pruebe y refine métodos de entrenamiento para un modelo Claude más fuerte, con ganancias medibles en varios problemas de comportamiento.