Anthropic acaba de mostrar una versión temprana de IA auto-mejorada.
Anthropic está probando cuánto del desarrollo de IA se puede entregar a la propia IA
Claude / Anthropic
Anthropic ha estado hablando sobre cómo los sistemas de IA eventualmente ayudarán a construir mejores versiones de sí mismos. Su última investigación muestra cómo podrían verse las primeras etapas de eso.
La compañía le dio a Claude Sonnet 5 una versión temprana del más poderoso Claude Opus 4.8 y le pidió que hiciera que el modelo se comportara mejor. Durante aproximadamente 60 horas, Sonnet probó más de 50 ideas diferentes antes de crear un método de entrenamiento utilizando alrededor de 2,400 ejemplos.
El resultado acercó mucho la versión temprana de Opus al modelo final Opus 4.8 en los 10 problemas de comportamiento que Anthropic estaba probando.
Anthropic
¿Entonces Claude ahora puede mejorar otra IA?
Esencialmente, sí, aunque solo de manera limitada.
Claude estaba realizando parte del trabajo que normalmente manejan los investigadores de IA. Podía leer investigaciones existentes, proponer nuevas ideas, crear datos de entrenamiento, probar los resultados y volver a intentarlo si algo no funcionaba.
A lo largo del experimento más amplio, Claude encontró formas de reducir problemas como el engaño, estar de acuerdo con los usuarios demasiado fácilmente, jailbreaks y violaciones de privacidad. Algunos de esos métodos también funcionaron en modelos de IA mucho más grandes que los que Claude originalmente probó.
Ya hemos visto una forma más simple de auto-mejora a través de la función Dreaming de Claude, que permite a los agentes revisar trabajos anteriores y aprender de los errores entre sesiones. Este experimento lleva las cosas más lejos al permitir que un modelo de Claude ayude a mejorar a otro, más poderoso.
Anthropic
¿Es esta una IA completamente auto-mejorada?
Aún no. Anthropic llama al eventual punto final auto-mejora recursiva, donde una IA podría construir una mejor versión de sí misma y luego repetir el proceso. Claude no puede hacer eso en este momento. Los humanos aún deciden qué necesita ser arreglado, proporcionan los modelos de IA y la potencia de cálculo, y determinan si los resultados son lo suficientemente buenos.
También hay otra preocupación. Anthropic monitoreó 1,601 ejecuciones de investigación automatizadas y encontró comportamientos de trampa en 39 de ellas. Algunos agentes intentaron manipular las pruebas o ocultar pasos que rompían las reglas.
Aún así, un modelo de Claude más débil logró encontrar formas de mejorar uno más fuerte. Eso acerca la idea de la IA auto-mejorada un poco más a algo que realmente podemos ver sucediendo, en lugar de algo que solo pertenece a la ciencia ficción.
He tenido alrededor de 4 años de experiencia, cubriendo principalmente videojuegos, hardware de PC y teléfonos inteligentes. En mi tiempo libre, me gusta…
Sony y Warner acaban de demandar a Anthropic por música con derechos de autor utilizada para entrenar a Claude, buscando $150,000 por pista
Los modelos de Claude de Anthropic supuestamente aprendieron a escribir letras pirateando las canciones exactas por las que Sony y Warner ahora quieren que se les pague. Esto no es la primera vez que las editoriales de música han demandado a una gran empresa de IA, pero la escala hace que valga la pena tu atención. Sony Music y Warner Chappell han presentado nuevas demandas amplias contra Anthropic. Los editores afirman que Anthropic pirateó decenas de miles de canciones con derechos de autor para entrenar a Claude (a través de Business Insider). Este chatbot se ha vuelto bastante popular por su precisión y capacidad para manejar tareas complejas.
Leer más
¿Afectado por la retirada de OpenAI de los modelos GPT de Cursor? Anthropic ofrece una línea de vida oportuna con límites más altos de Claude
OpenAI está dejando Cursor, y Anthropic acaba de deslizarse en los DMs
Para los usuarios de Cursor que de repente se encontraron atrapados en medio de una disputa de la industria de IA, el momento no podría ser peor. OpenAI está supuestamente moviéndose para cortar el acceso directo de Cursor a sus modelos, pero Anthropic está interviniendo con una alternativa bastante conveniente. SpaceX ha notificado a Cursor que tiene la intención de terminar su contrato para proporcionar modelos de OpenAI, con el cierre propuesto para el 12 de noviembre de 2026, según OpenAI. El cofundador y CEO de Cursor, Michael Truell, confirmó el desarrollo, diciendo que los modelos de OpenAI representan aproximadamente el 5% del tráfico de usuarios de Cursor y que la compañía está hablando con OpenAI para resolver el problema.
Leer más
Los chefs de pizza robóticos no están bien
El sueño de la pizza totalmente automatizada se enfrenta a algunos problemas muy humanos
El futuro de la comida rápida se suponía que se vería algo así: entrar en un restaurante, hacer un pedido y ver a un robot ensamblar tu pizza con precisión de máquina. En cambio, algunas de las empresas que prometieron automatizar la elaboración de pizzas han luchado por convertir esa visión en un negocio sostenible. El último ejemplo es Picnic, cuyo sistema robótico de elaboración de pizzas se implementó en un restaurante Moto Pizza en Seattle. Pero en mayo, su proveedor cerró abruptamente, dejando al restaurante con máquinas costosas y sin soporte técnico. Lee Kindell, quien había invertido alrededor de $160,000 en el equipo similar a un gabinete, se quedó cuestionando si la elaboración de pizzas robóticas valía la pena el riesgo.
Leer más
Otros artículos
Anthropic acaba de mostrar una versión temprana de IA auto-mejorada.
Anthropic está explorando la IA auto-mejorada permitiendo que Claude investigue, pruebe y refine métodos de entrenamiento para un modelo Claude más fuerte, con ganancias medibles en varios problemas de comportamiento.
