Клод Опус 5 здесь, и Anthropic утверждает, что он может соперничать с Fable 5 в некоторых задачах.
Основные улучшения в программной инженерии приблизили Opus 5 к ведущей модели Anthropic
Anthropic запустила Claude Opus 5, свою последнюю модель ИИ на переднем крае для кодирования, исследований, бизнес-работы и других сложных задач. Компания утверждает, что она обеспечивает значительный прирост производительности по сравнению с Claude Opus 4.8, сохраняя ту же цену API. Anthropic также утверждает, что она близка к Claude Fable 5 по некоторым тестам кодирования и использования компьютеров, при этом стоит гораздо меньше за задачу.
Opus 5 доступен во всех приложениях и API Claude. Теперь это модель по умолчанию для подписчиков Claude Max и самая мощная опция, включенная в Claude Pro.
Насколько близок Claude Opus 5 к Fable 5?
На CursorBench 3.2, который тестирует кодирующих агентов на реальных задачах разработки программного обеспечения, Opus 5 завершил тестирование с результатом в пределах 0,5% от лучшего результата Fable 5 при максимальных усилиях. Anthropic утверждает, что достиг этого результата за половину стоимости за задачу.
Claude Opus 5 OSWorld 2.0 бенчмарк Anthropic
Claude Opus 5 CursorBench бенчмарк Anthropic
Opus 5 также превзошел лучший результат Fable 5 на OSWorld 2.0 при стоимости чуть более трети. Бенчмарк измеряет, насколько хорошо ИИ-агенты могут управлять компьютерами и выполнять задачи в различных приложениях и файлах.
Для подписчиков Pro и стандартной команды Opus 5 может помочь заполнить пробел, оставленный Fable 5, который переходит на оплату по мере использования 20 июля.
Насколько он лучше, чем Opus 4.8?
Anthropic утверждает, что Opus 5 более чем вдвое превзошел результат Opus 4.8 на Frontier-Bench, который тестирует ИИ-агентов на сложных задачах программной инженерии. Он также завершил эти задачи с более низкой средней стоимостью.
Claude Opus 5 Frontier-Bench v0.1 бенчмарк Anthropic
Компания утверждает, что Opus 5 лучше проверяет свою работу, находит причины ошибок и продолжает выполнение сложных задач, вместо того чтобы останавливаться после быстрого исправления. В одном из примеров он нашел крайний случай, упущенный существующим патчем сообщества.
Эти результаты получены в результате собственных тестов Anthropic, поэтому производительность может варьироваться в зависимости от повседневных нагрузок. Claude Opus 5 стоит 5 долларов за миллион входных токенов и 25 долларов за миллион выходных токенов, без изменений по сравнению с Opus 4.8.
Другие статьи
Клод Опус 5 здесь, и Anthropic утверждает, что он может соперничать с Fable 5 в некоторых задачах.
Anthropic запустил Claude Opus 5 с значительными улучшениями в кодировании, с такой же ценой API, как у Opus 4.8, и производительностью, близкой к Fable 5 в некоторых тестах.
