Anthropic представила Claude Opus 5: новая модель почти приблизилась к уровню Fable 5, но стоит вдвое дешевле
"Узнайте о Claude Opus 5 от Anthropic — новой AI модели, почти достигнувшей уровня Fable 5, но по цене вдвое ниже. Читайте наш обзор!"
Краткий пересказ от QRazy ИИ
- Anthropic представила Claude Opus 5 — мощную модель ИИ для программирования и научных исследований.
- Новая модель показывает улучшенные результаты в бенчмарках, превышая предыдущие разработки компании и конкурентов.
- Важные улучшения в способностях к выполнению долгосрочных задач делают Opus 5 идеальным решением для комплексной автоматизации.
Anthropic выпустила новую флагманскую модель искусственного интеллекта Claude Opus 5, которая ориентирована на сложное программирование, автономных ИИ-агентов и задачи, требующие глубокого анализа. Компания заявляет, что новая система по возможностям приблизилась к более мощной Claude Fable 5, сохранив при этом значительно меньшую стоимость.
Новая модель для сложных задач и автономной работы
Рынок продвинутых ИИ-моделей становится всё более конкурентным: Anthropic одновременно сталкивается с развитием решений от OpenAI и быстрым ростом китайских разработок. На этом фоне компания представила Claude Opus 5 — модель, которую она позиционирует как новый уровень для профессиональной работы с кодом, научных исследований и сложных интеллектуальных задач.
Claude Opus 5 пришла на смену Opus 4.8 и сохранила прежнюю стоимость API-доступа. При этом модель стала основной для подписчиков Claude Max и самой мощной версией, доступной пользователям Claude Pro.
По данным Anthropic, в ряде популярных тестов Opus 5 смогла превзойти не только предыдущие модели компании, но и конкурирующие решения, включая Fable 5 и GPT-5.6 Sol.
Результаты тестов показывают заметный прирост возможностей
Anthropic опубликовала результаты нескольких бенчмарков, которые должны показать преимущества новой модели в реальных сценариях использования.
- Frontier-Bench v0.1: Claude Opus 5 получила результат 43,3%, установив новый рекорд среди протестированных моделей. Это более чем в два раза выше показателя Opus 4.8, при этом стоимость выполнения задач стала ниже.
- CursorBench 3.2: при максимальном уровне вычислительных усилий Opus 5 отстала от пикового результата Fable 5 всего на 0,5%, хотя её использование обходится примерно в два раза дешевле.
- ARC-AGI 3: в тесте на способность решать новые, ранее неизвестные задачи модель показала результат примерно в три раза выше, чем ближайший конкурент.
- Zapier AutomationBench: Opus 5 продемонстрировала примерно в 1,5 раза больше успешных выполнений задач по сравнению со следующей лучшей моделью при одинаковой стоимости.
- OSWorld 2.0: новая модель смогла превзойти Fable 5, затрачивая при этом чуть больше трети её стоимости.
| Opus 5 | Fable 5 | Opus 4.8 | GPT-5.6 Sol | |
|---|---|---|---|---|
| Agentic terminal coding Frontier-Bench v0.1 | 43.3% | 33.7% | 21.1% | 34.4% |
| Knowledge work GDPval-AA v2 | 1861 | 1747 | 1593 | 1736 |
| Novel problem-solving ARC-AGI-3 | 30.2% | — | 1.5% | 7.8% |
| Agentic search BrowseComp | 90.8% | 87.4% | 84.3% | 90.4% |
| Multidisciplinary reasoning Humanity’s Last Exam |
56.3% no tools 64.7% with tools | 56.5% no tools 63.9% with tools |
49.8% no tools 57.9% with tools | — |
| Computer use OSWorld 2.0 | 70.6% | 66.1% | 55.7% | 62.6% |
| Business workflows AutomationBench | 26.0% | 17.4% | 17.0% | 18.1% |
| Biology BioMistryBench | 49.4% hard 90.1% human solved |
46.5% hard 89.0% human solved |
42.4% hard 88.5% human solved | — |
Модель стала лучше работать с долгими задачами
Anthropic отдельно отмечает улучшения в сценариях, где ИИ должен долго выполнять последовательность действий. По словам компании, Claude Opus 5 лучше проверяет собственную работу, ищет настоящие причины ошибок, а не только исправляет внешние проявления проблем.
Модель также чаще возвращается к уже выполненным шагам и дорабатывает результат до тех пор, пока задача действительно не будет решена. Это особенно важно для программирования, автоматизации процессов и работы с большими проектами, где одного ответа недостаточно.
При этом Anthropic признаёт, что Opus 5 не является лидером абсолютно во всех направлениях. В некоторых задачах, связанных с наступательной кибербезопасностью и отдельными исследованиями в области биологии, модель всё ещё уступает Mythos 5.
Разработчики получили больше свободы при работе с инструментами
Вместе с выпуском новой модели Anthropic добавила ещё одно изменение для разработчиков. Теперь они могут менять набор инструментов, доступных Claude внутри текущего диалога, без необходимости сбрасывать или заново создавать кэш промпта.
Это упрощает создание сложных агентных систем, где набор доступных функций может меняться в зависимости от текущей задачи.
Стоимость Claude Opus 5 осталась на прежнем уровне
Claude Opus 5 уже доступна во всех продуктах Anthropic и через API под названием claude-opus-5. Цена использования модели составляет $5 за миллион входных токенов и $25 за миллион выходных токенов.
Для пользователей, которым важна скорость работы, компания также запустила режим Fast. Он обеспечивает примерно в 2,5 раза более быструю обработку запросов, но стоит в два раза дороже стандартного тарифа.
Выход Claude Opus 5 показывает, что борьба за лидерство среди ИИ-моделей всё больше смещается не только в сторону максимальной мощности, но и в сторону эффективности. Возможность получить результат уровня более дорогой модели за меньшие деньги становится одним из главных факторов конкуренции между разработчиками искусственного интеллекта.