Opus 5 → Сравнение
Что выбрать внутри линейки
Opus 5 против Fable 5, Sonnet 5 и предыдущей Opus 4.8. Разница в цене — кратная, разница в качестве — единицы баллов. Разбираемся, где эта арифметика работает в вашу пользу.
Цифры на одном экране
Прежде чем спорить о нюансах, полезно увидеть четыре модели рядом. Индекс интеллекта — сводный агрегат бенчмарков от Artificial Analysis, оценка арены — человеческие предпочтения в слепых парных сравнениях. Метрики принципиально разные, и совпадать они не обязаны.
| Модель | Индекс | Арена | $/1M вход | $/1M выход |
|---|---|---|---|---|
| Fable 5 | 60 | 1508 ±6 | 10,00 | 50,00 |
| Opus 5 (max) | 61 | 1495 ±8 | 5,00 | 25,00 |
| Opus 4.8 (max) | 56 | 1473 ±5 | прайс не опубликован | |
| Sonnet 5 (max) | 53 | нет данных | 2,00 до 31.08 | 10,00 до 31.08 |
Opus 5 против Fable 5
Это главный вопрос линейки, потому что модели соседние, а цена отличается вдвое. Формально Fable 5 первая в общем зачёте арены — 1508 против 1495. Но в сводном индексе Artificial Analysis на максимальном усилии Opus 5 набирает 61 против 60, то есть выходит вперёд. Смешанная цена за миллион токенов при этом 2,03 доллара у Opus 5 против 2,75 у Fable 5.
Сама Anthropic формулирует так: на CursorBench 3.2 Opus 5 держится «в пределах 0,5 % от пика Fable 5 за половину цены», а на OSWorld 2.0 и вовсе «превосходит Fable 5 за треть стоимости». Абсолютных чисел вендор не даёт, так что это заявление производителя, а не измерение.
Разница между старшей и топовой моделью — один балл сводного индекса. Разница в прайсе — ровно вдвое.
Практический вывод: Fable 5 имеет смысл только там, где вы упёрлись в потолок Opus 5 и это подтверждается вашими же замерами. Во всех остальных случаях переплата не окупается — тем более что Opus 5 позволяет докупить качество, подняв усилие, а не переходя на другую модель.
Opus 5 против Sonnet 5
Здесь разрыв в качестве уже честный: 61 против 53 балла сводного индекса. Sonnet 5 быстрее (75 токенов в секунду против 53) и до конца августа 2026 года идёт по промо-прайсу 2 и 10 долларов, после чего дорожает до 3 и 15. Anthropic описывает Sonnet 5 как модель, которая «приближается к уровню Opus 4.8 при меньшей цене» — то есть к предыдущему, а не к текущему старшему поколению.
Правило простое: если задача разбивается на короткие независимые шаги — классификация, извлечение полей, черновые ответы, суммаризация — берите Sonnet 5. Если это длинная агентская цепочка, где ошибка на десятом шаге обесценивает предыдущие девять, разница в восемь баллов индекса превращается в разницу между «работает» и «не работает».
Opus 5 против Opus 4.8
Обновление внутри одного семейства даёт 61 балл против 56 на максимуме и, по заявлению Anthropic, более чем двукратный результат на Frontier-Bench v0.1 при меньшей цене за задачу. Есть и внешнее свидетельство прожорливости предыдущей версии: xAI, продвигая свой Grok 4.5, опубликовала замер, где Opus 4.8 тратит 67 020 выходных токенов на задачу против 15 954 у их модели. Именно эту проблему уровни усилия и решают.
Переход с 4.8 обычно ломает подобранные промпты: 4.8 думала ровно столько, сколько считала нужной сама, у Opus 5 бюджет размышления задаёте вы. Один и тот же промпт на низком усилии может дать ответ короче и суше, чем вы привыкли, — это настройка, а не деградация.
Уровни усилия ломают привычное сравнение
Обычный вопрос «какая модель лучше» с появлением шкалы усилия стал некорректным. Opus 5 на уровне medium даёт 56 баллов при смешанной цене 62 цента за миллион — это ровно уровень Opus 4.8 на максимуме, который стоил 1,80. А Opus 5 на low даёт 51 балл за 36 центов и всё равно обходит Gemini 3.1 Pro Preview.
То есть сравнивать теперь надо не модели, а точки на кривой «качество — цена». Разумная тактика: взять самый низкий уровень, на котором ваша задача ещё решается, и поднимать только при явном провале. Подробности механики — в обзоре модели, цены за токены — в разделе API.
Короткие ответы
- Fable 5 или Opus 5 — что лучше?
- Fable 5 сильнее: первое место в общем зачёте arena.ai с оценкой 1508 против 1495 у Opus 5. Но стоит она ровно вдвое дороже, а сама Anthropic заявляет, что на CursorBench 3.2 Opus 5 держится в пределах 0,5 % от пика Fable 5.
- Sonnet 5 или Opus 5?
- Sonnet 5 дешевле в 2,5 раза по промо-прайсу и по индексу Artificial Analysis на максимуме даёт 53 балла против 61 у Opus 5. Для типовых задач разницы часто не видно, для длинных агентских цепочек — видно сразу.
- Стоит ли переходить с Opus 4.8 на Opus 5?
- По цифрам да: 61 балл против 56 в индексе Artificial Analysis на максимуме и появившиеся уровни усилия, которых у 4.8 нет. Но проверьте промпты — модель с другим режимом рассуждения может вести себя иначе на ваших сценариях.
- Какая модель Claude самая сильная?
- Зависит от метрики. В общем зачёте arena.ai первая — Fable 5 с оценкой 1508 против 1495 у Opus 5. В сводном индексе Artificial Analysis наоборот: Opus 5 на максимальном усилии даёт 61 балл против 60 у Fable 5. Арена меряет предпочтения людей, индекс — результаты бенчмарков.
- Какую модель Claude брать для кода?
- Рутину — переименования, правки по образцу, типовые тесты — дешевле отдавать Sonnet 5: он вдвое дешевле и заметно быстрее, около 75 токенов в секунду против 53. Разбор незнакомой кодовой базы и рефакторинг с сохранением поведения логичнее оставить Opus 5.
- Claude или ChatGPT — что лучше?
- Прямого сравнения здесь нет: сайт разбирает линейку Anthropic. Ориентир по независимым данным на 27 июля 2026: верхние шесть строк общего текстового зачёта arena.ai занимали модели Anthropic подряд.
Дальше по сайту
- Версии ClaudeВся линейка и история Opus от 4.5 до 5
- API AnthropicЦены за токены, ключи и кабинет
- Claude CodeГде эта разница в качестве видна лучше всего