Claude Opus 5 — новая флагманская модель Anthropic — на тесте ARC-AGI-3, который проверяет умение решать нестандартные задачи, набрала 30,2%, это почти вчетверо больше, чем у GPT-5.6 Sol. При этом токены Opus 5 стоят вдвое дешевле топовой модели Claude Fable 5: $5 за миллион входных и $25 за миллион выходных токенов против $10 и $50 у Fable 5. Anthropic ИИ явно отвечает на ценовое давление со стороны OpenAI и китайских конкурентов — причём отвечает агрессивно, выкатывая модель, которая почти не уступает флагману, но обходится в разы дешевле.

Сравнение Claude GPT: где новый лидер реально сильнее

Opus 5 стал моделью по умолчанию в Claude Max и самой мощной из доступных в Claude Pro — то есть большинство платящих пользователей получили апгрейд без доплаты. По собственным бенчмаркам Anthropic, модель ставит рекорды в двух ключевых для бизнеса категориях. На Frontier-Bench v0.1 (агентный кодинг в терминале) Opus 5 набирает 43,3%, обгоняя Fable 5 (33,7%), GPT-5.6 Sol (34,4%) и предыдущий Opus 4.8 (всего 21,1%). На тесте офисной работы GDPval-AA v2 Opus 5 тоже лидирует с Elo 1861 против 1747 у Fable 5 и 1736 у GPT-5.6 Sol. Но идеальным его не назвать: на бенчмарке агентного кодинга DeepSWE v1.1 первое место у GPT-5.6 Sol (72,7% против 68,8% у Opus 5), а в медицинских и юридических задачах по-прежнему сильнее Fable 5 и Mythos 5.

Нейросеть для кодинга и анализа данных: что это значит для вас

Если вы фрилансер или предприниматель, использующий нейросеть для кодинга, автоматизации или анализа данных, разница в цене — это не абстракция, а прямая экономия на счетах за API. Opus 5 умеет сам проверять и улучшать свою работу через итерации и на лету создавать себе инструменты через код, когда штатных возможностей не хватает. Для агентных задач — написание и отладка кода, работа с терминалом, многошаговые сценарии — это особенно ценно: модель не просто выдаёт ответ, а доводит задачу до рабочего результата.

ИИ-чат MyKreaTool — попробовать ChatGPT, Claude и Gemini в одном окне. Прямо на MyKreaTool.Открыть инструмент →

Дешевый ИИ — не всегда экономия: важный нюанс

Здесь стоит быть внимательным. У пользователей есть пять уровней «усилия» — low, medium, high, xhigh и max, — и Anthropic прямо советует активнее использовать low и medium: они дают хороший результат при куда меньшем расходе токенов и задержке, обгоняя даже старые модели Opus на тех же настройках. А вот режим max на двух бенчмарках (Frontier-Bench v0.1 и Artificial Analysis Coding Agent Index) неожиданно показал результат хуже, чем предпоследний уровень xhigh, — при том что стоит max дороже. Для кодинга и агентных сценариев Anthropic по-прежнему рекомендует начинать именно с xhigh, а не с максимума. Ещё один урок из истории: Opus 4.7 в итоге обходился на 30–40% дороже за задачу, чем Opus 4.6, при одинаковых базовых тарифах — из-за неэффективного расхода токенов. Похожая история недавно случилась с Claude Sonnet 5. Так что дешевый ИИ на бумаге может оказаться не таким дешёвым на практике — тестируйте эффективность на своих задачах, а не только смотрите на прайс-лист.

Fast Mode и что делать дальше

Для тех, кому важна скорость, а не цена, добавили Fast Mode — он ускоряет ответы в 2,5 раза, но и стоит вдвое дороже. Контекстное окно осталось прежним — 1 миллион токенов. Если вы уже используете Claude в работе, есть смысл прогнать привычные задачи через Opus 5 на medium или xhigh и сравнить качество и счёт с тем, что было раньше: судя по бенчмаркам Anthropic, для агентного кодинга и офисной аналитики апгрейд выглядит оправданным почти по умолчанию.