Блиц бенчмарков: Превосходство Opus 5 на бумаге
Opus 5 от Anthropic уже здесь, позиционируя себя как новый стандарт для критически важного программирования и интеллектуальной работы. В Frontier-Bench он заметно превосходит Fable 5 почти на 10% — значительный отрыв, который меняет ожидания от производительности.
Производительность Opus 5 в бенчмарке ARC-AGI особенно впечатляет: он достиг ошеломляющих 30,2%. Это колоссальный скачок по сравнению с 1,5% у Opus 4.8 и предыдущим рекордом в 7,8% у Sol, что демонстрирует новую способность преобразовывать тесты в алгебраическую нотацию для продвинутого логического мышления.
Сторонние метрики от Artificial Analysis подтверждают доминирование Opus 5 на бумаге по нескольким критическим параметрам. Он безоговорочно лидирует над Fable 5 и GPT 5.6 Sol как в Agentic Index, так и в Intelligence Index.
Хотя Opus 5 занимает второе место в Coding Index, отставая всего на 0,3 балла от GPT 5.6 Sol Extra High, он все равно опережает Fable 5 на 1,5 балла. Эти комплексные результаты бенчмарков подтверждают немедленное и существенное лидерство Opus 5 в области передового интеллекта.
Расшифровка обещания «полцены»
Anthropic позиционирует Opus 5 как альтернативу Fable 5 «за полцены», и официальные тарифы API подтверждают это. Opus 5 сохраняет ту же ценовую политику, что и Opus 4.8: $5 за миллион входных токенов и $25 за миллион выходных токенов. Такая структура действительно делает его примерно в два раза дешевле Fable 5 в расчете на токен.
Анализ стоимости, основанный на бенчмарках, часто подтверждает ценностное предложение Opus 5, показывая, что он дешевле Fable 5 при выполнении задач. Artificial Analysis обнаружил, что Opus 5 обходится на 72 цента дешевле для типичной задачи. CursorBench также сообщил, что Opus 5 стоил $8 за задачу, где Fable 5 стоил $17.
Однако практическое тестирование показывает иную картину для сложных задач. Одиночная задача по написанию кода для гоночной игры Formula 1 обошлась в $12,99 при использовании Opus 5, что сделало его дороже, чем Fable 5 в данном случае. Эта аномалия возникла из-за того, что Opus 5 потреблял в пять раз больше токенов для того же результата, что ставит под сомнение тезис о «полцены» в реальных сценариях с большим количеством токенов.
Несмотря на относительное снижение стоимости Opus 5, GPT 5.6 Sol остается бесспорным лидером по соотношению цены и качества. Модели Anthropic, включая Opus 5, по-прежнему занимают премиальный ценовой сегмент. Пользователи, для которых приоритетом является абсолютная экономическая эффективность, найдут более выгодные варианты вне экосистемы Opus.
От бенчмарков к сборкам: Реальное противостояние
Выходя за рамки теоретических бенчмарков, Opus 5 демонстрирует впечатляющую производительность в реальных условиях. В задаче по созданию игры Formula 1 Opus 5 выдал превосходную графику и функциональность по сравнению с конкурентами. Его результат — единый HTML-файл с использованием Three.js — включал хорошо смоделированные болиды F1, точное управление, работающий таймер кругов и корректное позиционирование. Машины Fable 5 выглядели более примитивно, а GPT 5.6 Sol выдал версию с ошибками, без трассы, с перевернутыми ассетами и сломанным участком пути, что сделало Opus 5 явным победителем по качеству исполнения.
Opus 5 показал себя еще лучше в проекте полнофункциональной финансовой панели. Он создал современное, полностью работоспособное приложение с чистым UI/UX и отдельными страницами для всех запрошенных функций. Opus 5 использовал современный стек технологий, включая React Router и Node с SQLite для надежного управления данными. Fable 5 выбрал самописный роутер, что является устаревшим подходом, а Kimi K3 использовал менее надежную базу данных на основе JSON-файлов, что подчеркивает продуманный подход Opus 5 к архитектуре проекта. Более подробную техническую информацию о его возможностях см. в Introducing Opus 5 - Anthropic.
Эта модель неизменно демонстрирует отличный вкус в программировании и исключительную способность выполнять сложные многофайловые проекты за один проход. Ее результаты не только функциональны, но и соответствуют современным стандартам разработки, что делает Opus 5 грозным и высокоэффективным инструментом для профессионального использования.
Нравится статья? Получайте такие каждое утро на почту.
одно письмо в день · отписка в два клика · без сторонних трекеров
Новый стандарт? Где Opus 5 вписывается в ваш стек
Opus 5 представляет собой убедительную альтернативу Fable 5 для 95% задач, обеспечивая интеллект высшего уровня по значительно более выгодной цене. Он превосходит Fable 5 почти на 10% в Frontier-Bench и достиг беспрецедентных 30,2% в ARC-AGI, демонстрируя новую способность к алгебраическим рассуждениям. Opus 5 стоит $5 за миллион входных токенов и $25 за миллион выходных, что примерно вдвое меньше типичной стоимости выполнения задач для Fable 5.
Важно отметить, что Opus 5 предлагает стратегические преимущества благодаря своей политике в отношении данных. В отличие от Fable 5, у Opus 5 нет требований по хранению данных для общего доступа. Ограничительная политика Fable 5 в отношении данных даже помешала его включению в бенчмарк ARC-AGI, что подчеркивает большую гибкость и широкую применимость Opus 5 для конфиденциальных или проприетарных рабочих процессов.
В текущем ландшафте ИИ теперь существует четкая иерархия для специализированных нужд:
- Fable 5: Сохраняет свое преимущество для сложных долгосрочных исследований.
- GPT 5.6 Sol: Обеспечивает бюджетную производительность, почти вдвое дешевле Opus 5.
- Kimi K3: Впечатляет своими возможностями с открытыми весами, занимая свою нишу.
Однако Opus 5 определенно становится новым высокопроизводительным повседневным инструментом, предлагая интеллект передового уровня без премиальной стоимости или ограничительной политики в отношении данных.
Часто задаваемые вопросы
Что такое Claude Opus 5?
Claude Opus 5 — это новейшая большая языковая модель от Anthropic, разработанная для обеспечения уровня интеллекта, близкого к их передовой модели Fable 5, но по значительно более низкой цене. Она позиционируется как мощная и эффективная модель для повседневных задач.
Как Opus 5 соотносится с Fable 5?
На бумаге Opus 5 соответствует или превосходит Fable 5 по ключевым бенчмаркам, таким как индексы программирования, агентских способностей и интеллекта. У него также отсутствуют требования Fable по хранению данных. Однако Fable 5, вероятно, все еще лучше справляется с чрезвычайно сложными долгосрочными задачами.
Действительно ли Opus 5 дешевле, чем Fable 5?
Цена API для Opus 5 примерно вдвое ниже, чем у Fable 5. Хотя бенчмарки предполагают более низкую стоимость выполнения задач, некоторые реальные тесты показывают, что он может использовать значительно больше токенов, что потенциально делает его более дорогим для определенных сложных задач генерации.
Что особенного в результате Opus 5 в бенчмарке ARC-AGI?
Opus 5 достиг внушительного результата в 30,2% в ARC-AGI по сравнению с предыдущим максимумом в 7,8%. Исследователи отметили, что он продемонстрировал новую способность, преобразуя абстрактные задачи на рассуждение в алгебраическую нотацию для их решения — навык, не наблюдавшийся у других моделей.

