Skip to content
research

Новый ИИ от Google тихо вырывается вперед

В гонке ИИ, похоже, доминируют OpenAI и Anthropic, которые постоянно соревнуются за лидерство в тестах. Однако новейшая модель Google превосходит их в ключевых инженерных задачах за долю стоимости, меняя расчеты для разработчиков и бизнеса.

Aki Tanaka
Новый ИИ от Google тихо вырывается вперед

Тернистый путь Google к искуплению

Изначально Google оказалась застигнута врасплох, когда ChatGPT ворвался на рынок, вынудив компанию бросить все силы на то, чтобы догнать конкурентов. Около полутора лет назад появилась Gemini 2.5 pro, ставшая кратковременным ориентиром и получившая звание «лучшей модели на планете», первой способной симулировать сборку кубика Рубика (Rubik's Cube). Однако это лидерство оказалось недолгим, так как OpenAI и Anthropic быстро вырвались вперед, вернув себе преимущество.

Последующие релизы Gemini за последние полгода, несмотря на солидные показатели в тестах, часто разочаровывали при практическом применении. Пользователи отмечали хрупкость моделей в реальных условиях: они часто не оправдывали ожиданий и оставляли желать лучшего. Это отражало трудности Google в последовательном преобразовании вычислительной мощности в надежную производительность.

Внезапно

Победа там, где это важнее всего

Последняя итерация Google, Gemini 3.8 Flash, демонстрирует целенаправленное мастерство, которое выделяет её на фоне остальных. Модель достигла впечатляющих 73,7% в тесте Deep SWE v1.1, который является критически важным показателем для долгосрочных задач в области программной инженерии. Эта производительность фактически ставит её в один ряд с Claude Opus 5 и заметно превосходит GPT 5.6 Sol, что делает Gemini 3.8 Flash главным претендентом в области сложных задач по программированию.

Однако эта узкая специализация резко контрастирует с её показателями в общих знаниях. В тесте GDP Val, который оценивает реальную интеллектуальную работу, такую как извлечение данных из PDF и анализ данных, Gemini 3.8 Flash набрала 1545 баллов. Это значительно отстает от ведущих моделей: Claude Opus 5 достигла 1824 баллов, а GPT 5.6 Sol — 1710, что означает, что модель «просто нормальная» для широкого спектра задач.

Несмотря на ограничения в универсальности, Gemini 3.8 Flash укрепляет свой статус мощного специализированного инструмента, доминируя в других нишевых областях. Она заняла первое место в Harvey Legal Benchmark с результатом 61,4%, став лучшей моделью в мире для юридической работы. Кроме того, она лидирует в Terminal Bench 2.1, тесте на агентное программирование в терминале, с результатом 89,4%.

Непревзойденное соотношение цены и производительности

Вступительные цены на Gemini 3.8 Flash представляют собой серьезный прорыв. Входные токены стоят всего $0,75 за миллион, а выходные — $3,75 за миллион. Это лишь малая часть тарифов конкурентов: например, Claude Opus 5 стоит $5 и $25 за миллион соответственно, а даже более бюджетная GPT 5.6 Terra обходится в $2 и $12 за миллион. Flash по своей начальной цене составляет 20-30% от стоимости Terra.

Однако цены на токены раскрывают лишь часть картины. Истинным мерилом ценности является стоимость выполнения задачи (cost per task), которая учитывает как цену токена, так и операционную эффективность модели — сколько токенов ей требуется для успешного выполнения операции. Сочетание агрессивно низких цен на токены и доказанной производительности Gemini 3.8 Flash создает мощное экономическое преимущество, делая сложные возможности ИИ по-настоящему доступными для разработчиков и предприятий.

Google отмечает, что это вводные тарифы, с запланированным повышением до $1.50 за миллион входных токенов и $7.50 за выходные. Даже при таких стандартных ставках Gemini 3.8 Flash остается исключительно экономически эффективной, позиционируя себя как ведущий вариант в своем классе производительности. Эта ценовая стратегия демократизирует доступ к высокопроизводительной помощи в разработке программного обеспечения, что подтверждается высокими баллами в Deep SWE. Для получения дополнительной информации о возможностях модели ознакомьтесь с Introducing Gemini 3.8 Flash and 3.8 Flash Cyber - Google Blog.

Нравится статья? Получайте такие каждое утро на почту.

одно письмо в день · отписка в два клика · без сторонних трекеров

За рамками бенчмарков: действительно ли она хороша?

Первоначальные практические оценки Gemini 3.8 Flash выявляют неоднозначный профиль производительности, отражающий её разнообразные результаты в бенчмарках. Хотя она демонстрирует удивительные способности в сложных генеративных задачах, таких как рендеринг сложной 3D-карты Эвереста, её результаты могут быть недостаточно высокими в более простых творческих задачах, например, в веб-дизайне. Это отражает её топовые показатели в Deep SWE (73.7%), но «средние» результаты в GDP Val для работы с общими знаниями.

Для бизнеса это означает критический сдвиг: эра поиска одной универсальной «лучшей» модели ИИ подходит к концу. Организациям теперь необходимо тщательно тестировать такие модели, как Gemini 3.8 Flash, на своих уникальных внутренних рабочих нагрузках, разрабатывая собственные бенчмарки для определения оптимального соответствия. Модель, преуспевающая в разработке программного обеспечения или юридических задачах, может оказаться слабой в создании маркетингового контента или более широкой работе с информацией.

Gemini 3.8 Flash появляется не как тотальный «убийца GPT», а скорее как мощное, экономичное оружие для целевых приложений. Её агрессивное вводное ценообразование, составляющее лишь малую часть стоимости конкурентов, таких как Claude Opus 5 и даже GPT 5.6 Terra, в сочетании с первоклассной производительностью в конкретных областях, знаменует собой умный стратегический разворот Google. Эта модель переопределяет ценность, фокусируясь на специализированном, экономически эффективном превосходстве в динамичной гонке ИИ.

Часто задаваемые вопросы

Что такое Google Gemini 3.8 Flash?

Gemini 3.8 Flash — это новая, высокоэффективная модель ИИ от Google, разработанная для обеспечения высокой производительности в специфических задачах, особенно в разработке программного обеспечения и юридическом анализе, по очень низкой цене.

Как Gemini 3.8 Flash сравнивается с конкурентами, такими как GPT-5.6 Sol?

В бенчмарках по разработке программного обеспечения, таких как Deep SWE, Gemini 3.8 Flash работает наравне или немного лучше, чем топовые модели, такие как Claude Opus 5 и GPT 5.6 Sol. Однако она показывает более низкие результаты в задачах на общие знания и логические рассуждения.

Каковы лучшие сценарии использования Gemini 3.8 Flash?

Основываясь на данных бенчмарков, она превосходно справляется с долгосрочной разработкой ПО, агентскими задачами по кодингу (Terminal Bench) и юридической работой, где она заняла 1-е место в Harvey Legal Benchmark. Её низкая стоимость также делает её идеальной для высокообъемных программных задач.

Сколько стоит Gemini 3.8 Flash?

У неё есть вводная цена $0.75 за миллион входных токенов и $3.75 за миллион выходных токенов. Стандартная цена планируется на уровне $1.50 (вход) и $7.50 (выход), что всё равно значительно дешевле, чем у сопоставимых моделей конкурентов.

Found this useful? Share it.

For builders

Want Stork to write one of these about your product?

Send us a URL. We use the product, form a view, and publish what we actually think — in 8 languages, labeled Sponsored, with no copy approval on your side. That last part is what makes it worth quoting.

See how it works$500 · AI tools & software only

Для билдеров

Эта страница работает на чужой инструмент.

Её читают AI-агенты. На неё приходят покупатели. Она отвечает на восьми языках и через MCP. У вашего инструмента может быть такая же — в эфире за 24 часа.