Skip to content
ai agents

AI-агент Alibaba программировал 10 дней

Новая ИИ-модель с открытыми весами только что завершила 10-дневный марафон программирования, создав сложное приложение с нуля. Это не просто очередной чат-бот; это прямой вызов гигантам с закрытым исходным кодом и взгляд в будущее автономных разработчиков.

Sol Aguirre
AI-агент Alibaba программировал 10 дней

ИИ программировал 10 дней без перерыва

Alibaba расширила границы возможностей автономных ИИ-агентов. Их новый флагман, Qwen 3.8 Max, модель с открытыми весами и 2,4 триллионами параметров, недавно продемонстрировала беспрецедентный результат: она программировала более 10 дней подряд. Получив пустую папку, модель автономно создала «O my CLI», полноценного программного агента, который теперь доступен на GitHub, продемонстрировав свою способность к устойчивой и независимой разработке.

Эта прорывная демонстрация подчеркивает ключевую силу Qwen 3.8 Max: агентное программирование. Эта возможность, созданная для выполнения задач в течение нескольких дней, позволяет модели справляться с долгосрочными проектами, требующими сложного планирования, итеративного выполнения и постоянной самокоррекции без постоянного вмешательства человека. Она превосходно справляется с многодневными задачами программирования, используя контекстное окно в 1 миллион токенов для поддержания целостности проекта.

Дополнительно повышая свою автономность, Qwen 3.8 Max обладает встроенными мультимодальными возможностями. Ее интегрированная система зрения действует как непрерывный цикл обратной связи, позволяя модели «видеть» свой прогресс, анализировать результаты и динамически уточнять план. Это визуальное понимание позволяет осуществлять сложную самокоррекцию и адаптацию, что критически важно для навигации в итеративном процессе сложной разработки программного обеспечения, от первоначальной концепции до развертывания.

Внутри гиганта с 2,4 триллионами параметров

Qwen 3.8 Max от Alibaba — это монументальное достижение в архитектуре моделей: разреженная система Mixture-of-Experts (MoE) с 2,4 триллионами параметров. Эта конструкция разумно активирует только около 95 миллиардов параметров на токен во время вывода, достигая критического баланса между «сырой» вычислительной мощностью и операционной эффективностью. Модель также может похвастаться контекстным окном в 1 миллион токенов и мультимодальными возможностями, обрабатывая изображения, видео и текст для всестороннего понимания.

Этот релиз представляет собой глубокий стратегический сдвиг для Alibaba, впервые выпускающей веса для своей самой мощной модели уровня «Max». Этот агрессивный шаг в сторону «открытых весов» сигнализирует о серьезном вызове проприетарным ИИ-гигантам, фундаментально меняя конкурентную среду для передовых агентных систем. Это намекает на будущее, в котором возможности ИИ высшего уровня станут более доступными.

Несмотря на колоссальный масштаб, Alibaba обеспечила широкую доступность. Разработчики могут получить доступ к Qwen 3.8 Max через API по конкурентной цене: 2 доллара за миллион входных токенов и 6 долларов за миллион выходных токенов. Кроме того, для локальных экспериментов и разработки Alibaba выпустила меньший, более управляемый вариант с 27 миллиардами параметров, предназначенный для эффективной работы на персональных компьютерах. Такой двойной подход демократизирует доступ к продвинутым агентным возможностям ИИ.

Битва бенчмарков против GPT-5 и Claude

Qwen 3.8 Max не просто программирует автономно; она конкурентоспособна в бенчмарках по сравнению с ведущими моделями с закрытым исходным кодом. В агентных задачах она блистает, набирая 86,1 балла в OSWorld-Verified, превосходя Claude Fable 5 (около 85,0) и GPT-5.6 Sol (83,2). Она также лидирует в PaperBench для анализа исследований с результатом 93,0, опережая GPT-5.6 Sol (90,5) и Claude Fable 5 (88,8).

В Terminal-Bench 2.1 Qwen 3.8 Max набирает 86,6 балла, превосходя как Claude Opus 4.8, так и Claude Fable 5 (у обоих по 84,6), хотя и уступает GPT-5.6 Sol (88,8). Однако в задачах сложной инженерии на SWE-bench Pro она набирает 67,7 балла, уступая Claude Fable 5 (80,0) и Claude Opus 4.8 (69,2).

Эта система с 2,4 триллионами параметров представляет собой мощный, сбалансированный профиль, напрямую бросающий вызов долгому доминированию моделей с закрытым исходным кодом от Anthropic и OpenAI. Она особенно эффективна в агентных сценариях использования и воспроизведении исследований, позиционируя себя как надежное универсальное решение.

Хотя 10-дневная демонстрация создания «O my CLI» оказалась революционной, она проходила в контролируемой среде, что является важным нюансом для реального развертывания. Учитывая стоимость API: $2 за миллион входных токенов и $6 за миллион выходных токенов. Эта модель с открытыми весами может работать днями, предлагая убедительную и экономически эффективную альтернативу в развивающемся ландшафте ИИ.

Нравится статья? Получайте такие каждое утро на почту.

одно письмо в день · отписка в два клика · без сторонних трекеров

Конец доминированию моделей с закрытым исходным кодом?

Выпуск Alibaba модели Qwen 3.8 Max фундаментально меняет расстановку сил в мировом ИИ. Первоклассная MoE-модель с 2,4 триллионами параметров из Китая, теперь с открытыми весами, напрямую бросает вызов устоявшемуся доминированию западных технологических гигантов в области закрытого ПО. Это усиливает глобальную гонку за создание и распространение передовых ИИ, создавая более диверсифицированную конкурентную среду.

Важно отметить, что «открытые веса» не равнозначны полностью «открытому исходному коду». Alibaba предоставляет доступ к параметрам модели, что позволяет проводить широкие эксперименты и разработки. Однако потенциальные будущие лицензионные ограничения все еще могут регулировать коммерческое развертывание, определяя истинные границы ее доступности для корпоративных приложений.

Для широкой индустрии это демократизирует доступ к высокоэффективному агентному ИИ. Разработчики получают мощный новый инструмент, предназначенный для многодневного автономного программирования, что может значительно ускорить циклы инноваций. Тем не менее, широкое внедрение таких мощных моделей из различных геополитических источников также поднимает новые вопросы о коммерческом использовании, управлении данными и этических стандартах развертывания по всему миру. Граница развития ИИ теперь кажется определенно более открытой и более сложной.

Часто задаваемые вопросы

Что такое Qwen 3.8 Max?

Qwen 3.8 Max — это ИИ-модель с открытыми весами и 2,4 триллионами параметров от Alibaba, специально разработанная для длительных автономных задач, таких как агентное программирование.

Могу ли я запустить Qwen 3.8 Max на своем ноутбуке?

Нет, модель с 2,4 трлн параметров требует значительных вычислительных ресурсов. Однако Alibaba также выпустила вариант с 27 миллиардами параметров, Qwen 3.8-27B, предназначенный для запуска на персональных компьютерах.

Как Qwen 3.8 Max соотносится с моделями вроде GPT или Claude?

Она обладает высокой конкурентоспособностью. Qwen 3.8 Max превосходит такие модели, как Claude Fable 5 и GPT-5.6 Sol, в тестах на агентное компьютерное использование (OSWorld-Verified), но немного уступает в некоторых сложных тестах по разработке программного обеспечения (SWE-bench Pro).

Что создал Qwen 3.8 Max в своей 10-дневной демонстрации?

В своей самой впечатляющей демонстрации модели была предоставлена пустая папка, и в течение 10 дней она автономно создала «O my CLI» — полноценный рабочий программный агент, который теперь доступен на GitHub.

Found this useful? Share it.

For builders

Want Stork to write one of these about your product?

Send us a URL. We use the product, form a view, and publish what we actually think — in 8 languages, labeled Sponsored, with no copy approval on your side. That last part is what makes it worth quoting.

See how it works$500 · AI tools & software only