Skip to content
industry insights

AI-чип от AMD — билет в один конец

AMD только что приобрела AI-чип, который в 48 раз быстрее лучшего решения от NVIDIA, но у него есть фатальный недостаток. Эта ставка на неизменяемый, не подлежащий обновлению кремний может либо переопределить рынок AI-оборудования, либо стать самым дорогим пресс-папье в индустрии.

Cassidy Wolfe
AI-чип от AMD — билет в один конец

Встречайте чип, который невозможно обновить

Приобретение компанией AMD стартапа Taalas, запланированное на 4 квартал 2026 года, знаменует собой радикальный отход от традиционных решений в области оборудования для AI-инференса. Этот базирующийся в Торонто стартап стал пионером в создании Model-Specific Integrated Circuits (MSICs) — философии проектирования, которая фундаментально меняет взаимодействие AI-моделей с кремнием. Это не просто новый чип, это совершенно новая парадигма ускорения AI.

Taalas буквально вытравливает веса AI-модели непосредственно в кремний, превращая их из программно-определяемых данных в физическую разводку самого чипа. Эти веса становятся неизменной частью оборудования, жестко закодированной в устройстве. Такой подход устраняет традиционную программную гибкость, характерную для большинства вычислительных систем, делая модель неотъемлемым компонентом железа.

Обычные GPU, такие как решения от NVIDIA, работают путем загрузки весов AI-моделей из внешней памяти в свои вычислительные блоки для каждой задачи инференса. Эта постоянная передача данных создает значительное «узкое место» производительности, известное как «memory wall» (стена памяти), что ограничивает скорость и эффективность AI-инференса. Taalas полностью обходит это ограничение, обещая беспрецедентную пропускную способность для конкретных моделей. Их тестовый чип HC1, изготовленный по 6-нм техпроцессу TSMC, обрабатывал модель Meta Llama 3.1 8B со скоростью примерно 17 000 токенов в секунду на пользователя, что в 48 раз быстрее, чем GPU от NVIDIA.

В 48 раз быстрее NVIDIA — но какой ценой?

Model-Specific Integrated Circuits (MSICs) от Taalas обещают производительность инференса, которая звучит почти мифически. Их тестовый чип HC1, изготовленный по 6-нм техпроцессу TSMC, обрабатывал Meta Llama 3.1 8B со скоростью около 17 000 токенов в секунду на пользователя. Это приводит к ошеломляющим заявлениям: до 48 раз быстрее, чем NVIDIA B200, или даже в 73 раза быстрее, чем NVIDIA H200, при потреблении всего одной десятой части энергии. Чип HC1, объединяющий 53 миллиарда транзисторов на кристалле площадью 815 мм², потребляет около 200 Вт, демонстрируя поразительную эффективность.

Но есть подвох, и довольно существенный. Taalas достигает такой скорости, буквально вытравливая веса AI-модели в сам кремний. Веса — это не данные, загружаемые в память; они являются физической разводкой чипа. Это делает модель неизменной после производства — вы просто не можете ее обновить.

Эта негибкость сопровождается высокой ценой и значительным временем ожидания. Новый набор фотошаблонов для обновления встроенной модели стоит около 1,5 миллионов долларов. Более того, даже при заявлении Taalas о том, что модификации требуют только два металлических слоя, цикл обновления все равно занимает около двух месяцев на мощностях TSMC. В мире AI, где модели развиваются еженедельно, это стратегическая ставка эпических масштабов, рискующая превратить пиковую производительность в мгновенное устаревание.

Почему AMD делает ставку на устаревание

Приобретение Taalas компанией AMD — это не осторожный шаг, а громкое заявление о выходе на рынок специализированного AI-инференса. Компания, о покупке которой AMD договорилась 6 августа 2026 года, делает ставку на то, что для конкретных стабильных AI-моделей прорывная эффективность будет решительно перевешивать гибкость GPU общего назначения. Этот стратегический поворот направлен на захват прибыльного сегмента, где приоритет отдается «сырой» производительности, а не адаптивности.

Это видение воплощается в жизнь благодаря дезагрегированному выводу (disaggregated inference). Model-Specific Integrated Circuits (MSIC) от Taalas, в которые аппаратно «зашиты» веса моделей, будут исключительно заниматься молниеносной генерацией токенов — обеспечивая до 17 000 токенов в секунду для таких моделей, как Llama 3.1 8B, на их чипе HC1. Мощные графические процессоры AMD, в свою очередь, могут взять на себя более ресурсоемкий процесс предварительного заполнения промптов (prompt prefill), создавая симбиотический и оптимизированный конвейер.

Столь смелый шаг — это прямой вызов доминированию NVIDIA, утверждение того, что для определенных высоконагруженных приложений специализированный чип превосходит универсальный. AMD подсчитала, что производительность, в 48 раз превышающая показатели NVIDIA B200, или в 73 раза выше, чем у H200, при энергопотреблении в одну десятую, оправдывает риск устаревания. Несмотря на стремительную эволюцию моделей, Taalas утверждает, что для обновления требуется модификация всего двух металлических слоев, что сокращает цикл до примерно двух месяцев. Этот специализированный подход дополняет более широкую стратегию AMD по приобретению комплементарных технологий, что подтверждается сделкой AMD to Acquire Xilinx, Creating the Industry's High-Performance and Adaptive Computing Leader, которая расширила их возможности в области адаптивных вычислений.

Нравится статья? Получайте такие каждое утро на почту.

одно письмо в день · отписка в два клика · без сторонних трекеров

Гонка против срока годности ИИ

Приобретение Taalas компанией AMD несет в себе серьезный и немедленный риск. Модель, которую Groq «вытравил» в кремнии — ключевая демонстрация технологии Taalas, — была признана устаревшей в тот же месяц, когда AMD завершила покупку. Это не теоретические опасения по поводу будущего устаревания моделей (model deprecation), а живой пример того, как чип, рассчитанный на годы работы, может обесцениться за считанные недели.

Этот инцидент высвечивает фундаментальное противоречие: бешеный темп инноваций в индустрии ИИ вступает в прямой конфликт с неизменностью производства кремниевых чипов. Новый набор фотошаблонов для обновления модели стоит около 1,5 миллионов долларов, даже с учетом заявленного Taalas двухмесячного цикла замены всего двух металлических слоев. Хотя адаптеры для дообучения LoRA обеспечивают небольшую гибкость за счет перезаписываемой SRAM, кардинальные архитектурные изменения невозможны без создания совершенно нового оборудования.

AMD делает колоссальную ставку на долговечность моделей. Компания рассчитывает, что некоторые модели ИИ эволюционируют в стабильные, прикладные функции, достаточно фундаментальные для того, чтобы их можно было «зашить» в Model-Specific Integrated Circuit (MSIC). Если некоторые модели достигнут такой стабильности, предлагая прорывную эффективность в 17 000 токенов в секунду при доле энергопотребления NVIDIA B200, то этот путь в один конец может оказаться прибыльным. В противном случае AMD рискует приобрести технологию, созданную для срока годности, который наступит слишком быстро.

Часто задаваемые вопросы

Что такое Model-Specific Integrated Circuit (MSIC)?

MSIC, подобный чипу от Taalas, — это ИИ-чип, в котором веса модели физически вытравлены в кремниевой схеме, а не хранятся в памяти. Это делает его постоянным ускорителем для одной конкретной модели.

Почему чип Taalas работает намного быстрее, чем GPU?

Благодаря аппаратной реализации весов модели устраняется «узкое место» в виде «стены памяти» (memory wall). Данные не нужно постоянно загружать из памяти в процессор, что приводит к колоссальному приросту скорости и эффективности для вывода ИИ.

В чем главный недостаток технологии Taalas?

Чип является неизменяемым. Если модель ИИ, для которой он создан, устареет или потребует критического обновления, вы не сможете внести исправления. Вам придется производить совершенно новый кремний, что дорого и долго.

Можно ли как-то настроить чип Taalas?

Да, но лишь ограниченно. Чип HC1 поддерживает легкое дообучение через адаптеры LoRA с помощью небольшой области перезаписываемой SRAM, но базовая модель остается неизменной.

Found this useful? Share it.

For builders

Want Stork to write one of these about your product?

Send us a URL. We use the product, form a view, and publish what we actually think — in 8 languages, labeled Sponsored, with no copy approval on your side. That last part is what makes it worth quoting.

See how it works$500 · AI tools & software only

Для билдеров

Эта страница работает на чужой инструмент.

Её читают AI-агенты. На неё приходят покупатели. Она отвечает на восьми языках и через MCP. У вашего инструмента может быть такая же — в эфире за 24 часа.