Skip to content

Tag

#Inference

9 статей

AI-чип от AMD — билет в один конец
Аналитика отрасли

AI-чип от AMD — билет в один конец

AMD только что приобрела AI-чип, который в 48 раз быстрее лучшего решения от NVIDIA, но у него есть фатальный недостаток. Эта ставка на неизменяемый, не подлежащий обновлению кремний может либо переопределить рынок AI-оборудования, либо стать самым дорогим пресс-папье в индустрии.

Читать статью
Этот инструмент запускает дата-центровые ИИ на вашем ПК
Инструменты ИИ

Этот инструмент запускает дата-центровые ИИ на вашем ПК

Запуск передовых ИИ-моделей с сотнями миллиардов параметров раньше был фантастикой для всех, у кого нет собственного дата-центра. Но новый движок с открытым исходным кодом меняет правила игры: он не требует больше VRAM, а использует её как CPU-кэш.

Читать статью
Ваш ПК не справляется с ИИ нового поколения
Аналитика отрасли

Ваш ПК не справляется с ИИ нового поколения

ИИ достигает скоростей, которые раньше казались невозможными, но есть подвох: ваше оборудование к этому не готово. Скрытое «узкое место» — это не сама модель ИИ, а машина, стоящая у вас на столе.

Читать статью
ИИ только что спроектировал собственный чип
Новости ИИ

ИИ только что спроектировал собственный чип

OpenAI только что представила свой первый кастомный ИИ-чип, разработанный с помощью собственных моделей. Этот шаг знаменует собой масштабный сдвиг сил, превращая ИИ-лаборатории в новых гигантов аппаратного обеспечения.

Читать статью
Jalapeño: Убийца Nvidia от OpenAI?
Новости ИИ

Jalapeño: Убийца Nvidia от OpenAI?

OpenAI только что представила свой первый специализированный чип для ИИ, Jalapeño, в смелом шаге, чтобы вырваться из-под контроля Nvidia. Этот специализированный процессор создан для одного: сделать вывод ИИ невероятно быстрым и дешевым, потенциально устраняя задержки, которые вы ненавидите в ChatGPT.

Читать статью
4-кратный трюк для уменьшения памяти LLM
Исследования ИИ

4-кратный трюк для уменьшения памяти LLM

Память вашего LLM — это бомба замедленного действия, которая убивает производительность и раздувает затраты. Новая техника под названием Speculative KV Coding может уменьшить ее в 4 раза без потери качества.

Читать статью
Теневой поглощение NVIDIA за $20 млрд
Аналитика отрасли

Теневой поглощение NVIDIA за $20 млрд

NVIDIA только что потратила 20 миллиардов долларов на своего крупнейшего конкурента, но это была не традиционная приобретение. Вот внутренняя история сделки, которая переопределяет будущее скорости ИИ и почему Дженсен Хуанг играет в шахматы, пока другие играют в шашки.

Читать статью