AMD официально решила купить канадский стартап Taalas — команду инженеров, которая в буквальном смысле впаивает веса нейросети в кремниевый кристалл. Сделку объявили 6 августа, сумму не раскрыли: стороны говорят лишь о «стандартных условиях закрытия» и регуляторных согласованиях.
Обычный GPU на каждом шаге вычислений тащит миллиарды параметров модели из памяти к вычислительным блокам — и это главный тормоз при инференсе больших языковых моделей. Taalas решает проблему радикально: чип просто не хранит веса отдельно, они «выжжены» прямо в его транзисторах. Демонстрационный чип HC1 — кристалл площадью 815 квадратных миллиметров с 53 миллиардами транзисторов, выпущенный по 6-нанометровому техпроцессу TSMC — по собственным замерам компании выдаёт до 17 000 токенов в секунду на пользователя при работе с Llama 3.1 8B, обгоняя в этом тесте Nvidia H200 и B200, а также чипы Groq, SambaNova и Cerebras.
У подхода есть цена — гибкость. Стойку, собранную под одну модель, нельзя просто перенастроить под другую: чип и есть модель. В Taalas утверждают, что для смены весов достаточно поменять два слоя фотошаблона, а не переделывать всю архитектуру — это удешевляет итерации, но каждое обновление всё равно требует нового цикла производства. Такая экономика имеет смысл только для моделей, которые работают стабильно и в огромных объёмах, а не меняются каждые пару месяцев.
AMD объясняет покупку желанием закрыть весь спектр задач инференса. «Мы строим полноценную ИИ-платформу, которая даёт клиентам гибкость в выборе нужных вычислений под каждую нагрузку», — сказал старший вице-президент AMD по ИИ-направлению Вамси Боппана. Технологию Taalas компания намерена встроить в свою дорожную карту ускорителей рядом с GPU Instinct, процессорами EPYC, стоечной платформой Helios и программной средой ROCm — той самой связкой, которой AMD в июле уже бросала вызов Nvidia. Сооснователь и глава Taalas Любиша Байич — компания основана в Торонто в 2023 году — назвал сделку способом ускорить разработку силами канадской команды.
Пока речь идёт о демонстрационном чипе, а не о серийном продукте, и цена сделки останется коммерческой тайной. Но ставка на модель-специфичные чипы спорит с самой логикой рынка, где новые версии LLM выходят каждые несколько недель: AMD делает шаг в сторону экономичного «серийного» инференса именно там, где модели уже устоялись и меняются редко.



