AMDがAI推論チップスタートアップTaalasを買収する。Taalasは、特定AIモデルに特化し、「重み」を直接焼き付けることで高速な推論を実現するチップを開発している。AMDは同社の技術を「Instinct GPU」を用いたシステムレベルのソリューションに統合する計画だ。
AMDは、Tenstorrentの元CEOであるLjubisa Bajic氏が共同設立したAI推論チップスタートアップTaalasを買収すると発表した。AMDの元幹部でもあるBajic氏とTaalasのチームは、Vamsi Boppana氏の率いるAMDのAI組織に加わる。買収条件は明らかにされていない。
Bajic氏は「Taalasは、モデルを中心にしたハードウェアを構築することで、AI推論を根本から再考するために設立した。カナダを拠点とする当社のチームは、深い技術的専門知識と、従来のアプローチに挑む意欲を兼ね備えている。AMDに参画することで、規模、エンジニアリングリソース、グローバルな展開力を獲得し、イノベーションを加速できると期待している」と述べている。
2023年にカナダのトロントで設立されたTaalasは、2026年2月にステルスモードを解除し、Metaが開発したオープンソースの大規模言語モデル(LLM)「Llama3.1-8B」において1ユーザー当たり毎秒1万6000トークン以上を生成できるデモチップを公開した。これは競合他社が現行世代のチップで達成できる処理速度の数倍に相当する。ただし、1つ注意点がある。Taalasの初代チップはLlama3.1-8Bしか実行できないのだ。
Taalasは、2000年代初頭のストラクチャードASICからいくつかのアイデアを取り入れている。基本的には、演算要素間のモデルのデータフローをハードワイヤリングし、重みを焼き付ける。推論処理は非常に高速動作するが、プログラマビリティはほぼ完全に排除される。そのため、実行できるモデルは1つだけとなる。
新しいモデルに切り替えるには、新しいチップを設計する必要がある。Bajic氏が2026年初めに米国EE Timesに語ったところによると、実際には、モデルの重みとデータフローを表す2つのマスクの変更に近いという。このソリューションは完全にSRAMベースなので、より大規模なモデルにはより多くのチップが必要になる。例えば中国DeepSeekのLLM「DeepSeek-671B」では、30回程度の個別のテープアウトが必要になるという。Taalasの秘伝の技術の一部は、特定のモデルに基づいてこうしたマスクを迅速に設計できるように同社が開発したツールフローにある。同社は、ワークロードに特化したチップを約2カ月でテープアウトすることを目指している。
AMDは、Taalasの技術を自社の「Instinct GPU」を用いたシステムレベルのソリューションに統合する計画だと述べている。
2025年末、市場リーダーのNVIDIAは、AIチップスタートアップのGroqを事実上買収した。GroqはTaalasと同様に、NVIDIAのGPUよりも高速にトークンを生成できるが、大規模なモデルを実行するには数十個のチップを必要としていた。NVIDIAは、システムに自社のGPUとGroqのチップを併用して、推論のデコード段階の重要な部分のみをGroqに委ねる計画だ。この分散型の推論構成によって、Groqのチップはモデル全体とKVキャッシュを保持する必要がなくなり、GPUのボトルネックだったトークン生成速度を維持できる。
AMDは最近、Cerebrasと共同で、同様の分散型ソリューションを開発していると発表した。このソリューションでは、AMDのGPUがワークロードのプリフィル部分を処理し、Cerebrasのウエハースケールエンジンがデコード部分を高速化する。TaalasのSRAMベースのチップをCerebrasの代わりにAMDのGPUと組み合わせ、デコード処理を高速化することも考えられる。その場合、システム全体をAMDが制御、供給できるため、NVIDIAとGroqの組み合わせにより近い構成となる。
AMDにとってもう1つの選択肢は、小規模モデルの推論処理全体にTaalasのチップを使用することだ。例えば、現在AMDがFPGAベースのアクセラレーターやSoC(System on Chip)を提供しているフィジカルAIなど、成長が見込まれる用途が考えられる。エッジ用途では、消費電力の制約から小規模なモデルを実行することが多く、コストに対する要求も厳しい。また、モデルを頻繁に更新する必要もないため、TaalasのストラクチャードASICに似たアプローチと相性がよい可能性がある。競合するIntelは、2018年にeASICを買収して獲得したストラクチャードASIC技術を、ネットワークインフラや防衛用途向けに展開している。
Taalasのチップ1個で対応できる上限は、約80億パラメーターとみられる。ただし、これはモデルをどの程度積極的に量子化するかによって変わる。
なお、今回の買収は、クロージング条件の充足および規制当局の承認を前提としている。
【翻訳:滝本麻貴、編集:EE Times Japan】
AMDとMicrosoft、戦略的パートナーシップ拡大
Cerebrasが上場 NVIDIA対抗馬の「試金石」となるか
AMDがメモリ最適化技術の新興を買収 「メモリの壁」を打破できるか
AmazonはNVIDIAに挑戦状を突きつけるのか
「ファウンドリーの実力」試されるIntel
「AIは依然として古い性能法則に従っている」 Tenstorrent Jim Keller氏Copyright © ITmedia, Inc. All Rights Reserved.
記事ランキング