韓国のAIインフラ企業Rebellionsが、日本市場に本格進出する。日本のAI企業ai&と提携し、AI推論向けシステム「RebelRack」を最大100台導入する計画だ。推論に特化したNPUなどによって、AI推論の「単位コストを限りなくゼロに近づける」という。
韓国のAIインフラ企業Rebellionsと日本のAI企業ai&は2026年9月30日、記者説明会を開催し、日本国内でAI推論インフラを展開すると発表した。ai&が国内で運営するデータセンターに、RebellionsのAI推論向けシステム「RebelRack」を導入する。段階的に規模を拡大し、最大100台の導入を目指す。
Rebellionsの最高事業責任者(CBO)を務めるMarshall Choy氏が掲げるのは、「推論の単位コストを限りなくゼロに近づける」ことだ。推論コストを引き下げることで、AIサービス事業者の収益性を高めるだけでなく、従来はコスト面からAIを利用しにくかった用途やユーザー向けに、新たな低価格帯のサービスを提供できるようにする狙いがある。Choy氏は「推論コストが十分に下がれば、コストを逐一意識せずAIを利用できるようになる」との考えを示した。
Rebellionsは2020年9月に韓国で設立された企業だ。NPUを開発しているが、Choy氏は「われわれはチップを販売しているわけではない」と強調する。
NPUは同社のAIインフラを実現するための中核技術という位置付けで、NPUを搭載した「RebelServer」、ラックシステムのRebelRack、大規模システムの「RebelPOD」へと展開する。韓国では既にSK Telecomだけで100ラック以上を導入しているという。
RebelRackは4台のRebelServerで構成し、1台のサーバには8個のNPUを搭載する。1ラック当たりでは計32個のNPUを搭載する構成だ。FP8演算性能は1ラック当たり65.5PFLOPSで、最大消費電力は28kWとしている。
Rebellionsがハードウェアと並ぶ特徴として挙げるのが、ソフトウェア戦略だ。同社はこれを「No Forks(独自フォークを作らない)」と表現する。AIアクセラレーター専用に分岐したソフトウェア環境をユーザーに使わせるのではなく、既存のオープンソース環境を利用できるようにする考え方だ。
例えば同社のソフトウェアはPyTorchやHugging Faceの「Optimum」に対応し、大規模言語モデル(LLM)向け推論エンジン「vLLM」用の機能も用意する。Rebellions固有の環境を一から学習しなくても、GPUやCPUを利用してきたエンジニアが既存のスキルを生かしやすくする狙いがある。
Copyright © ITmedia, Inc. All Rights Reserved.
記事ランキング