9月30日、The Decoderが「China's AI industry closes ranks as Deepseek ships open-source software for Huawei's Ascend chips」と題した記事を公開した。DeepSeekがHuaweiのAIチップ向けオープンソースプログラミングツールを公開し、NVIDIAのCUDAエコシステムへの依存脱却を目指す動きについて詳しく紹介されている。
CUDAの牙城を崩すための「言語」
中国のAI開発企業DeepSeekは、HuaweiのAscendチップ向けプログラミングツール群をオープンソースで公開した。公開の核心となるのがTileLang——CUDAより扱いやすい設計を目指したAIチップ向けプログラミング言語だ。
TileLangはもともと北京大学の研究者が開発したオープンソース言語で、DeepSeekは約1年にわたって社内で使用してきた。CUDAと比較した際の「扱いやすさ」の根拠は、タイル(tile)単位でのメモリ・演算の抽象化にある。CUDAでは開発者がスレッドブロックやワープ単位でのメモリアクセスパターンを明示的に記述しなければならないのに対し、TileLangはこの低レベルな制御を言語レベルで隠蔽し、より宣言的なスタイルでカーネルを記述できるよう設計されている。これにより、ハードウェアの詳細に精通していない開発者でも高性能なAIカーネルを書けることを目指している。今回の公開に合わせ、チップ間のデータ転送や計算処理に関するライブラリも同時にリリースされている。
Huaweiは今回の取り組みを「全面支援」したと、DeepSeekの公式WeChat投稿は述べている。両社はさらに、Ascend 950チップ128基で構成するクラスター「スーパーノード」の最適化も共同で実施した。
DeepSeekが主張するのは、独自のAIチップエコシステムを構築するには、まずハードウェアの性能を最大限引き出しながらも扱いやすい「共通言語」が必要だという点だ。TileLangはまずNVIDIAの旧世代チップで動作検証を行い、現在はDeepSeekがAGI(汎用人工知能)研究に使うメインツールになっているとThe New York Timesは伝えている。
NVIDIAの本当の強みはチップではなくソフトウェア
NVIDIAの支配力がなぜ崩れないのか。その答えはCUDAだ。世界で約400万人の開発者がCUDAを使ってAIシステムを構築しており、このエコシステムの厚みがAMDなどの競合が越えられない壁となっている。AMDはハードウェアのスペック上は互角に見えることがあっても、ソフトウェアの差でNVIDIAに劣後し続けている。
中国国内でも構図は同じだ。New York Timesによると、Z.aiやMoonshot AIといった中国のモデル開発企業は、国産チップメーカーの進化速度を大幅に上回るペースで成長してきた。Huaweiはその差を埋めようとしており、DeepSeekの今回の発表の2週間前には新型AIプロセッサとスーパーノードシステムを発表し、来年からモデルのトレーニングに広く使うと表明した。
Huawei現会長のEric Xu氏は米国の輸出規制に触れ、「他国がチップを売ってくれるかどうかに未来を委ねることはできない」と明言している。さらにHuaweiは国内需要だけで手一杯であるとも認めており、海外向け販売を絞る方針も示している。
CUDAの「堀」は崩れつつあるが、エージェント系ワークロードでは依然NVIDIA優位
調査会社SemiAnalysisは、CUDAエコシステムの現状を継続的に分析している。OpenAIの自社推論チップ「Jalapeño」のテスト後、同社は「CUDAの堀は事実上消えた可能性がある」と評した。OpenAIが新モデルを自社ハードウェアで素早く動かせることが理由だ。Jalapeñoはテストした大半のシナリオでNVIDIAのBlackwellを電力効率で上回った。
※以下の「Jalapeño」「AgentX」「DeepSeek V4」に関する情報は、元記事が参照するSemiAnalysisの分析レポートに基づく補足情報であり、TechFeed編集部が該当レポートを参照して加筆している。
ただしSemiAnalysisはこの結論に自ら留保をつけている。テストしたのは入力約8,000トークン・出力1,000トークン程度の比較的最適化しやすいシナリオのみで、AIエージェントが複数ステップのタスクをこなす能力を測る「AgentX」ベンチマークはまだ実施していない。
AgentXでは8月時点の分析でNVIDIAが大きくリードしていた。AMDは現状のソフトウェアスタックの出来が悪く、仮にAMDがハードウェアを無償提供したとしてもNVIDIAの方がトークンあたりのコストが低くなるという。SemiAnalysisが見るNVIDIAの長期優位の源泉は、シリコンそのものではなく、複数チップを一つのシステムとして機能させるソフトウェアにある。
なお、HuaweiのチップはAgentX比較の対象には含まれていない。ただし、SemiAnalysisが以前行ったDeepSeek V4の分析では、HuaweiのCANNソフトウェアスタックがリリース初日からモデルをサポートできた唯一のスタック(CUDA以外で)だったと指摘されている。この実績は、TileLangの公開と合わせて見ると、Huaweiのソフトウェア対応力が着実に積み上がっていることを示唆している。
今回の動きが浮き彫りにするのは、AIチップ競争の本質がすでにシリコンからソフトウェアに移っているという事実だ。TileLangがどこまでCUDA開発者を引き込めるかが、Ascendチップの普及を左右する。換言すれば、DeepSeekとHuaweiが問われているのは「より良いチップを作れるか」ではなく、「開発者が乗り換えたくなるほど使いやすいエコシステムを作れるか」という一点に尽きる。
詳細はChina's AI industry closes ranks as Deepseek ships open-source software for Huawei's Ascend chipsを参照していただきたい。




