DeepSeekの創設者は、中国と米国のAIの最大の格差は計算能力であると述べた
ジャカルタ - DeepSeekの創設者であるLiang Wenfengは、計算能力の限界は、才能や技術の欠如ではなく、中国のAIと米国の最大のギャップであると述べました。
Yicai Globalは7月23日金曜日に引用され、この評価はDeepSeekの最新ラウンドの投資家会議の議事録に記載されていたと述べた。しかし、梁氏も杭州に本拠を置く同社も、文書の真正性を確認していない。
「米国と米国の間の最大の格差は、リソースにあります」とLiang氏は声明で述べています。
文書によると、梁氏は才能、モデル能力、AIの適用の違いを計算リソースの不平等に関連付けました。
中国はまた、高度なグラフィックスプロセッシングユニットまたはGPUの購入制限に直面しています。制限は、中国企業がNvidiaの最先端のAIチップにアクセスすることを制限する米国の輸出規制に起因します。
レポートはまた、中国のAI投資は米国よりも小さいと述べ、AI専門家の給与は総支出の比較的小さな割合しか占めていないと述べた。
DeepSeekは、より低コストで大規模な言語モデルを開発できるという点で世界を魅了しました。同社は5月末に最初の外部資金調達ラウンドを閉鎖し、500億元(約74億ドル)以上を調達しました。
この資金調達は、投資前の企業評価で約3,675億元、543億ドルで行われた。
関係する投資家には、テンセントホールディングス、コンテンポラリーアンペレックステクノロジー、ネットイース、JD.Com、IDGキャピタル、国家人工知能産業投資ファンドなどがあります。
リアンは200億元を投じ、このラウンドで投資家からの最大の金額だった。
昨年1月に打ち上げられたDeepSeek-R1は、シリコンバレーの投資家マーク・アンドレセンが「Sputnik AIの瞬間」と呼んだ。この用語は、通常、大きな競争を引き起こす技術的衝撃を表すために使用されます。
Yicaiが見た資料によると、DeepSeekは、その能力が米国の大手AI企業から約12〜18ヶ月遅れていると評価しています。
しかし、同社は、競合他社の約20分の1の計算能力しか使用していないにもかかわらず、同等の結果を達成したと主張しています。
DeepSeekは、高度なチップへのアクセスがまだ限られているにもかかわらず、このギャップを3〜6ヶ月に短縮できると目標としている。
同社は、約2万基のNvidia HシリーズGPUに相当するコンピューティングリソースを保有していると述べている。ほとんどのハードウェアは過去2か月以内に受け入れられた。
リアン氏は、現在、最大のAIモデルには約8,000億の有効パラメータがあると言います。一方、中国の最先端のモデルには数十億のパラメータしかなく、約10倍の差があります。
アクティブなパラメータは、AIがコマンドを処理するときに使用されるモデルパラメータの一部です。
Liang氏によると、DeepSeekは、すべての新しい資金がコンピューティングパワーの購入に費やされたにもかかわらず、そのような大きなモデルをトレーニングすることができませんでした。
レザラはまた、DeepSeekがHuawei Technologiesと協力して、HuaweiのAscendコンピューティングエコシステムのためにモデルを最適化していると述べています。
DeepSeekは、CUDAへの依存を減らすために、独自のプログラミング言語であるTile Languageを使用しています。
CUDAは、GPU上でAI演算を実行するために広く使用されているNvidiaのプログラミングプラットフォームです。
このアプローチは、推論の効率を向上させ、パフォーマンスをわずか1%から2%低下させることができると主張されています。
推論とは、AIモデルが学習した能力を使用して回答や予測を生成するプロセスです。
レポートによると、Huawei 950 SuperPodは、パフォーマンスと価格の面でNvidia GB200とGB300と比較可能です。
主要な障害は、技術やエコシステムの成熟度ではなく、生産能力にあると述べられている。リサーチペーパーによると、エコシステムの問題は、ほとんどが1年以内に解決されると推定されています。
その技術ロードマップでは、DeepSeekは、汎用人工知能(AGI)への旅は、連鎖的推論、AIエージェント、継続的な学習、システムが自律的に発展し始める段階の「奇点」を経て行くと信じていると述べています。
AGIは、人間のレベルの一般的な推論能力を持つように設計されたAIです。
次の段階は、ロボットやデバイスを介して物理世界と対話する具現化されたAI、すなわち人工知能です。
DeepSeekは、ビデオ制作とワールドモデルを開発の主要な軌道外に置きます。ワールドモデルは、将来の出来事を予測するために現実の環境を模倣するAIシステムです。