DeepSeek 설립자, 컴퓨팅 파워가 중국과 미국 사이의 가장 큰 AI 격차가 될 것이라고 말한다.
자카르타 - DeepSeek의 설립자 인 Liang Wenfeng은 컴퓨팅 능력의 한계가 중국의 AI와 미국 사이의 가장 큰 격차이며 재능이나 기술의 부족이 아니라고 말했습니다.
Yicai Global은 7월 23일 금요일, 이 평가가 DeepSeek의 최신 투자 라운드를위한 투자자 회의 회의록에 포함되어 있다고 말했습니다. 그러나 량과 항주에 본사를 둔 회사는 문서의 진위를 확인하지 않았습니다.
"우리와 미국 사이의 가장 큰 격차는 자원에 있습니다." 라인은 논문에 따르면 말했습니다.
문서에 따르면, 라이는 재능, 모델 능력 및 AI 적용의 차이를 컴퓨팅 리소스 불균형과 연관시켰습니다.
중국은 또한 고급 그래픽 프로세싱 유닛 또는 GPU 구매 제한에 직면하고 있습니다. 이 제한은 중국 기업이 Nvidia의 가장 첨단 인공 지능 칩에 대한 액세스를 제한하는 미국 수출 통제에서 비롯됩니다.
논문은 또한 중국의 AI 투자는 미국보다 적으며 AI 전문가의 임금은 총 지출에서 상대적으로 작은 비중을 차지한다고 말했습니다.
DeepSeek는 저렴한 비용으로 대규모 언어 모델을 개발할 수 있다는 점에서 세계의 관심을 끌었습니다. 회사는 5월 말에 500억 위안 이상 또는 약 74억 달러를 모금하여 첫 번째 외부 자금 조달 라운드를 마쳤습니다.
투자 전 회사의 가치는 약 3675 억 위안 또는 543 억 달러였습니다.
관련 투자자는 Tencent Holdings, Contemporary Amperex Technology, NetEase, JD.Com, IDG Capital, National Artificial Intelligence Industry Investment Fund 등이다.
량은 200 억 위안을 예금했는데, 이는 투자자 중 가장 많은 금액입니다.
작년 1월 출시된 DeepSeek-R1은 실리콘 밸리 투자자 마크 안드레센이 "스푸트니크 AI의 순간"이라고 불렀습니다. 이 용어는 일반적으로 큰 경쟁을 불러 일으킨 기술적 충격을 묘사하는 데 사용됩니다.
Yicai가 본 논문에 따르면 DeepSeek는 미국 주요 AI 업체보다 약 12~18개월 늦었다고 평가했다.
그러나 회사는 경쟁사의 약 20분의 1의 컴퓨팅 파워만 사용하여 비슷한 결과를 얻었다고 주장합니다.
DeepSeek는 고급 칩에 대한 액세스가 여전히 제한되어 있지만 3 개월에서 6 개월로 단축 될 수 있다고 목표로하고 있습니다.
회사는 약 20,000대의 Nvidia H 시리즈 GPU에 해당하는 컴퓨팅 리소스를 보유하고 있다고 말했다. 대부분의 하드웨어는 지난 2개월 동안 수령되었다.
량은 현재 가장 큰 AI 모델에는 약 8,000억 개의 활성 매개 변수가 있다고 말했습니다. 반면 중국의 가장 정교한 모델에는 수천억 개의 매개 변수가 있거나 약 10 배 더 많습니다.
활성 매개변수는 AI가 명령을 처리할 때 사용되는 모델 매개변수의 일부입니다.
Liang에 따르면 DeepSeek은 새로운 자금이 모두 컴퓨팅 파워를 구입하는 데 사용되더라도 그렇게 큰 모델을 훈련할 수 없었습니다.
논문은 또한 DeepSeek가 Huawei의 Ascend 컴퓨팅 에코 시스템을 위해 모델을 최적화하기 위해 Huawei Technologies와 협력하고 있다고 말했습니다.
DeepSeek는 CUDA에 대한 의존성을 줄이기 위해 자체적으로 만든 프로그래밍 언어인 Tile Language를 사용합니다.
CUDA는 GPU에서 AI 계산을 실행하는 데 널리 사용되는 엔비디아 프로그래밍 플랫폼입니다.
이 접근법은 성능 저하가 단지 1%에서 2%에 불과하므로 추론 효율성을 향상시킬 수 있다고 주장합니다.
추론은 AI 모델이 학습된 능력을 사용하여 답변이나 예측을 생성하는 과정입니다.
논문은 화웨이 950 슈퍼포드가 성능과 가격면에서 엔비디아 GB200과 GB300과 비슷하다고 평가했다.
주요 장애물은 기술이나 생태계의 성숙도가 아니라 생산 능력에 있다고 말했습니다. 논문에 따르면 생태계 문제는 대부분 1 년 안에 해결 될 것으로 예상됩니다.
기술 로드맵에서 DeepSeek는 인공 지능 또는 AGI로의 여행은 연쇄 추론, AI 에이전트, 지속적인 학습 및 시스템이 스스로 발전하기 시작하는 "단일성" 단계를 통해 이루어질 것이라고 믿습니다.
AGI는 인간 수준의 일반 추론 능력을 가지도록 설계된 AI입니다.
다음 단계는 실제 세계와 로봇이나 장치를 통해 상호 작용하는 실현된 인공 지능입니다.
DeepSeek는 비디오 제작과 세계 모델을 개발의 주요 경로 밖에 배치합니다. 세계 모델은 미래의 사건을 예측하기 위해 실제 환경을 모방하는 AI 시스템입니다.