DeepSeek के संस्थापक ने कहा कि कंप्यूटिंग पावर चीन और अमेरिका के बीच एआई में सबसे बड़ा अंतर है

JAKARTA - DeepSeek के संस्थापक लियांग वेंफेंग ने कम्प्यूटिंग क्षमता की सीमा को चीन और संयुक्त राज्य अमेरिका के बीच एआई की सबसे बड़ी खाई बताया, न कि प्रतिभा या प्रौद्योगिकी की कमी।

Yicai Global ने शुक्रवार, 23 जुलाई को उद्धृत किया, यह कहा कि मूल्यांकन डीपसीक के नवीनतम फंडिंग राउंड के लिए निवेशकों की बैठक के एक नोट में सूचीबद्ध था। हालांकि, लियू और हांग्जो स्थित कंपनी ने दस्तावेज़ की प्रामाणिकता की पुष्टि नहीं की है।

"हमारे और अमेरिका के बीच सबसे बड़ा अंतर संसाधन में है," लियू ने कहा, रिपोर्ट के अनुसार।

दस्तावेज़ के अनुसार, लिआंग ने प्रतिभा, मॉडल क्षमता और एआई के कार्यान्वयन के बीच कम्प्यूटेशनल संसाधन असमानता को जोड़ा।

चीन को अत्याधुनिक ग्राफिक प्रोसेसिंग इकाइयों या GPU की खरीद पर भी प्रतिबंध का सामना करना पड़ रहा है। प्रतिबंध अमेरिकी निर्यात नियंत्रण से आता है जो चीन की कंपनियों को एआई चिप्स के लिए एनवीडिया तक पहुंच सीमित करता है।

रिसाल में यह भी कहा गया है कि चीन की एआई निवेश अमेरिका की तुलना में कम है, जबकि एआई पेशेवरों की वेतन कुल खर्च का केवल एक छोटा सा हिस्सा लेती है।

DeepSeek ने दुनिया का ध्यान आकर्षित किया क्योंकि यह कम लागत पर बड़े भाषा मॉडल विकसित करने में सक्षम था। कंपनी ने मई के अंत में 50 बिलियन युआन या लगभग 7.4 बिलियन डॉलर से अधिक एकत्र करके अपनी पहली बाहरी वित्तपोषण राउंड को बंद कर दिया।

निवेश से पहले कंपनी का मूल्यांकन लगभग 367.5 बिलियन युआन या 54.3 बिलियन अमेरिकी डॉलर था।

इसमें शामिल निवेशकों में Tencent Holdings, Contemporary Amperex Technology, NetEase, JD.Com, IDG Capital और National Artificial Intelligence Industry Investment Fund शामिल हैं।

लिआंग ने 20 बिलियन युआन जमा किए, जो इस दौर में एक निवेशक की सबसे बड़ी राशि थी।

जनवरी 2021 में लॉन्च किया गया डीपसीक-आर1 को सिलिकॉन वैली निवेशक मार्क एंड्रेसेन द्वारा "स्पुतनिक एआई का क्षण" कहा जाता था। यह शब्द आमतौर पर एक बड़ी प्रतिस्पर्धा को प्रेरित करने वाली तकनीकी आश्चर्य को दर्शाने के लिए उपयोग किया जाता है।

Yicai द्वारा देखे गए एक रिपोर्ट के अनुसार, DeepSeek ने मूल्यांकन किया कि इसकी क्षमता अभी भी अमेरिका के प्रमुख एआई कंपनियों से लगभग 12 से 18 महीने पीछे है।

हालांकि, कंपनी का दावा है कि यह अपने प्रतिस्पर्धियों के केवल लगभग दो दसवें कंप्यूटिंग पावर का उपयोग करके तुलनीय परिणाम प्राप्त करता है।

DeepSeek का लक्ष्य यह है कि यह अंतर तीन से छह महीने तक कम किया जा सकता है, भले ही उन्नत चिप तक पहुंच अभी भी सीमित है।

कंपनी के पास लगभग 20,000 एनवीडिया एच सीरीज जीपीयू के बराबर कंप्यूटिंग संसाधन होने का दावा किया गया है। अधिकांश हार्डवेयर पिछले दो महीनों में प्राप्त किया गया था।

लिआंग ने कहा कि वर्तमान में सबसे बड़े एआई मॉडल में लगभग 800 बिलियन सक्रिय पैरामीटर हैं। जबकि चीन के सबसे उन्नत मॉडल में केवल कुछ दसियों अरब पैरामीटर हैं, या लगभग दस गुना कम हैं।

सक्रिय पैरामीटर मॉडल पैरामीटर का एक हिस्सा है जिसका उपयोग एआई द्वारा किसी आदेश को संसाधित करते समय किया जाता है.

लिआंग के अनुसार, डीपसीक अभी भी उस तरह के मॉडल को प्रशिक्षित करने में सक्षम नहीं है, भले ही उसके पूरे नए धन का उपयोग कंप्यूटिंग शक्ति खरीदने के लिए किया जाता है।

रिसाल में यह भी कहा गया है कि डीपसीक Huawei के Ascend कंप्यूटिंग इकोसिस्टम के लिए अपने मॉडल को अनुकूलित करने के लिए Huawei Technologies के साथ काम कर रहा है।

DeepSeek अपने स्वयं के कृत्रिम भाषा, टाइल भाषा का उपयोग करता है, जो CUDA पर निर्भरता को कम करता है।

CUDA Nvidia का एक प्रोग्रामिंग प्लेटफ़ॉर्म है जिसका उपयोग GPU पर AI गणना चलाने के लिए किया जाता है।

यह दृष्टिकोण केवल 1 प्रतिशत से 2 प्रतिशत की प्रदर्शन गिरावट के साथ अनुमान की दक्षता में सुधार करने का दावा करता है।

अनुमान एक ऐसी प्रक्रिया है जब एआई मॉडल उत्तर या पूर्वानुमान उत्पन्न करने के लिए सीखी गई क्षमताओं का उपयोग करता है.

रिसाल में कहा गया है कि Huawei 950 सुपरपॉड को प्रदर्शन और कीमत के मामले में Nvidia GB200 और GB300 के साथ तुलनीय माना जाता है।

मुख्य बाधा उत्पादन क्षमता में है, न कि प्रौद्योगिकी या पारिस्थितिकी तंत्र की परिपक्वता में। निबंध के अनुसार, पारिस्थितिकी तंत्र की समस्या का अनुमान है कि यह एक वर्ष में अधिकांश भाग हल हो सकता है।

अपने तकनीकी रोडमैप में, डीपसीक ने कहा कि कृत्रिम सामान्य बुद्धि या एजीआई की यात्रा श्रृंखलाबद्ध तर्क, एआई एजेंट, निरंतर शिक्षा और "अभिनव" चरणों के माध्यम से होगी, जब सिस्टम खुद को विकसित करना शुरू कर देता है।

AGI एक ऐसी AI है जिसे मानव स्तर की सामान्य तर्क क्षमता के साथ डिज़ाइन किया गया है.

अगला चरण मूर्त एआई है, जो रोबोट या डिवाइस के माध्यम से भौतिक दुनिया के साथ बातचीत करता है।

DeepSeek वीडियो निर्माण और दुनिया के मॉडल को इसके मुख्य विकास पथ से बाहर रखता है। वर्ल्ड मॉडल एक एआई सिस्टम है जो भविष्य की घटनाओं की भविष्यवाणी करने के लिए वास्तविक वातावरण की नकल करता है।