काठमाण्डौं — चिनियाँ आर्टिफिसियल इन्टेलिजेन्स (एआई) ल्याब ‘डिपसिक’ (DeepSeek) ले आफ्नो नयाँ र शक्तिशाली ‘लार्ज ल्याङ्ग्वेज मोडल’ DeepSeek V4 को प्रिभ्यू भर्सन सार्वजनिक गरेको छ । गत वर्ष विश्वभर चर्चा बटुल्न सफल V3.2 र R1 रिजनिङ मोडलको परिष्कृत रूपमा यसलाई ल्याइएको हो ।
कम्पनीले DeepSeek V4 Flash र V4 Pro गरी दुईवटा संस्करण सार्वजनिक गरेको छ । यी दुवै मोडलहरूले अहिलेका विश्वप्रसिद्ध ‘फ्रन्टियर मोडल’हरूसँगको दूरीलाई निकै कम गरेको दाबी गरिएको छ ।
१.६ ट्रिलियन प्यारा मिटर्सको शक्ति र प्राविधिक उत्कृष्टता
डिपसिकको यस नयाँ मोडलमा ‘मिक्सचर-अफ-एक्सपर्ट्स’ (MoE) प्रविधिको प्रयोग गरिएको छ जसले यसको कार्यक्षमतालाई अझ प्रभावकारी बनाएको छ। यस प्रविधिको मुख्य विशेषता भनेको कुनै पनि कार्य सम्पादन गर्दा मोडलका सबै प्यारा मिटर्सहरू सक्रिय नभई निश्चित संख्यामा मात्र सक्रिय हुनु हो। यसले गर्दा एआईको ‘इन्फरेन्स कस्ट’ अर्थात् सञ्चालन लागतमा उल्लेख्य कमी आउँछ।
प्राविधिक क्षमताका हिसाबले DeepSeek V4 Pro मा कुल १.६ ट्रिलियन प्यारा मिटर्स रहेका छन् जसमध्ये ४९ बिलियन प्यारा मिटर्स सक्रिय रहन्छन्। यो हालसम्मकै सबैभन्दा ठूलो ‘ओपन-वेट’ मोडलको रूपमा सार्वजनिक भएको छ। यसले मुनशट एआईको किमि के २.६ (१.१ ट्रिलियन) र मिनीम्याक्सको एम१ (४५६ बिलियन) जस्ता स्थापित मोडलहरूलाई समेत पछि पारेको छ।
त्यसैगरी यसको सानो संस्करण DeepSeek V4 Flash मा २८४ बिलियन प्यारा मिटर्स रहेका छन् जसमा १३ बिलियन मात्र सक्रिय रहन्छन्। प्रयोगकर्ताको सहजताका लागि दुवै मोडलमा १ मिलियन टोकन्सको विशाल ‘कन्टेक्स्ट विन्डो’ उपलब्ध गराइएको छ। यस क्षमताले गर्दा प्रयोगकर्ताहरूले निकै ठूला डकुमेन्टहरू र जटिल कोडबेसहरूलाई एकैपटक प्रोसेस गर्न सक्नेछन्।
बेन्चमार्कमा जीपीटी र जेमिनीसँग प्रतिस्पर्धा
डिपसिकको दाबी अनुसार ‘रिजनिङ’का केही बेन्चमार्कहरूमा V4-Pro-Max ले ओपनएआईको GPT-5.2 र गुगलको Gemini 3.0 Pro लाई समेत पछाडि पारेको छ । यस्तै ‘कोडिङ कम्पिटिसन’मा यसको पर्फर्मेन्स GPT-5.4 सँग तुलनायोग्य रहेको कम्पनीले जनाएको छ ।
यद्यपि ‘नलेज टेस्ट’मा भने यो मोडल केही पछि देखिएको छ । GPT-5.4 र Gemini 3.1 Pro को तुलनामा यो मोडल करिब ३ देखि ६ महिना पछाडि रहेको स्वयं ल्याबले स्वीकार गरेको छ ।
लागतमा निकै सस्तो, तर ‘टेक्स्ट’मा मात्र सीमित
बजारमा उपलब्ध अन्य प्रिमियम एआई मोडलहरूको तुलनामा DeepSeek V4 निकै किफायती देखिएको छ। यसको सानो संस्करण ‘V4 Flash’ को लागत प्रति मिलियन इनपुट टोकन $०.१४ र आउटपुट टोकन $०.२८ मात्र तोकिएको छ। यो मूल्य OpenAI को GPT-5.4 Nano र Google को Gemini 3.1 Flash जस्ता मोडलहरूको तुलनामा निकै कम हो।
त्यसैगरी शक्तिशाली ‘V4 Pro’ मोडलको प्रयोग पनि निकै सस्तो पर्ने देखिएको छ। यसको प्रति मिलियन इनपुट टोकन $०.१४५ र आउटपुट टोकन $३.४८ निर्धारण गरिएको छ जसले गर्दा यसले बजारका महंगा मोडलहरू Claude Opus 4.7 र GPT-5.5 लाई सिधै मूल्यमा टक्कर दिएको छ।
मूल्य र कार्यक्षमतामा आक्रामक देखिए पनि यो मोडलका केही प्राविधिक सीमाहरू भने रहेका छन्। हाल बजारमा उपलब्ध धेरैजसो फ्रन्टियर मोडलहरूले अडियो, भिडियो र इमेज (Multimodal) सपोर्ट गरे पनि डिपसिकका यी दुवै नयाँ मोडलहरूले हालका लागि ‘टेक्स्ट’ (Text) मात्र सपोर्ट गर्दछन्। यसले गर्दा अन्य ‘मल्टिमोडल’ सुविधायुक्त मोडलहरूको तुलनामा यसको दायरा केही सीमित देखिएको छ।
विवादको छाया
डिपसिकले यो नयाँ मोडल यस्तो समयमा सार्वजनिक गरेको छ जतिबेला अमेरिकाले चीनमाथि हजारौं प्रोक्सी एकाउन्ट प्रयोग गरेर अमेरिकी एआई ल्याबको ‘बौद्धिक सम्पत्ति’ (IP) चोरी गरेको आरोप लगाएको छ । यसअघि एन्थ्रोपिक र ओपनएआईले पनि डिपसिकमाथि उनीहरूको मोडल कपी (Distilling) गरेको आरोप लगाइसकेका छन् ।
