
જાન્યુઆરી 2025 માં, ડીપસીક નામની ચાઇનીઝ AI લેબએ બે નવા AI મોડલ રજૂ કર્યા જે સમગ્ર ટેકની દુનિયામાં તરંગો બનાવી રહ્યા છે. સૌથી આશ્ચર્યજનક બાબત એ છે કે કેવી રીતે ડીપસીકે યુએસમાં તેના સ્પર્ધકોની તુલનામાં અત્યંત મર્યાદિત સંસાધનોનો ઉપયોગ કરીને અવિશ્વસનીય પરિણામો પ્રાપ્ત કર્યા. આનાથી વૈશ્વિક AI રેસમાં પરિવર્તન આવ્યું છે, જ્યાં યુનાઇટેડ સ્ટેટ્સના વર્ચસ્વને પડકારતી ચીન હવે એક મુખ્ય ખેલાડી તરીકે જોવામાં આવે છે.
ડીપસીકનો ઉદય
ઘણા વર્ષો સુધી, યુનાઈટેડ સ્ટેટ્સે કૃત્રિમ બુદ્ધિમત્તાના વિકાસનું નેતૃત્વ કર્યું, જેમાં ઓપનએઆઈ, ગૂગલ અને મેટા જેવી મોટી કંપનીઓ પ્રગતિ કરી રહી છે. જો કે, ડીપસીકના લેટેસ્ટ એઆઈ મોડલ્સ, ખાસ કરીને ડીપસીક-વી3, દર્શાવે છે કે ચીન હવે અદ્યતન હાર્ડવેર પરના નિયંત્રણો સાથે પણ ઉચ્ચ સ્તરે સ્પર્ધા કરી શકે છે.
ડીપસીકની પ્રગતિ વિશે અહીં કેટલાક મુખ્ય મુદ્દાઓ છે:
- DeepSeek-V3 ને માત્ર $5.6 મિલિયન સાથે વિકસાવવામાં આવ્યું હતું, જે OpenAI એ તેના GPT-4 મોડલ પર ખર્ચેલા $100 મિલિયન કરતા ઘણું ઓછું હતું.
- મોડેલને જૂના GPU નો ઉપયોગ કરીને તાલીમ આપવામાં આવી હતી જે યુએસ કંપનીઓ દ્વારા ઉપયોગમાં લેવાતા નવીનતમ જીપીયુ જેટલા શક્તિશાળી નથી.
- આ પડકારો હોવા છતાં, DeepSeek-V3 એ GPT-4 અને Meta's Llama જેવા મોડલને ઘણા બેન્ચમાર્કમાં પાછળ રાખી દીધા છે.
ડીપસીકની સફળતા પાછળની વ્યૂહરચના
ડીપસીકની સફળતા કેટલાક મહત્વપૂર્ણ પરિબળોને આભારી હોઈ શકે છે:
- H800 GPUs જેવા ઓછા અદ્યતન હાર્ડવેરનો ઉપયોગ કરીને, ડીપસીકે તેમની કાર્યક્ષમતા વધારવા માટે નવીન તકનીકોનો ઉપયોગ કર્યો. આનાથી તેમને તેમની પાસેના સંસાધનોમાંથી વધુ મેળવવાની મંજૂરી મળી.
- તેઓએ મલ્ટિ-હેડ લેટન્ટ એટેન્શન (એમએલએ) અને મિક્સચર-ઓફ-એક્સપર્ટ્સ જેવી સ્માર્ટ ડિઝાઇનનો પણ ઉપયોગ કર્યો, જેણે તેમના મોડલ્સને તાલીમ આપવા માટે જરૂરી કમ્પ્યુટિંગ પાવરની માત્રા ઘટાડવામાં મદદ કરી.
- ડીપસીકનો અભિગમ સાબિત કરે છે કે નવીનતા માટે હંમેશા શ્રેષ્ઠ અથવા સૌથી મોંઘી ટેકનોલોજીની જરૂર હોતી નથી, પરંતુ સર્જનાત્મકતા અને કોઠાસૂઝની જરૂર હોય છે.
ડીપસીકનો ઓપન-સોર્સ અભિગમ, કેવી રીતે ઉપયોગ કરવો?
ડીપસીકના AI મોડલ્સના સૌથી નોંધપાત્ર પાસાઓ પૈકી એક એ છે કે તે ઓપન સોર્સ છે. આ ઘણી યુએસ સ્થિત AI કંપનીઓથી વિપરીત છે, જેમ કે OpenAI, જેઓ તેમના મોડલને લોકો માટે બંધ રાખે છે. તેમના AI દરેકને ઉપલબ્ધ કરાવીને, DeepSeek વૈશ્વિક સહયોગને પ્રોત્સાહન આપી રહ્યું છે અને વિકાસકર્તાઓને તેમના મૉડલને આગળ વધારવા અને સુધારવાની મંજૂરી આપી રહ્યું છે.
અહીં આ ઓપન-સોર્સ અભિગમના કેટલાક ફાયદા છે જેનો કોઈપણ નીચેની ગીથબ લિંક પરથી ઉપયોગ કરી શકે છે:
- કોઈપણ વ્યક્તિ ડીપસીકના મોડલ્સ (ગીથબ લિંક) એક્સેસ કરી શકે છે, તેને રિફાઈન કરી શકે છે અને તેનો ઉપયોગ કરીને નવી એપ્લિકેશન બનાવી શકે છે.
- આ અભિગમથી ચાઈનીઝ AI ટેક્નોલોજી વૈશ્વિક ટેક ઈકોસિસ્ટમમાં એમ્બેડ થઈ શકે છે.
- તે યુએસ સ્થિત કંપનીઓના વર્ચસ્વને પડકારે છે અને AI સંસાધનો શેર કરવા માટે એક નવું મોડલ ઓફર કરે છે.
ડીપસીકની નવીનતાની વૈશ્વિક અસર
ડીપસીકની સફળતા એઆઈના ભાવિ અને વૈશ્વિક મંચ પર તેની અસરો વિશે કેટલાક મહત્વપૂર્ણ પ્રશ્નો પણ ઉભા કરે છે:
- ચાઇનીઝ કંપની તરીકે, ડીપસીકના AI મોડલ્સ ચાઇનીઝ નિયમોથી પ્રભાવિત છે, જે તેમની વૃદ્ધિને મર્યાદિત કરી શકે છે અથવા અમુક દેશોમાં તેનો ઉપયોગ કેવી રીતે થાય છે.
- વિવેચકો ચિંતા કરે છે કે સરમુખત્યારશાહી સરકારો હેઠળ વિકસિત AI સિસ્ટમો પક્ષપાતી અથવા સેન્સર્ડ મંતવ્યો પ્રતિબિંબિત કરી શકે છે. ચિંતાઓમાં શામેલ છે કે ડીપસીકનું AI તાઈવાન અથવા તિયાનમેન સ્ક્વેર ઘટના જેવા સંવેદનશીલ વિષયોને કેવી રીતે હેન્ડલ કરે છે.
- ચાઇનીઝ AI મોડલ્સનો ઉદય એ વિશે ચર્ચાને ઉત્તેજન આપી શકે છે કે શું AI એ લોકશાહી મૂલ્યોને પ્રતિબિંબિત કરવું જોઈએ અથવા તે સરકાર-નિયંત્રિત કથાઓ દ્વારા આકાર લેશે કે કેમ.
AI નું ભવિષ્ય: શું ચીન વધતું રહેશે?
ડીપસીકની સફળતા સાથે, ચીન બતાવી રહ્યું છે કે તે હવે AI રેસમાં માત્ર અનુયાયી નથી, પરંતુ એક ગંભીર હરીફ છે. યુ.એસ. હજુ પણ ઘણા ક્ષેત્રોમાં અગ્રેસર છે, ત્યારે ડીપસીકની સફળતાએ દર્શાવ્યું છે કે કોઠાસૂઝ અને નવીનતા નવીનતમ ટેક્નોલોજીની મર્યાદિત ઍક્સેસ જેવા પડકારોને દૂર કરી શકે છે. AI વિકાસના ભાવિમાં કદાચ સરહદો પર વધુ સહયોગ જોવા મળશે, પરંતુ ટેક્નોલોજીના ભાવિને આકાર આપવામાં નીતિશાસ્ત્ર, નિયંત્રણ અને સરકારી પ્રભાવની ભૂમિકા વિશે વધુ ચર્ચાઓ પણ થશે.
અન્ય AI મોડલ્સ સાથે ડીપસીકની સરખામણી
| બેન્ચમાર્ક (મેટ્રિક) | ડીપસીક V3 | ડીપસીક V2.5 | Qwen2.5 | લામા3.1 | ક્લાઉડ-3.5 | GPT-4o |
|---|---|---|---|---|---|---|
| આર્કિટેક્ચર | MoE | MoE | ગાઢ | ગાઢ | - | - |
| # સક્રિય કરેલ પરમ | 37B | 21બી | 72B | 405B | - | - |
| # કુલ પરમ | 671B | 236B | 72B | 405B | - | - |
| અંગ્રેજી MMLU (EM) | 88.5 | 80.6 | 85.3 | 88.6 | 88.3 | 87.2 |
| MMLU-Redux (EM) | 89.1 | 80.3 | 85.6 | 86.2 | 88.9 | 88.0 |
| MMLU-Pro (EM) | 75.9 | 66.2 | 71.6 | 73.3 | 78.0 | 72.6 |
| ડ્રોપ (3-શોટ F1) | 91.6 | 87.8 | 76.7 | 88.7 | 88.3 | 83.7 |
| IF-Eval (પ્રોમ્પ્ટ કડક) | 86.1 | 80.6 | 84.1 | 86.0 | 86.5 | 84.3 |
| GPQA-ડાયમંડ (પાસ@1) | 59.1 | 41.3 | 49.0 | 51.1 | 65.0 | 49.9 |
| સિમ્પલક્યુએ (સાચો) | 24.9 | 10.2 | 9.1 | 17.1 | 28.4 | 38.2 |
| ફ્રેમ્સ (એસીસી) | 73.3 | 65.4 | 69.8 | 70.0 | 72.5 | 80.5 |
| LongBench v2 (Acc.) | 48.7 | 35.4 | 39.4 | 36.1 | 41.0 | 48.1 |
| કોડ HumanEval-Mul (Pass@1) | 82.6 | 77.4 | 77.3 | 77.2 | 81.7 | 80.5 |
| LiveCodeBench (Pass@1-COT) | 40.5 | 29.2 | 31.1 | 28.4 | 36.3 | 33.4 |
| LiveCodeBench (Pass@1) | 37.6 | 28.4 | 28.7 | 30.1 | 32.8 | 34.2 |
| કોડફોર્સ (શકકો) | 51.6 | 35.6 | 24.8 | 25.3 | 20.3 | 23.6 |
| SWE ચકાસાયેલ (ઉકેલાયેલ) | 42.0 | 22.6 | 23.8 | 24.5 | 50.8 | 38.8 |
| Aider-Edit (Acc.) | 79.7 | 71.6 | 65.4 | 63.9 | 84.2 | 72.9 |
| સહાયક-પોલીગ્લોટ (Acc.) | 49.6 | 18.2 | 7.6 | 5.8 | 45.3 | 16.0 |
| ગણિત AIME 2024 (પાસ@1) | 39.2 | 16.7 | 23.3 | 23.3 | 16.0 | 9.3 |
| MATH-500 (EM) | 90.2 | 74.7 | 80.0 | 73.8 | 78.3 | 74.6 |
| CNMO 2024 (પાસ@1) | 43.2 | 10.8 | 15.9 | 6.8 | 13.1 | 10.8 |
| ચાઇનીઝ CLUEWSC (EM) | 90.9 | 90.4 | 91.4 | 84.7 | 85.4 | 87.9 |
| C-Eval (EM) | 86.5 | 79.5 | 86.1 | 61.5 | 76.7 | 76.0 |
| C-SimpleQA (સાચો) | 64.1 | 54.1 | 48.4 | 50.4 | 51.3 | 59.3 |
મુખ્ય મુદ્દાઓનો સારાંશ
- ડીપસીક, એક ચાઈનીઝ AI લેબ, જાન્યુઆરી 2025 માં તેના પ્રગતિશીલ AI મોડલ્સ, DeepSeek-V3 અને DeepSeek-R1 રજૂ કર્યા.
- DeepSeek-V3 મોડલને માત્ર $5.6 મિલિયનમાં વિકસાવવામાં આવ્યું હતું, જે OpenAI અને Google જેવી યુએસ કંપનીઓ દ્વારા ખર્ચવામાં આવેલા અબજો કરતાં ઘણું ઓછું છે.
- ડીપસીકે તેના મોડલ્સને તાલીમ આપવા માટે જૂની પેઢીના જીપીયુનો ઉપયોગ કર્યો, જે દર્શાવે છે કે કેવી રીતે સર્જનાત્મકતા અને કોઠાસૂઝ હાર્ડવેરની મર્યાદાઓને દૂર કરી શકે છે.
- ડીપસીકના AI મોડલ્સે GPT-4 અને મેટાના લામા જેવા ટોચના મોડલ્સને કોડિંગ અને ગણિતના કાર્યો સહિત અનેક બેન્ચમાર્ક્સમાં પાછળ છોડી દીધા છે.
- ડીપસીક કોમ્પ્યુટીંગ પાવરની જરૂરિયાતોને ઘટાડવા માટે મલ્ટી-હેડ લેટેન્ટ એટેન્શન (એમએલએ) અને મિક્સચર-ઓફ-એક્સપર્ટ જેવી નવીન તકનીકોનો ઉપયોગ કરે છે.
- કંપનીનો ઓપન-સોર્સ અભિગમ વૈશ્વિક વિકાસકર્તાઓને તેમના AI મોડલ્સને એક્સેસ, રિફાઇન અને બિલ્ડ કરવાની મંજૂરી આપે છે.
- આ ઓપન-સોર્સ વ્યૂહરચના યુએસ કંપનીઓથી વિપરીત છે કે જેઓ તેમના AI મોડલ્સને બંધ રાખે છે, જેનાથી ચીનને AI ટેક્નોલોજીમાં વૈશ્વિક પ્રભાવ પ્રાપ્ત થાય છે.
- અદ્યતન NVIDIA ચિપ્સ પરના નિયંત્રણો હોવા છતાં, ડીપસીકે યુએસ વર્ચસ્વને પડકારતા સ્પર્ધાત્મક AI મોડલ્સ બનાવવાનું સંચાલન કર્યું છે.
- ડીપસીકની સફળતા એ વિશે પ્રશ્નો ઉભા કરે છે કે શું સરમુખત્યારશાહી સરકારો દ્વારા વિકસિત AI સિસ્ટમ્સ પક્ષપાતી અથવા સેન્સર્ડ દૃષ્ટિકોણને પ્રતિબિંબિત કરી શકે છે.
- ડીપસીકનો ઉદય વૈશ્વિક AI રેસમાં ચીનના વધતા પ્રભાવને દર્શાવે છે, જે સંભવિતપણે AI ટેક્નોલોજીના ભાવિને ફરીથી આકાર આપે છે.





