
DeepSeek din China antrenează un model de inteligență artificială cu 2 trilioane de parametri și are ca obiectiv un model cu 8 trilioane de parametri, depășind modele existente precum Alibaba Qwen și Moonshot AI. Aceasta reprezintă o creștere semnificativă în capacitatea de calcul AI.
Pentru a realiza acest lucru, DeepSeek face un pas strategic prin folosirea cipurilor locale Huawei Ascend 950 în antrenare, urmând să diminueze dependența de Nvidia în contextul restricțiilor americane la export. Acest efort este unul cu miză mare pentru companie și industria chineză.
Echipamentul necesar este masiv, necesitând zeci de mii de cipuri, iar DeepSeek a alocat aproximativ 4,5 miliarde USD pentru infrastructura AI. Totuși, pe termen scurt, compania va continua să utilizeze și hardware Nvidia pentru a face tranziția graduală.