Svet umetne inteligence je doživel potres. Kitajska raziskovalna ekipa DeepSeek je v samo dveh mesecih in s proračunom 5,6 milijona dolarjev ustvarila odprtokodni AI model, ki postavlja nove standarde v industriji. Model DeepSeek R1 je cenejši, učinkovitejši in primerljiv z vodilnimi modeli, kot so GPT-4, Anthropic Claude in Meta Llama.
Toda šokantno ni le to, kako hitro in poceni je bil model razvit – presenetljivo je, da je to uspelo s strojno opremo, ki jo ameriške sankcije skušajo onemogočiti. DeepSeek R1 je živ dokaz, da inovacija ne potrebuje drage tehnologije, temveč pametno strategijo in iznajdljivost.
Nasdaq in Nvidia – Učinek domin
Tehnološki indeks Nasdaq, v katerem je Nvidia ena največjih zvezd, je prav tako občutil posledice. Ko se je novica o DeepSeekovem preboju razširila, je indeks izgubil na vrednosti zaradi negotovosti glede prihodnosti strojne opreme za AI. Poleg tega so vlagatelji začeli dvomiti v dosedanjo strategijo masivnih investicij v drago infrastrukturo.
Zakaj DeepSeek R1?
DeepSeek R1 je odprtokodni model umetne inteligence, zasnovan za široko dostopnost in nizke stroške. Model uporablja “mešanico strokovnjakov” (Mixture of Experts), metodo, ki omogoča optimizacijo strojne opreme, da se doseže visoka zmogljivost tudi z omejenimi viri.
- Cena uporabe: Le 10 centov na milijon tokenov, kar je 1/30 stroškov GPT-4.
- Strojna oprema: Nvidia H800 GPU-ji, ki so manj zmogljivi od ameriških H100, a so bili uporabljeni neverjetno učinkovito.
- Čas razvoja: Samo 60 dni – kar je impresivno glede na dolgotrajne procese pri drugih podjetjih.
DeepSeek je dokaz, da lahko inovacije, osredotočene na optimizacijo, konkurirajo dragemu, visoko zmogljivemu razvoju.
Primerjava z ameriškimi velikani
Velikani, kot so OpenAI, Google in Anthropic, vlagajo milijarde dolarjev v razvoj umetne inteligence. OpenAI je v letu 2024 na primer porabil več kot 5 milijard dolarjev, Microsoft pa je samo za podporo OpenAI namenil 13 milijard dolarjev.
DeepSeek je s svojimi 5,6 milijona dolarjev dosegel skoraj enako kakovost. Tu je primerjava:
- GPT-4: Močnejši v kompleksnih nalogah, a izjemno drag za uporabo.
- Meta Llama: Odprtokodna alternativa, ki pa še vedno zahteva več virov kot DeepSeek.
- DeepSeek R1: Cenejši, hitrejši, enostavnejši – in odprtokoden.







