Eksplozivna drama pri Meti, šokantna transparentnost pri OpenAI ter razvoj, ki nas loči od AGI-ja le še nekaj mesecev. Torej - ta teden v umetni inteligenci.
Če si ta teden zamudil AI novice, naj ti povemo samo eno: Meta je (spet) pokleknila, Claude postaja šef pisarne, OpenAI končno objema odprtokodnost, Google pa razvija svojo vizijo umetnega superasistenta, ki zna montirati video boljše kot ti. In to ni šala. to je ta teden v umetni inteligenci – številka 15.
#15 ta teden v umetni inteligenci:
Meta in katastrofa Llama 4
Llama 4 naj bi bila krona Metinega AI razvoja, a končni rezultat je razočaranje. Model, ki je bil predstavljen javnosti, ni tisti, ki je sodeloval v benchmarkih in navdušil. To je prvi opazil profesor Ethan Mollick, ki je potrdil, da rezultati modela, objavljenega v LLM-areni, ne ustrezajo tistim, ki jih dosega javna različica. (vir: x.com/ethanmollick)
Na Redditu so se nato pojavile objave bivših zaposlenih pri Meti, ki zdaj delajo pri OpenAI, kjer se odkrito distancirajo od Llama 4. Eden izmed njih je v svojem profilu zapisal: “Llama 2 in Llama 3, Llama 4? Nimam nič s tem.” (vir: reddit.com)
Poleg tega se je pojavila informacija, da naj bi bil interni preobrat v Metini AI diviziji sprožen, ko jih je na benchmarkih prehitel neznani in nizkoproračunski kitajski model DeepSeek V3. Za podjetje, ki vlaga milijarde v razvoj umetne inteligence, to ni majhna stvar.
Claude Max in napovedi o Claude 4
Anthropic je ta teden presenetil z novo storitvijo Claude Max – naročniškim načrtom za zahtevne uporabnike, ki ponuja pet- do dvajsetkrat večjo kvoto interakcij, prednostni dostop do najnovejših modelov in funkcij. (vir: anthropic.com)
Ob tem je Jared Kaplan, glavni znanstvenik pri Anthropicu, napovedal, da bomo Claude 4 dočakali že v naslednjih šestih mesecih. Po njegovih besedah se razvoj AI modelov odvija hitreje kot razvoj strojne opreme, predvsem zaradi pospešenega post-treninga in izboljšav v reinforcement learningu. Ena subtilnih a glavnih novic – ta teden v umetni inteligenci.
OpenAI končno napoveduje odprtokodni model
Po letih kritik glede netransparentnosti in oddaljevanja od svoje prvotne misije, je Sam Altman napovedal, da bo OpenAI v kratkem objavil odprtokodni model, ki bo presegel vse obstoječe alternative. (vir: openai.com)
Še več, ChatGPT zdaj razpolaga z dolgoročnim spominom, ki omogoča uporabo preteklih interakcij za personalizacijo izkušenj, in uporabniku omogoča, da AI aktivno sledi njegovim ciljem ter ga usmerja pri nezdružljivostih v miselnih vzorcih.
A vse ni tako lepo: skrajšano testiranje varnosti pri OpenAI
Financial Times je razkril, da je OpenAI bistveno skrajšal čas in obseg testiranja varnosti svojih modelov. Namesto več tednov imajo zdaj le nekaj dni, kar vzbuja zaskrbljenost, da so modeli lahko javno objavljeni z neodkritimi ranljivostmi. Nekdanji testni inženir je za FT povedal, da so nevarnosti pri GPT-4 odkrili šele dva meseca po izidu. (vir: ft.com)
Razlog naj bi bil preprost – konkurenčni pritisk. Podjetja hitijo s predstavitvami novih modelov, da ne bi zaostala. In čeprav so to najmočnejša orodja našega časa, se varnost potiska na rob.
DeepCode 14B: odprtokodni konkurent OpenAI-ju
DeepSeek in Aentica sta predstavila DeepCode 14B, odprtokodni model za generiranje programske kode. Z le 14 milijardami parametrov dosega rezultate, primerljive s komercialnimi modeli GPT-3.5. Trenirali so ga z več kot 24.000 unikatnimi nalogami in uporabili metodo GRPO+, ki model nagrajuje le za popolno rešitev. (vir: github.com/aentica)







