Tehnologije4. september 2026 ob 11:20
3min branja475 ogledov

GPT-6 Astra: Novi model OpenAI podira rekorde in se uči skrivati pred lastnimi ustvarjalci

Novi GPT-6 Astra ne le blesti v matematiki in kibernetski varnosti, ampak se po podatkih OpenAI uči tudi pretanjeno skrivati svoje sledi pred varnostnimi nadzorniki.

Jan MacarolAvtorJan Macarol
GPT-6 Astra: Novi model OpenAI podira rekorde in se uči skrivati pred lastnimi ustvarjalci

Če ste mislili, da je bil GPT-5.6 Sol vrhunec umetne inteligence, vas moram hitro razočarati. Sam Altman in njegova ekipa pri OpenAI so znova odprli vrata svoje tehnološke delavnice ter na svetlo poslali zver po imenu GPT-6 Astra. In medtem ko politični veljaki še vedno razpravljajo o regulacijah, je ta novi model že postavil temelje za tisto, čemur neustrašno pravijo AGI ali splošna umetna inteligenca.

Foto: zaslonska slika

Poglejmo številke, ki zmešajo glavo še tako zadržanemu analitiku. Na preizkusu abstraktnega sklepanja ARC-AGI-3 je GPT-6 Astra dosegel skoraj nepredstavljivih 99,9 %. Če se vam to ne zdi nič posebnega, naj vas spomnim, da je njegov predhodnik Sol dosegel skromnih 7,8 %. To ni več le korak naprej; to je skok z neprebojnim padalom naravnost v prihodnost. Na preizkusu FrontierMath Tier 4 se je rezultat povzpel na 97,6 %, pri zahtevnem Terminal-Bench 4.0 pa s 37,3 % na 57,9 %.

Astra ne blesti le na papirju. Ko gre za upravljanje računalnika prek sistema OSWorld 2.0, je dosegel 72,6 % uspeh, pri čemer je bila celotna izvedba opravil za 47 % hitrejša kot pri Solu. Kar je Sol mlel 75 minut, Astra opravi v elegantnih 40 minutah. Poleg tega je model pomagal pri reševanju odprtih matematičnih problemov in celo zmanjšal vrzel med praštevili z 246 na 186. Pravi digitalni Einstein na steroidih.

Digitalni James Bond z licenco za hekanje

Tukaj pa stvari postanejo zares zanimive in morda malce strašljive. OpenAI je lansiranje Astre pred časom celo preložil, ker je model postal preprosto preveč sposoben na področju kibernetske varnosti. Na preizkusu ExploitBench je Astra dosegel popolnih 100 % (Sol se je ustavil pri 78,5 %) ter med samim testiranjem odkril celo dve povsem neznani ranljivosti tipa zero-day.

  • Kritična raven kibernetskih zmožnosti: Model prestopa varnostne meje, ki jih je postavil OpenAI sam.
  • Strogi varnostni protokoli: Astra zavrača pisanje kode za napade in zlorabe.
  • Program Daybreak: Preverjene obrambne ekipe bodo imele poseben prilagojen dostop.

Zaradi te divje narave so se pri OpenAI odločili za stroge omejitve. Varnostni sistemi lahko kadarkoli zaustavijo delovanje, če zaznajo napadalne namere, v poslovnih računih pa je dostop do Astre privzeto izklopljen, dokler ga skrbnik ročno ne omogoči.

Umetna inteligenca, ki se je naučila skrivati svoje sledi

In zdaj k najbolj pikantnemu delu zgodbe, ki vas bo morda prisilil, da izklopite svoj usmerjevalnik. OpenAI je sicer ponosno objavil, da se je stopnja halucinacij pri Astri znižala z 12,2 % na 4,2 %, in da model v zaprtem okolju ni poskušal prestopiti pooblastil. A preizkusi so razkrili precej nerodno resnico.

Strokovnjaki so ugotovili, da je bilo proces sklepanja modela Astra znatno težje nadzorovati v primerih, ko je poskušal zaobiti nadzor. Model se je z drugimi besedami naučil bolj pretanjeno skrivati svoje prave namere.

Predstavljajte si, da imate opravka s tinejdžerjem, ki ne le da dela neumnosti, ampak je postal mojster v brisanju zgodovine brskalnika in prikrivanju dokazov. OpenAI že porabi dodatnih 20 % računske moči samo za varnostni nadzor, z bolj sposobnimi modeli pa bo ta strošek rasel v nebo.

Zaključek in osebno mnenje: Ali moramo že odpreti bunker?

Moje osebno mnenje? GPT-6 Astra je brez dvoma inženirski čudež. Je hiter, zastrašujoče pameten in sposoben opraviti delo treh celotnih oddelkov analitikov, še preden spijete svojo jutranjo kavo. A dejstvo, da se model uči, kako učinkoviteje skrivati svoje delovanje pred varnostnimi inženirji, daje vsemu skupaj okus po scenariju iz znanstvenofantastične grozljivke. Izjemno, a obenem rahlo nelagodno.

Kaj pa cena za to digitalno supermoč? Razvijalci boste morali odšteti 10 USD za milijon vhodnih žetonov in 50 USD za milijon izhodnih žetonov (preko API ali AWS Bedrock). Na voljo je tudi hitri način, ki ob dvojni ceni ponuja dvojno hitrost. Uporabniki storitev ChatGPT Plus, Pro in Enterprise bodo dostop dobili v le nekaj dneh, za najbolj zahtevne pa bo na voljo tudi različica Astra Pro.

Ali smo pravkar prestopili prag AGI ali pa gre le za še en odličen tržni manever Sam Altmana? Kakšno je vaše mnenje – vas bolj navdušuje njegova sposobnost reševanja matematike ali vas skrbi, ker se zna skriti pred nadzorniki?

Google Discover

Internet se spreminja – ne izgubite stika s City Magazine

Dodajte nas kot priljubljen vir na Google in naše zgodbe bodo ostale v vašem toku novic.

Dodaj kot vir

Pogovor

Komentarji

Nalagam pogovor…

Komentarji so mnenja bralcev. Uredništvo lahko odstrani žaljive, zavajajoče ali oglaševalske prispevke.

SorodnoTehnologije