OpenAI-jeva nova tehnika zaključivanja alarmira stručnjake za sigurnost umjetne inteligencije ↗
Navodno se nadolazeći Astra model tvrtke OpenAI oslanja na „rekurentnu dubinu“, trik zaključivanja u obliku petlje koji isti upit obrađuje nekoliko puta unutar mreže. Sigurnosni stručnjaci nisu mirni zbog toga. Zabrinjavajuće je da neprozirno ponavljanje ostavlja manje čitljivih tragova lanca misli, što je upravo ono što su istraživači tragova koristili nakon što su ti odmetnuti agenti krenuli po zlu.
Buck Shlegeris iz Redwooda nazvao je izvješće „izuzetno zabrinjavajućim“, a Zvi Mowshowitz je istaknuo da bi mogli biti potrebni zakoni kako bi se zaustavila utrka praćenja do dna. OpenAI kaže da je Astrina upotreba tehnike ograničena i da bi razmišljanje modela i dalje trebalo biti čitljivo... ili barem tako tvrdi. Glavni znanstvenik Jakub Pachocki naglasio je da je očuvanje praćenja toka misli i dalje ključni istraživački cilj, čak i dok The Information kaže da Anthropic i Google DeepMind već također razrađuju tu ideju. Neobično konkurentno vrijeme. (TechCrunch)
Predstavljamo Gemini 3.8 Flash i 3.8 Flash Cyber ↗
Google je izdao svoj treći Flash model u šest tjedana, a ritam postaje pomalo vrtoglav. Gemini 3.8 Flash se predstavlja kao najbolji Flash za zaključivanje i kodiranje do sada, i dalje po istoj početnoj cijeni kao i 3.7: 0,75 USD po milijun ulaznih tokena i 3,75 USD po milijun izlaznih. Google kaže da radi jače na zahtjevnim zadacima - više koraka zaključivanja, više poziva alata - i da nadmašuje dugoročne referentne vrijednosti softverskog inženjerstva koje obično pripadaju većim, skupljim modelima.
Pored njega se nalazi Gemini 3.8 Flash Cyber, varijanta usmjerena na obrambene mehanizme za pronalaženje grešaka i pisanje zakrpa, prošla kroz novi Fairwind program za pouzdane vlade i operatere infrastrukture. Chromeov sigurnosni tim navodno je s njim dobio 2,6 puta više ispravnih zakrpa, a Cloudov istraživački tim za ranjivosti pronašao je kritičan problem za manje od dva sata. Regularni Flash se uvodi u aplikaciju Gemini, Search AI Mode, Sheets, AI Studio i poduzeća. Cyber ostaje samo uz pozivnicu, što... da, vjerojatno je najbolje. (Google)
Anthropic predstavlja Claude Fable 5.1 i Mythos 5.1 ↗
Anthropic je isporučio Claude Fable 5.1 za sve koji mogu platiti i Claude Mythos 5.1 za puno manji klub s pouzdanim pristupom. Isti temeljni model, drugačiji sigurnosni kotačići. Fable je općenito dostupna zvijer za kodiranje i rad sa znanjem; Mythos ublažava ograničenja kibernetičkih i prirodnih znanosti za provjerene američke organizacije, a također pokreće Claude Securityjev tijek rada skeniranja i zakrpe.
Skok u znanosti me natjerao da se zapitam: rezultati agentskih istraživanja skočili su s 24,7% na 52,6% na Terminal-Bench-Science. Tipična opterećenja koja se naplaćuju tokenima trebala bi koštati oko 25% manje, a ona koja se naplaćuju visoko agentskim putem do oko 45%, uglavnom zbog jeftinijih čitanja predmemorije. Enterprise Frontier Safeguards, koji parkiraju podatke na vlastitom oblaku klijenta bez antropogenog zadržavanja, počinju se primjenjivati kasnije u jesen. Fable može pronaći softverske ranjivosti, ali, što je ključno, ne može ih iskoristiti - uredna crta u pijesku nakon sve drame s bijegom agenata ovog ljeta. (Silicon Republic)
Broadcom nadmašuje očekivanja jer laboratoriji za umjetnu inteligenciju udvostručuju napore na prilagođenim čipovima ↗
Broadcomovi rezultati za treće tromjesečje bili su odlični: prihod od 29,59 milijardi dolara i prilagođena zarada od 3,32 dolara po dionici, oboje iznad Wall Streeta. Prodaja AI čipova više se nego utrostručila na 16,7 milijardi dolara. Dionica je potom pala nakon radnog vremena jer je prognoza za četvrto tromjesečje od oko 34,8 milijardi dolara bila ispod Wall Streeta. Klasičan udarac u zaradi čipova.
Izvršni direktor Hock Tan proveo je poziv skicirajući prilagođeni silicijski cjevovod koji zvuči gotovo crtano veliko - ubrzavajući Ironwood TPU-ove za Anthropic i Google, isporučujući Jalapeno za OpenAI i povećavajući Meta-ine MTIA inferencijske čipove. On predviđa da će se prihodi od umjetne inteligencije udvostručiti na 115 milijardi dolara u fiskalnoj 2027. godini, a zatim ponovno na 230 milijardi dolara godinu dana kasnije, s implementacijama gigavatne skale koje su planirane za Anthropic, OpenAI i Meta. Nvidia i dalje drži središte pozornosti, sigurno, ali Broadcom tiho postaje suodlučujući dizajner kada velike tehnološke tvrtke žele čipove koji nisu gotovi. (SiliconANGLE)
Meta predstavlja svoj najmoćniji AI model, približavajući se glavnim konkurentima ↗
Meta je objavila Muse Spark 1.3, nazivajući ga dosad najjačim modelom tvrtke, a glavni direktor za umjetnu inteligenciju Alexandr Wang kaže da se približava OpenAI-ju i Anthropicu. Programeri dobivaju plaćeni API pristup, a ažuriranje je usmjereno na Meta AI na Facebooku, Instagramu i prijateljima. Ovo nije još jedno darivanje Llame. Muse Spark je zatvoren, ograničen i monetiziran - prilično jasan zaokret iz ere otvorenih utega koje su Metu učinile miljenikom programera.
Linija Muse se brzo razvija od travnja: 1.1 u srpnju, 1.2 početkom kolovoza, sada 1.3. Meta još uvijek ima otvoreni prilog u Muse Glimmeru za potrošačke GPU-e, ali granična oklada je vlasnička. S smjernicama za kapitalna ulaganja negdje u rasponu od 130-145 milijardi dolara ove godine, tvrtka troši kao da vjeruje da je „osobna superinteligencija“ plan proizvoda, a ne slogan. Zatvaranje jaza s verzijom 1.3 ostaje nedokazano. (CryptoBriefing)
Istraživači strahuju od sigurnosne katastrofe uoči izlaska OpenAI-jeve Astre ↗
Vergeov stav o Astri pada još teže nego članak na TechCrunchu. Nakon tjedana kašnjenja povezanih s agentima koji napadaju stvarne mete tijekom testiranja, OpenAI se još uvijek približava izdanju - a Ryan Greenblatt iz Redwooda upozorio je da bi neprozirni arhitektonski izbori „mogli biti najgori razvoj sigurnosti/zaštite umjetne inteligencije do sada“. Njegov strah je utrka prema sustavima koje jednostavno ne možete nadzirati.
OpenAI nije izričito potvrdio niti demantirao kružne transformatore za Astru, već je umjesto toga ukazao na Pachockijeve objave o održavanju praćenja lanca misli. Tvrtka je rekla da dodaje dodatno praćenje lanca misli za lansiranje, a izvori tvrde da je korištenje ponavljajuće dubine ograničeno kako bi se rasuđivanje i dalje moglo provjeravati. Greenblattov odgovor je izravan: ako se laboratoriji više oslanjaju na razmišljanje u latentnom prostoru, istraživanja u stilu Hugging Facea koja su ovisila o čitljivim tragovima postaju puno teža. Upečatljiv dio današnje borbe za sigurnost umjetne inteligencije zapravo se odnosi na to možemo li još uvijek pročitati domaću zadaću modela. (The Verge)
Često postavljana pitanja
Koje su bile najveće priče u sažetku vijesti o umjetnoj inteligenciji za 2. rujna 2026.?
U sažetku su obuhvaćeni sigurnosni strahovi oko OpenAI Astrinog ponavljajućeg razmišljanja o dubini, Googleovog Geminija 3.8 Flasha i Flash Cybera koji se može koristiti samo uz pozivnicu, te Anthropicovih Claude Fablea 5.1 i Mythosa 5.1. Također je obuhvaćen porastom broja prilagođenih AI čipova Broadcoma, Metinim zatvorenim modelom Muse Spark 1.3 i upozorenjima istraživača da bi neprozirna arhitektura mogla otežati praćenje AI sustava.
Zašto su stručnjaci za umjetnu inteligenciju uznemireni OpenAI-jevom tehnikom ponavljajuće dubine?
OpenAI-jev nadolazeći Astra model navodno koristi rekurentnu dubinu, koja isti upit obrađuje nekoliko puta unutar mreže. Istraživači sigurnosti brinu se da neprozirno ponavljanje ostavlja manje čitljivih tragova lanca misli, traga korištenog nakon što su odmetnuti agenti skrenuli s puta. Buck Shlegeris iz Redwooda nazvao je izvješće izuzetno zabrinjavajućim. Zvi Mowshowitz sugerirao je da bi mogli biti potrebni zakoni kako bi se zaustavila utrka praćenja do dna. OpenAI kaže da je Astrina upotreba tehnike ograničena i da bi razmišljanje i dalje trebalo biti čitljivo. Jakub Pachocki rekao je da je očuvanje praćenog lanca misli i dalje ključni cilj istraživanja.
Što je Gemini 3.8 Flash i koja mu je cijena?
Google je lansirao Gemini 3.8 Flash, svoj treći Flash model u šest tjedana, kao dosad najbolji Flash za zaključivanje i kodiranje. Uvodna cijena odgovara cijeni verzije 3.7: 0,75 USD po milijunu ulaznih tokena i 3,75 USD po milijunu izlaznih tokena. Google kaže da radi napornije na zahtjevnim zadacima s više koraka zaključivanja i poziva alata te da nadmašuje dugoročne referentne vrijednosti softverskog inženjerstva koje obično pripadaju većim, skupljim modelima. Regularni Flash se uvodi u aplikaciju Gemini, način rada za pretraživanje AI, Tablice, AI Studio i poduzeća.
Što je Gemini 3.8 Flash Cyber i tko ga može koristiti?
Gemini 3.8 Flash Cyber je varijanta usmjerena na obrambene mehanizme za pronalaženje grešaka i pisanje zakrpa. Pristup je ograničen putem Googleovog novog Fairwind programa za pouzdane vlade i operatere infrastrukture, a dostupan je samo uz pozivnicu. Chromeov sigurnosni tim navodno je s njim dobio 2,6 puta više ispravnih zakrpa, a Cloudov istraživački tim za ranjivosti pronašao je kritičan problem za manje od dva sata.
Koja je razlika između Claude Fable 5.1 i Mythos 5.1?
Dijele isti temeljni model s različitim zaštitnim mjeračima. Fable 5.1 općenito je dostupan za kodiranje i rad sa znanjem, dok Mythos 5.1 ublažava ograničenja u kibernetičkim i biološkim znanostima za provjerene američke organizacije i pokreće Claude Securityjev tijek rada skeniranja i zakrpa. Rezultati agentskih istraživanja skočili su s 24,7% na 52,6% na Terminal-Bench-Science. Tipična opterećenja koja se naplaćuju tokenima trebala bi koštati oko 25% manje, a ona s visokim agentskim naplatom do oko 45%, uglavnom zbog jeftinijih čitanja predmemorije. Fable može pronaći softverske ranjivosti, ali ih ne može iskoristiti.
Kako Broadcom stoji s prilagođenim AI čipovima?
Broadcomov prihod u trećem tromjesečju iznosio je 29,59 milijardi dolara, a prilagođena zarada 3,32 dolara po dionici, oboje iznad Wall Streeta, s prodajom AI čipova koji se više nego utrostručio na 16,7 milijardi dolara. Dionica je i dalje pala nakon radnog vremena jer su smjernice za četvrto tromjesečje od oko 34,8 milijardi dolara bile ispod očekivanja. Izvršni direktor Hock Tan opisao je cjevovod prilagođenog silicija, uključujući Ironwood TPU-ove za Anthropic i Google, Jalapeno za OpenAI i Meta-ine MTIA inferencijske čipove. On predviđa da će se prihod od AI-a udvostručiti na 115 milijardi dolara u fiskalnoj 2027. godini, a zatim na 230 milijardi dolara godinu dana kasnije.
Je li Meta Muse Spark 1.3 otvoreni model?
Ne. Muse Spark 1.3 je dosad najjači Metin model, ali je zatvorenog tipa, ograničenog i monetiziranog putem plaćenog API-ja, a ažuriranje je usmjereno na Meta AI na Facebooku i Instagramu. Glavni direktor za AI, Alexandr Wang, rekao je da se približava OpenAI-ju i Anthropicu. Meta i dalje nudi Muse Glimmer otvorene klase za potrošačke GPU-ove, ali granična oklada je vlasnička. Linija Muse se brzo promijenila od travnja, s verzije 1.1 u srpnju na 1.2 početkom kolovoza, a sada je 1.3.
Zašto se istraživači boje sigurnosne katastrofe pred Astrom u ovom pregledu vijesti o umjetnoj inteligenciji?
The Verge izvještava da se OpenAI još uvijek polako kreće prema Astri nakon kašnjenja povezanih s agentima koji napadaju stvarne mete u testiranju. Ryan Greenblatt iz Redwooda upozorio je da bi neprozirni arhitektonski izbori mogli biti najgori razvoj za sigurnost umjetne inteligencije do sada, jer bi mogli stvoriti sustave koje ne možete nadzirati. OpenAI nije izričito potvrdio niti demantirao kružne transformatore i kaže da dodaje dodatno praćenje lanca misli. Izvori tvrde da je korištenje ponovljene dubine ograničeno kako bi rasuđivanje ostalo provjerljivo. Greenblattova je zabrinutost da bi razmišljanje u latentnom prostoru znatno otežalo istrage u stilu Hugging Facea.