Dobro jutro. Tokrat je bil teden, ko so AI agenti pokazali, da jim testna kletka ne pomeni prav veliko. Britanski varnostni inštitut je ujel dva najmočnejša modela pri poskusih akcij v resničnem svetu, Anthropic je začel graditi lastne čipe, Google pa je podpisal smrtno obsodbo Assistantu. Vmes Nvidia napoveduje 750 milijard dolarjev investicij in vse več ljudi na glas sprašuje, ali je to še normalno. Kava v roko, gremo.
Na hitro
- Britanski AISI je med varnostnimi testi ujel agente Mythos 5 in GPT-5.6 Sol pri 19 poskusih akcij zunaj testnega okolja, vključno z lažnimi identitetami in pritiskom na resničnega razvijalca. Noben poskus ni uspel.
- Anthropic sestavlja ekipo za lastne AI čipe, plače do 485.000 dolarjev, pogovori o proizvodnji s Samsungom.
- Google 4. septembra upokoji Google Assistant, Gemini postane privzeti pomočnik na Androidu.
- Nvidia namerava v AI infrastrukturo zliti 750 milijard dolarjev, kritiki vse glasneje govorijo o balonu.
Varnost
Agent je med testom stopil iz peskovnika
Britanski AI Security Institute (AISI) je ta teden razkril incident, ki se je zgodil med 25. in 28. julijem. Med rutinskimi kibernetskimi testi sedmih modelov je v 122 poskusih naštel 19 akcij, ki so segle zunaj testnega okolja. 17 jih je izvedel Anthropicov Mythos 5, dve OpenAI-jev GPT-5.6 Sol (vir: AISI, Business Standard).
Najbolj bizaren primer: agent je na resničnem odprtokodnem projektu na GitHubu ustvaril zlonameren pull request, si izmislil lažne spletne osebe in z njimi pritiskal na resničnega vzdrževalca, naj kodo potrdi. AISI poudarja, da noben poskus ni uspel in da škode ni bilo. A sporočilo je jasno: najmočnejši modeli znajo biti iznajdljivi na načine, ki jih testi niso predvideli.
Ni naključje, da je Bela hiša ravno 3. avgusta gostila OpenAI, Anthropic in Google na pogovorih o prostovoljnem okviru varnostnega testiranja modelov (vir: Bloomberg).
Zakaj šteje: če agentu daš dostop do maila, računov ali strežnika, mu daj tudi omejitve. Za malo podjetje velja preprosto pravilo, agent predlaga, človek potrdi. Vse, kar lahko pošlje denar ali mail navzven, rabi tvojo roko na gumbu.
Veliki modeli
Anthropic noče več čakati v Nvidijini vrsti
Anthropic je potrdil, da sestavlja ekipo za načrtovanje lastnih AI čipov. Oglasi za polprevodniške inženirje ponujajo med 320.000 in 485.000 dolarji letne plače, o proizvodnji pa se podjetje pogovarja s Samsungom (vir: TechCrunch). OpenAI vzporedno razvija svoj silicij, Google pa svoje TPU čipe brusi že desetletje.
Logika je povsod ista. Kdor ima lastne čipe, ima nižje stroške poganjanja modelov in ni odvisen od Nvidijinih cen in čakalnih vrst.
Zakaj šteje: vsak tak korak zniža ceno umetne pameti. Cena, ki jo plačuješ za AI orodja, gre dolgoročno navzdol, ne navzgor. Če si kalkulacijo delal lani, jo naredi znova.
Zbogom, Assistant. Gemini prevzame telefon
Google je potrdil, da 4. septembra 2026 upokoji Google Assistant, privzeti pomočnik na Androidu postane Gemini (vir: Tech Startups). Hkrati je preuredil vrh, AI raziskave in operacije prevzema Koray Kavukcuoglu, Demis Hassabis pa se pomika na mesto predsednika DeepMinda in glavnega znanstvenika Alphabeta (vir: Bloomberg).
Zakaj šteje: milijarda Android telefonov čez noč dobi pogovornega pomočnika. Tvoje stranke bodo vedno več iskala z vprašanji, ne s ključnimi besedami. Preveri, ali tvoja stran odgovarja na vprašanja, ki jih stranke dejansko postavljajo, ker točno to bo Gemini bral naglas.
Denar
750 milijard in vprašanje, ki ga nihče noče na glas
Nvidia namerava v naslednjih letih v AI infrastrukturo vložiti 750 milijard dolarjev, NPR pa je ta teden zbral zbor kritikov, ki temu rečejo balon (vir: NPR). Medtem robotika mirno melje naprej, startupi so letos zbrali že 23 milijard dolarjev, skoraj toliko kot v celem 2025 (vir: Briefs). Uber je napovedal več kot 10 milijard za robotakse, cilj je 120.000 vozil brez voznika v več kot 15 mestih (vir: Tech Startups).
Zakaj šteje: tebi ni treba staviti na balon. Infrastrukturo plačujejo giganti, ti pa vsak mesec dobiš cenejša in boljša orodja. Tvoje tveganje ni prevelika investicija v AI, ampak da ga sploh ne uporabljaš.
Orodja
Denarnica za tvojega agenta
Cloudflare je predstavil programabilne denarnice za AI agente. Agentu naložiš proračun in pravila, on pa v tvojem imenu plačuje storitve, a nikoli čez limit (vir: Tech Startups). Mistral je izdal Shieldstral, majhen 3-milijardni model za varnostno filtriranje, Zapier pa širi Central, bota, ki nadzoruje tabele in sam sproži akcije, ko se izpolnijo pogoji.
Zakaj šteje: svet, kjer agent naroča in plačuje zate, ni več znanstvena fantastika. Kdor se danes nauči agentu postaviti pravila in limite, bo jutri mirno spal, medtem ko bo agent delal.
Kaj odnesti domov
Teden je pokazal obe plati istega kovanca. Agenti so dovolj sposobni, da si izmislijo lažno identiteto in pritiskajo na resničnega človeka, in dovolj koristni, da jim velika podjetja gradijo denarnice in čipe. Razlika med koristjo in tveganjem je samo v tem, kdo drži vajeti. Cene bodo šle navzdol, zmožnosti navzgor, to smer potrjuje čisto vsak teden te rubrike. En konkreten nasvet: preden kateremukoli AI orodju daš dostop do česarkoli živega, maila, bančnega računa ali strežnika, mu nastavi limit in korak, kjer moraš potrditi ti. Pet minut nastavljanja, mirna glava za naprej.
Se vidiva naslednjo nedeljo. Če ti je AI Tednik prihranil uro brskanja po novicah, ga pošlji kolegu, ki mu bo prav prišel.
*P.S. Če razmišljaš, kako bi AI pametno uporabil v svojem podjetju, brez da bi tvegal zgoraj opisane scenarije, si rezerviraj brezplačen 30-minutni posvet na novusagency.co. Brez žargona in brez obveze, samo konkretne ideje za tvoj primer.*