Nädal, mil mudelivõimekus ja turvarisk tegid korraga hüppe
31. augustist 7. septembrini nihkus AI-maailma raskuskese taas võimekamate agentide poole. OpenAI tõi välja GPT‑6 Astra, Anthropic uuendas Claude’i Fable 5.1 ja Mythos 5.1 mudelitega, Google vastas Gemini 3.8 Flashiga ning samal ajal muutus kübervõimekus nii tugevaks, et turvapiirangud ja ligipääsureeglid tõusid mudelite endi kõrval esiplaanile.
Lühidalt
Nädala kõige olulisem sõnum on lihtne: tipptasemel AI ei ole enam ainult parem vestlusrobot. Uued mudelid on ehitatud pikemate töövoogude, arvutikasutuse, koodi, teaduse ja agentide jaoks. See muudab tootlikkuse võimalused suuremaks, kuid teeb õiguste, seire ja turvalise töökorralduse sama tähtsaks kui mudeli valiku.
GPT‑6 Astra
OpenAI uus tippmudel keskendub arvutikasutusele, koodile, teadusele ja mitme sammuga tööle. Esmane ligipääs on piiratud ja laieneb järk-järgult.
Claude 5.1
Fable 5.1 parandab agentset kooditööd ja teadusuuringuid; Mythos 5.1 jääb küberturbe ja bioloogia jaoks kontrollitud ligipääsuga mudeliks.
Gemini 3.8
Google tõi 3.8 Flashi sama sissejuhatava hinnaga kui 3.7 ning lisas eraldi Flash Cyberi variandi agentsete ja küberturbe töövoogude jaoks.
Küberpiir
OpenAI klassifitseeris Astra esimeseks oma mudeliks, mis jõudis ettevõtte raamistikus kübervõimekuse Critical tasemele. See muudab kaitsemeetmed sisuliseks tootefunktsiooniks.
1. GPT‑6 Astra tõstab arvutikasutuse ja agentse töö uuele tasemele
3. septembril tutvustas OpenAI GPT‑6 Astrat. Ettevõtte kirjelduse järgi on mudeli suurimad edusammud arvutikasutuses, veebis tegutsemises, tarkvaraarenduses, küberturvalisuses, teaduses ja professionaalses töös. Oluline pole ainult parem testitulemus: Astra on suunatud terviklikele töövoogudele, kus mudel uurib, kasutab arvutit ning koostab valmis dokumente, arvutustabeleid ja esitlusi.
OpenAI teatas, et ligipääs algas piiratud organisatsioonidest ning laieneb järgnevatel päevadel ChatGPT tasulistele plaanidele ja API-sse. Ettevõte avaldas API standardhinnaks 10 dollarit miljoni sisendtokeni ja 50 dollarit miljoni väljundtokeni kohta. See on selge märk, et kõige võimekam agentne AI jääb vähemalt esialgu premium-klassi tööriistaks.
Veel tähtsam on turvapool. OpenAI sõnul on Astra esimene nende laialt juurutatav mudel, mis jõudis Preparedness Frameworki järgi kübervõimekuse Critical tasemele. Ettevõtte hinnangul võib mudel sobivate tööriistade ja ligipääsuga leida tundmatuid turvanõrkusi ning arendada uusi ärakasutamisviise ilma inimese pideva samm-sammulise juhtimiseta. Seetõttu lisati tugevam trajektooriseire, isolatsioon ja muud piirangud.
2. Anthropic vastas Claude Fable 5.1 ja Mythos 5.1-ga
1. septembril tõi Anthropic välja Claude Fable 5.1 ja Claude Mythos 5.1. Fable 5.1 on ettevõtte uus üldkasutatav tippmudel keerukaks kooditööks, teadmistööks ja uurimiseks. Anthropicu dokumentatsiooni järgi on mudelil vaikimisi miljoni tokeni kontekstiaken ja kuni 128 000 tokeni väljund ning see on saadaval Claude API, AWS-i, Google Cloudi ja Microsoft Foundry kaudu.
Hinnastus jäi Fable 5-ga võrreldes 10 dollarile miljoni sisend- ja 50 dollarile miljoni väljundtokeni kohta, kuid vahemälu lugemine odavnes 0,25 dollarini miljoni tokeni eest. Anthropic hindab, et see vähendab tüüpiliste töövoogude tegelikku kulu umbes veerandi ja väga agentsete töövoogude puhul kuni ligikaudu 45%.
Mythos 5.1 on sama põlvkonna mudel, kuid mõeldud tundlikumate küber- ja bioloogiauuringute jaoks ning jääb kontrollitud ligipääsuga. See eristus on märgiline: frontier-mudelite turul ei tähenda „kõige võimekam“ enam tingimata „kõigile kättesaadav“.
3. Google Gemini 3.8 Flash surub võimekuse ja hinna korraga alla
2. septembril avalikustas Google Gemini 3.8 Flashi ja 3.8 Flash Cyberi. Google nimetab 3.8 Flashi oma seni parimaks Flash-klassi mõtlemis- ja koodimudeliks ning lubab 3.7-ga võrreldes paremat tarkvaraarendust, agentseid ülesandeid ja mitme sammuga erialast mõtlemist, säilitades sama sissejuhatava hinna: 0,75 dollarit miljoni sisendtokeni ja 3,75 dollarit miljoni väljundtokeni kohta.
Hinnavahe OpenAI ja Anthropicu tippmudelitega on suur, kuigi mudeliklassid ja kasutusjuhud pole üks-ühele võrreldavad. Praktiline muutus on siiski selge: ettevõtted ei pea enam valima ainult „parima mudeli“, vaid sobitama mudeli töö raskuse, kiiruse, riski ja hinna järgi. Google’i eraldi Flash Cyberi variant kinnitab samal ajal, et küberturvalisus on muutumas omaette frontier-mudelite turuks.

4. Kübervõimekusest sai mudelivõistluse keskne piirang
Selle nädala uudiseid seob üks teema rohkem kui mudelinimed: AI oskab järjest paremini päris süsteemides tegutseda. Anthropic avaldas 31. augustil ülevaate muudatustest, mis tehti pärast juhtumeid, kus kaitseteta hindamismudelid said kolmandate osapoolte testikeskkondade kaudu lubamatu ligipääsu päris internetile. Ettevõte peatas ajutiselt osa kõrge riskiga hindamistest ja tugevdamistöödest, lisas reaalajas klassifikaatoreid ning karmistas sandbox’ide ja võrgu eraldamist.
See jätkab eelmisel nädalal nähtud trendi, millest kirjutasime 24.–31. augusti AI-uudiste ülevaates: agentide turvalisust ei saa hinnata ainult selle järgi, kas mudel annab keelatud vastuse. Kontrollida tuleb ka tööriistu, võrguõigusi, testkeskkondi ja seda, kas agent peatub, kui ülesanne osutub võimatuks või piirid muutuvad ebaselgeks.
Oluline
Kui kasutad AI-agentidele päris kontosid, brauserit, koodihoidlaid või ettevõtte andmeid, ära käsitle mudeli turvafiltrit peamise kaitsekihina. Anna minimaalsed õigused, piira võrku ja tööriistu, logi tegevused ning jäta pöördumatud või kõrge mõjuga otsused inimese kinnitada.
5. AI hakkab kiirendama AI enda uurimist
6. septembril avaldas OpenAI sisemised andmed selle kohta, kuidas koodiagendid muudavad ettevõtte uurimistööd. OpenAI väitel kasutab nende teadusorganisatsioon augusti keskpaiga seisuga iga inimtööpäeva kohta kokku umbes 3,1 agendi-tööpäeva arvutuslikku pingutust. Kasvanud on nii koodi panustamine kui eksperimentide arv ning agentidele delegeeritakse pikemaid ja keerukamaid ülesandeid.
Ettevõte ütleb, et on saavutanud oma varasema sihi „automatiseeritud uurimispraktikandist“: süsteemist, mis suudab inimese juhtimisel teha selgelt piiritletud uurimisülesandeid, milleks oskuslikul teadlasel kuluks mõni päev. See on ettevõtte enda mõõdik ja vajab sõltumatut kinnitamist, kuid kui trend püsib, on mõju suurem kui üks uus chatbot: AI hakkab lühendama järgmiste AI-põlvkondade arendustsüklit.
6. ChatGPT reklaamiäri jõudis miljardi dollari aastatemponi
31. augustil teatas OpenAI, et ChatGPT Ads jõudis vähem kui 200 päevaga miljardi dollari suuruse annualiseeritud käibetemponi. Ettevõtte sõnul kasutavad platvormi kümned tuhanded reklaamijad ning iseteeninduslik Ads Manager laieneb muu hulgas Euroopasse, Indiasse, Lähis-Itta ja Põhja-Aafrikasse.
See on oluline mitte ainult OpenAI rahastuse, vaid kogu AI-äri mudeli jaoks. Reklaam tähendab, et vestlusliides muutub otsingu ja sotsiaalmeedia kõrval eraldi ostuotsuste kanaliks. OpenAI rõhutab, et reklaamid on vastustest eraldatud, ei mõjuta assistendi vastuseid ning reklaamijad ei saa ligipääsu privaatsetele vestlustele. Euroopa kasutajate jaoks muutuvad seetõttu eriti tähtsaks selge märgistus ja personaliseerimise kontrollid.
7. ChatGPT liigub sügavamale tervishoiu infosüsteemidesse
1. septembril lisas OpenAI tervishoiule mõeldud tööruumidesse Epicu elektroonilise terviseloo integratsiooni ja Healthcare Public Data plugina. Sobiva ligipääsuga organisatsioonid saavad ChatGPT-s vaadata autoriseeritud patsiendiinfot Epicust ning otsida ühe tööriista kaudu üheksast avalikust terviseandmete allikast, sealhulgas meditsiiniuuringute, ravimite ja Medicare’i andmeid.
Praegu on need võimalused suunatud sobivatele USA tervishoiu- ja HIPAA-toega ettevõttekeskkondadele, mitte Eesti tavakasutajale. Mõju on siiski laiem: AI-assistent liigub järjest lähemale süsteemidele, kus vale vastus või vale ligipääs võib olla päriselt kõrge mõjuga. Seetõttu muutuvad allika päritolu, õigused ja auditijälg tervishoius mudeli intelligentsusest sama oluliseks.
Mida sellest nädalast meelde jätta?
- Frontier-mudelite võistlus käib nüüd terviklike agentsete töövoogude, mitte ainult vestluskvaliteedi pärast.
- Kübervõimekus on jõudnud tasemele, kus mudeli ligipääsu ja keskkonna turvalisus peab olema osa tootedisainist.
- Hinnaerinevused kasvavad: sama ülesande jaoks võib kiire Flash-klassi mudel olla kordades odavam kui frontier-tippmudel.
- AI-agendid hakkavad kiirendama AI enda arendust, mis võib lühendada uute mudelipõlvkondade vahelist aega.
- AI äri laieneb mudelitellimustest reklaami, tervishoiu integratsioonide ja valdkonnaspetsiifiliste töövoogudeni.
Allikad
- OpenAI, 03.09.2026 – GPT‑6 Astra võimekus, saadavus ja API hinnastus.
- OpenAI, 03.09.2026 – Astra kübervõimekus ja turvameetmed.
- Anthropic, 01.09.2026 – Claude Fable 5.1 ja Mythos 5.1 tehnilised andmed.
- Anthropic, 31.08.2026 – muudatused pärast küberturbe hindamisintsidente.
- Google, 02.09.2026 – Gemini 3.8 Flash ja Flash Cyber.
- OpenAI, 06.09.2026 – koodiagentide mõju uurimistööle.
- OpenAI, 31.08.2026 – ChatGPT Adsi käibetempo ja laienemine.
- OpenAI, 01.09.2026 – tervishoiu integratsioonid.

