Kiirus kasvas, pidurid otsivad alles teed
- OpenAI tulevase Astra mudeli küberturbevõimed võivad ettevõtte esialgsel hinnangul jõuda kriitilise riskitasemeni.
- Tasuta mudelipääs, Alibaba Qwen ja Meta kodeerimisagent suruvad AI kasutamise hinda alla, kuid tootjaväited vajavad sõltumatut testi.
- USA vabatahtlik testiraamistik ja Maailmapanga raport näitavad, et päris pudelikael on kontroll, taristu ja oskused.
Augusti esimene täisnädal tõi AI-turule tuttava vaatemängu: mudelid muutusid odavamaks, agendid iseseisvamaks ja pressiteated julgemaks. Samal ajal tunnistas üks turuliider, et tulevase mudeli küberturbevõimed võivad jõuda tasemeni, mille jaoks senistest kaitsetest ei pruugi piisata. Gaasipedaal sai jälle põrandale, piduripedaali asukohta alles märgitakse.
3.–9. augusti olulisemad uudised ei moodusta seepärast lihtsalt nimekirja uutest toodetest. Need näitavad, kuidas AI-võistlus liigub mudeli suurusest juurdepääsu, arendusagentide, riikliku testimise, juhtimiskultuuri ja taristu peale. Kui sina kasutad AI-d töös, loeb nüüd vähem see, kes lubab kõige rohkem, ning rohkem see, kes suudab näidata kontrollitavat tulemust ja selget vastutust.
Allikad annavad eri tugevusega tõendeid. Reutersi ja Maailmapanga kontrollitud info kõrval on ettevõtete enda testitulemused, mida tuleb käsitleda tootjaväitena. Tehisaruka praktiline järeldus on lihtne: kasuta uusi võimalusi, aga ära laena neile oma usaldust enne, kui logid, õigused ja testid on paigas.
Kübervõime jõudis ebamugava piirini
Nädala kaalukaim signaal tuli 7. augustil. OpenAI teatas oma Astra esialgsetest küberturbetestidest ja ütles, et ei saa välistada kriitilise võimekuse taset. Ettevõtte raamistikus tähendab see võimalust leida ning arendada toimivaid nullpäeva turvaauke (varem parandamata tarkvaranõrkused) paljudes tugevdatud pärissüsteemides või korraldada keerukaid ründeid vähese inimjuhisega.
Oluline täpsustus: Astra ei ole avalik toode ja hinnang ei ole sõltumatu kinnitus, et mudel suudab kõike kirjeldatut. OpenAI sõnastus oli ettevaatlikult ebamugav: esialgsete testide põhjal ei saa kriitilist taset välistada. Ettevõte peatas Astra tegevused, mis ei vasta karmistatud nõuetele, lisas isoleeritud testikeskkonnad, piiratud võrgu- ja tööriistaõigused, tugevama monitooringu ning mudelikaalude kaitse.
Paar päeva varem teatas Reuters USA vabatahtlike AI-küberturbetestide valmimisest. Valge Maja kutsus Meta, Anthropic, OpenAI ja Google’i raamistikku arutama. Avalikkusele ei öeldud, milliseid mõõdikuid kasutatakse, kas tulemused avaldatakse ega kuidas puudustele reageeritakse. Vabatahtlik kontroll ilma nähtava mõõdulindita võib olla parem kui mitte midagi, kuid sellest ei maksa veel kvaliteedimärki teha.
Eesti ettevõtte jaoks ei tähenda see, et peaksid hommikul interneti välja tõmbama. See tähendab, et tugeva kodeerimisagendi õigused peavad olema väiksemad kui tema oskused. Ära anna katsetamata agendile korraga tootmisserveri ligipääsu, kliendiandmeid ja võimalust käske käivitada. Kasuta liivakasti (pärissüsteemist eraldatud testikeskkond), luba ainult vajalikud tööriistad ja nõua inimese kinnitust enne välist kirjutamist.
Tasuta mudel muudab turu raskuskeset
6. augustil teatas OpenAI GPT-5.6 Luna ja Soli kasutajauuendustest. Luna pidi muutuma tasuta ning Go kasutajate vaikemudeliks, tekstivestlused piiramatuks ja keerulisemate küsimuste jaoks lisanduma Think-nupp. Plus- ja Pro-kasutajate Sol sai ühe mudeli kaudu nii kiirema kui põhjalikuma vastamisviisi ning vastuse detailsuse liuguri.
See on suurem uudis kui uus menüünupp. OpenAI ütles, et ChatGPT-d kasutab nädalas miljard inimest. Kui tasuta vaikemudel muutub, muutub korraga väga paljude inimeste tööriist, õpiabi ja otsingukäitumine. Piiramatu tekst ei tähenda siiski piiramatuid faile, pilte ega muid tööriistu ning tasuta teenuse kuritarvituspiirangud jäävad alles.
Ettevõte väitis sisehindamise põhjal, et vähemalt ühe faktiveaga vastuseid esines Luna puhul umbes 62% ja Soli puhul 68% harvem kui GPT-5.5 Instantil. See kõlab uhkelt, kuid puudub sõltumatu universaalne tõend, et sinu lepingute, maksuküsimuste või eestikeelsete dokumentide vead vähenevad samas suhtes. Protsent kirjeldab konkreetset testi, mitte garantiid. Töökindlust kontrollid enda näidete, allikate ja vastuvõtukriteeriumidega.
Praktiline võit on siiski päris. Väike meeskond saab odavamalt proovida, kas AI aitab mustandeid, andmete korrastamist või uurimist kiirendada. Tee enne kasutuselevõttu 20–30 kontrollülesandega väike testikomplekt, kus õige vastus on teada. Märgi eraldi faktiviga, puuduv allikas, vale toon ja ohtlik soovitus. Nii saad teada, kas tasuta mudel säästab sinu aega või lihtsalt toodab kiiremini järelkontrolli.
Hiina mudel jõuab mudelist platvormiks
Alibaba avalikustas 3. augustil Qwen3.8-Maxi. CNBC kirjelduse järgi teatas ettevõte 2,4 triljonist parameetrist ja kuni miljoni tekstiühiku kontekstiaknast (mudelile korraga nähtav infomaht). Alibaba võrdlused asetasid mudeli mõnes testis Anthropic Fable 5 lähedale või ette ning ettevõte kirjeldas 16-päevast autonoomset kodeerimiskatset.
Need tulemused on huvitavad, aga praegu eelkõige Alibaba väited. Mudel pidi avalikult saabuma alles järgmisel nädalal, seega ei olnud 3.–9. augusti jooksul võimalik tootja juttu laialt sõltumatutes päristöödes korrata. Parameetrite arv on nagu automootori kubatuur: see ütleb midagi konstruktsiooni kohta, kuid ei ütle, kui hästi auto sinu teel pidurdab.
8. augustil muutus Qweni lugu konkreetsemaks. Reuters teatas Apple’i Hiina Maci juhendist, mis lubab sobilikel kasutajatel ühendada Qweni Siri ja Writing Toolsiga. Vajalik on macOS 26.6 või uuem süsteem, funktsiooni eraldi aktiveerimine ja Qweni konto. Apple’i juhendi järgi ei tohi Alibaba neid materjale mudelite treenimiseks kasutada.
Siin on päris strateegiline muutus. AI ei liigu kasutajani ainult parima mudeli kaudu, vaid kohaliku konto, andmelepingute, seadmeplatvormi ja riiklike reeglite kaudu. Apple saab Hiinas kohaliku AI-tee, Alibaba pääseb oma rakendustest kaugemale ning kasutaja saab ühe funktsiooni taga mitu vastutajat. Euroopa ettevõte peaks sama loogikat kasutama hankes: küsi lisaks mudelinimele, kus andmeid töödeldakse, milline konto neid näeb ja kes saab tingimusi muuta.

Kodeerimisagentide võistlus läheb rahvarohkeks
Meta tõi 5. augustil beetasse Muse Code’i. TechCrunchi ülevaate järgi töötab see terminalis, kavandab suurte koodihoidlate muudatusi, kirjutab koodi ja valideerib tulemust. Suure ülesande saab tööriist jagada paralleelseteks alamagentideks, mis töötavad eraldatud worktree’des (eraldi Giti töökataloogid), et muudatused üksteisele otsa ei sõidaks.
Arhitektuur on mõistlik. Paralleelne töö võib kiirendada sõltumatuid ülesandeid ja isoleeritud kataloog vähendab kokkupõrkeid. Meta tegevjuhi näide kuue mängufunktsiooni samaaegsest ehitamisest jääb siiski tootjademoks. Ettevõtte koodibaasis on raskemad küsimused: kas agent mõistab kohalikke reegleid, säilitab teiste arendajate poolelioleva töö, ei loe saladusi ja oskab katkise testi järel peatuda.
Samal nädalal vahetas Google DeepMind juhtimisrütmi. Reuters kinnitas, et Demis Hassabis liikus tegevjuhi rollist DeepMindi esimeheks ja Alphabeti peateadlaseks, igapäevase juhtimise võttis üle Koray Kavukcuoglu. Jeff Dean, Sanjay Ghemawat, Oriol Vinyals ja Quoc Le lahkusid uude ettevõttesse Discovery Loop.
Juhtimisvahetus ei tõesta, et Google’i mudelid oleksid korraga halvemad. See näitab teistsugust pinget: teaduse, toote ja tulu tempod ei ole samad. Kui tippteadlased lahkuvad ning uus juht saab tugevama kommertsialiseerimise mandaadi, muutuvad tõenäoliselt prioriteedid, väljalasketsükkel ja koostöö pilveteenusega. AI-võistlus ei ole ainult kiipide lahing; see on ka küsimus, kas organisatsioon suudab leiutise turvaliselt kasutatavaks tooteks muuta.
Sina ei pea kodeerimisagendi valikul ennustama, kes võidab laborite võistluse. Vali üks väike pärisülesanne, anna agendile minimaalne õiguste komplekt ja nõua enne ühendamist läbivaid teste. Tehisaruka AI-tööriista kasutuselevõtu kontroll aitab kirja panna eesmärgi, andmeriski ja katkestamise tingimuse. Hea agent kiirendab kontrollitud protsessi; halb agent automatiseerib segaduse.
Maailmapank tõmbas jutu maa peale
Mudelinädala kõige kainem allikas oli Maailmapanga 2026. aasta arenguraport. Selle hinnangu järgi ohustab generatiivse AI automatiseerimine 4,5% madala ja keskmise sissetulekuga riikide olemasolevatest töökohtadest, võrreldes 14,2 protsendiga kõrge sissetulekuga riikides. Tootlikkust võiks AI tähenduslikult tõsta vastavalt 16,2% ja 18,7% töökohtadest.
Need arvud ei ole personaalne töökaotuse ennustus. Need on laiad majandusmudelid, mis sõltuvad tööülesannetest, tehnoloogia kasutuselevõtust ja riigi võimest muutusega toime tulla. Raporti tugevam mõte on mujal: vaesem riik ei pea kasu saamiseks ehitama oma tippmudelit ega hiigelandmekeskust. Ta peab esmalt tagama elektri, ühenduse, oskused, kohaliku andmestiku ja toimivad institutsioonid.
Maailmapank soovitab kolmeastmelist rada: võta olemasolevad tööriistad kasutusele, kohanda need kohaliku keele ja vajaduse järgi ning arenda oma tipptehnoloogiat alles siis, kui vundament kannab. See on vähem glamuurne kui riikliku supermudeli pressikonverents, aga tõenäoliselt palju kasulikum. Sahara-taguses Aafrikas puudub raporti järgi ligi kolmandikul maakoolidest usaldusväärne elekter ja rohkem kui kahel kolmandikul kindel internet. Sellises kohas ei lahenda 2,4 triljonit parameetrit katkist pistikupesa.
Eesti ei ole arengumaa, kuid õppetund sobib ka siia. Väikeettevõtte pudelikael pole enamasti mudeli intelligentsus, vaid korrastamata dokumendid, ebaselge vastutus, puuduv koolitus ja töövoog, mille tulemust keegi ei mõõda. Enne uue agendi ostmist pane paika üks omanik, üks mõõdetav tulemus ja üks andmepiir. AI-kirjaoskuse käivitamiseks annab praktilise alguse Tehisaruka 90 minuti miinimumprogramm ettevõttele.
Nädala praktiline kontrollnimekiri
Selle nädala uudised ei ütle, et areng on peatunud. Vastupidi: tasuta ligipääs laieneb, Hiina mudelid survestavad USA turuliidreid, kodeerimisagente tuleb juurde ja suurte laborite juhtimine muutub. Just seepärast peab kontroll muutuma igapäevaseks tööks, mitte juriidilise dokumendi viimaseks leheküljeks.
- Erista fakt tootjaväitest. Märgi üles, kas number tuli sõltumatust allikast, ettevõtte sisetestist või turundusdemost.
- Testi oma keeles ja oma andmetel. Eestikeelne leping, kohalik tootenimi ja vigane tabel paljastavad rohkem kui edetabeli ingliskeelne ideaalülesanne.
- Piira agenti enne kiirendamist. Eralda testikeskkond, luba ainult vajalikud tööriistad ja logi iga väline kirjutamine.
- Kontrolli tarneahelat. Vaata mudeli kõrval kontot, andmete asukohta, alltöötlejat, piirkondlikke tingimusi ja väljalülitamise võimalust.
- Mõõda päris tulemust. Loetud minutid ei ole võit, kui vead ja järelkontroll söövad säästu tagasi.
Kui uus tööriist lubab teha nädalatöö tunniga, ära vaidle lubadusega. Palu tal teha üks kontrollitud töö, jäta alles sisend, vahetulemused ja väljund ning lase pädeval inimesel tulemust hinnata. See annab sulle ühe päevaga rohkem otsustusinfot kui kümme säravat esitlust.
Pane testile ka katkestamise tingimus. Kui agent muudab ootamatult faili, kasutab keelatud allikat, jätab kohustusliku kontrolli vahele või küsib ligipääsu, mida ülesanne ei vaja, peab töö peatuma enne järgmise sammu käivitamist. See pole üleliigne bürokraatia, vaid odav kaitse selle vastu, et üks vale otsus kandub automaatselt kümnesse järgmisse toimingusse. Määra samal ajal taastamispunkt: milline fail, kirje või versioon oli viimane inimese kinnitatud seis ning kuidas sinna ilma andmekadudeta tagasi jõuda.
Võrdle tööriistu sama ülesande ja sama hindamislehega. Üks mudel võib kirjutada parema teksti, teine leida kiiremini koodivea ja kolmas vajada vähem käsitsi parandusi. Ära suru kõiki kasutusjuhte ühe üldise edetabeli alla. Arvesta lisaks tellimuse hinnale kontrollimise aega, vigade mõju, andmekaitset ja võimalust teenusest lahkuda. Odav vastus võib olla kallis, kui töötaja peab iga fakti uuesti otsima või teenusepakkuja lukustab töö ajaloo formaati, mida sa mujale viia ei saa.
Augusti esimese täisnädala päris sõnum ei olnud, et AI sai jälle targemaks. Sõnum oli, et võimsus liigub kiiremini kui ühised tõendid ja vastutus. Sinu eelis ei tule sellest, et proovid kõike esimesena. See tuleb sellest, et oskad uue võimaluse kiiresti, odavalt ja kontrollitavalt läbi katsuda ning tead täpselt, millal käsi pidurile panna.
Sageli küsitud (FAQ)
Kas OpenAI Astra on juba avalikult kasutatav?
Ei. OpenAI kirjeldas Astrat tulevase mudelina ja rõhutas, et küberturbevõime hinnang on esialgne.
Kas Qwen3.8-Max on tõestatult parem kui USA tippmudelid?
Mitte veel sõltumatult. Alibaba avaldas tehnilised näitajad ja oma võrdlustulemused, mida tuleb päristöödes kontrollida.
Mida peaks Eesti väikeettevõte sellest nädalast tegema?
Testi uus tööriist kontrollandmetel, piira agendi õigusi ja määra inimese kinnitus enne pöördumatut toimingut.

