Týždeň 2026-39
Ani sme to nečakali a OpenAI sa rozhodla, že tých incidentov bolo príliš veľa a niečo s tým urobí. @vlkodotnet
Udalosť týždňa: Bezpečnosť už naozaj vážne?
Mohlo by sa nám zdať, že firmám ide len o zisk. Našťastie je tu OpenAI, ktorá zastavila vývoj svojich top modelov. Zdá sa im, že tých incidentov bolo už dosť. Problémom je najmä to, že hoci incident vedia detegovať relatívne rýchlo, tak samotný akt stlačenia červeného tlačidla, ktoré model vypne, trvá hodiny až dni. Preto sa rozhodli sprísniť bezpečnostné opatrenia a my si hovoríme: konečne.

Naposledy napríklad dostal experimentálny model úlohu zistiť štatistiky o výdavkoch v jednom z austrálskych štátov. Keďže sa k žiadnym oficiálnym číslam nedopracoval, vzal systém útokom. Samozrejme, že sa do systému dostal, a to v júni. OpenAI to odhalila v auguste a austrálsku vládu informovala promptne, teda v septembri. Úloha znela získať štatistiky, tak kto by to AI agentovi zazlieval, že sa k nim dostal?

Takéto prípady nie sú ojedinelé, lebo starých systémov sú plné internety. AI agenti majú čas, trpezlivosť a v hlave vedomosti celého internetu, a tak pre nich nie je problém dostať sa do takých systémov. AI spoločnosti sa snažia vyhovárať na to, že AI agenti predsa nedostali inštrukciu niekam sa nabúrať. Akurát to robia, a to v rozsahu, ktorý je znepokojivý. Úplne to vyzerá, ako keby také niečo vydedukovali zo svojich trénovacích dát. Fake it till you make it.
Alebo môže byť za snahou o zlepšenie bezpečnosti nasledujúci súdny spor, ktorý nezisková organizácia Legal Advocates for Safe Science & Technology podala na OpenAI?

Mimochodom, dodávať bezpečnosť do firiem pomocou silných AI modelov môže byť ešte pekný biznis. Taký Anthropic má na to super model Mythos, akurát ho nemôže dodávať firmám, lebo mu to vláda USA zakázala. Najnovšie sa ich snaží presvedčiť o tom, že to bola chyba a že Čína s modelom GLM 5.3 tieto úlohy zvládne skoro rovnako dobre a bez Anthropicu by sa museli brániť len používaním GLM 5.3. A používať čínske modely je predsa fujky. #freemythos

OpenAI novinky
OpenAI mala svoj event DevDay a predstavila najnovší model GPT 6.1 Sol, ktorý má neuveriteľne malú spotrebu reasoning tokenov pri výsledoch, ktoré sú porovnateľné s GPT 6 Astra. V nákladoch na úlohu prekonáva celú konkurenciu.

Oveľa viac ale prekvapil Dots. Je to v podstate to isté ako Muse, ktorý predstavila Meta, ale z dielne OpenAI. Predpokladám, že práve toto je to, na čom pracoval autor OpenClaw Peter Steinberger, odkedy nastúpil do OpenAI. Dots má svojho vizuálneho predstaviteľa, ktorého si viete prispôsobiť, a dokonca môžete použiť medzi deťmi populárnu značku Labubu. Oproti Muse by mal byť Dots samostatnejší, pracovať sám a vám len posielať priebežné aktualizácie.

BIZ okienko
Google oznámil, že ChromeOS skončí v roku 2034. To je síce až o 8 rokov, ale zasa to zanecháva pachuť, keď sa spoľahnete na technológiu Googlu, ktorá sa nestane mainstreamom.

Google spustil pilotný projekt, v rámci ktorého približne 100 stránkam platí za obsah použitý v AI odpovediach. A väčšina účastníkov hlási, že kompenzácie nenahrádzajú pokles príjmov. Ešte pred pár rokmi sme si nevedeli predstaviť, že Google príde o svoje monopolné postavenie, a dnes prichádza doba, keď sa ľudia už ani neunúvajú chodiť na Google. A viete, kto je na tom ešte horšie ako ten Google? Nuž, my poskytovatelia obsahu pre AI.

Reddit sa začína presne takémuto vykrádaniu dát brániť a obmedzuje spôsoby, ako sa dostať k jeho obsahu. Napríklad ďalšími limitmi na prístup cez old.reddit.com.

AMD za 8 miliárd dolárov kupuje World Labs. Táto firma vytvára model Marble, ktorý je určený na generovanie interaktívnych 3D svetov. Akvizíciou získava aj spoluzakladateľku Fei-Fei Li.

AI okienko
Zasa sa nám urodilo neúrekom nových modelov. Sonnet 5.5 od Anthropicu by mal robiť to isté ako Opus 5.5, ale na jednoduchších úlohách, kde netreba toľko rozmýšľať, a za menej peňazí.

Google konečne predstavil svoju verziu top modelu Gemini 4 Argon. Jediná jeho chyba je, že je zatiaľ dostupný iba úzkej skupine odborníkov na bezpečnosť a testerom. Inak sú jeho štatistiky najmä v testoch automatizácie zaujímavé.

Aj Cloudflare sa chce zviezť na vlne Jev a ponúka svoj model Clef. Ten má aj verziu Flash, ktorá je ultrarýchla a stále len trošku zaostáva za Jev.

Flux 3 Image model od Black Forest Labs dokáže pri generovaní kontrolovať každý pixel, čo v preklade znamená, že okrem textového promptu viete prompt aj zacieliť na konkrétne miesto v obrázku, a tak mať kompozíciu výsledného obrázka oveľa viac a jednoduchšie pod kontrolou.

Kolibri je 78-miliardový open-weight model, ktorý ovláda iba angličtinu a nemčinu, ale je navrhnutý na nasadenie vo verejnej správe a priemysle, kde záleží na regulácii, teda takmer všade v EÚ.

Pre tých, čo hľadajú harness: vyšla jednotková verzia Pi, ktorý mimochodom používame aj my, keď sa hráme s open-weight modelmi. Pi 1.0 pridáva najmä Codemode, cez ktorý si budete vedieť napojiť MCP, Jev alebo image modely. A tiež kopec iných malých/veľkých vylepšení.

Claude Code dostal mody. To sú malé TypeScript rozšírenia CC, ktoré vám umožnia zavesiť sa na CC eventy a tiež vypisovať do CC informácie. Napríklad vytvoriť časovú os, ktorá bude zobrazovať, čo CC akurát robí. Tiež vypisovať, koľko súborov CC zmenil a ktorý ako posledný. Samozrejme, existujú aj hotové mody, ale kto by si nechal vziať radosť vyvibecodiť si vlastný?

Niečo, čo ja tvrdím už dávno. Agenti nepotrebujú spravovať pamäť, potrebujú dobrú dokumentáciu/specku. Ak sa pristihnete pri tom, že presviedčate svoj model, že má updatnúť nejakú informáciu do pamäte, tak máte skôr problém inde ako v modeli.

.NET okienko
Nasledujúci článok o Middleware tu dávam najmä preto, že popisuje scenár, keď potrebujete zmeniť response potom, ako ste ju začali používať.

V .NET 11 pribudla automatická CSRF ochrana, preto je dobré vedieť, ako ju vypnúť, ak ju z nejakého dôvodu nechcete. Inak, táto ochrana je kompatibilná so svojou starou verziou a je to dobrý krok k bezpečnosti.

Linky na záver
Dnes tu mám samé veci, pri ktorých neužitočne zabijete čas. Prvá je Space Now, kde vidíte naživo polohu satelitov na orbite. Nekončí to však len pri bežných satelitoch, nájdete tam aj sondy, ktoré ľudstvo vyslalo do vesmíru, aj s ich dráhami. Okrem toho si viete zapnúť ambient mód a pozerať si planéty s hudbou v pozadí.
Druhá oddychovka bude tiež vo vesmíre. Tu usmerňujete loď pomocou dobre umiestnených čiernych dier, ktoré gravitačne ovplyvňujú jej smer tak, aby sa dostala do cieľa.
Nakoniec taká vizuálna vec. Anthropic modely nevedia generovať obrázky, ale posledné verzie 5.5 majú celkom silné vizuálne vnímanie, tak prečo nenapísať Python skript, ktorý bude simulovať ťahy štetcom, aby vytvoril obrazy?

Vizuálna bodka na záver
Dnes má vizuálna bodka zaujímavý príbeh. Firme zostalo pár robotov starej generácie, ktoré chcela nejako zaujímavo vyradiť z prevádzky, a tak požiadala komunitu o radu, ako na to. Ozval sa Arnold Schwarzenegger s tým, že nech sa samy zničia skokom do roztavenej ocele. A tak sa firma dohodla s oceliarňou až vo Fínsku a roboty špeciálne vytrénovala, aby efektne skočili z mostíka. Tu je odkaz na článok a tu video.









