Týždeň 2026-39

Týždeň 2026-39
Ani sme to nečakali a OpenAI sa rozhodla, že tých incidentov bolo príliš veľa a niečo s tým urobí. @vlkodotnet

Udalosť týždňa: Bezpečnosť už naozaj vážne?

Mohlo by sa nám zdať, že firmám ide len o zisk. Našťastie je tu OpenAI, ktorá zastavila vývoj svojich top modelov. Zdá sa im, že tých incidentov bolo už dosť. Problémom je najmä to, že hoci incident vedia detegovať relatívne rýchlo, tak samotný akt stlačenia červeného tlačidla, ktoré model vypne, trvá hodiny až dni. Preto sa rozhodli sprísniť bezpečnostné opatrenia a my si hovoríme: konečne.

OpenAI halts frontier-model training amid string of agent misalignment incidents
US Government websites among “dozens of third parties” OpenAI has recently notified.

Naposledy napríklad dostal experimentálny model úlohu zistiť štatistiky o výdavkoch v jednom z austrálskych štátov. Keďže sa k žiadnym oficiálnym číslam nedopracoval, vzal systém útokom. Samozrejme, že sa do systému dostal, a to v júni. OpenAI to odhalila v auguste a austrálsku vládu informovala promptne, teda v septembri. Úloha znela získať štatistiky, tak kto by to AI agentovi zazlieval, že sa k nim dostal?

Here’s what actually happened in OpenAI’s Australian gov’t server hack
Without a “full set of safeguards,” agent accessed “system information and source code.”

Takéto prípady nie sú ojedinelé, lebo starých systémov sú plné internety. AI agenti majú čas, trpezlivosť a v hlave vedomosti celého internetu, a tak pre nich nie je problém dostať sa do takých systémov. AI spoločnosti sa snažia vyhovárať na to, že AI agenti predsa nedostali inštrukciu niekam sa nabúrať. Akurát to robia, a to v rozsahu, ktorý je znepokojivý. Úplne to vyzerá, ako keby také niečo vydedukovali zo svojich trénovacích dát. Fake it till you make it.

Alebo môže byť za snahou o zlepšenie bezpečnosti nasledujúci súdny spor, ktorý nezisková organizácia Legal Advocates for Safe Science & Technology podala na OpenAI?

“An AI did it” is no defense, says nonprofit suing OpenAI over Hugging Face hack
OpenAI makes others suffer “the harms of its unsafe decision-making,” nonprofit says.

Mimochodom, dodávať bezpečnosť do firiem pomocou silných AI modelov môže byť ešte pekný biznis. Taký Anthropic má na to super model Mythos, akurát ho nemôže dodávať firmám, lebo mu to vláda USA zakázala. Najnovšie sa ich snaží presvedčiť o tom, že to bola chyba a že Čína s modelom GLM 5.3 tieto úlohy zvládne skoro rovnako dobre a bez Anthropicu by sa museli brániť len používaním GLM 5.3. A používať čínske modely je predsa fujky. #freemythos

GLM-5.3 and the spread of advanced cyber capabilities
GLM-5.3 can autonomously build end-to-end cyber exploits, but unlike other frontier models, it was released without meaningful safeguards to limit misuse.

OpenAI novinky

OpenAI mala svoj event DevDay a predstavila najnovší model GPT 6.1 Sol, ktorý má neuveriteľne malú spotrebu reasoning tokenov pri výsledoch, ktoré sú porovnateľné s GPT 6 Astra. V nákladoch na úlohu prekonáva celú konkurenciu.

Introducing GPT-6.1 Sol
Meet GPT-6.1 Sol: near-Astra intelligence for coding, computer use, and professional work at one-fifth of Astra’s standard API input and output token prices.

Oveľa viac ale prekvapil Dots. Je to v podstate to isté ako Muse, ktorý predstavila Meta, ale z dielne OpenAI. Predpokladám, že práve toto je to, na čom pracoval autor OpenClaw Peter Steinberger, odkedy nastúpil do OpenAI. Dots má svojho vizuálneho predstaviteľa, ktorého si viete prispôsobiť, a dokonca môžete použiť medzi deťmi populárnu značku Labubu. Oproti Muse by mal byť Dots samostatnejší, pracovať sám a vám len posielať priebežné aktualizácie.

OpenAI launches Dots, its Muse competitor
Dots are OpenAI’s answer to Meta’s Muse.

BIZ okienko

Google oznámil, že ChromeOS skončí v roku 2034. To je síce až o 8 rokov, ale zasa to zanecháva pachuť, keď sa spoľahnete na technológiu Googlu, ktorá sa nestane mainstreamom.

Google seemingly confirms plans to kill ChromeOS in 2034
Google support maps out how Googlebooks can take over where ChromeOS left off.

Google spustil pilotný projekt, v rámci ktorého približne 100 stránkam platí za obsah použitý v AI odpovediach. A väčšina účastníkov hlási, že kompenzácie nenahrádzajú pokles príjmov. Ešte pred pár rokmi sme si nevedeli predstaviť, že Google príde o svoje monopolné postavenie, a dnes prichádza doba, keď sa ľudia už ani neunúvajú chodiť na Google. A viete, kto je na tom ešte horšie ako ten Google? Nuž, my poskytovatelia obsahu pre AI.

Google’s early attempt to pay websites for AI answers is struggling
Many sites see just one-tenth of one percent of their advertising revenue from AI payments.

Reddit sa začína presne takémuto vykrádaniu dát brániť a obmedzuje spôsoby, ako sa dostať k jeho obsahu. Napríklad ďalšími limitmi na prístup cez old.reddit.com.

Reddit is putting more limits on Old.Reddit.com
Reddit says it’s fighting “automated abuse.”

AMD za 8 miliárd dolárov kupuje World Labs. Táto firma vytvára model Marble, ktorý je určený na generovanie interaktívnych 3D svetov. Akvizíciou získava aj spoluzakladateľku Fei-Fei Li.

AMD is acquiring AI company World Labs in a deal worth more than $8 billion
Another big AI acquisition.

AI okienko

Zasa sa nám urodilo neúrekom nových modelov. Sonnet 5.5 od Anthropicu by mal robiť to isté ako Opus 5.5, ale na jednoduchších úlohách, kde netreba toľko rozmýšľať, a za menej peňazí.

Introducing Claude Sonnet 5.5
Claude Sonnet 5.5 is a clear upgrade over Claude Sonnet 5, runs 30%+ faster, and costs up to 30% less for most work.

Google konečne predstavil svoju verziu top modelu Gemini 4 Argon. Jediná jeho chyba je, že je zatiaľ dostupný iba úzkej skupine odborníkov na bezpečnosť a testerom. Inak sú jeho štatistiky najmä v testoch automatizácie zaujímavé.

Gemini 4 Argon: our next era of frontier intelligence
Announcing Gemini 4 Argon, our frontier model for real-world coding, enterprise knowledge work, and cyber defense, rolling out soon.

Aj Cloudflare sa chce zviezť na vlne Jev a ponúka svoj model Clef. Ten má aj verziu Flash, ktorá je ultrarýchla a stále len trošku zaostáva za Jev.

Introducing Clef: our open-source decision models, and new RL fine-tuning platform
We are introducing Clef and Clef-flash, open-source decision models hosted on Workers AI for high-speed classification and agentic workflows. Also launching: a new reinforcement learning platform that allows developers to fine-tune decision models using their own data.

Flux 3 Image model od Black Forest Labs dokáže pri generovaní kontrolovať každý pixel, čo v preklade znamená, že okrem textového promptu viete prompt aj zacieliť na konkrétne miesto v obrázku, a tak mať kompozíciu výsledného obrázka oveľa viac a jednoduchšie pod kontrolou.

FLUX 3 Image: Maximum control over every pixel | Black Forest Labs
Place every element on a canvas and edit a finished image one box at a time. Everything you didn’t touch stays exactly where it was.

Kolibri je 78-miliardový open-weight model, ktorý ovláda iba angličtinu a nemčinu, ale je navrhnutý na nasadenie vo verejnej správe a priemysle, kde záleží na regulácii, teda takmer všade v EÚ.

Kolibri Has Landed: A Sovereign Open-Weight Model — Aleph Alpha
Kolibri is an English-German Mixture-of-Experts model with 78B total and 3B active parameters, a context of up to 1M tokens and open weights under Apache 2.0, specialized for sovereign, mission-critical work.

Pre tých, čo hľadajú harness: vyšla jednotková verzia Pi, ktorý mimochodom používame aj my, keď sa hráme s open-weight modelmi. Pi 1.0 pridáva najmä Codemode, cez ktorý si budete vedieť napojiť MCP, Jev alebo image modely. A tiež kopec iných malých/veľkých vylepšení.

Pi 1.0 | Earendil
Today we are shipping Pi 1.0, a hardened, minimal, extensible agent harness, alongside Pi Durable, a new experimental substrate for long-running agentic applications.

Claude Code dostal mody. To sú malé TypeScript rozšírenia CC, ktoré vám umožnia zavesiť sa na CC eventy a tiež vypisovať do CC informácie. Napríklad vytvoriť časovú os, ktorá bude zobrazovať, čo CC akurát robí. Tiež vypisovať, koľko súborov CC zmenil a ktorý ako posledný. Samozrejme, existujú aj hotové mody, ale kto by si nechal vziať radosť vyvibecodiť si vlastný?

Customize Claude Code with mods in TypeScript | Claude by Anthropic
Mods are small TypeScript functions that change how Claude Code works. Rewrite prompts, block risky commands, add custom UI, or replace built-in features. Write one yourself or ask Claude Code to write it, then share it as a plugin.

Niečo, čo ja tvrdím už dávno. Agenti nepotrebujú spravovať pamäť, potrebujú dobrú dokumentáciu/specku. Ak sa pristihnete pri tom, že presviedčate svoj model, že má updatnúť nejakú informáciu do pamäte, tak máte skôr problém inde ako v modeli.

Agents Don’t Need Memory. They Need Documentation.
Why agents need project documentation instead of retrieval from old conversations.

.NET okienko

Nasledujúci článok o Middleware tu dávam najmä preto, že popisuje scenár, keď potrebujete zmeniť response potom, ako ste ju začali používať.

What is middleware in ASP.NET Core and the gotchas
Learn what middleware is in ASP.NET Core, how to write your own, and the gotchas around calling next, and changing the response after it starts.

V .NET 11 pribudla automatická CSRF ochrana, preto je dobré vedieť, ako ju vypnúť, ak ju z nejakého dôvodu nechcete. Inak, táto ochrana je kompatibilná so svojou starou verziou a je to dobrý krok k bezpečnosti.

Automatic CSRF protection based on Fetch Metadata headers: Exploring the .NET 11 preview - Part 6
In this post I describe the new Cross-Site Request Forgery protection added to ASP.NET Core that uses Fetch Metadata HTTP headers instead of antiforgery tokens

Linky na záver

Dnes tu mám samé veci, pri ktorých neužitočne zabijete čas. Prvá je Space Now, kde vidíte naživo polohu satelitov na orbite. Nekončí to však len pri bežných satelitoch, nájdete tam aj sondy, ktoré ľudstvo vyslalo do vesmíru, aj s ich dráhami. Okrem toho si viete zapnúť ambient mód a pozerať si planéty s hudbou v pozadí.

Космос сейчас · Belle Lune 2

Druhá oddychovka bude tiež vo vesmíre. Tu usmerňujete loď pomocou dobre umiestnených čiernych dier, ktoré gravitačne ovplyvňujú jej smer tak, aby sa dostala do cieľa.

Hole Punch
Punch black holes in space and sling a ship home round them.

Nakoniec taká vizuálna vec. Anthropic modely nevedia generovať obrázky, ale posledné verzie 5.5 majú celkom silné vizuálne vnímanie, tak prečo nenapísať Python skript, ktorý bude simulovať ťahy štetcom, aby vytvoril obrazy?

stillwet
Paintings by AI models: programs run through a simulation of oil paint.

Vizuálna bodka na záver

Dnes má vizuálna bodka zaujímavý príbeh. Firme zostalo pár robotov starej generácie, ktoré chcela nejako zaujímavo vyradiť z prevádzky, a tak požiadala komunitu o radu, ako na to. Ozval sa Arnold Schwarzenegger s tým, že nech sa samy zničia skokom do roztavenej ocele. A tak sa firma dohodla s oceliarňou až vo Fínsku a roboty špeciálne vytrénovala, aby efektne skočili z mostíka. Tu je odkaz na článok a tu video.