Krásný víkend!
Jak často řešíš, komu ve světě AI svěřuješ svá data, prompty, fotografie?
Poslední týdny ve světě AI totiž nejsou jen o nových funkcích a modelech. Začíná se řešit něco, co dlouho stálo spíš trochu bokem: komu vlastně svoje data svěřujeme. A vůbec se teď nebavím o čínských firmách - tam je ta obezřetnost dost na místě už delší dobu.
Kauza kolem Anthropic to celé ukazuje naplno. Firma se před pár týdny dostala do sporu s americkou vládou poté, co odmítla uvolnit svůj model Claude pro citlivé vojenské využití bez jasných pravidel. Výsledkem byl tlak ze strany státu, zákaz ve federální správě a v tomto týdnu nakonec i soudní zásah, který tyhle kroky alespoň dočasně stopnul.
Mezitím se to ale vše rychle promítlo do chování lidí. Část uživatelů začala odcházet od OpenAI a jejich ChatGPT (protože OpenAI se rozhodlo zaskočit za Anthropic a začít spolupracovat s vládními institucemi, což (minimálně teoreticky) otevírá otázky kolem práce s uživatelskými daty) právě k Anthropicu a jejich Claude, kde mají, díky přístupu firmy, pocit většího bezpečí a jistoty, že jejich data nebudou sdílena způsobem, který nemají pod kontrolou.
AI není jen o tom, co umí. Je to i o tom, komu věříš.
Suno v5.5
Suno v5.5 přináší tři věci, které mají společný jmenovatel: méně generické výstupy a víc tvého rukopisu. Nová verze modelu staví na Voices, Custom models a My Taste, tedy na personalizaci hlasu, stylu i preferencí. Jinými slovy, Suno se nesnaží jen vyrobit skladbu, ale lépe napodobit to, co se ti líbí a jak tvoříš.
Největší změna jsou Voices, funkce pro tarify Pro a Premier, která ti dovolí nahrát nebo živě zachytit vlastní zpěv a pak s ním generovat nové skladby. Suno to doplňuje ověřením, kdy porovnává zpěv z nahrávky s náhodnou větou, kterou máš říct, aby se z toho nestal veřejný bazar s cizími hlasy. A hlavně, tvoje Voices mají být soukromé, použitelné jen tebou, sdílení má přijít až později a s důrazem na kontrolu ze strany autora.
Druhá vrstva je Custom models, tedy možnost doladit v5.5 na vlastní katalog, když nahraješ svoje původní tracky. Suno říká, že tak vznikne personalizovaná verze modelu, která zná tvůj styl, a Pro a Premier uživatelé si mohou vytvořit až tři. To je dobrá zpráva pro každého, kdo chce konzistentnější sound napříč skladbami, třeba pro firemní znělky nebo pro producenty, kteří nechtějí, aby každá ukázka zněla jako náhodná inspirace z internetu. Nebo pro virtuální “kapely”, které chtějí mít svůj styl :-)
A pak je tu funkce My Taste, dostupná pro všechny, která se časem učí, jaké žánry a nálady si vybíráš nejčastěji. Je to takový učenlivý pomocník, který se dívá na tvé volby a postupně tě méně nutí vysvětlovat stále to samé. Pokud jsi někdy u generování hudby strávil víc času upřesňováním promptu než poslechem, tak víš, o čem je řeč.
Stejně tě ale asi nejvíc bude zajímat, jak Suno 5.5 zní, že jo? Tady jsou dvě ukázky:
https://suno.com/s/J4Mzs3rvhj2H4dK3
https://suno.com/s/QEvnuKK8hpM7VUoh
Google představuje Lyria 3 Pro
Google posunul generování hudby z režimu “ochutnávka“ do něčeho, co už se dá použít jako reálný podklad do videa, podcastu nebo prezentace. Nová Lyria 3 Pro umí generovat skladby až kolem 3 minut a navíc drží strukturu typu intro, sloka, refrén, bridge.
Když to porovnám se staršími verzemi, skok je hlavně v délce a v tom, jak moc máš kontrolu nad formou. Lyria 3 v aplikaci Gemini byla (a pořád je) typicky 30sekundová hudba na rychlé nápady, mood a krátké podkresy.
U Lyria 3 Pro se tím pádem mění workflow: místo slepování několika ústřižků můžeš vygenerovat jeden souvislý track, který už vypadá jako písnička
Kde všude se Lyria 3 Pro objevuje? Google ji tlačí napříč ekosystémem, takže ji najdeš všude - od Gemini app přes Google Vids až po Vertex AI, AI Studio a Gemini API pro vývojáře a firmy. Když je hudba přímo tam, kde už tvoříš, roste šance, že ji začneš používat jako běžnou součást produkce. A nebudeš z Google odcházet tvořit hudbu třeba do… Suna :-)
A ještě jedna věc, která je pro firmy a agentury celkem důležitá: Google u Lyria zmiňuje označování výstupů pomocí SynthID a kontroly originality, aby bylo jasnější, co je AI a co ne. Což je dobrý signál směrem k bezpečnějšímu používání v komerčních výstupech.
Jak na tvorbu AI videa prakticky?
V pondělí 30. března v 17 hod. to pouštím živě. Pokud ses chtěl/a na webinář “Začněte tvořit AI videa (jako profíci)“ připojit, ale ještě jsi to neudělal/a, tohle je poslední připomenutí.
Bude to praktické a k věci: ukážeme konkrétní postupy a příklady, které můžeš rovnou použít, a necháme prostor i pro dotazy. Žádná velká teorie. Prostě vytvoříme za dvě hodiny komplet video.
Jestli si nejsi jistý/á, jak se pustit do tvorby AI videí pro sebe, do práce nebo pro své podnikání, ber to jako možnost nasát to podstatné a udělat si jasno, jak na AI videa. Malé tajemství: není to totiž jen o perfektním promptu a kouzelném modelu pro generování videí.
Pokud už přihlášený/á jsi, super, v pondělí se uvidíme.
Claude Code Auto mode: konec klikání na “OK“. Ale s pojistkou
Anthropic do Claude Code přidává Auto mode, tedy režim, kdy Claude sám rozhoduje o povoleních pro akce typu zápis do souborů nebo spuštění příkazů v terminálu. V běžném režimu je Claude schválně “přísný“ a ptá se skoro pořád, což je sice bezpečné, ale u delších úkolů to mění práci v nekonečný a často i otravný ping pong. Hodně lidí to řešilo brutálně, prostě spustili --dangerously-skip-permissions, což je rychlé, ale umí to zabolet, když se něco nepovede. Auto mode je kompromis - méně vyrušování a současně menší riziko než úplné vypnutí brzd.
Jak to funguje prakticky? Před každým “tool call“ proběhne kontrola klasifikátorem, který se snaží odchytit destruktivní nebo podezřelé věci, třeba hromadné mazání souborů, exfiltraci citlivých dat nebo spuštění škodlivého kódu. Bezpečné akce nechá projít automaticky, rizikové blokuje a Claude zkusí jiný postup. Když se bude pořád snažit o něco, co je blokované, nakonec tě to stejně vyzve k ručnímu potvrzení. Jde vlastně o takového autopilota, který občas řekne “hele, teď si na chvíli sedni za volant ty“.
Anthropic tuto funkci zatím označuje jako research preview a zároveň rovnou říká, že to snižuje riziko, ale neeliminuje ho. Klasifikátor může občas pustit něco, co bys radši nepustil, nebo naopak zablokovat neškodnou věc, třeba když je záměr nejasný nebo Claude nemá dost kontextu o tvém prostředí. Proto pořád platí doporučení používat Auto mode v izolovaném prostředí, typicky separátní repository, sandbox, kontejnery, cokoliv bez ostrých klíčů a produkčních dat.
Zapnutí je jednoduché: v CLI claude --enable-auto-mode a pak přepínání režimu přes Shift+Tab, ve VS Code a na Desktopu se Auto mode zapíná v nastavení Claude Code a volí se v rozbalovačce režimu povolení. Aktuálně tato funkce běží jako náhled pro Claude Team a má to postupně dorazit i na Enterprise a API, plus je to omezené na modely Claude Sonnet 4.6 a Opus 4.6.
In silico neurověda: když si experiment nejdřív vyzkoušíš na “digitálním mozku“
Meta spolu s akademiky teď vyšlo ven se zajímavým experimentem: místo desítek malých modelů, které umí předpovídat mozkovou aktivitu jen pro jeden typ podnětů nebo jedno měření, vzniká jeden společný základ. Jejich TRIBE v2 je trimodální model, který bere video, zvuk i text a snaží se předpovědět, jak by na to zareagoval mozek ve fMRI. Cíl je ambiciózní, ale zároveň přízemní: mít univerzální model, který umí “překládat“ multimodální podněty do očekávané mozkové odezvy napříč úlohami a lidmi.
Že úplně netušíš, co je fMRI? Stará dobrá funkční magnetická rezonance. Je to metoda, která nepřímo měří aktivitu mozku podle toho, kde se v mozku mění průtok a okysličení krve. Tomu se říká BOLD signál (Blood Oxygen Level Dependent). Když při fMRI něco děláš (koukáš na video, posloucháš zvuk, čteš text), skener v čase sleduje, které oblasti mozku se “rozsvěcují“ víc než jindy.
Ale zpět k TRIBE v2.
Má celkem zajímavý dopad na práci výzkumníků. Když máš model, který slušně predikuje odezvy, můžeš dělat takzvané in silico experimenty: pustíš do něj podněty, které bys jinak musel měřit v magnetu, a koukneš, jestli se objeví známé efekty a oblasti mozku, které už věda popsala. Jinými slovy si otestuješ hypotézu nanečisto, vybereš lepší podněty, doladíš design studie, a teprve pak jdeš za lidmi a za drahým měřením.
Z produktového pohledu je na tom sympatické, že TRIBE v2 pod kapotou kombinuje moderní modely pro text, video a audio a sjednocuje je do tzv. Transformer architektury, která mapuje reprezentace na mozkovou kůru. A Meta k tomu rovnou dává ven kód, váhy i notebook pro demo, takže se dá rychle pochopit, co to dělá a co ne.
A co si z toho můžeš odnést ty, i když neděláš neurovědu? Jednak to, že multimodální systémy se začínají testovat “přes člověka“ mnohem konkrétněji než jen přes klasické benchmarky. Jednak to, že se tu rýsuje nová vrstva interpretovatelnosti: místo debat, co je v modelu “uvnitř“, můžeš u některých úloh porovnávat, jestli se reprezentace chovají podobně jako lidské zpracování. Ne jako ultimátní pravda, spíš jako další kompas, který občas zachrání případnou slepou uličku a pár týdnů práce.
OpenAI zařízlo Soru (a nejen ji)
Ještě v minulých 5 tipech od Petra jsem tu psal o plánech OpenAI, jak integrovat Soru ještě víc do prostředí ChatGPT a ejhle… V týdnu OpenAI oznámilo, že Sora končí. Kompletně. Tedy, že skončí i související služba pro vývojáře.
Proč by OpenAI zahazovalo produkt, který byl ještě nedávno všude? A ještě ke všemu na něj byl navázaný milardový obchod s Disney?
Podle dostupných informací je to kombinace dvou věcí. Video modely jsou extrémně náročné na výpočet a provoz a zároveň se firma snaží víc soustředit na hlavní byznys, hlavně ChatGPT a nástroje pro firmy a programování, zvlášť když se mluví o přípravách na vstup na burzu.
Některé zdroje navíc zmiňují, že zájem o Soru postupně klesal a konkurence v AI videu mezitím hodně zrychlila. Osobně jsem věřím, že dost pravdy bude i na tomto. Kling, Seedance nebo Veo zvládají generování videí o dost lépe. A u Sory mě teda dost vadilo i to, že jakmile ve videu byla lidská postava (a klidně vygenerovaná s pomocí AI), tak člověk mohl na nějaké video zapomenout.
Co máš udělat teď, pokud máš v Soře vygenerovaná nějaká videa?
Pokud jsi Soru používal(a), počítej s tím, že dostaneš nějaké časové okno na export dat. Rozumný krok je stáhnout si důležité výstupy co nejdřív, jakmile to půjde.
Přesné termíny zatím nejsou venku, takže se vyplatí sledovat komunikaci OpenAI, ať něco neprošvihneš.
Co dalšího v OpenAI tento týden “zařízli”? Podle Financial Times OpenAI odložilo na neručito plány na erotický režim pro ChatGPT. Část zaměstnanců a také investoři upozorňovali na možné společenské dopady sexualizovaného obsahu a na riziko nezdravých emočních vazeb na chatbota, hlavně u zranitelných lidí. A když se k tomu přidalo i to větší soustředění se na vlastní byznys OpenAI(jak jsem psal výše), tak je to celkem pochopitelné.
A to je pro tento týden vše.
Moc díky za přečtení a příště se uvidíme až po Velikonocích - 10. dubna. Ano, i já si dávám velikonoční prázdniny :-)
Ať mášdo té doby krásný čas a když si najdeš chvilku na doporučení 5 tipů od Petra kamarádům pomocí následujícího tlačítka, pomůžeš své karmě :-)

