OpenAI se chce stát novým Applem a Čína reguluje emoce v AI agentech
- • OpenAI plánuje smartphone založený na AI a boří monopol aplikací
- • Čína reguluje emocionální AI asistenty
- • Google integruje nativní formáty Office do Gemini
OpenAI chce skoncovat s monopolem společnosti Apple na aplikace
Podle analytika Ming-Chi Kuo pracuje OpenAI na chytrém telefonu, který nahradí aplikace AI agenty. Spolupráce se společnostmi MediaTek, Qualcomm a Luxshare se zaměřuje na vlastní čip a zařízení, které neustále rozumí kontextu uživatele. Místo přes App Story by úkoly vyřizovali přímo agenti, bez omezení ze strany Applu a Googlu. S téměř miliardou týdenních uživatelů ChatGPT by tak OpenAI mohla získat přímější přístup k uživatelským datům. CEO společnosti Nothing Carl Pei rovněž předpovídá konec éry aplikací. Ambice v oblasti hardwaru zahrnují také sluchátka Earbuds, která by se měla objevit v roce 2026 → AI Valley
Synthszr Take: OpenAI buduje iPhone věku agentů, ale skutečná inovace spočívá jinde. Společnost nejenže obchází App Story, ale vytváří novou kategorii „kontextového stroje“, který neustále přemýšlí, místo aby čekal na příkazy. Nabízí se srovnání s počátky webu: tehdy prohlížeče nahradily tisíce desktopových programů, nyní by agenti mohli rozložit ekonomiku aplikací. Technická výzva je zvládnutelná (MediaTek a Qualcomm vyrábějí čipy už dlouho), ale ta regulační bude brutální. Kdo ponese odpovědnost, když agent samostatně přebookuje let nebo objedná léky? Sázka OpenAI: kontext uživatele poráží kontrolní mechanismy
Čína reguluje emocionální AI asistenty
Čína zavádí od července 2026 komplexní regulace pro antropomorfní AI služby, které simulují emocionální interakce s uživateli. „Předběžná správní opatření pro antropomorfní interakční služby založené na AI“, vydaná společně pěti národními úřady, poprvé definují právní hranice pro AI systémy, které napodobují lidské osobnostní rysy, způsoby myšlení a komunikační styly. Regulace explicitně rozlišují mezi emocionálními doprovodnými službami a funkčními AI asistenty, jako jsou zákaznický servis nebo vzdělávací nástroje. Poskytovatelé musí provádět bezpečnostní hodnocení, pokud mají více než 100 000 registrovaných uživatelů nebo 10 000 měsíčně aktivních uživatelů. Zvláště přísné jsou požadavky pro nezletilé: virtuální příbuzenské nebo partnerské vztahy pro děti do 18 let jsou zcela zakázány, služby pro děti do 14 let vyžadují souhlas rodičů. Předpisy rovněž vyžadují nouzové intervenční mechanismy při zjištění rizika sebepoškození a jasné označení, že uživatelé komunikují s AI, a ne s lidmi. → Hello China Tech
Synthszr Take: Čína píše první soubor pravidel pro technologii, která je na Západě stále považována za neškodnou hračku. Rozlišení mezi funkční AI (povolena) a emocionální AI (regulována) připomíná oddělení potravin a léčiv: jakmile produkt slibuje terapeutické účinky, platí jiné standardy. Povinnost kontaktovat příbuzné v případě rizika sebepoškození činí z poskytovatelů AI digitální záchranáře – odpovědnost, kterou dnes nenesou ani platformy sociálních médií. Dvouhodinové varování kopíruje regulaci herního průmyslu, ale analogie pokulhává: hry jsou koncipovány jako zábava, emocionální AI společníci slibují skutečné vztahy. Čína zachází s emocionální AI jako s kontrolovanou látkou, zatímco Silicon Valley stále sní o „Companion Apps“ jako o dalším trhu pro jednorožce.
Gemini: Excel už nepotřebuje Excel
Google rozšiřuje svého AI asistenta Gemini o přímé generování nativních formátů souborů. Uživatelé mohou nově nechat vytvářet dokumenty Workspace (Docs, Sheets, Slides), soubory PDF, formáty souborů Microsoft Office (DOCX, XLSX), CSV, LaTeX, TXT, RTF a Markdown, aniž by museli opustit aplikaci Gemini. Tato funkce nahrazuje dosavadní kopírování a vkládání: místo kopírování textu z Gemini a jeho ručního vkládání do jiných programů vznikají hotové, sdílitelné soubory přímo v požadovaném formátu. V demonstračním videu Google ukazuje, jak jsou ručně psané poznámky po nahrání převedeny do studijní pomůcky ve formátu PDF formátované v LaTeXu s vizualizacemi, grafy a rovnicemi. Současně přicházejí do Velké Británie personalizační funkce: funkce „Memories“ ukládá preference uživatelů a je možné importovat chaty z jiných AI aplikací. → us.list-manage.com
Synthszr Take: Google řeší problém, který sám vytvořil: past formátů mezi výstupem AI a produktivním dalším zpracováním. Tento vývoj připomíná přechod od CRT monitorů k plochým obrazovkám: léta jsme se spokojovali s provizorními řešeními (snímky obrazovky, kopírování a vkládání), dokud někdo neimplementoval zřejmé řešení. Generování souborů v Gemini není ani tak technickou inovací, jako spíše uznáním, že AI asistenti nesmí být izolovanými věštírnami, ale musí se hladce integrovat do stávajících pracovních postupů. Microsoft bude tento vývoj jistě bedlivě sledovat, koneckonců jeho formáty Office žijí z toho, že jsou de facto standardem pro výměnu dokumentů. Skutečný trik spočívá v podpoře LaTeXu: Google tím signalizuje, že Gemini není určen jen pro běžné uživatele, ale bere vážně i vědecké a technické případy použití.
Vaši agenti teď mohou nakupovat se Stripe
Stripe Link rozšiřuje svůj platební systém o funkce autonomních agentů. AI agenti nyní mohou provádět transakce samostatně, zabezpečené jednorázovými kartami, blokovanými přístupovými údaji a individuálním schválením pro každý nákup. Integrace probíhá prostřednictvím jediné instalace npm a souboru SKILL ve formátu Markdown. Současně Gemini od Googlu přináší přímé generování souborů do chatu (PDF, Word, Excel, Google Docs), zatímco ElevenLabs spouští ElevenMusic, tržiště pro hudbu generovanou AI, kde uživatelé vydělávají na používání svých skladeb. Pika mezitím vyvíjí „agenty“ jako kreativní partnery s hlasem, tváří a osobností, kteří zdokonalují obsah prostřednictvím konverzace. Startup Nebius nabízí „Token Factory“ pro jemné ladění modelů na základě uživatelských dat s dedikovanými GPU endpointy. → TAAFT - There’s An AI For That
Synthszr Take: Stripe dělá rozhodující krok od poskytovatele platebních služeb k infrastruktuře pro autonomní ekonomické aktéry. Jednorázové karty fungují jako kapesné pro teenagery: omezené, sledovatelné, ale s reálným prostorem pro jednání. To připomíná první experimenty s předplacenými kartami pro mobilní telefony v 90. letech, které náhle připojily k síti miliony lidí bez prověřování bonity. Rozdíl je v tom, že tentokrát novými účastníky trhu nejsou lidé, ale řádky kódu. Zatímco všichni filozofují o AGI, Stripe potichu buduje pokladní infrastrukturu pro ekonomiku, ve které software nejenže požírá svět, ale také sám platí.
Nvidia uvolňuje multimodální AI model jako open source
Nvidia vydala multimodální AI model Nemotron 3 Nano Omni, který v jediné architektuře spojuje vidění, zvuk a jazyk. Model má 30 miliard parametrů, ale díky designu Mixture-of-Experts využívá při každém inferenčním průchodu pouze 3 miliardy. Nvidia tvrdí, že má 9krát vyšší propustnost než srovnatelné otevřené modely a uvádí šest benchmarků. Model běží na jediné GPU a jako vstup zpracovává text, obrázky, audio, video, dokumenty a diagramy. Architektura využívá 23 vrstev Mamba-2, 23 vrstev Mixture-of-Experts se 128 experty (6 aktivních na token) a podporuje kontextové okno o velikosti 256 000 tokenů. Je k dispozici na Hugging Face pod licencí Nvidia Open Model Agreement s plnými komerčními právy na použití. → Techpresso
Synthszr Take: Nvidia hraje stejnou hru jako Apple s iPhonem: hardware a software z jedné ruky, jen s tím rozdílem, že „aplikacemi“ jsou zde AI modely. Architektura Mixture-of-Experts funguje jako systém urgentního příjmu v nemocnici: každý pacient (token) je přesměrován přesně k těm specialistům (6 ze 128 expertů), které potřebuje, místo aby zaměstnával všechny lékaře najednou. To vysvětluje, proč si model s 30 miliardami parametrů vystačí s pouhými 3 miliardami aktivních parametrů. Historicky to připomíná strategii IBM ze 60. let, kdy neprodávali jen sálové počítače, ale dodávali k nim i software – jenže Nvidia navrhuje lock-in elegantněji: modely jsou open source, ale optimalizované pro hardware Nvidia. Skutečným trikem je sjednocení: místo orchestrace tří specializovaných modelů pro vidění, zvuk a text (s obvyklou latencí na každém rozhraní) proudí všechny modality stejným kanálem. Nvidia už neprodává jen lopaty pro zlatou horečku, ale teď už kope sama.
NEXT26: Google představuje Gemini Enterprise Agent Platform
Google Cloud NEXT '26 měl jasný titulek: Gemini Enterprise Agent Platform. Kompletní rebranding Vertex AI, Agent Designer, Long-Running Agents s perzistentní pamětí. Thomas Kurian řekl 32 000 lidem v Las Vegas, že jsme pilotní fázi AI zanechali za sebou. To je pravda. Ale technicky nejzajímavější oznámení dostalo možná desetinu času v hlavní keynote: GKE Agent Sandbox, nyní Generally Available. Problém je jednoduchý: každý tutoriál pro agenty končí stejně – agent přemýšlí, píše kód a spouští ho, většinou pomocí volání exec() přímo na produkčním stroji. Kód generovaný LLM je zásadně nebezpečný, mohl by způsobit nekonečné smyčky nebo v multi-tenant prostředích otrávit jiné agenty. Dosavadní řešení byla všechna suboptimální: brány pro lidskou kontrolu zabíjejí automatizaci, přísné parsery výstupů se rozbijí při aktualizacích modelu, VM na agenta potřebují 10–30 sekund na studený start. → Dev.to AI
Synthszr Take: Google zde buduje infrastrukturu pro svět, ve kterém se agenti generující kód stanou tak běžnými jako dnes volání API. Čísla jsou působivá: izolace pod jednu sekundu, 300 sandboxů za sekundu, o 30 % lepší poměr cena/výkon na Axion N4A. Claim Model (podobně jako PersistentVolumeClaims) elegantně abstrahuje složitost – vývojáři požádají o sandbox, dostanou zpět stabilní endpoint a nikdy se nemusí starat o IP adresy podů. Zvláště chytrá je funkce pozastavení/obnovení pomocí GKE Pod Snapshots, která zmrazí dlouhodobě běžící agenty uprostřed procesu uvažování a později jim umožní pokračovat přesně tam, kde přestali. Lovable už denně prohání sandboxem 200 000 projektů, to už není signál beta verze. Co sandbox neřeší: gVisor izoluje systémová volání, ne záměry – když agent provádí HTTPS volání ven, je to platné systémové volání. Google sází na to, že bezpečné spouštění se stane důležitějším než efektní funkce, až se agenti z demoverzí stanou produkčními systémy.
Vývojářské nástroje se stávají agentickými: novinky od Warp a Zed
Svět vývojářských nástrojů právě zažívá zásadní změnu: Warp, terminál s podporou AI, zveřejňuje svůj kompletní kód v Rustu pod licencí AGPL-v3 a během několika hodin dosahuje 40 000 hvězdiček na GitHubu. Současně Zed po pěti letech vývoje vydává verzi 1.0 svého GPU-renderovaného editoru kódu, který se zcela obejde bez Electronu. Skutečný trik u Warpu: příspěvky již neprobíhají prostřednictvím klasických Pull Requestů, ale přes vlastní systém Oz, který paralelně využívá několik AI agentů pro kódování, plánování a testování. Vývojáři v podstatě řídí tým robotů, místo aby programovali sami. Zed naopak sází na brutální výkon díky GPU renderování jako ve videohrách a integruje AI asistenty přímo do editoru. Oba projekty značí trend směřující k nativnímu výkonu a integraci AI jako klíčovým prvkům. → AlphaSignal
Synthszr Take: Zveřejnění kódu Warpu jako open source se řídí principem franšízy McDonald’s: recept je veřejný, ale skutečná hodnota spočívá v operačním systému kolem něj. Warp dává kód zdarma, ale prodává orchestraci AI agentů jako službu. To připomíná počátky Red Hatu, který dával Linux zdarma a prodával podporu, jen s tím rozdílem, že tentokrát se „podpora“ skládá z autonomních agentů, kteří pro vás vyvíjejí. Zed jde opačnou cestou a sází na radikální výkon jako na odlišující prvek, podobně jako kdysi id Software se svým Quake enginem konkuroval zavedené konkurenci. Oba přístupy ukazují: další generace vývojářských nástrojů se již nedefinuje podle funkcí, ale podle toho, kdo vlastně dělá práci – vy, nebo stroj.
AI agenti přebírají práci mediálních agentur
Velcí hráči v AdTech berou autonomní reklamu vážně. Taboola, The Trade Desk, TripleLift, Roks&Stars a Pubmatic představili během jednoho týdne své agentické systémy, které nejen podporují, ale také samostatně jednají. Od analýzy cílových skupin přes nastavení kampaní až po optimalizaci v reálném čase: AI agenti přebírají celý procesní řetězec. The Trade Desk již s partnerem Stagwell testuje Koa Agents, kteří na základě jednoduchých cílů automaticky orchestrují kampaně. TripleLift sjednocuje s TL Spark inventář, kreativu, cílové skupiny a měření do jedné „inteligentní vrstvy“. Taboola s Realize+ slibuje, že 80 procent marketérů by zvýšilo své rozpočty na otevřený web, pokud by tam byla dostupná stejná automatizace jako u Googlu nebo Mety. Systémy jsou stále ve fázích alfa nebo beta, ale první pilotní projekty již ukazují nižší CPM a efektivnější alokaci rozpočtu. → MEEDIA Daily Update
Synthszr Take: Reklamní průmysl právě zažívá svůj vlastní AlphaGo moment, jen s tím rozdílem, že nikdo nezná pravidla hry. Zatímco u šachů nebo go existují jasné podmínky pro vítězství, AI agenti v reklamě operují v prostoru bez definovaných kritérií úspěchu: Co je to „dobrá“ kampaň? Maximální počet kliknutí, minimální náklady, dlouhodobé budování značky? Systémy optimalizují na základě metrik, které ani samotné odvětví nedokáže jednoznačně definovat. To připomíná Goodhartův zákon: jakmile se metrika stane cílem, přestává být dobrou metrikou. Když AI agenti přesouvají miliardové rozpočty v milisekundách, vznikají nové zpětné vazby mezi konkurenčními algoritmy, digitální ekosystém, ve kterém se optimalizační strategie vyvíjejí koevolučně. Skutečná disrupce nespočívá v automatizaci, ale v tom, že stroje by mohly poprvé definovat, co úspěšná reklama vůbec znamená.
Taylor Swift definuje nové právní základy pro audio deepfakes
Taylor Swift podala žádosti o ochrannou známku na dvě zvukové nahrávky svého hlasu, ve kterých propaguje své fiktivní album „The Life of a Showgirl“. Navíc si zajistila práva na obrazový záznam jevištního vystoupení v jednom ze svých charakteristických třpytivých kostýmů s růžovou kytarou. Držitelka Grammy tak reaguje na četné deepfakes své osoby, včetně falešných reklam na nádobí, sexuálně explicitního obsahu a zmanipulovaných obrázků, které sdílel dokonce i Donald Trump. Swift tak následuje Matthewa McConaugheyho, který v lednu 2024 jako první celebrita nejvyšší kategorie požádal o řadu ochranných známek na obrázky, videa a zvuk své osoby. Právník specializující se na ochranné známky Josh Gerben zdůrazňuje, že registrace hlasu celebrity jako ochranné známky představuje právní novinku, protože dosavadní autorská práva chrání pouze existující nahrávky, zatímco technologie AI nyní mohou generovat zcela nový obsah s klamavě podobnými hlasy. Tento vývoj ukazuje trend: také Scarlett Johansson, Tom Hanks a Bryan Cranston se stále častěji brání proti neoprávněným AI replikacím svých osobností. → NBC News
Synthszr Take: Swift nechrání svůj hlas, ale svůj ekonomický podpis. Zvukové značky byly dosud DNA firem (lev MGM, zvony NBC), nyní se stávají osobním firewallem proti syntetickým dvojníkům. Ironií je, že Swift musí vymyslet fiktivní album („The Life of a Showgirl“), aby získala reálnou ochranu, protože právo ochranných známek vyžaduje konkrétní kontexty použití. Zatímco autorské právo operuje na hranici mezi originálem a kopií, právo ochranných známek vytváří novou kategorii: zaměnitelnou podobnost. To zásadně posouvá rovnováhu sil, protože majitelé ochranných známek mohou bránit nejen identickým replikacím, ale i přiblížením. Swift transformuje svůj hlas z kreativního výrazového prostředku na kontrolovatelné ekonomické aktivum.



