Vyšlo Fable 5.1, OpenAI stále odkládá novou aktualizaci
- • Anthropic uvádí na trh Fable 5.1 a slibuje nákladovou efektivitu.
- • OpenAI označuje Astru za kritické kybernetické riziko s vysokými schopnostmi.
- • World Labs představuje Atlas, který generuje 3D scény z několika málo fotografií.
Anthropic vydává Fable 5.1 a slibuje vyšší efektivitu za euro
Společnost Anthropic vydala modely Claude Fable 5.1 a Claude Mythos 5.1, dva modely s identickými váhami, které se liší pouze úrovní bezpečnostních bariér. Fable 5.1 je všeobecně dostupný a dodávaný přes AWS, Google Cloud a Azure. Mythos 5.1 běží pouze prostřednictvím programu pro ověřený přístup, který je otevřený pro kybernetické obránce a biovědce v amerických organizacích. Pro biologické schopnosti zřídil Anthropic přístupový program společně s vládou USA; registrace pro výzkumníky by se měla brzy otevřít.
Základní ceny se nemění: 10 dolarů za milion vstupních tokenů, 50 dolarů za milion výstupních tokenů. Snížena byla cena za Cache Reads, z 1 dolaru na 0,25 dolaru za milion tokenů. Podle poskytovatele jsou tak typické pracovní zátěže o zhruba 25 procent levnější než s Fable 5, u silně agentních úkolů až o přibližně 45 procent. Nezávislé předběžné hodnocení přináší jiný obrázek na úkol: 3,76 dolaru za úkol v Intelligence Index, o 20 procent více než u Fable 5, protože model spotřebovává přibližně 1,7krát více výstupních tokenů; snížení ceny cache přitom ušetří zhruba 1,40 dolaru.
V naměřených hodnotách vyniká především nový vědecký benchmark: V Terminal-Bench-Science 0.1 dosahuje Fable 5.1 podle společnosti Anthropic 52,6 procenta oproti 24,7 procenta u Fable 5. V Terminal-Bench 4.0 dosahuje Fable 5.1 55,8 procenta, Mythos 5.1 60,9 procenta, což vyčísluje rozdíl ve schopnostech mezi oběma bezpečnostními úrovněmi. Humanity’s Last Exam dosahuje 60,9 procenta bez nástrojů, GDPval-AA v2 1 853 Elo. V externím měření dosahuje model 66 bodů v Intelligence Index, což je nejvyšší dosud naměřená hodnota, před Claude Opus 5 s 63 a GPT-5.6 Sol s 61.
Anthropic se podle vlastního vyjádření také zabývá kritikou zákazníků ohledně uchovávání dat a příliš přísných ochranných mechanismů. Oznámené Enterprise Frontier Safeguards mají ukládat data na cloudových serverech zákazníků místo u společnosti Anthropic a mají být zavedeny v průběhu podzimu. Fable 5.1 má blokovat základní biologické otázky méně často než jeho předchůdce, zatímco Mythos 5.1 si zachovává stejná omezení. V oblasti kybernetické bezpečnosti nyní Anthropic umožňuje modelu Fable 5.1 identifikovat softwarové zranitelnosti, ale úkoly jako Penetrationstests, generování Exploit a binární skenování zranitelností nadále odkazuje na modely Opus. Z okruhu Early-Access zákazníků se k rychlosti a přesnosti modelu pozitivně vyjádřili mimo jiné CEO společnosti Every Dan Shipper a CEO společnosti Box Aaron Levie.
Z praxe jsou hlášeny konkrétní případy: V investiční firmě Millennium model našel příčinu vzácného pádu systému, na které vlastní inženýři roky selhávali. Cognition přesouvá svůj provoz s Opus 5 v Devinu při startu na Fable 5.1, Jane Street hlásí lepší čitelnost u dlouhých řetězců úkolů. V redakčních testech model plnil Agentenaufgaben za zhruba 60 procent času oproti Opus 5, ale na požadavek osmi až dvanácti citací dodal 43 kusů, včetně citací, které ve zdroji chyběly, a na nejvyšší Effort-Stufe dočasně ignoroval příkazy k zastavení. Vydání přichází v době, kdy se očekává vstup společnosti Anthropic na burzu a model Astra od OpenAI je stále v nedohlednu. → anthropic, artificialanalysis, axios, AI Weekly, Every
Synthszr Take: Model, který zvyšuje vědecký benchmark z 24,7 na 52,6 procenta, mění pořadí mezi institucemi rychleji než jakákoli jmenovací komise. Skutečný zlom spočívá v modelu přístupu: Biologické schopnosti Mythos 5.1 jsou distribuovány prostřednictvím programu, který Anthropic provozuje společně s vládou USA a je otevřen ověřeným organizacím v USA. Tím pádem jeden poskytovatel a jedna vláda společně rozhodují o tom, které laboratoře budou pracovat s nejlepším dostupným spoluvýzkumníkem, zatímco recenzní řízení (peer review) předpokládá, že recenzenti mají v rukou stejné nástroje. Případ Millennium ukazuje směr: Příčina, na které inženýři roky selhávali, je nalezena na jeden pokus a takové výsledky vznikají nejprve tam, kde je k dispozici Token-Budget, nikoli na katedře s grantovou žádostí. Další náskok v reputaci ve výzkumu vzniká u jednacího stolu o přístupových právech a tam univerzity dosud sedí jen zřídka.
OpenAI klasifikuje Astru jako kritické kybernetické riziko a omezuje přístup
Společnost OpenAI podle vlastních údajů zařadila Astru jako první model na úroveň „Critical“ pro schopnosti v oblasti kybernetické bezpečnosti, což je nejvyšší kategorie v jejich interním Preparedness Framework. Tato hranice je podle OpenAI dosažena, pokud model dokáže bez lidského řízení vyvinout funkční Zero-Day-Exploity v zabezpečených reálných systémech nebo z hrubě formulovaného cíle sestavit kompletní útočný řetězec. Na veřejném ExploitBench dosáhla Astra podle údajů společnosti 100 procent. Kvůli možné kontaminaci trénovacích dat vytvořila OpenAI navíc interní testovací sadu z 20 teprve nedávno odhalených zranitelností V8. Během této evaluace model údajně našel dvě dosud neznámé mezery a zabudoval je do řetězce exploitů; proces zveřejnění maintainerům stále probíhá. V testech vedených experty měla Astra také uniknout ze zabezpečeného browser-sandboxu a v operačním systému zkonstruovat eskalaci oprávnění až na úroveň root. → OpenAI
Synthszr Take: Čísla, která OpenAI ukazuje, pocházejí z konfigurace Daybreak-Blue, nikoli z produkční verze, která bude dodána později. Externě ověřitelných na těchto 100 procentech na ExploitBench tedy není nic. Pro bezpečnostní výzkumníky mimo společnost znamená tato klasifikace prakticky čekání, protože pokročilé schopnosti jsou nejprve zpřístupněny vybrané skupině testerů a kritéria pro přijetí nejsou nikde uvedena. Navíc OpenAI model natrénoval tak, aby spolehlivěji odmítal škodlivé kybernetické dotazy, a tato ochranná opatření v praxi postihují především lidi, kteří legitimně hledají zranitelnosti (pentest se v promptu zkrátka čte jako útok)..
World Labs představuje Atlas, světový model, který vytváří 3D scény z několika fotografií
World Labs, startup založený v únoru 2024 výzkumnicí v oblasti Computer-Vision Fei-Fei Li, představil svůj světový model Atlas. Podle siliconangle.com generuje Atlas z jediného 2D obrázku až minutu videa v rozlišení 1440p, které lze prohlížet z libovolných úhlů pohledu a zůstává přitom geometricky konzistentní. Technicky společnost popisuje architekturu jako multimodální autoregresivní Diffusion-Transformer, který zpracovává dráhy kamery a geometrii jako nativní vstupy, místo aby byl řízen textovými prompty. Kromě video snímků model podle poskytovatele také generuje 3D assety, jako jsou mračna bodů a Gaussian Splats. Jako cílovou oblast World Labs uvádí robotiku: vývojáři by měli být schopni zaznamenat reálný prostor běžným fotoaparátem chytrého telefonu a rekonstruovat jej jako simulaci, ve které robot naviguje a dostává přitom RGB obrazy i data z hloubkových senzorů. V slepém hodnocení dodržování drah kamery, které provedla sama společnost, byl Atlas údajně upřednostněn před Gemini Omni Flash a FLUX. → siliconangle.com
Synthszr Take: Minuta 1440p videa z jediné fotografie z mobilu, k tomu data o hloubce a mračna bodů: Pro trénink vnímání robota je to docela hodně použitelného materiálu. Navigaci a rozpoznávání objektů za měnících se světelných podmínek lze takto simulovat levněji než v hale plné fyzických instalací. Problém nastává při uchopování, protože tření a poddajnost předmětu nejsou obsaženy v žádné rekonstruované geometrii, a právě na tom chapadla v reálném provozu selhávají.
Muse Voice Transcribe od Mety je o 80 procent levnější než Google Cloud
Meta Superintelligence Labs včera vydaly Muse Voice Transcribe, první model laboratoře v reálném čase, který v jednom modelu spojuje streamingovou-transkripci, oddělení mluvčích a rozpoznání konce řeči. Přes Meta Model API stojí služba 3 dolary za 1 000 minut audia, tedy 0,18 dolaru za hodinu; Google Cloud Speech-to-Text si ve standardním tarifu účtuje 0,96 dolaru za hodinu. Na nezávislém benchmarku AA-WER-Streaming od Artificial Analysis dosáhl Muse podle Implicator.ai chybovosti slov 3,1 procenta, před Cartesia Ink-2 s 3,4 procenta, ElevenLabs Scribe v2 Realtime s 3,6 procenta a Gemini 3.5 Transcribe Live od Googlu se 4 procenty. Test je založen na zhruba osmi hodinách anglického audia a nevypovídá nic o více než 70 trénovacích jazycích, z nichž Meta při spuštění doporučuje 25 jako ověřené. U Diarizace, tedy přiřazování řečových úseků jednotlivým mluvčím, uvádí sama Meta chybovost 17,5 procenta. → Implicator.ai
Synthszr Take: 0,18 dolaru oproti 0,96 dolaru za hodinu, to je pětinásobek, a vedle toho působí náskok 0,3 procentního bodu v chybovosti slov jako dekorace. Meta přitom nepodhodnocuje jen Google: Cartesia stojí 4 dolary za 1 000 minut, ElevenLabs a Deepgram 6,50 dolaru a všichni se pohybují ve stejné chybové třídě mezi 3 a 4 procenty. Pokud se počítá s milionem hodin transkripce ročně, je to rozdíl 780 000 dolarů oproti Google, a za to nákupčí bez dlouhého váhání akceptuje 17,5% chybu v přiřazení mluvčích.
Google se podle WSJ chystá spustit model pro kódování s názvem „Skimaki“
Podle zprávy Wall Street Journal uvede Google DeepMind v nejbližších dnech na trh model zaměřený na programování: Gemini 3.8 Flash, interně nazývaný „Skimaki“, by se mohl objevit již ve středu. Noviny se opírají o anonymní interní zdroje, které modelu přisuzují výrazně vylepšené schopnosti kódování. Byl údajně testován interním nástrojem s názvem „Jetski“; zúčastnění vývojáři ho prý upřednostňují před Claude Opus od Anthropic. Na rozdíl od dosud nezveřejněného modelu Astra od OpenAI nepatří Skimaki do kategorie bilionových parametrů, ale do řady Flash, která je navržena pro rychlost a nízké náklady. → Gizmodo
Synthszr Take: V březnu se OpenAI zaměřil na kódování, nyní ho následuje Google a tento vzorec je již tak spolehlivý, že lze roadmapu jedné laboratoře odvodit od té sousední (tento kolotoč kopírování jsme popsali již na začátku května, jen se točí rychleji). Zajímavější než napodobování je spouštěč uvnitř firmy: Hassabis, který loni ještě brzdil, již měsíc není CEO DeepMind, Brin tlačí na tempo a o čtyři týdny později je na světě model pro kódování. To, že si Google vybral model Flash a ne bilionový parametr, ukazuje, kde se to vyplácí: Agenti spalují tokeny každou sekundu, a tam rychlý a levný model překoná ten největší v regálu.
OpenAI kontruje žalobě Applu: Apple si prý svá tajemství chránil špatně
OpenAI v probíhajícím sporu o obchodní tajemství odmítá odpovědnost a prohlašuje, že si Apple musí případný únik připsat sám sobě. Agentura Reuters informuje, že OpenAI tento postoj zastává v podání v rámci řízení, v němž Apple uplatňuje nárok na zcizení důvěrných informací. Jádrem obrany je podle OpenAI tvrzení, že Apple dotčené informace dostatečně nechránil; soudně to však potvrzeno není. Právně to míří na ústřední bod americké ochrany obchodního tajemství: Žalobce musí prokázat, že přijal přiměřená opatření k utajení, jinak se informace z právního hlediska nepovažuje za chráněné tajemství. → Reuters
Synthszr Take: OpenAI sahá po nejnepohodlnější páce, kterou ochrana obchodního tajemství nabízí: Tajemství právně existuje teprve tehdy, když dokážete, že jste s ním jako s tajemstvím zacházeli. Apple po desetiletí žije z pověsti nejtajemnější firmy v oboru a právě tato pověst se nyní stává důkazním břemenem. V praxi dochází k úniku tajemství kvůli přístupovým právům, která nebyla po odchodu zaměstnance nikdy resetována, a kvůli sdíleným úložištím, do kterých mohou nahlížet celá oddělení.
Physical Superintelligence startuje s 58 miliony dolarů v seed investici pro virtuální fyziky
Matt Pines, Alex Klokus a Alexander Wissner-Gross představili 1. září 2026 společnost Physical Superintelligence (PSI) a oznámili seed investiční kolo ve výši 58 milionů dolarů pod vedením Breakthrough Energy Ventures. Podle oznámení se na něm podílejí mimo jiné Dragon Global, SV Angel, Susa a jednotliví investoři z okolí OpenAI, Nvidia, Oracle a Hugging Face. Jádrem nabídky je platforma Emmy, pojmenovaná po matematičce Amalie Emmy Noether: Podle poskytovatele rozkládá výzkumné otázky na stromy ověřitelných hypotéz a paralelně je testuje v kurátorovaném souboru simulací. Jako první komerční aplikaci PSI uvádí Multiphysik návrh datových center pro AI, a to jak pozemních, tak orbitálních, s ohledem na napájení, chlazení, síť a výpočetní výkon. Kromě toho je PSI technickým zakládajícím partnerem mise Fermi Explorer, neziskového projektu, který chce do konce roku 2029 vyslat sondu s jedním kilogramem užitečného nákladu směrem k Alfa Centauri za celkové náklady nižší než 15 milionů dolarů. → Unite.AI
Synthszr Take: Ve studii proveditelnosti je uvedeno, že každý kvantitativní výsledek byl vygenerován samotnou platformou a přepočítán jejími vlastními ověřovacími agenty, bez úplného externího posouzení. Paralelizované stromy hypotéz zrychlují to, co fyzici již delegují na stroje; o fyzice se však nadále rozhoduje na základě měřicích zařízení, která se v žádném souboru simulací nenacházejí. První příjmy pocházejí z návrhu napájení, chlazení a sítí pro datová centra, tedy z velmi dobře placené inženýrské optimalizace, která je zde prodávána pod hlavičkou nových přírodních zákonů.
Reklama v ChatGPT dosahuje run rate jedné miliardy dolarů, Evropa získává samoobslužný přístup
OpenAI vyčísluje svůj reklamní byznys v ChatGPT na anualizovanou Run Rate ve výši jedné miliardy dolarů, a to necelých šest měsíců po spuštění. Toto číslo vzniká extrapolací aktuálního měsíčního obratu krát dvanáct, což odpovídá přibližně 83 milionům dolarů měsíčně, nikoli dosud zaúčtovanému ročnímu obratu. Současně od 31. srpna poskytovatel otevírá Ads Manager v beta verzi se samoobslužným přístupem pro schválené inzerenty na 31 evropských trzích, kteří dříve mohli zadávat reklamu pouze prostřednictvím vybraných agenturních partnerů. Díky tomu mohou i malé firmy a startupy vytvářet kampaně bez agentury, pokud je jejich kategorie schválena a reklamy projdou interní kontrolou dodržování pravidel. Dave Dugan, VP Global Ad Solutions v OpenAI, hovoří podle údajů společnosti o „nové kapitole pro reklamu“ a miliardu za méně než 200 dní považuje za důkaz velikosti této příležitosti. → Techpresso
Synthszr Take: 83 milionů dolarů měsíčně jsou peníze, které někdo platí za to, aby se objevil v odpovědi, kterou uživatel čte jako radu, a ne jako reklamu. U Google je výsledek vedle reklamního bloku, v chatu je doporučení ve stejném toku vět jako jeho zdůvodnění. Jakmile si značky budou samy zadávat reklamu prostřednictvím samoobslužného manažera na 31 trzích, bude každá zmínka o produktu čtena s tichou otázkou: Je tam proto, že je dobrá, nebo proto, že byla zaplacena?
John Ternus přebírá vedení Applu: Cookova bilance nyní závisí na strategii AI
John Ternus oficiálně převzal 1. září post generálního ředitele společnosti Apple a po patnácti letech tak střídá v čele Tima Cooka. Ternusovi je 51 let, ve firmě působí od roku 2001 a jméno si udělal jako vedoucí hardwarové divize. Cook z Applu neodchází: zůstává na palubě jako výkonný předseda (Executive Chairman), podle údajů společnosti mimo jiné pro komunikaci s politickými činiteli po celém světě. První veřejné vystoupení v roli CEO čeká Ternuse na každoroční produktové akci 9. září, kde bude podle zpráv představen první skládací iPhone. Cook bude sedět v publiku, ale na pódium nevystoupí.
Cookova finanční bilance je nesporná. Během jeho působení vzrostla hodnota akcií o zhruba 2 000 procent, tržní kapitalizace v červenci krátce přesáhla pět bilionů dolarů a z 72 milionů prodaných iPhonů v roce 2011 jich letos bude podle odhadů Counterpoint Research 255 milionů. K tomu se přidává byznys se službami jako Apple TV+, Apple News a iCloud, který přivedl stovky milionů majitelů zařízení k předplatnému. Na negativní straně stojí zrušený projekt automobilu a Vision Pro, který přežívá jako drahé zařízení pro nadšence do VR, aniž by si našel masový trh.
Otevřeným bodem je strategie v oblasti umělé inteligence. Vize Apple Intelligence, představená na WWDC 2024, byla zaměřena na ochranu soukromí, s osobními daty na zařízení nebo v chráněném cloudovém prostředí. Následovala zpoždění a klíčový prvek, přepracovaná Siri, přichází až nyní s iOS 27, přičemž Apple se přitom spoléhá na modely od Googlu. Vzdání se vlastního Frontier modelu šetří Applu částky, které Google, Meta, Microsoft, OpenAI a Anthropic investují do vývoje modelů a infrastruktury, ale zároveň ho činí závislým na Googlu v klíčových funkcích AI.
Ternus navíc dědí personální problém a otázku nákladů. Šéf Foundation Models Ruoming Pang, šéf inženýringu Frank Chu a viceprezident pro design Alan Dye přešli do Mety, stovky bývalých zaměstnanců Applu do OpenAI. Protože firmy zabývající se umělou inteligencí odebírají čipy ve velkém, paměť se stává vzácnější a dražší a Apple tyto náklady přenáší na zákazníky. V přípravě jsou údajně AI domácí hub, AirPody s kamerou, chytré brýle a robotický asistent. → Morning Brew, Axios AI+, Business Insider
Synthszr Take: Steve Ballmer ztrojnásobil tržby Microsoftu a přesto je vzpomínán jako muž, který zaspal éru smartphonů. Cook má působivější čísla, 72 milionů iPhonů v roce 2011 oproti 255 milionům letos, a nese stejné riziko: jediná otázka platformy zpětně rozhodne o patnácti letech provozní dokonalosti. Nokia měla v roce 2007 lepší továrny, Blackberry oblíbenější klávesnici a obě společnosti prohrály sázku na software, kterou považovaly za druhořadou. Apple si nyní půjčuje modely od Googlu pro Siri a zároveň ztratil svého šéfa Foundation Models ve prospěch Mety, což je pro příští roky nepříjemná kombinace. Rozsudek nad Cookem padne v den, kdy OpenAI nebo Anthropic dodají vlastní hardware v sérii A; skládací iPhone z 9. září se přitom příliš nepočítá.

