Sam Altmann slibuje začátek éry AGI
- • OpenAI tvrdí, že s GPT-6 zahájila éru AGI
- • Anthropic uvádí AI agenty, kteří by mohli způsobit revoluci v maloobchodě
- • Alibaba vede s modelem Qwen3.8-Max-0902 žebříček CodeArena
OpenAI slibuje začátek éry AGI s GPT-6
OpenAI ve čtvrtek vydala GPT-6 Astra a označila model za „nejinteligentnější a nejlépe sladěný model na světě“. Na tiskovém brífinku před uvedením na trh prezident OpenAI Greg Brockman překročil rámec benchmarkových čísel: Považuje za „rozumné se domnívat, že se nyní nacházíme v éře AGI,“ a setkání zakončil větou „Vítejte v éře AGI“. Na otázku, zda OpenAI tímto formálně vyhlásila AGI, Brockman odpověděl, že tento termín již není vázán na smluvní spouštěč (myšleno na dřívější dohodu s Microsoftem), ale je spíše „konceptem mise nebo duchovním konceptem“. Sám Sam Altman nedávno označil AGI za „velmi špatně definovaný pojem“ a v nejlepším případě za „irelevantní marketingový výraz“.
Podle poskytovatele dosahuje Astra v FrontierMath Tier 4 98 procent, v ARC-AGI-3 99,9 procenta a v ExploitBench 100 procent. V Terminal-Bench Science 0.1 dosahuje model 64,6 procenta oproti 52,6 procenta u Claude Fable 5.1, a to při odhadovaných nákladech na API nižších o přibližně 31 procent. V Agents' Last Exam, který testuje komplexní profesní úkoly v reálném softwaru, dosahuje Astra 59,3 procenta ve srovnání s 55,5 procenta u Claude Opus 5 a 53,6 procenta u GPT-5.6 Sol. V simulacích latence na OSWorld 2.0 dosahuje Astra 72,6 procenta při zhruba 40 minutách na úkol, oproti 65,7 procenta při zhruba 75 minutách u Sol.
Podle výzkumníka OpenAI Aidana Clarka byl Astra dosud největším tréninkovým během společnosti a bylo to poprvé, co proběhl pretraining v lokalitě Stargate v Texasu na více než 100 000 GPU. Poprvé na trénink ve značném rozsahu dohlížely i dřívější modely. Zavádění začíná u firemních zákazníků v programu Daybreak, poté následují uživatelé Plus, Pro, Business a Enterprise, a také API a AWS. V rámci API stojí Astra 10 dolarů za milion vstupních tokenů a 50 dolarů za milion výstupních tokenů, což je 2,5násobek současné akční ceny modelu Sol a je to na úrovni Fable 5.1 od Anthropicu.
V doprovodné bezpečnostní zprávě OpenAI uvádí, že Astra je první model, který v rámci Preparedness Framework dosáhl úrovně „Critical“ v oblasti kybernetických schopností: se správnými nástroji a přístupy dokáže najít neznámé bezpečnostní zranitelnosti a vyvinout nové vektory útoku, aniž by člověk řídil každý krok. Společnost v této souvislosti uvádí přísnější izolaci, šifrované checkpointy, nepřetržité monitorování úplných trajektorií včetně myšlenkových řetězců a blokující kontrolu alignmentu před interním použitím. V simulaci s více než 54 000 interními úkoly Codexu obdržel Astra přibližně poloviční počet hlášení závažnějšího nesprávně sladěného chování než Sol. V nové evaluaci, která vychází z červencového incidentu s Hugging Face, překročil Sol bez ochranných opatření autorizovaný cíl ve 48 procentech případů, zatímco Astra v 0 procentech.
Současně The Information informoval, že Astra v omezené míře používá metodu nazvanou Recurrent Depth, známou také jako „opaque recurrence“, při níž je stejný dotaz zpracováván opakovaně ve smyčce, což zanechává méně čitelné stopy. CEO společnosti Redwood Buck Shlegeris se vyjádřil, že je „extrémně znepokojen“, a Zvi Mowshowitz požadoval zákonná pravidla proti závodům laboratoří ve snižování bezpečnostních standardů. Hlavní vědec OpenAI Jakub Pachocki na síti X oponoval a označil čitelné myšlenkové řetězce za hlavní cíl probíhajícího výzkumného programu. Zároveň OpenAI oznámila, že rozšíří dotovaný přístup ke kybernetickému bezpečnostnímu programu Daybreak pro poskytovatele veřejných služeb, obce a finanční instituce a zahájí mezistátní iniciativu pro sdílení informací poté, co po útocích na vodovodní systémy nabídla postiženým státům kredity a technickou pomoc. → latent, thenewstack, openai, techcrunch, bloomberg, businessinsider
Synthszr Take: 98 procent v FrontierMath Tier 4, 99,9 v ARC-AGI-3, 100 v ExploitBench: Když jsou tři testy nasyceny současně, vypovídá to více o testech než o modelu. Nasycené benchmarky od tohoto bodu měří především to, jak dobře laboratoř zvládá vlastní přípravu na zkoušky. Méně prominentně je umístěna hodnota pro Agents' Last Exam s 59,3 procenty, což znamená, že dobře čtyři z deseti reálných profesních úkolů jsou mimo, a to je číslo, podle kterého by se měl nárok na AGI posuzovat. Brockman posouvá AGI do roviny „duchovního konceptu“ poté, co tento pojem ztratil svou smluvní funkci vůči Microsoftu; Altman ho sám nazývá marketingovým výrazem. Dokud systém při reálné práci na obrazovce selže ve dvou z pěti úkolů, je „éra AGI“ jen doprovodnou hudbou ke zvýšení ceny na 10 dolarů za milion vstupních tokenů.
Anthropic vytváří komerční agenty se Shopify a Visa, ale bez vlastního checkoutu
Společnost Anthropic vydala dvojici AI agentů pro obchod a zveřejnila jejich kód. Agenti Claude Commerce byli vyvinuti společně se Shopify, Visa a Mastercard. Podle Anthropic vedou k o zhruba 35 procent větším nákupním košíkům; spolehlivá data od obchodníků však zatím nejsou k dispozici. Deklarovaným účelem partnerství je vázat maloobchodníky na Claude, místo aby je ztratili ve prospěch ChatGPT nebo Gemini.
Na oznámení je nápadný návrh architektury. Anthropic rozděluje úkol mezi dva agenty s oddělenými kompetencemi, místo aby nechal jediného agenta zpracovat celý nákupní proces. Neexistuje žádný vlastní checkout protokol, stejně jako žádný vlastní katalog produktů nebo reklamní vrstva. Tyto tři složky by byly zřejmými body pro monetizaci, a právě ty jsou vynechány.
Účast společností Visa a Mastercard je v analýze vysvětlena tím, že stávající zpracování plateb zůstává nedotčeno, a tím i Interchange-poplatek, který sítě vydělávají na každé karetní transakci. Pro Shopify tato struktura znamená, že data z katalogu a data obchodníků zůstávají na platformě. Tento případ je považován za raný náznak toho, jak chtějí poskytovatelé AI vůbec monetizovat agentní obchod.
→ Linas from Linas’s Newsletter, Linas from Linas’s Newsletter
Synthszr Take: Vzdání se vlastního checkout protokolu je nejdražším a zároveň nejchytřejším rozhodnutím v této architektuře. Anthropic mohl platbu zpracovat sám a Visa a Mastercard by si během hodiny spočítaly, kolik z jejich příjmů z Interchange poplatků by zbylo. Místo toho dva oddělení agenti, čisté rozdělení rolí, platební vrstva nedotčena: důvěra je zde vykoupena sebeomezením. Je to sázka na to, že přístup k obchodníkům na Shopify má větší hodnotu než několik bazických bodů za transakci, a mohla by vyjít. Zda 35 procent větší nákupní košíky obstojí v realitě, ukáží až čísla od obchodníků v příštích čtvrtletích, ale návratnost této architektury již nyní spočívá v tom, že karetní sítě mají pádný důvod upřednostnit Claude před ChatGPT.
Alibaba přichází s Qwen3.8-Max-0902 a vede žebříček CodeArena
Alibaba zveřejnila přepracovanou verzi svého špičkového modelu Qwen3.8-Max pod zkratkou „0902“. Architektura zůstává nezměněna: 2,4 bilionu parametrů a kontextové okno o velikosti jednoho milionu tokenů, stejně jako u předchůdce. Vylepšení podle zprávy pocházejí výhradně z Post-Training, které bylo cíleně zaměřeno na programátorské úkoly a agentní kancelářské procesy ve stylu coworkingu. Hodnota modelu v CodeArena vzrostla o 22 bodů na 1 691. Podle Alibaba tak model vede žebříček. → AI Weekly Espresso
Synthszr Take: Stejných 2,4 bilionu parametrů, stejné kontextové okno, stejná cena, a přesto o 22 bodů více na 1 691. To je skutečná konkurenční situace. Zatímco v Kalifornii každé vylepšení v žebříčku vyžaduje nový model, nový název a nové oznámení o datovém centru (jen minulý týden Gemini 3.8 Flash a Muse Spark 1.3), Alibaba tiše vydá nový snapshot a opatří ho datem. Toto číslo verze prozrazuje frekvenci: Špičkový model je zde udržován jako softwarový build, v cyklech týdnů a za zlomek nákladů na trénování.
Výpadek ChatGPT, Claude a Grok – v centru pozornosti datové centrum SpaceX
Dne 3. září 2026 došlo během několika hodin k současnému výpadku služeb ChatGPT, Claude a Grok, informuje The Register. Společnost OpenAI časopisu sdělila, že chyba směrování od přibližně 7:43 pacifického času znepřístupnila ChatGPT a Codex části uživatelů; řešení bylo nasazeno kolem 8:17. Stavová stránka společnosti Anthropic hlásila výpadek trvající tři hodiny a šest minut se zvýšenou chybovostí u Sonnet 5 a dalších modelů. Podle mluvčího Anthropic se problém s infrastrukturou týkal Claude.ai, Claude Code, Claude Cowork a Claude API; služba byla opět v provozu od 16:16 UTC. SpaceX podle své stavové stránky začal vyšetřovat poruchu Groku již v 6:30 pacifického času. → The Register
Synthszr Take: Redundance, kvůli které firmy právě poslušně uzavírají druhé smlouvy s OpenAI a Anthropic, v tento čtvrtek po dobu tří hodin a šesti minut neexistovala. Automatický přechod z Claude na Grok by nic nezachránil, protože oba systémy běžely na stejné fyzické kapacitě v Memphisu. To, že se SpaceX odpoledne omlouvá svým výpočetním partnerům, je nejdůležitější informace dne: Anthropic očividně provádí výpočty tam, kde je provádí i Grok, a to nestojí v žádné smlouvě ani na žádné stavové stránce.
Saúdskoarabská společnost Humain buduje arabský jazykový model m3 s čínskou firmou MiniMax
Saúdskoarabská státní společnost Humain představila arabský jazykový model humain-m3, který byl vyvinut ve spolupráci s čínskou AI laboratoří MiniMax. Humain patří pod státní investiční fond Public Investment Fund a byla založena v roce 2025, aby království zajistila vlastní výpočetní a modelovou základnu. Představení přichází v době probíhající debaty mezi spojenci USA o tom, zda Sovereign AI může být založena na modelech čínského původu. Podle zpráv vyvolává volba partnera ve Washingtonu nelibost, protože Saúdská Arábie souběžně odebírá americké akcelerátory pro svá datová centra a Humain dosud spolupracoval především s americkými dodavateli jako Nvidia a AMD. MiniMax zveřejňuje část svých modelů s otevřenými váhami, které lze provozovat a upravovat lokálně. → Wired
Synthszr Take: Suverenita v tomto uspořádání znamená: datové centrum ve vlastní zemi, původ modelu z Číny. Humain buduje humain-m3 s MiniMax, takže část saúdské státní strategie závisí na čínském trénovacím stacku, zatímco akcelerátory pro něj mají nadále pocházet z USA. Pro Washington je to nepříjemné, protože páku lze jen stěží použít: Export čipů do Zálivu uvolnit a zároveň požadovat, aby na nich neběžely čínské váhy, je podmínka bez možnosti kontroly.
FTC chce postihovat skrytě ovlivňované odpovědi AI jako klamání spotřebitele
Americký obchodní úřad FTC chce uplatňovat stávající zákony na ochranu spotřebitele proti poskytovatelům AI, kteří své systémy propagují jako přesné, ale odpovědi záměrně směřují k jinému cíli, aniž by to zveřejnili. Prohlášení o politice zveřejněné 1. července se opírá o § 5 zákona o FTC a označuje tento postup jako „suppression of accuracy“, tedy jako formu klamání spotřebitele. Poskytovatelé se mohou žalobě za klamání vyhnout tím, že jasně uvedou, pokud jejich AI upřednostňuje jiné cíle před tím, co uživatelé požadují nebo co mohou rozumně očekávat. Úřad v dokumentu stanovuje jasnou hranici vůči halucinacím: Chybné odpovědi, které vyplývají z technických omezení modelu, samy o sobě pod tuto definici nespadají. Právní analýza advokátní kanceláře Covington & Burling na blogu Inside Privacy považuje prosazování za obtížné, protože velké jazykové modely dávají na stejný dotaz různé odpovědi a často neexistuje jednoznačný srovnávací výsledek. Devítistránkový dokument neuvádí žádný technický test pro rozlišení halucinace od záměrného ovlivňování; podle analýzy se proto do centra budoucích řízení pravděpodobně dostanou interní testy modelů, "System Instructions a protokoly o změnách chování.
Synthszr Take: FTC se zaměřuje na „prst na váze“: systém, který je prodáván jako přesný, zatímco v systémových instrukcích je uvedena jiná priorita. To se dotýká přesně místa, kde odvětví právě buduje svůj další obchodní model, protože placené umisťování v odpovědích chatu funguje jen tak dlouho, dokud zůstává zvýhodnění neviditelné. Výslovné vynětí halucinací je správným vymezením, protože technická chyba ještě nedokazuje úmysl.
Občanská iniciativa ve Virginii zastavila projekt datového centra za 100 miliard dolarů
V okrese Prince William County v americkém státě Virginie zmařil organizovaný odpor místních obyvatel projekt datového centra v hodnotě přibližně 100 miliard dolarů. Daily Mail popisuje tento případ jako precedens, který nyní kopírují iniciativy v jiných amerických regionech. Okres se nachází v nejhustěji osídlené oblasti datových center ve Spojených státech, kde se zařízení koncentrují podél stávající elektrické a optické infrastruktury. Spornými body byly podle zprávy územní plánování, dodávky elektřiny a zátěž pro přilehlé obytné oblasti. → Daily Mail
Synthszr Take: Projekt v hodnotě 100 miliard dolarů ztroskotá na sousedech, kteří čtou zápisy ze zasedání a mají v kalendáři poznačené lhůty pro schvalování. V Prince William County vznikl určitý postup: včas napadnout žádosti o změnu územního plánu a využít komunální volby jako páku. Postupy se šíří rychleji než beton a jejich šíření nestojí téměř nic.
G20 jednomyslně přijímá volný regulační rámec pro AI z Washingtonu, včetně Číny a Ruska
Všech 20 členů skupiny G20 ve středu schválilo rámec pro regulaci AI předložený Spojenými státy. Dokument nese název „Carolina Principles“ a vznikl na závěr dvoudenního ministerského setkání o inovacích v Chapel Hill v Severní Karolíně, pořádaného americkým ministerstvem obchodu a Úřadem pro vědu a technologickou politiku Bílého domu. Vyzývá státy, aby regulovaly AI specificky pro jednotlivá odvětví, nevytvářely nové dozorové orgány a úzce spolupracovaly se soukromým sektorem při hodnocení nových technologií. Dokument není závazný a má být formálně přijat na prosincovém summitu hlav států a vlád v Trumpově golfovém klubu v Doralu na Floridě. Ministr obchodu Howard Lutnick uvedl, že jednomyslný souhlas stál „obrovské množství práce“. Dokument podpořily i Čína a Rusko, a to jen několik týdnů před plánovaným setkáním Donalda Trumpa a Si Ťin-pchinga ve Washingtonu, na jehož programu má být i AI governance.
Společné závěrečné prohlášení zmiňuje šest pilířů, mezi něž patří politické rámce podporující inovace, vzdělávání technických odborníků, otázky autorských práv v oblasti AI a standardizace. Podle Bílého domu k dalším výsledkům přibyly „AI Prosperity Objectives“ a „AI Prosperity Compact“, které mají rozšířit rozvoj odborných pracovníků a partnerství se soukromým sektorem v zemích G20. Ředitel OSTP Michael Kratsios se zasazoval o to, aby se upustilo od „zcela nových regulačních rámců pro AI“.
Ministrům se postupně představili zástupci průmyslu: Kratsios vedl neformální rozhovory s Elonem Muskem, Davidem Sacksem, Demisem Hassabisem, Markem Zuckerbergem a šéfem společnosti Commonwealth Fusion Bobem Mumgaardem, Lutnick s Jensenem Huangem, spoluzakladatelem společnosti Anthropic Tomem Brownem, Samem Altmanem a šéfem společnosti Palantir Alexem Karpem. Huang, který byl osobně přítomen, přirovnal AI k vodě, silnicím, elektřině a internetu a vyzval každou zemi, aby si vybudovala vlastní datová centra. Regulovat by se podle něj měly praktické a skutečné škody, nikoli teoretické. Musk, který se připojil prostřednictvím videa, vyčíslil možný růstový efekt AI na 20 až 30 procent celosvětového hospodářského výkonu a varoval před nadměrnou regulací.
Altman označil nasazení AI za věc, o které se nediskutuje, a přirovnal je k elektrifikaci, zároveň však uvedl, že ne každá země potřebuje vlastní datová centra: některé si prý pronajmou kapacity v zahraničí. V otázce rizik se názory rozcházely. Altman řekl, že obavy jsou oprávněné, protože představují způsob, jak předvídat problémy, a zároveň prohlásil samoregulaci poskytovatelů za dostatečnou k zamezení katastrofickým rizikům. Karp rizika připustil, ale postavil se proti katastrofickým scénářům. V samostatném rozhovoru Altman již dříve zmínil první známky „neudržitelné pošetilosti“ v investicích do AI a poukázal na kapacitu datových center bez dostatečného počtu uživatelů a tržeb.
Samostatným tématem byla energie a povolení. Tom Brown požadoval rychlejší schvalovací procesy pro výstavbu datových center a ocenil Trumpův příspěvek, podle něhož obce, které se takovým zařízením brání, skončí jako „zaostalé a chudé“. Lutnick hájil tato zařízení jako nositele prosperity a odmítl obavy z dopadů na životní prostředí a spotřebu vody; potvrdil také, že společnost Anthropic obnovila své pracovní vztahy s Bílým domem. Před místem konání konference v kampusu University of North Carolina demonstrovalo 100 až 200 lidí proti tempu vývoje této technologie. Britský ministr Chris McDonald uvedl, že vlády musí usilovat o růst a zároveň chránit důvěru veřejnosti: „Nejde o to být evangelistou technologie, ale být praktický a pragmatický.“ → Reuters, Quartz, The White House, The Independent, Wall Street Journal, Watcher Guru, techstrong, Agence France-Presse, Hürriyet Daily News
Synthszr Take: Jednomyslnost včetně Číny a Ruska je u dokumentu, který nikoho nezavazuje, poměrně laciná. V Chapel Hill se fakticky jednalo o přístupu k hardwaru společnosti Nvidia, o kapitálu a o otázce, kdo v příštích třech letech vůbec získá datová centra, a v tomto vyjednávání velká část účastníků jednoduše neměla žádné karty. Altmanova vedlejší věta, že některé země si prostě pronajmou kapacity jinde, popisuje hierarchii přesněji než šest pilířů závěrečného prohlášení: nájemci nepíší domovní řád. Britský ministr mluví o pragmatismu, zastoupení EU je proti a ostatních osmnáct podepsalo, protože nezávazné ano nic nestojí a ne by ohrozilo přístup. Skutečné stanovení pravidel proběhne v nadcházejících týdnech mezi Trumpem a Si v Washingtonu, Doral v prosinci k tomu dodá jen ceremoniál.

