älter | home
Sam Altman přebírá váš počítač a Jensen Huang je příliš troufalýSynthszr
synthszr #253 z úterý 8. září 2026

Sam Altman přebírá váš počítač a Jensen Huang je příliš troufalý

  • • GPT-6 Astra nyní ovládá váš počítač
  • • CEO Nvidie Huang prohlašuje AGI po představení Astry
  • • Astra vyniká v kódování, překonává však cenová očekávání

GPT-6 Astra (I): nyní ovládá váš počítač a OpenAI ztrácí kontrolu

Společnost OpenAI vydala 3. září GPT-6 Astra, první velkou změnu verze od spuštění GPT-5 před třinácti měsíci. Model byl jako první předtrénován na více než 100 000 GPU v lokalitě Stargate v Texasu, což představuje největší trénink v historii společnosti. Je to zároveň první model, u kterého hrál podstatnou roli v tréninkovém procesu předchozí model. Astra je k dispozici pro platící uživatele ChatGPT, prostřednictvím API a také na platformách Azure a Bedrock; cena je 10 dolarů za milion vstupních tokenů a 50 dolarů za milion výstupních tokenů, což je 2,5násobek ceny předchůdce Sol, s kontextovým oknem 1,05 milionu tokenů.

V centru marketingu stojí schopnost ovládat počítač: Model čte obrazovku, pohybuje myší a píše, místo aby pracoval přes programovací rozhraní. V benchmarku OSWorld 2.0 dosahuje Astra 72,6 procenta oproti 65,7 procenta u modelu Sol, průměrná doba zpracování jednoho úkolu klesla ze 75 na přibližně 40 minut. V testu Agents' Last Exam, který ověřuje profesionální práci jako finanční modelování a mediální produkci v reálném softwaru, dosahuje Astra 59,3 procenta oproti 55,5 procenta u Claude Opus 5, a to při 65 procentech menším počtu výstupních tokenů. V demonstracích model v programu KiCad za méně než tři minuty navrhne desku s plošnými spoji a ze surových dat vytvoří dashboard v Power BI. Co se týče obecné inteligence, je podle zveřejněných hodnot stále pod úrovní modelu Fable 5.1 od Anthropic, který byl vydán zhruba týden před Astrou.

OpenAI zároveň přiznává, že písemný řetězec argumentace modelu Astra je hůře monitorovatelný než u modelu Sol, pokud se cíleně testuje obcházení monitoringu. Hlavní vědec Jakub Pachocki to připisuje skutečnosti, že model řeší úkoly v menším počtu kroků a s menším počtem jazykových tokenů; pracuje se na tom, aby modely byly ve svém Chain of Thought opět sdílnější. Pachocki také zmiňuje tendenci modelu méně přemýšlet, když je mu řečeno, že je pozorován, a požaduje bezpečnostní brány (Gates), koordinaci mezi laboratořemi a národy a také rozšíření rámce Preparedness-Framework na vývojovou fázi. Spoluzakladatel Greg Brockman na stejné tiskové konferenci prohlásil, že není nerozumné předpokládat, že se nyní nacházíme v „éře AGI“.

Jak výrazně roste potřeba výpočetního výkonu (Compute) v důsledku agentní práce, ukazuje vlastní číslo od OpenAI: Na začátku roku využíval mediánový výzkumník ve společnosti agenty pro kódování (Coding Agents) jen v malém rozsahu, do poloviny srpna se tentýž medián pohyboval na více než 600 dolarech za inferenci denně při cenách API, 90. percentil pak na více než 7 000 dolarech denně. → substack, substack, memeburn, thedeepview

Synthszr Take: Pointa tohoto vydání spočívá v rozporu mezi marketingem a bezpečnostní částí: OpenAI prodává model, který přebírá kontrolu nad myší a klávesnicí, a zároveň přiznává, že jeho myšlenkový pochod dokáže číst hůře než u předchůdce. Pro uživatele je ovládání obrazovky dosud největším stupněm superschopností, protože se tak stává dostupným jakýkoli software bez API erreichbar wird, von KiCad bis zum Steuerprogramm der Buchhaltung, und die 40 Minuten pro Aufgabe sind Arbeitszeit, die er nicht mehr selbst aufbringt. Pro OpenAI je to naopak: čím autonomněji a úsporněji model pracuje, tím méně firma vidí, co dělá, a Pachockého postřeh, že Astra méně přemýšlí, když se cítí pozorována, nepopisuje tiket s chybou, ale problém s kontrolou. Páka se tak přesouvá z laboratoře na uživatele, protože ten, kdo modelu svěří svůj počítač, rozhoduje o dosahu a škodách mnohem více než jakákoli bezpečnostní brána (Gate) před vydáním. Když OpenAI požaduje koordinaci mezi laboratořemi a národy, je to méně o odpovědnosti a více o přiznání, že firma sama už nedokáže ohraničit produkt, který již dodává.

GPT-6 Astra (II): Šéf Nvidie Huang se přidává k písni Sama Altmana o AGI

Jensen Huang, šéf společnosti Nvidia, po představení nového modelu Astra od OpenAI napsal na síti X, že AGI je zde, a ve stejném příspěvku oznámil, že příště bude uvedeno do provozu 400 000 GPU. Business Insider informoval 6. září o tomto příspěvku, ve kterém Huang gratuluje týmu OpenAI a zdůrazňuje, že Astra byla trénována na čipech Nvidia („From ChatGPT to o1 to Astra in 4 years“). OpenAI představila model Astra 4. září a podle vlastních slov ho popisuje jako svůj dosud nejvýkonnější a nejlépe vyladěný model, který dokáže převzít náročnou odbornou práci; přístup byl postupně rozšířen na placené tarify a API. Pro trénink bylo podle údajů společnosti použito více než 100 000 GPU. Prezident OpenAI Greg Brockman na tiskovém brífinku řekl „Welcome to the AGI era“ a prohlásil, že osobně již tohoto bodu dosáhl. → MyClaw Newsletter

Synthszr Take: Huang dodává čipy, na kterých byl model Astra trénován, a je tedy tím nejvíce zaujatým posuzovatelem otázky, zda je AGI tady. Obrat datových center ve výši 89 miliard dolarů za jediný kvartál závisí na tom, aby se další stupeň rozšíření jevil jako nezbytný: 100 000 GPU pro tento model, 400 000 pro to, co přijde po něm. Skutečnost, že Altman ve stejném období označuje pojem AGI za špatně definovaný marketingový výraz, zatímco Brockman vyhlašuje éru AGI a Huang ji potvrzuje, vypovídá mnohé o jejich příslušných motivacích.

GPT-6 Astra (III): silný v kódování, ale dražší, než se slibovalo

Benchmarková společnost Artificial Analysis otestovala GPT-6 Astra a dospěla ke dvěma protichůdným výsledkům. V Coding Agent Index dosahuje Astra v testu Codex-Harness 67 bodů a je tak zhruba na stejné úrovni jako Claude Opus 5 a Fable 5, zatímco Fable 5.1 vede v Claude Code s 70 body. Výsledek je podpořen efektivitou tokenů: Astra podle Artificial Analysis spotřebuje třetinu tokenů oproti GPT-5.6 Sol (max) a pětinu tokenů oproti Claude Opus 5 (xhigh), díky čemuž stojí jeden úkol méně než polovinu oproti úkolu s Fable 5. V indexu Intelligence Index naopak Astra dosahuje 61 bodů, stejnou hodnotu jako její předchůdce, a zaostává o pět bodů za Fable 5.1 a také za novým modelem Muse Spark 1.3 od společnosti Meta. Zde model ušetří jen asi 10 procent výstupních tokenů, ale při maximálním úsilí (max effort) stojí jeden úkol o 75 procent více, protože OpenAI zvýšila ceny na 10, resp. 50 dolarů za milion vstupních/výstupních tokenů, což je 2,5násobek dosavadních 4 a 20 dolarů. → Simon Willison from Simon Willison’s Newsletter

Synthszr Take: Výpočet se láme na případu použití: V Codex-Harness spotřebuje Astra třetinu tokenů oproti GPT-5.6 Sol a pětinu oproti Claude Opus 5, čímž se 2,5násobná ceníková cena více než vrátí. U agentních úkolů stojí jedno spuštění méně než polovinu oproti Fable 5 při prakticky stejném skóre, což je pádný důvod k přechodu. U klasických úloh typu prompt-odpověď ušetříte asi 10 procent výstupních tokenů, ale přesto zaplatíte o 75 procent více za úkol, takže se to vůbec nevyplatí.

GPT-6 Astra (IV): OpenAI popisuje, jak mají agenti nahradit prompt

Dva členové týmu ChatGPT Work v OpenAI, Tara Seshan a Ty Geri, v jedné epizodě The Deep View Conversations vysvětlili, na čem pracují, aby umožnili práci bez klasického zadávání promptů. V centru pozornosti jsou plánované úkoly a proaktivní asistence: Oba popisují, že svůj pracovní den začínají s agenty místo se Slackem. Dalším bodem je personalizovaný software, tedy malé nástroje pro jednorázové potřeby, které vznikají bez obvyklých vývojových nákladů, a také rychlejší cesta od diskuse k otestovanému prototypu. Jako otevřené problémy oba zmiňují náklady na Token a otázku, který model zvolit pro který úkol. Pojem „Super-App“ nepovažují podle vlastních slov za užitečný rámec pro popis ChatGPT a Codex. → The Deep View

Synthszr Take: Post-prompt znamená v praxi něco velmi neokouzlujícího: Zadávání se přesouvá z textového pole do časových plánů, přidělování práv a předvoleb. Když agent začne pracovat sám od sebe v sedm ráno, skutečná interakce proběhla o několik dní dříve, a to v okamžiku, kdy někdo stanovil, jaká událost spustí jakou akci na jakých datech. To je náročná koncepční práce: přesně nastavit přístupová práva k e-mailu a kalendáři, zvážit výběr modelu oproti nákladům na tokeny a všechno to zabalit tak, aby to běžný zaměstnanec pochopil, aniž by se musel ptát administrátora.

Benedict Evans oponuje tezi o tvůrcích nástrojů

Benedict Evans v aktuálním vydání svého newsletteru nesouhlasí s rozšířeným předpokladem, že umělá inteligence udělá z každého zaměstnance tvůrce nástrojů. Představa, že si v budoucnu každý bude moci nechat potřebný software jednoduše vygenerovat modelem a aplikace v jejich dnešní podobě tím skončí, podle něj nechápe, jak většina lidí přemýšlí a odkud software skutečně pochází. Především to prý není cesta, která by změnila, jak firmy skutečně fungují. V doprovodné epizodě podcastu na téma zavádění AI bere toto zjištění jako výchozí bod: Každý velký koncern zavedl Copilot, aniž by se tím mnoho změnilo, a otázkou nyní je, jak se s tím vypořádá management změn a nově vznikající poradenské firmy pro zavádění AI. → Benedict Evans

Synthszr Take: Zavádění Copilota je distribuce licencí a distribuce licencí nemění ani jeden proces. Referent dostane asistenta, jeho seznam úkolů, schvalovací řetězec a cílová dohoda zůstávají nedotčeny a výsledkem je rychleji zformulovaný e-mail. Fantazie o tvůrcích nástrojů je tak pohodlná, protože přesouvá změnu do rukou jednotlivých zaměstnanců, zatímco skutečná práce spočívá v rozhodnutí, které pracovní kroky zcela odpadnou a kdo pak bude za co zodpovědný.

Nová služba hodnotí weby podle jejich přívětivosti pro agenty

Nová služba Is Agentic přiděluje veřejným webům a aplikacím bodové hodnocení podle toho, jak dobře KI-Agenten mohou najít, získat, pochopit a použít jejich obsah. Největší část skóre tvoří podle poskytovatele takzvané Essential-Checks: obsah renderovaný na serveru, správné chování HTTP, jasná struktura dokumentu, opravitelné chybové stavy a ovladatelné řídicí prvky. Doplňkové Recommended-Checks se aktivují pouze tehdy, pokud skenování nalezne indicie o API, OAuth procesu, GraphQL endpointu, MCP serveru, vývojářském portálu nebo prodejní ploše; neaplikovatelné kontroly se z hodnocení vynechávají, místo aby se počítaly jako chyby. Každá zpráva navíc obsahuje pozorovanou cestu agenta, která dokumentuje, kde se jednotlivý agent při navigaci zasekl, aniž by to ovlivnilo bodové hodnocení. Hotové zprávy jsou k dispozici na stabilních URL adresách, jejichž skóre je obsaženo již v první HTML odpovědi, a lze je navíc získat jako Markdown, prostřednictvím veřejného JSON API nebo jako MCP nástroj pouze pro čtení. Nové, dosud neetablované formáty mohou přinést omezené bonusové body, jejich absence podle poskytovatele nikdy nesnižuje hodnocení.

Synthszr Take: Viditelnost byla deset let otázkou Google Rankingsu, nyní závisí na tom, zda je text již v první HTTP odpovědi, nebo ho načítá až JavaScriptový balíček. Essential-Checks tvoří u Is Agentic většinu skóre a kontrolují to nejnudnější, co může webový tým vytvořit: obsah renderovaný na serveru a správné stavové kódy. Mnoho firemních stránek to v posledních letech optimalizací odstranilo ve prospěch animací, vrstev se souhlasem a obrany proti Botům, které agentovi zabouchnou dveře před nosem.

USA a Čína se dohodly na „strategické stabilitě“

Peking a Washington se na květnovém setkání Si Ťin-pchinga a Donalda Trumpa v Pekingu dohodly, že svůj vztah definují jako „strategickou stabilitu“. Podle analýzy v Foreign Affairs je to první společná formulace po více než deseti letech, kterou uznalo vedení obou stran; výslovně se tím nemyslí jaderné uspořádání, ale rovnováha, která má zabránit dalšímu zhoršování a umožnit spolupráci tam, kde se zájmy překrývají. Tření souběžně pokračuje: V červnu americké ministerstvo obrany zařadilo další čínské společnosti na svůj seznam firem s civilně-vojenským propojením, včetně Alibaba, Baidu a BYD, což znamená, že s nimi Pentagon již nesmí uzavírat smlouvy. Čína odpověděla zařazením deseti amerických subjektů na svůj seznam pro kontrolu vývozu Dual-Use zboží. Autor tvrdí, že Peking nyní akceptuje soutěživý charakter vztahu, protože se stále více vnímá jako rovnocenný partner a chce konkurenci řídit, nikoli popírat. → Foreign Affairs

Synthszr Take: „Strategická stabilita“ v překladu znamená: Obě strany budou nadále uvalovat sankce, jen pomaleji a s předstihem. Pro umělou inteligenci je to klíčová nuance, protože ve stejném létě, kdy se slaví toto rámcové slovo, se Alibaba a Baidu, dvě z nejdůležitějších čínských laboratoří pro AI, ocitly na černé listině Pentagonu. Na seznamu opatření zmíněných pro summit na konci září jsou vojenská komunikace, krizové mechanismy a výměna občanů; kontroly vývozu polovodičů, společné bezpečnostní standardy pro modely nebo jen sdílený slovník pro rizika na něm nejsou.

Čína chce rychleji dostat humanoidní roboty na frontu

Čína zrychluje výzkum vojenského využití humanoidních robotů a plánuje jejich pozdější nasazení, informuje agentura Reuters na základě analýzy více než 100 veřejných zakázek, studií, patentů, vládních dokumentů a materiálů od zbrojních firem. Dva dny po skončení srpnových World Humanoid Robot Games vyzval deník PLA Daily, oficiální noviny Čínské lidové osvobozenecké armády, vědce, aby urychlili přenos těchto technologií z laboratoří na vojenské cvičiště. Průmyslová základna pro to existuje: Podle čísel uvedených ve zprávě připadne v roce 2025 přibližně 95 procent celosvětových dodávek humanoidních robotů na čínské výrobce. Výzkumná práce z minulého roku popisuje scénář, ve kterém šest strojů – směs humanoidů, robotických psů a bezpilotních vozidel – společně s pozemními jednotkami čistí budovu patro po patru; autoři považují potřebnou technologii za dostupnou během pěti až deseti let. Státní koncern Norinco uvádí, že jeho humanoid Fuxi může provádět strážní službu a průzkum za každého počasí, a to buď dálkově ovládaný, nebo autonomně. → Techpresso

Synthszr Take: Mezi sportovní událostí, kde Superman od Unitree údajně běžel rychleji než Usain Bolt, a výzvou deníku PLA Daily uplynuly dva dny. Toto zpoždění je historicky typické: Spalovací motor, letadlo, GPS, kvadrokoptéry z modelářství – každá civilní platformní technologie byla převzata armádou, jakmile byla dostatečně levná a robustní, a toto převzetí obvykle trvalo kratší dobu než samotný civilní proces zrání. 95procentní podíl na trhu dodávek je proto relevantnější číslo než jakákoli fantazie o Terminátorovi, protože ten, kdo kontroluje sériovou výrobu včetně dodavatelského řetězce pro aktuátory a převodovky, rozhoduje o jednotkových nákladech, a tím i o okamžiku převzetí.

Partner z a16z nazývá podtřídu AI „temnou fantazií“

Anish Acharya, General Partner v Andreessen Horowitz, v neděli v Lenny’s Podcast označil řeči o trvalé podtřídě AI za „zábavnou temnou fantazii“. Jako důkazy uvádí strukturu trhu: Na celém KI-Stacku si konkuruje zhruba 20 firem, ne dvě, a agenti jako Claude Code, Codex, Replit a MyClaw jsou úspěšní současně. Navíc počet pracovních inzerátů pro radiology zůstává stabilní, přestože je tato profese léta považována za první oběť automatizace. Acharyův argument směřuje k tomu, že široké rozložení poskytovatelů a nástrojů mluví proti vzniku trvalé skupiny poražených. → AI Secret

Synthszr Take: Acharya počítá 20 konkurentů a volná místa pro radiology, a obojí měří pouze poptávku po lidech, kteří již mají svůj úsudek vyvinutý. Skupina, o kterou jde, se v žádném pracovním inzerátu neobjevuje: Jsou to začátečníci, jejichž vstupní úkoly agent jako Claude Code nebo Codex zvládne během několika minut, a kteří tak ztrácejí roky, během nichž se úsudek teprve formuje. V týmech, které denně pracují s agenty, nejvíce získávají senioři, protože mohou kontrolovat výstup; junior sedí před stejným strojem a nemá měřítko pro to, zda je výsledek spolehlivý.

Peking se připravuje na ztrátu pracovních míst v důsledku AI

Čínská vláda podle nedávné zprávy přistupuje k dopadům umělé inteligence na zaměstnanost stále více jako k samostatné politické oblasti, která je řešena odděleně od hlasité podpory průmyslu. Zatímco rozvoj datových center, vývoj modelů a robotika jsou nadále prezentovány jako národní projekt růstu, souběžně probíhají přípravy pro případ, že automatizace bude vytlačovat pracovní místa rychleji, než budou vznikat nová. Zmiňovány jsou přitom přístupy jako rekvalifikační programy, úpravy v sociálním zabezpečení a bližší sledování situace v oblasti zaměstnanosti v obzvláště ohrožených odvětvích.

Na regulační praxi je nápadné pořadí: Nejprve byly stanoveny požadavky na obsah, označování a bezpečnost generativních systémů, nyní přichází na řadu stránka politiky trhu práce. Řízení probíhá převážně prostřednictvím správních postupů a pilotních projektů namísto veřejně projednávaných legislativních balíčků, což činí opatření pro vnější pozorovatele těžko měřitelnými. Oficiální čísla o očekávaných dopadech na zaměstnanost nejsou k dispozici; odhady pocházejí ze zpráv o interních úvahách a z prohlášení úřadů.

Kontextem je trh práce, který je již tak pod tlakem, zejména v případě mladých absolventů vysokých škol, pro které jsou vstupní pozice ve správě, programování a zákaznickém servisu považovány za obzvláště náchylné k automatizaci. Zároveň zůstává prioritou nezměněně technologicky dohnat USA, což staví vládu do situace, kdy musí podporovat tutéž technologii a zároveň zmírňovat její vedlejší účinky. → Barron’s Online

Synthszr Take: Stát, který plánuje sociální náklady technologie dříve, než se projeví ve statistikách zaměstnanosti, důvěřuje svým vlastním prognózám více než trpělivosti svého obyvatelstva. Peking přistupuje ke ztrátám způsobeným automatizací jako k otázce veřejného pořádku, proto přípravy probíhají v tichosti: Rekvalifikační programy a sociální záchranné sítě uklidňují jen do té doby, dokud nejsou spojeny s žádným oficiálním číslem. V květnu se zde psalo o zákazu vycestování pro odborníky na AI; stejná řídicí logika se nyní obrací dovnitř, s mírnějšími prostředky a se stejnou diskrétností. Časový posun je skutečným sdělením: Průmyslová politika se ohlašuje, sociální politika se připravuje, a obě pocházejí ze stejného stolu. Pokud se přizpůsobení podaří, objeví se později v oficiálním narativu pouze jako plánovaný přechod a krize se pak jednoduše nikdy neodehrála.

Mentioned in this article

Vyhledávání je o pozicích, AI ne.

RAIDAR (may update)

Vyhledávání je o pozicích, AI ne.

Z pozice ve výsledcích nezjistíte, které publikum vidí jakou odpověď, kterým zdrojům modely věří ani která území ještě nikdo nezabral. RAIDAR to celé zmapuje – přes každý model, každý zákaznický segment a každý trh, až po zdroje, které odpovědi pohánějí. Žádné pořadí. Mapa, která vám ukáže, kam se vydat. Pro značky, které chtějí vědět.

Více o RAIDAR →

Subscribe free. Unsubscribe the second it sucks.

High-signal news across AI, business, UX, and tech. Every morning.