Čínské modely lákají agenty umělé inteligence tokeny zdarma
- • Anonymní frontier model Ox Alpha dobývá OpenRouter v utajeném režimu
- • Nvidia investuje 6 miliard dolarů do technologie proti DeepSeek
- • LinkedIn zaznamenává o 40 procent menší dosah obsahu generovaného umělou inteligencí
Guerillový marketing: Nový frontier model v utajeném režimu dobývá OpenRouter
Neznámá laboratoř zveřejnila 20. srpna na OpenRouter anonymní frontier model s názvem Ox Alpha a na týden jej zdarma zpřístupnila vývojářům. Model běží pod identifikátorem stealth/ox-alpha, nabízí kontextové okno o velikosti přibližně 1,05 milionu tokenů, výstupní limit 131 072 tokenů a zpracovává text, obraz i video. Je propagován společně s terminálovým-agentem OpenCode jako možnost pro dlouhotrvající úkoly v oblasti kódování a agentů. Oznámení uvádí kapacitu až 100 bilionů tokenů denně s nulovým ukládáním dat, což se liší od obvyklých utajených vydání, která sbírají prompty pro trénování.
Autorství je nejasné a komunita během několika hodin zahájila technické pátrání. Vzorek tokenizeru podle vývojářů odhalil 30 z 30 přesných shod tokenů s modelem GLM-5.3 od Z.ai, dříve známé jako Zhipu AI. Vyvolané Java stack traces poskytly chybový kód 1214, který má odpovídat interní infrastruktuře Z.AI, a poměr snímků k tokenům u videí odpovídá enkodéru modelu GLM-5V-Turbo. Na žebříčku třetí strany Kingbench dosáhl Ox Alpha 87,5 procenta, zatímco GLM-5.3 tam má 91,25 procenta. Pro Zhipu hovoří i předchozí historie: laboratoř již dříve testovala GLM-5 naživo pod názvem Pony Alpha a provozuje několik clusterů s 10 000 GPU a také nově spuštěné datové centrum s výkonem jednoho gigawattu.
V oběhu jsou i další teorie. DeepSeek je považován za vzor pro tento agresivní přístup, protože jeho model V4 se 11. března nejprve objevil jako Hunter Alpha, avšak výpočetní kapacita pro inzerovanou propustnost je považována za spornou, zvláště když byla nedávno zvýšena cena za V4-Flash. Jeden z analytiků vypočítal, že 100 bilionů tokenů denně by při realistických rychlostech vyžadovalo přibližně 580 000 GPU. Konkurenční analýza poukazuje na tokenizer modelu cl100k_base a řadí jej tak do linie Phi/MAI od Microsoftu, možná jako dosud nevydanou verzi MAI 2. Zmiňován je také tým MiMo od Xiaomi, který již v minulosti na OpenRouter používal pseudonymy.
Současně podnítily spekulace dva příspěvky od zaměstnanců Google DeepMind: Vamsi Batchu napsal „Google is back. Trust the process“ a Jonathan Ouyang zveřejnil „It’s Gemini time :)“. Během několika hodin se na X a Redditu rozšířila teze, že Ox Alpha je uniklá varianta modelu Gemini. Model si zatím nepřihlásila ani Z.ai, ani OpenRouter. Chybí nezávislé ověření na oficiálních žebříčcích, kolující nejlepší výsledky, například na DeepSWE, pocházejí od komunity a bezpečnostní experti nedoporučují vkládat citlivý firemní kód do neověřeného modelu.
Vystoupení modelu přichází v době, kdy se na OpenRouter mění rozložení sil: podíl tokenů zpracovaných přes platformu, které připadají na americké modely, klesl podle metrik platformy během jednoho roku ze 70 na přibližně 30 procent. Stripe mezitím pokračuje v akvizici platformy routeru. → Wccftech, NPowerUser, techstrong
Synthszr Take: Výpočetní čas zdarma je nejlevnější reklamní plochou v oboru: rozdávat týden 100 bilionů tokenů denně stojí méně než jedna keynote a přinese podstatně více mediálního prostoru. Anonymita je skutečný trik, protože model bez odesílatele promění každého vývojáře v neplaceného vyšetřovatele, který porovnává tokenizery, vyvolává stack traces a zveřejňuje screenshoty. Dvě nenápadné věty od lidí z DeepMind stačily k tomu, aby nasměrovaly polovinu diskuzí na stopu Gemini, a oprava o 30 z 30 shodných tokenů přišla o několik dní později s pouhým zlomkem původního dosahu. Uvedení na trh se tak odehrává ještě před samotným uvedením: než model oficiálně dostane jméno, jeho pozice na trhu je již zafixována v tisících diskuzních vláken. Levné to zůstane jen do té doby, dokud se nikdo nezeptá, čí kódová báze po dobu jednoho týdne procházela modelem bez jakékoli identifikace.
Nvidia investuje 6 miliard dolarů v boji proti DeepSeek
Nvidia platí 6 miliard dolarů za neexkluzivní licenci na technologii pro vývoj modelů od Poolside a nabízí zaměstnání 109 pracovníkům tohoto startupu. K tomu přidává investici ve výši jedné miliardy dolarů do Poolside při pre-money valuaci 12 miliard. Deklarovaným cílem výrobce čipů je vytvoření jednoho z nejvýkonnějších open-weight modelů na světě, který má konkurovat čínským poskytovatelům jako DeepSeek a Kimi K3, ale také uzavřeným modelům od OpenAI a Anthropic. Podmínky pocházejí z dopisu od Poolside jeho investorům, ve kterém společnost výslovně uvádí, že se nejedná ani o akvizici, ani o nákup talentů. Poolside chce těchto 6 miliard vyplatit svým investorům do konce roku 2027. Předmětem licence je systém, který Poolside nazývá Model Factory: integrovaná sada datových pipeline, distribuovaného trénovacího softwaru, evaluačních systémů, inferenční infrastruktury a nástrojů pro reinforcement learning. Podle společnosti byly modely Laguna M.1 a Laguna XS.2 kompletně natrénovány od základu v tomto systému s více než 30 biliony trénovacích tokenů. Vývoj modelu Laguna XS.2 od zahájení tréninku po vydání údajně trval pět týdnů. V červenci následoval Laguna S 2.1, model typu Mixture-of-Experts se 118 miliardami parametrů, z nichž 8 miliard je aktivních na každý token, a s kontextovým oknem až jednoho milionu tokenů. Údaje o výkonu pocházejí z vlastních evaluací společnosti Poolside, která však průběhy vyhodnocení zveřejnila k externímu přezkoumání. Nvidia již podporuje architekturu Laguna ve své dokumentaci NeMo-AutoModel. → RuntimeWire, Wall Street Journal, PYMNTS
Synthszr Take: Průmyslová politika bez státu: Nvidia dává 6 miliard dolarů, aby pozicovala USA v oblasti, kterou Peking již léta prosazuje jako oficiální doktrínu. Otevřené váhy jsou strategickou pákou proto, že se dostávají do ministerstev, klinik a výrobních hal, kde není povoleno žádné externí rozhraní, a tam na desetiletí nastavují referenční architekturu. To, že účet přebírá právě dodavatel hardwaru, má pádný důvod: každý západní model, který konkuruje DeepSeek, bude optimalizován pro křemík od Nvidie. Ve srovnání se 6 miliardami za jedinou neexkluzivní licenci působí 722 milionů eur, které nedávno získal Mistral na vlastní datová centra, jako drobné, a v Evropě jednoduše chybí hráč s takovou finanční silou. Zbývá tedy datová úroveň jako realistická páka: provozovat otevřené váhy na vlastním hardwaru a procesní data si ponechat interně, bez ohledu na to, zda váhy pocházejí z Kalifornie nebo z Chang-čou.
Práskač AI Slopu: LinkedIn hlásí o 40 procent menší dosah pro AI odpad
LinkedIn představuje první bilanci svého tlačítka pro hlášení obsahu generovaného umělou inteligencí a prohlašuje ho za úspěšné. Jak informuje Engadget, funkce „seems like AI slop“ byla od svého spuštění před několika týdny použita více než milionkrát. Produktový ředitel Hari Srinivasan v aktualizaci na platformě napsal, že členové nyní vidí o 40 procent méně zobrazení obsahu, který společnost klasifikuje jako AI odpad. Jak konkrétně hlášení uživatelů ovlivňují řízení dosahu, LinkedIn neupřesňuje: Srinivasan podle společnosti odkazuje na „mnoho signálů“ a na vestavěné mantinely, které mají zabránit zneužití jednotlivých hlášení proti jiným členům. Novinkou je oznámení v analytice příspěvků, které autory informuje o tom, že jejich příspěvek byl nahlášen. → Techpresso
Synthszr Take: Těch 40 procent je číslo, které si vypočítal sám LinkedIn, pro kategorii, kterou si sám LinkedIn definoval a kterou nikdo neověřuje. „Co klasifikujeme jako AI odpad“ je klíčová polovina věty ve zprávě Srinivasana, a právě ta zůstává nespecifikovaná: bez zveřejněných klasifikačních pravidel měří zpráva o úspěchu pouze to, jak usilovně pracuje jejich vlastní filtr. Pikantní je to při pohledu zpět, protože tatáž platforma léta nabízela tlačítko „Enhance“, které vylepšovalo příspěvky pomocí jazykového modelu, a odstranila ho až se spuštěním tlačítka pro hlášení.
Vědci vytvářejí syntetická trénovací data s miliardou umělých person
Výzkumný tým pod vedením Tao Ge zveřejnil „Persona Hub“, sbírku jedné miliardy automaticky kurátorovaných person z webových dat, která slouží jako výchozí bod pro generování syntetických trénovacích dat. Příslušný článek (arXiv:2406.20094) popisuje syntézu dat řízenou personami: každá persona je předána jazykovému modelu jako perspektiva, z níž model následně generuje různé úkoly, texty nebo instrukce. Autoři odhadují počet person na přibližně 13 procent světové populace a popisují je jako distribuované nositele světových znalostí, jejichž prostřednictvím lze vyvolat téměř jakýkoli úhel pohledu uložený v modelu. Jako případy použití práce uvádí matematické a logické úlohy, uživatelské pokyny, texty bohaté na znalosti, herní postavy pro videohry a také volání nástrojů a funkcí. → AINews
Synthszr Take: Každá z miliardy person je v podstatě klíčem, který odemyká jiný úhel paměti modelu. Díky tomu se rozmanitost stává produkční veličinou: místo aby se pracně sbírala od skutečných lidí, generuje se pomocí adresace a náklady na každou další perspektivu klesají téměř k nule. Háček je ve stejném mechanismu, protože vše, co nezná model, nezná ani jeho 1 000 000 000 rolí, a slepá místa se tak kopírují v miliardovém nákladu.
New York předstihl Bay Area: 394 300 zaměstnanců v technologiích oproti 375 730
New York se poprvé po 13 letech opět stal největším technologickým pracovním trhem v Severní Americe a předstihl San Francisco Bay Area. Metropolitní oblast má podle údajů, na které odkazuje CNBC, 394 300 zaměstnanců v technologickém sektoru, zatímco Bay Area jich má 375 730. Jako hnací síla je uváděna poptávka z finančního sektoru, který ve větší míře najímá odborníky na umělou inteligenci. Zároveň klesá zaměstnanost v technologickém sektoru v Bay Area. V oblasti pracovních míst specificky zaměřených na AI je však San Francisco stále na prvním místě.
Synthszr Take: Náskok 18 570 pracovních míst vzniká na straně poptávky: banky, hedgeové fondy a pojišťovny najímají odborníky na AI rychleji než platformy, které je vyškolily. Obchodní firma dokáže vypočítat výnos modelu na bazický bod přesně, a to jak při posuzování úvěrů, tak při odhalování podvodů, a podle toho platí, zatímco v Bay Area se zároveň ruší pracovní místa. Talent následuje rozpočet, ne poslání, a rozpočet se momentálně nachází v Midtownu.
Vědci nacházejí v 3200 let starém pouštním písku první značku v historii lidstva
Výzkumný tým z Vídeňské univerzity pod vedením Marty Luciani identifikoval keramickou tradici z doby bronzové jako jednu z nejstarších značek v historii lidstva. Studie byla publikována v časopise PLOS One a zkoumá takzvanou Qurayyah Painted Ware, keramiku, která byla rozšířená před zhruba 3200 lety na území dnešní Saúdské Arábie. Charakteristické jsou pro ni černo-červené geometrické vzory a stylizované postavy zvířat a lidí. Podle výzkumníků vznikl efekt značky ze samotné vizuální identity: stálé kvality materiálu, konzistentní výrobní techniky, centralizované výroby a exportu, který přesahoval původní region. → Becky from 404 Media
Synthszr Take: 3200 let a recept na úspěch se téměř nezměnil: stálá kvalita, rozpoznatelný tvar, dostatečný dosah, aby ostatní začali kopírovat. Hrnčíři z Qurayyah neměli marketingový rozpočet ani strategii positioningu, měli rukopis, který byl rozpoznatelný na sto metrů. Současné euforii kolem AI chybí povědomí o tom, že napodobitelé v tomto příběhu vždy prohrávali; studie výslovně uvádí místní imitace jako důkaz síly originálu, nikoli jako jeho ohrožení.
Greg Brockman po vlně odchodů kontroluje operativní chod OpenAI
Greg Brockman, spoluzakladatel a prezident OpenAI, se po sérii odchodů vedoucích pracovníků stal fakticky dvojkou společnosti a v každodenním provozu hlavní odpovědnou osobou. Jeho titul se léta nezměnil, ale jeho oblast odpovědnosti se výrazně rozšířila. Brockman je součástí vedení od založení a v počáteční fázi byl považován za inženýra, který zprovoznil velké trénovací systémy. Tehdy se o moc dělil se spoluzakladateli, jako byli hlavní vědec Ilya Sutskever a CEO Sam Altman. V roce 2017 si do osobního deníku poznamenal otázku, co ho finančně dovede k první miliardě; jeho dnešní podíl v OpenAI je odhadován na téměř třicetinásobek této částky.
Odchody se nahromadily v dubnu: společnost opustili šéf projektu Sora Bill Peebles, viceprezident pro výzkum Kevin Weil a Srinivas Narayanan, CTO pro B2B aplikace. Marketingová ředitelka Kate Rouch a Fidji Simo, zodpovědná jako CEO za nasazení AGI-nasazení, odešly s odkazem na zdravotní důvody; Simo si v dubnu vzala volno a v červenci oficiálně odstoupila. Začátkem tohoto měsíce překvapivě oznámila svůj odchod po pouhých osmi měsících obchodní ředitelka Denise Dresser, ačkoli po dubnových změnách převzala další úkoly. O několik dní později Brad Lightcap, dlouholetý COO a naposledy zodpovědný za speciální projekty, oznámil, že chce vybudovat něco vlastního.
Několik z těchto změn se Brockmanovy pozice nedotklo, jiné ji přímo rozšířily. Když si Simo vzala volno, převzal veškerou odpovědnost za produkt, včetně práce na plánované superaplikaci. Při následné reorganizaci, která byla zaměřena na růst tržeb, přibyla k produktové strategii i celá oblast škálování, čímž se mu prakticky podřídil celý komerční byznys. Formální odstoupení Simo, několik týdnů po oficiálním podání žádosti o IPO, tuto strukturu upevnilo. To vše se děje v roce, kdy probíhal několikaměsíční soudní proces s porotou proti spoluzakladateli Elonu Muskovi, žaloba od Applu kvůli obchodním tajemstvím a kritika poté, co nezveřejněný model hacknul jinou AI společnost. OpenAI se na dotaz prozatím nevyjádřila. → Globe and Mail, The Verge
Synthszr Take: Zvenčí je už měsíce slyšet hluk, ale uvnitř od založení sedí u stroje stále tentýž muž. Každý odchod přesunul odpovědnosti někam jinam a to ‚někam jinam‘ se téměř vždy jmenovalo Brockman: produktová strategie, superaplikace, celá oblast škálování a nakonec kompletní komerční byznys, to vše bez jediné změny titulu. To je nejstabilnější struktura, kterou může OpenAI v současnosti nabídnout, přičemž v dubnu situace z dálky ještě vypadala jako telenovela s otevřeným koncem. Pro vstup na burzu je důležité, kdo zodpovídá za stroj na peníze, ne kdo mluví na pódiu, a tato odpověď je od léta jasná. Při čtení prospektu se vyplatí podívat se na řádek pod Altmanem: tam stojí jméno, které drží každodenní chod firmy.

