Sam Altmann versprickt den Anfang vun de AGI-Ära
- • OpenAI seggt, dat se mit GPT-6 den Anfang vun de AGI-Ära inlüüdt hebbt
- • Anthropic bringt KI-Agenten rut, de den Enkelthannel revolutioneren künnen
- • Alibaba föhrt mit Qwen3.8-Max-0902 de CodeArena-Ranglist an
OpenAI versprickt den Anfang vun de AGI-Ära mit GPT-6
OpenAI hett an’n Dunnersdag GPT-6 Astra rutbröcht un nöömt dat Modell „dat klöökste un best utrichte Modell op de Welt“. Bi en Presse-Briefing vör den Start güng OpenAI-Präsident Greg Brockman över de Benchmark-Tallen rut: He meen, dat weer „nich unvernünftig, to föhlen, dat wi uns nu in de AGI-Ära befinnt“, un hett den Termin mit den Satz „Welcome to the AGI era“ afslaten. Op de Fraag, of OpenAI dormit formal AGI utropen hett, sä Brockman, de Begreep weer nich mehr an en vertraglichen Utlöser bunnen (meent is de fröhere Afspraak mit Microsoft), man mehr en „Missions- oder spirituell Konzept“. Sam Altman sülvst harr AGI toletzt as en „bannig slecht defineerten Begreep“ un in’n besten Fall as en „irrelevanten Marketingutdruck“ betekent.
Na Angaven vun den Anbieter sättigt Astra FrontierMath Tier 4 mit 98 Perzent, ARC-AGI-3 mit 99,9 Perzent un ExploitBench mit 100 Perzent. Op Terminal-Bench Science 0.1 kummt dat Modell op 64,6 Perzent gegenöver 52,6 Perzent för Claude Fable 5.1, bi üm un bi 31 Perzent lüttere schätzte API-Kosten. Op Agents' Last Exam, wat komplexe Beropsopgaven in echte Software pröövt, kummt Astra op 59,3 Perzent, vergleken mit 55,5 Perzent för Claude Opus 5 un 53,6 Perzent för GPT-5.6 Sol. In Latenzsimulatschonen op OSWorld 2.0 kummt Astra op 72,6 Perzent bi circa 40 Minuten pro Opgaav, gegenöver 65,7 Perzent bi üm un bi 75 Minuten för Sol.
Luut OpenAI-Forscher Aidan Clark weer Astra de bit nu gröttste Trainingsloop vun dat Ünnernehmen un dat eerste Maal, dat an’n Stargate-Standort in Texas op mehr as 100.000 GPUs vörtraniert worrn is. To’n eersten Maal harrn fröhere Modellen dat Training in en bedüdend Ümfang mitöverwacht. De Rollout fangt bi Firmkunnen in’t Daybreak-Programm an, dorna kaamt Plus-, Pro-, Business- un Enterprise-Nutzers as ok API un AWS. In de API kost Astra 10 Dollar för een Million Input-Token un 50 Dollar för een Million Output-Token, dat is dat 2,5-fache vun Sols aktuellen Aktschoonspries un op dat Niveau vun Anthropics Fable 5.1.
In den begleidend Sekerheitsbericht schrifft OpenAI, Astra weer dat eerste Modell, dat ünner dem Preparedness Framework de Stoop „Critical“ bi Cybersicherheitsegenschoppen reckt hett: Mit de passenden Warktüüg un Togäng kunn dat unbekannte Sekerheitslücken finnen un ne’e Angreepsweg utklamüstern, ahn dat en Minsch jeden Schreed föhrt. Dat Ünnernehmen nöömt dorför strengere Isolatschoon, verslötelte Checkpoints, en dörgahnd Överwachen vun vullstännige Trajektorien inklusiv Gedankenketten un en blockeerend Alignment-Prööv vör de interne Bruuk. In en Simulatschoon mit över 54.000 interne Codex-Opgaven schall Astra üm un bi de Hälft so vele Meldungen för sworwegend fehlorienteert Verhollen kregen hebben as Sol. In en ne’e Evaluation, de op den Hugging-Face-Vörfall vun’n Juli baseert, schall Sol ahn Schuulmatnahmen in 48 Perzent vun de Fäll dat autoriseerte Teel överschreeden hebben, Astra in 0 Perzent.
Blangenbi hett The Information bericht, dat Astra in en begrenzten Ümfang en Verfohren mit den Naam Recurrent Depth insett, ok „opaque recurrence“ nöömt, woneem de sülve Anfraag mehrfack in en Slööp verarbeit warrt un weniger lesbore Sporen achterlett. Redwood-CEO Buck Shlegeris hett sik „extrem besorgt“ wiest, Zvi Mowshowitz hett gesettliche Regeln gegen en Ünnerbeden-Wettloop vun de Labors foddert. OpenAI-Chefwetenschoppler Jakub Pachocki hett op X wedderspraken un nööm lesbore Gedankenketten en Karnteel vun dat lopen Forschungsprogramm. Togliek hett OpenAI ankünnigt, den subventschoneerten Togang to’n Daybreak-Cybersicherheitsprogramm för Versorgers, Kommunen un Finanzinstituten uttowieden un en bundsstaatenövergriepend Initiativ för den Informatschoonsuttuusch to starten, na de Angrepen op Watersystemen an de bedrapenen Bundsstaten Guthaben un technische Hülp anboden harr. → latent, thenewstack, openai, techcrunch, bloomberg, businessinsider
Synthszr Take: 98 Perzent op FrontierMath Tier 4, 99,9 op ARC-AGI-3, 100 op ExploitBench: Wenn dree Tests toglieks sättigt sünd, seggt dat mehr över de Tests as över dat Modell. Sättigte Benchmarks meten vun dissen Punkt an vör allen, wo goot en Labor sien egene Prööv-Vörbereiden in’n Greep hett. Minne prominent platzeert is de Weert för Agents' Last Exam mit 59,3 Perzent, also goot veer vun teihn echte Beropsopgaven dorneven, un dat is de Tall, an de sik de AGI-Anspruch meten laten müss. Brockman schufft AGI in en „spirituell Konzept“, na dat de Begreep sien vertragliche Funkschoon gegenöver Microsoft verloren hett; Altman nöömt em sülvst en Marketingutdruck. Solang en System bi reale Bildschirmarbeit twee vun fiev Opgaven verfehlt, is de „AGI-Ära“ de Begleitmusik to en Priesanstieg op 10 Dollar för een Million Input-Token.
Anthropic boot Commerce-Agenten mit Shopify un Visa, aver keen egen Checkout
Anthropic hett en Paar KI-Agenten för den Hannel rutbröcht un den Kood apenleggt. Utklamüstert worrn sünd de Claude Commerce Agents tohoop mit Shopify, Visa un Mastercard. Na Angaven vun Anthropic föhrt se to üm un bi 35 Perzent gröttere Warenkörv; belastbore Tallen vun Händlers gifft dat bit nu nich. De utdrückliche Sinn vun de Partnerschop is, Enkelthändlers an Claude to binnen, anstatt se an ChatGPT oder Gemini to verleren.
Opfallig an de Ankünnigen is de Tosnitt vun de Architektur. Anthropic deelt de Opgaav op twee Agenten mit trennte Tostännigkeiten op, anstatt en enkelten Agenten den kumpletten Koopvörgang afwickeln to laten. En egen Checkout-Protokoll gifft dat nich, jüst so wenig en egen Produktkatalog oder en Warf-Ebene. Disse dree Bosteen weern de naheliggen Monetariserenspunkten wesen, un jüst de blievt utspart.
De Bedeeligen vun Visa un Mastercard warrt in de Analys dormit verklort, dat de bestahn Betaalafwickeln nich anröögt warrt un dormit ok dat Interchange-Entgelt, wat de Nettwarken an jede Kortentransaktschoon verdeent. För Shopify bedüüdt de Opbo, dat Katalog- un Händlerdaten op de Plattform blievt. De Fall gellt as en fröhen Henwies dorop, woans KI-Anbieters agentischen Hannel överhaupt to Geld maken wüllt.
→ Linas from Linas’s Newsletter, Linas from Linas’s Newsletter
Synthszr Take: Dat Opgeven vun en egen Checkout-Protokoll is de düürste un togliek klöökste Entscheden in disse Architektur. Anthropic harr de Betahlen sülvst afwickeln kunnt, un Visa un Mastercard harrn binnen en Stünn narekent, woveel vun jemehr Interchange-Innahmen dorbi överblifft. Statts dat: twee trennte Agenten, schiere Rullentrennen, Betaalschicht nich anröögt: Vertruun warrt hier dör Sülvstbeschränken köfft. Dat is en Wett dorop, dat de Togang to Shopify-Händlers mehr weert is as en poor Basispunkten pro Transaktschoon, un se kunn opgahn. Of de 35 Perzent grötteren Warenkörv de Realität standhollen, wiest eerst de Händlertallen vun de nächsten Quartalen, man de Rendite vun disse Architektur liggt al nu dorin, dat de Kortennettwarken en handfesten Grund hebbt, Claude gegenöver ChatGPT vörtotehn.
Alibaba schufft Qwen3.8-Max-0902 na un föhrt dormit de CodeArena-Ranglist an
Alibaba hett en överarbeidte Version vun sien Spitzenmodell Qwen3.8-Max ünner dat Körzel „0902“ rutbröcht. De Architektur blifft unverännert: 2,4 Billionen Parameters un en Kontextfinster vun en Million Token, as al bi’n Vörgänger. De Verbetern kaamt luut Bericht blots ut dat Post-Training, dat gezielt op Programmeeropgaven un agentische Büroaflööp in’n Cowork-Stil utricht worrn is. De CodeArena-Weert vun dat Modell is üm 22 Punkten op 1.691 stegen. Na Angaven vun Alibaba föhrt dat Modell dormit de Ranglist an. → AI Weekly Espresso
Synthszr Take: Lieke 2,4 Billionen Parameters, liek Kontextfinster, lieken Pries, un liekers 22 Punkten mehr op 1.691. Dat is de würkliche Konkurrenzlaag. Wieldes in Kalifornien jede Rangverbetern en neet Modell, en ne’en Naam un en ne’e Rekenzentrums-Ankünnigen bruukt (blots letzte Week Gemini 3.8 Flash un Muse Spark 1.3), schufft Alibaba still en Snapshot na un stempelt dat Datum dorop. Disse Versionsnummer verrädt de Taktung: En Spitzenmodell warrt hier pleegt as en Software-Build, in Zyklen vun Weken un to en Brokdeel vun de Trainingskosten.
ChatGPT, Claude un Grok fallt ut – SpaceX-Rekenzentrum in’n Fokus
An’n 3. September 2026 sünd ChatGPT, Claude un Grok binnen wenige Stünnen togliek utfallen, mellt The Register. OpenAI hett gegenöver dat Magazin seggt, en Routing-Fehler af ca. 7:43 Uhr Pazifik-Tied harr ChatGPT un Codex för en Deel vun de Brukers un-erreichbor maakt; gegen 8:17 Uhr weer en Lösen utrullt worrn. Anthropic sien Status-Siet wies en Utfall vun dree Stünnen un söss Minuten ut, mit högere Fehlerraten bi Sonnet 5 un annere Modellen. Na Angaven vun en Anthropic-Spreker bedraap en Infrastrukturproblem Claude.ai, Claude Code, Claude Cowork un de Claude-API, de Deenst leep af 16:16 UTC wedder. SpaceX füng na egen Status-Siet al üm 6:30 Uhr Pazifik-Tied mit de Ünnersöken vun de Grok-Stören an. → The Register
Synthszr Take: De Redundanz, för de Ünnernehmen jüst brav Tweeverdrääg bi OpenAI un Anthropic afsluten doot, hett an dissen Dunnersdag dree Stünnen un söss Minuten lang nich existeert. En automaatschen Fallback vun Claude op Grok harr nix reddt, wiel beide an de sülve physische Kapazität in Memphis hüngen. Dat SpaceX sik an’n Namiddag bi sien Compute-Partners entschulligt, is de harte Informatschoon vun’n Dag: Anthropic rekent anscheinend dor, woneem ok Grok rekent, un dat steiht in keen Verdrag un op keen Status-Siet.
Saudi-Arabiens Humain boot araabsch Spraakmodell m3 mit Chinas MiniMax
Dat saudische Staatsünnernehmen Humain hett mit humain-m3 en araabschspraakig Spraakmodell vörstellt, dat gemeensam mit dat chinees’sche KI-Labor MiniMax entwickelt worrn is. Humain höört to’n Staatsfonds Public Investment Fund un is 2025 grünnt worrn, üm dat Königriek en egen Reken- un Modellbasis to schaffen. De Vörstellen fallt in en lopen Debatt ünner US-Verbündete doröver, of Sovereign AI op Modellen vun chinees’sche Herkumst opboon dröfft. Na Berichten sorgt de Partnerwahl in Washington för Unmoot, wiel Saudi-Arabien parallel amerikaansche Besleinigers för sien Rekenzentren kriggt un Humain bit nu vör allen mit US-Anbeders as Nvidia un AMD kooperiert hett. MiniMax publizeert en Deel vun sien Modellen mit apen Gewichten, de sik lokal bedrieven un anpassen laat. → Wired
Synthszr Take: Souveränität heet in disse Konstrukschoon: Rekenzentrum in’t egen Land, Modellherkumst ut China. Humain boot humain-m3 mit MiniMax, dormit hangt en Stück saudische Staatsstrategie an en chinees’schen Trainingsstack, wieldes de Besleinigers dorför wiederhen ut de USA kamen schöölt. För Washington is dat ungenehm, wiel sik de Hevel kaum ansetten lett: Chip-Exporten an den Golf freetogeven un toglieks to verlangen, dat dorop keen chinees’schen Gewichten loopt, is en Bedingen ahn Kontrollmööglichkeit.
FTC will heemlich stüerte KI-Antwoorten as Brukertäuschung bestrafen
De US-Hannelsopsicht FTC will bestahn Brukerschutzrecht gegen KI-Anbeders anwennen, de ehr Systemen as akkerat anpriesen doot, de Antwoorten aver mit Afsicht op en anner Teel hen lenken, ahn dat apen to leggen. Dat an’n 1. Juli publizeerte Policy Statement stütt sik op Section 5 des FTC Act un nöömt dissen Vörgang as „suppression of accuracy“, also as en Form vun Brukertäuschung. Anbeders köönt en Täuschungsklaag ut’n Weg gahn, indem se klor apenleggen doot, wenn ehr KI annere Telen över dat stellt, wat Brukers verlangen oder vernünftigerwies verwachten. De Behöörd treckt in dat Papeer en utdrückliche Grenz to Halluzinationen: Falsche Antwoorten, de ut technische Grenzen vun dat Modell entstaht, fallt för sik nahmen nich dorünner. En juristische Analyys vun de Kanzlei Covington & Burling in’n Blog Inside Privacy hollt de Dörsetten för swoor, wiel grote Spraakmodellen op de sülve Anfraag ünnerscheedliche Antwoorten geven un dat faken keen eendüdigen Verglieksergeevnis gifft. Dat negen-siedige Papeer nöömt keen technischen Test, üm en Halluzinatschoon vun en bewusste Stüern to ünnerscheden; na de Analyys schöölt dorüm interne Modelltests, "System Instructions un Protokollen över Verhaltensännern in’t Zentrum vun tokamen Verfohren rücken.
Synthszr Take: De FTC teelt op den Dumen op de Waag: en System, dat as akkerat verköfft warrt, wiel in de Systemanwiesen en annere Priorität steiht. Dat draapt de Steed, an de de Bransche jüst ehr nächst Geschäftsmodell opboot, denn betahlte Platzeren in Chat-Antwoorten funktschoneert blots so lang, as de Bevörtugen unsichtbor blifft. Halluzinatschonen utdrücklich uttonehmen, is de richtige Grenztehn, wiel en technischen Fehler noch keen Afsicht beleggt.
Börgerinitiative kippt 100-Milliarden-Rekenzentrum in Virginia
In Prince William County in’n US-Bundsstaat Virginia hett organiseerten Anwahnerwedderstand en Rekenzentrumsprojekt in’t Volumen vun rund 100 Milliarden Dollar to Fall bröcht. De Daily Mail beschrifft den Fall as en Vörlaag, de intwüschen vun Initiativen in annere US-Regionen kopeert warrt. De Landkreis liggt in de dichtste Rekenzentrumsregion vun de Vereenigten Staaten, in de sik de Anlagen langs de bestahn Nett- un Glasfaserinfrastruktur ballen doot. Strietpunkten weern na den Bericht Flächenwidmung, Stroomversorgen un de Belasten vun angrenzen Wahrebeden. → Daily Mail
Synthszr Take: 100 Milliarden Dollar Projektvolumen scheitert an Navers, de Sitzungsprotokollen lesen un Genehmigungsfristen in’n Klenner hebbt. In Prince William County is en Verfohren entstahn: Widmungsandrääg fröh angriepen un de Kommunalwahl as Hevel bruken. Verfohren reist gauer as Beton un köst in’t Verbreden meist nix.
G20 nimmt eenstimmig Washingtons lockeres KI-Regelwark an, China un Russland inslaten
All 20 Liddmaten vun de G20 hebbt an’n Middeweek en vun de USA vörleggt Rahmenwark to de KI-Reguleren goodkennt. Dat Papeer driggt den Naam „Carolina Principles“ un is an’t Enn vun en twee Daag duern Innovation Ministerial in Chapel Hill, North Carolina, utricht vun’t US-Hannelsministerium un dat Büro för Wetenschop- un Technologiepolitik vun’t Witte Huus. Dat röppt de Staten dorto op, KI sektorspezifisch to regeln, keen ne’e Opsichtsbehörden to schaffen un bi de Bewerten vun ne’e Technologien enger mit de Privatweertschop tosamen to arbeiden. Dat Dokument is nich binnend un schall bi’n Topp vun de Staats- un Regerenschefs in’n Dezember in Trumps Golfclub in Doral, Florida, formaal annahmen warrn. Hannelsminister Howard Lutnick sä, de eenstimmige Tostimmen harr „enorm veel Arbeit“ köst. Ok China un Russland hebbt dat Papeer mitdragen, wenige Weken vör en plaant Drapen twüschen Donald Trump un Xi Jinping in Washington, bi dat KI-Governance op de Dagorden stahn schall.
De gemeensame Afslussverkloren nöömt sess Sülen, dorünner innovatschoonsfründliche Politikrahmens, Utbillen vun technische Fachlüüd, Oorheverrechtsfragen bi KI un Standardiseren. Na Angaven vun dat Witte Huus kemen as wiedere Resultaten de „AI Prosperity Objectives“ un en „AI Prosperity Compact“ dorto, de de Entwicklung vun Fachlüüd un Partnerschoppen mit de Privatweertschop in de G20-Staaten utboen schöölt. OSTP-Direkter Michael Kratsios hett dorför worven, op „heel un deel ne’e Regelwarken för KI“ to verzichten.
De Ministerrunn kreeg de Industrie in Reeg präsenteert: Kratsios hett Kamingespräche föhrt mit Elon Musk, David Sacks, Demis Hassabis, Mark Zuckerberg un Commonwealth-Fusion-Baas Bob Mumgaard, Lutnick mit Jensen Huang, Anthropic-Mitgründer Tom Brown, Sam Altman un Palantir-Baas Alex Karp. Huang, de sülvst dor weer, hett KI mit Water, Straten, Stroom un Internet vergleken un hett jedet Land opfordert, egene Rechenzentren to boen. Reguleren schull man praktischen un tatsächlichen Schaden, nich theoretischen. Musk, de per Video toschalt weer, hett den mööglichen Wassen-Effekt vun KI op 20 bit 30 Perzent vun de globale Weertschopsleistung taxeer un vör Överreguleren wohrschaut.
Altman nööm den Insatz vun KI „nich verhannelbor“ un hett den Vergliek to de Elektrifizeren trocken, hett aver fasthollen, dat nich jedet Land egene Rekenzentren bruken deit: Welke wöörn Kapazität in’t Utland meden. Bi dat Thema Risiko güngen de Lienen utenanner. Altman sä, Sorg weer torecht, se weer de Oort, woans man Problemen vörutkieken deit, un hett toglieks de Sülvstreguleren vun de Anbeders as noog verkloort, üm katastrophale Risiken to vermieden. Karp hett Risiken ingrüümt un sik gegen Doom-Narichten stellt. In en separaat Interview harr Altman tovör eerste Anteken vun en „unhollbore Kasperee“ bi KI-Investitschonen nöömt un op Rechenzentrumskapazität ahn noog Brukers un Umsätz henwiest.
Energie un Genehmigungen weren en egen Thema. Tom Brown hett gauere Genehmigungsverfohren för den Bo vun Rekenzentren fordert un hett en Bidrag vun Trump loovt, na den Kommunen, de sik gegen sülke Anlagen wehren, „trüchbleven un arm“ ennen wöörn. Lutnick hett de Anlagen as Wohlstandsbringers verdeffendeert un Bedenken to Ümweltwirken un Waterverbruuk afwiest; he hett butendem bestätigt, dat Anthropic sien Arbeitsverhältnis to dat Witte Huus wedderherstellt hett. Vör den Drapenoort op den Campus vun de University of North Carolina hebbt 100 bit 200 Minschen gegen dat Entwicklungstempo vun de Technologie demonstreert. De britsche Minister Chris McDonald sä, Regeren müssen Wassen verfolgen un toglieks dat apentliche Vertroen schulen: „Dat geiht nich dorüm, Evangelist vun de Technologie to ween, man praktisch un pragmatisch.“ → Reuters, Quartz, The White House, The Independent, Wall Street Journal, Watcher Guru, techstrong, Agence France-Presse, Hürriyet Daily News
Synthszr Take: Eenigkeit, China un Russland inslaten, is bi en Papeer, dat nümms binnt, temlich billig to kriegen. Verhannelt worrn is in Chapel Hill faktisch över den Togang to Nvidia-Hardware, över Kapitaal un över de Fraag, wokeen in de nächsten dree Johr överhaupt Rekenzentren kriggt, un in disse Verhanneln hett en groten Deel vun de Runn eenfach keen Korten. Altman sien Nevensatz, dat manche Länner Kapazität eben annerwegens meden wöörn, beschrifft de Hierarchie genauer as de sess Sülen vun de Afslussverkloren: Meders schrievt keen Huusordnung. De britsche Minister snackt vun Pragmatismus, de EU-Vertreden höllt dorgegen, un de annern achtteihn hebbt ünnerschreven, wiel en nich-binnend Ja nix köst un en Nee den Togang in Gefohr bröcht harr. Dat egentliche Regelnfastleggen passeert in de tokamen Weken twüschen Trump un Xi in Washington, Doral in’n Dezember levert dorto bloots de Zeremonie.

