Fable 5.1 is dor, OpenAI vertrööst noch op't ne'e Update
- • Anthropic bringt Fable 5.1 op den Markt un versprickt Kosten-Effizienz.
- • OpenAI stuuft Astra as en kritisches Cyber-Risiko mit hoge Fähigkeiten in.
- • World Labs präsenteert Atlas, dat 3D-Szenen ut en poor Fotos genereren deit.
Anthropic bringt Fable 5.1 rut un versprickt mehr Effizienz för jeden Euro
Anthropic hett Claude Fable 5.1 un Claude Mythos 5.1 rutbrocht, twee Modellen mit de sülven Gewichten, de sik bloots dör de Hööchd vun de Sekerheitsschranken ünnerscheden doot. Fable 5.1 is för all Lüüd to hebben un warrt över AWS, Google Cloud un Azure utlevert. Mythos 5.1 löppt bloots över en Programm för prövten Togang, apen för Cyberverdeffenders un Biowetenschoplers bi US-Organisatschonen. För de Biologie-Fähigkeiten hett Anthropic en Togangsprogramm tohoop mit de US-Regeren op de Been stellt, de Anmellen för Forschers schall bold apenmookt warrn.
An de Grundpriesen ännert sik nix: 10 Dollar för een Million Input-Tokens, 50 Dollar för een Million Output-Tokens. Rünnersett worrn is de Pries för Cache Reads, vun 1 Dollar op 0,25 Dollar för jede Million Tokens. Na Angaven vun den Anbeder warrt tyypsche Arbeidslasten dormit üm un bi 25 Perzent günstiger as mit Fable 5, bi stark agentischen Opgaven bit to ca. 45 Perzent. En unafhängige Vöraf-Utweertung kummt op en anner Bild för jede Opgaav: 3,76 Dollar för jede Opgaav in’n Intelligence Index, 20 Perzent mehr as Fable 5, wiel dat Modell üm un bi 1,7-mol so veel Output-Tokens verbruukt; dat Rünnersetten vun de Cache-Priesen spoort dorbi üm un bi 1,40 Dollar.
Bi de Meetwerten fallt vör allen de ne’e Wetenschops-Benchmark op: Op Terminal-Bench-Science 0.1 kummt Fable 5.1 luut Anthropic op 52,6 Perzent gegenöver 24,7 Perzent bi Fable 5. Op Terminal-Bench 4.0 kummt Fable 5.1 op 55,8 Perzent, Mythos 5.1 op 60,9 Perzent, wat den Afstand in de Fähigkeiten twischen de beiden Sekerheitsstopen beziffert. Humanity’s Last Exam liggt bi 60,9 Perzent ahn Warktüüg, GDPval-AA v2 bi 1.853 Elo. Bi de externe Meten kummt dat Modell op 66 Punkten in’n Intelligence Index, den hööchsten Weert, de dor bit nu meten worrn is, vör Claude Opus 5 mit 63 un GPT-5.6 Sol mit 61.
Anthropic geiht na egen Dorstellen butendem op Kundenkritik an de Datenholen un to strenge Schutzmechanismen in. De ankünnigten Enterprise Frontier Safeguards schöölt Daten op de Cloud-Servers vun de Kunden statt bi Anthropic spiekern un in’n Loop vun’n Harvst utrullt warrn. Fable 5.1 schall grundleggen Biologiefragen roorer blocken as de Vörgänger, wieldes Mythos 5.1 de sülven Inschränkungen behollt. För Cybersicherheit verlöövt Anthropic Fable 5.1 nu dat Identifizeren vun Software-Swacksteden, verwist Opgaven as Penetrationstests, Exploit-Erzeugung un binärbaseert Swacksteden-Scanning aver wieder an de Opus-Modellen. Ut den Krink vun de Early-Access-Kunden hebbt sik ünner annern Every-CEO Dan Shipper un Box-CEO Aaron Levie positiv to dat Tempo un de Genaudigkeit vun dat Modell utlaten.
Ut de Praxis warrt konkrete Fäll mellt: Bi de Investmentfirma Millennium funn dat Modell de Oorsaak för en roren Afstört, an den de egen Ingenieurs johrelang scheitert weern. Cognition verleggt sien Opus-5-Verkehr in Devin to’n Start op Fable 5.1, Jane Street mellt betere Leesborkeit över lange Opgavenkeden. In redakschonelle Tests hett dat Modell Agentenopgaven in üm un bi 60 Perzent vun de Tied vun Opus 5 doon, leverte aver op en Anfraag na acht bit twölf Zitaten 43 Stück, dorünner Zitaten, de in de Born fehlen deen, un ignoreer bi de hööchste Effort-Stoop tietwies Stopp-Anwiesungen. Dat Rutbringen fallt in en Phaas, in de en Börsengang vun Anthropic vermoodt warrt un OpenAI sien Modell Astra noch op sik töven lett. → anthropic, artificialanalysis, axios, AI Weekly, Every
Synthszr Take: En Modell, dat den Wetenschops-Benchmark vun 24,7 op 52,6 Perzent anheevt, schufft de Rangorden twischen Instituten gauer as jede Beroopungskommischoon. De egentliche Zäsur stickt in dat Togangsmodell: De Biologie-Fähigkeiten vun Mythos 5.1 warrt över en Programm verdeelt, dat Anthropic tohoop mit de US-Regeren bedrifft, un dat steiht prövte Organisatschonen in de USA apen. Dormit entscheedt en Anbeder un en Regeren gemeensam doröver, welke Labors mit den besten verfügboren Mitforscher arbeiden doot, wieldes de Begootachten dör Fachkollegen vörutsett, dat de Gootachters de sülven Warktüüg in de Hand hebbt. De Millennium-Fall wiest de Richt: En Oorsaak, an de Ingenieurs johrelang scheitert sünd, warrt in een Dörloop funnen, un sücke Resultaten kaamt toeerst dor tostann, woneem en Token-Budget vörhannen is, nich an’n Lehrstohl mit Drüddmiddelandrag. De nächste Reputatschoonsvörsprung in de Forschkumst kummt an’n Verhanneldisch över Togangsrechten tostann, un dor sitt Universitäten bit nu roor.
OpenAI stuuft Astra as en kritisch Cyber-Risiko in un schränkt den Togang in
OpenAI hett Astra na egen Angaven as eerst Modell op de Stoop „Critical“ för Cybersecurity-Fähigkeiten inordent, de hööchste Kategorie in dat huusegene Preparedness Framework. Disse Drempel gellt luut OpenAI as reckt, wenn en Modell ahn minschliche Stüern funkschoonsfähige Zero-Day-Exploits in hard maakte reale Systemen entwickeln oder ut en groff formuleert Teel en vullstännige Angreepskedd buen kann. Op den öffentlichen ExploitBench hett Astra na Angaven vun dat Ünnernehmen 100 Perzent reckt. Wegen möögliche Kontaminatschoon vun de Trainingsdaten hett OpenAI tosätzlich en internen Testsatz ut 20 eerst korts apenleggte V8-Swacksteden boot. Bi disse Evaluierung hett dat Modell na de Angaven twee bit nu unbekannte Lücken funnen un hett se in en Exploit-Kedd inboot, dat Apenleggen an de Maintainers löppt noch. In Tests, de vun Experten leidt worrn sünd, schall Astra butendem ut en hard maakte Browser-Sandbox utbraken ween un in en Bedriefssystem en Rechtenutwieden bit to root konstrueert hebben. → OpenAI
Synthszr Take: De Tallen, de OpenAI wiest, kaamt ut de Daybreak-Blue-Konfiguratschoon un nich ut de Produktschoonsverschoon, de later utlevert warrt. Extern napröven kann een an disse 100 Perzent op ExploitBench also nix. För Sekerheitsforschers buten dat Huus bedüüdt de Instopen praktisch Tööv-Tied, wiel de fortschredenen Fähigkeiten eerstmal en utwählte Testergrupp apenstaht un de Opnahmkriterien nargens staht. Dorto kummt, dat OpenAI dat Modell traineert hett, schäädliche Cyber-Anfragen toverlässiger aftolehnen, un disse Leitplanken draapt in’n Alldag toeerst de Lüüd, de legitim na Swacksteden söökt (en Pentest leest sik in’n Prompt nu mal as en Angreep)..
World Labs stellt mit Atlas en Weltmodell vör, dat 3D-Szenen ut en poor Fotos boot
World Labs, dat Startup, dat vun de Computer-Vision-Forscherin Fei-Fei Li in’n Februar 2024 grünnt worrn is, hett sien Weltmodell Atlas vörstellt. Luut siliconangle.com maakt Atlas ut een enkelt 2D-Bild bit to een Minuut Video in 1440p, dat een sik ut jede möögliche Kiekwinkel ankieken kann un dorbi geometrisch konsistent blifft. Technisch beschrifft dat Ünnernehmen de Architektur as multimodalen autoregressiven Diffusion-Transformer, de Kamerapaads un Geometrie as native Ingaven verarbeidt, statt över Textprompts stüürt to warrn. Blangen Videoframes gifft dat Modell na Angaven vun den Anbeder ok 3D-Assets as Punktwulken un Gaussian Splats ut. As Teelfeld nöömt World Labs de Robotik: Entwicklers schöölt en realen Ruum mit en gewöhnliche Smartphone-Kamera opnehmen un as Simulatschoon wedderherstellen, in de en Roboter navigeert un dorbi RGB-Biller as ok Deepensensorweerten levert kriggt. In en Blindbeweertung, de dat Ünnernehmen sülvst dörföhrt hett, to dat Inholen vun Kamerapaads schall Atlas gegenöver Gemini Omni Flash un FLUX vörtrocken worrn ween. → siliconangle.com
Synthszr Take: Een Minuut 1440p-Video ut een enkelt Handyfoto, dorto Deepenweerten un Punktwulken: För dat Wohrnehmungstraining vun en Roboter is dat en Bült bruukbor Material. Navigatschoon un Objekterkennen bi wesseln Lichtverhältnissen laat sik so billiger dörspelen as mit en Hall vull physische Opbauten. Bi dat Togriepen höört dat op, denn Rieven un Nagievigkeit vun en Gegenstand steekt in keen rekonstrueerte Geometrie, un jüst doran scheitert Griepers in’n echten Bedriev.
Meta sien Muse Voice Transcribe ünnerbedt Google Cloud in’n Pries üm 80 Perzent
Meta Superintelligence Labs hett güstern Muse Voice Transcribe rutbrocht, dat eerste Echttiet-Modell vun dat Labor, dat Streaming-Transkription, Sprekertrennen un Erkennen vun’t Enn vun de Reed in een Modell tohoopbringt. Över de Meta Model API köst de Deenst 3 Dollar för 1.000 Audiominuten, also 0,18 Dollar pro Stünn; Google Cloud Speech-to-Text verlangt in’n Standardtarif 0,96 Dollar pro Stünn. Op den unafhängigen AA-WER-Streaming-Benchmark vun Artificial Analysis hett Muse luut Implicator.ai en Woortfehlerraat vun 3,1 Perzent reckt, vör Cartesia Ink-2 mit 3,4 Perzent, ElevenLabs Scribe v2 Realtime mit 3,6 Perzent un Google sien Gemini 3.5 Transcribe Live mit 4 Perzent. De Test baseert op üm un bi acht Stünnen engelsch Audio un seggt nix över de mehr as 70 Trainingsspraken ut, vun de Meta to’n Start 25 as prövt anbeveehlt. Bi de Diarisierung, also dat Toornen vun Reedandelen to enkelte Sprekers, nöömt Meta sülvst en Fehlerraat vun 17,5 Perzent. → Implicator.ai
Synthszr Take: 0,18 Dollar gegen 0,96 Dollar de Stünn, dat is Faktoor fiev, un dorneven wirkt 0,3 Perzentpunkte Vörsprung in de Woortfehlerrate as Smuckwark. Meta ünnerbedt dorbi nich blots Google: Cartesia liggt bi 4 Dollar pro 1.000 Minuten, ElevenLabs un Deepgram bi 6,50, un all speelt in de sülvige Fehlerklass twüschen 3 un 4 Perzent. Rekent man een Million Transkriptschoonsstünnen in’t Johr, sünd dat 780.000 Dollar Ünnerscheed to Google, un dorför nimmt en Inköper 17,5 Perzent Fehler bi de Sprekertoornung ahn lang Tögern in Koop.
Google steiht luut WSJ kort vör den Start vun en Coding-Modell mit den Naam „Skimaki“
Google DeepMind bringt na en Bericht vun’t Wall Street Journal in de nächsten Daag en op Programmeern utricht Modell op den Markt: Gemini 3.8 Flash, intern „Skimaki“ nöömt, kunn al an’n Middeweek rutkamen. De Zeitung stütt sik dorbi op anonyme Insider, de dat Modell düütlich betere Coding-Fähigkeiten toschrievt. Test worrn is dat na Berichten mit en intern Warktüüg mit den Naam „Jetski“; de bedeeligten Entwicklers schöölt dat lever hebben as Anthropics Claude Opus. Anners as OpenAI sien betnu nich publizeert Astra höört Skimaki nich to den Billionen-Parameter-Rebeet, man to de Flash-Reeg, de op Snelligkeit un ringe Kosten utleggt is. → Gizmodo
Synthszr Take: In’n März is OpenAI op Coding umswenkt, nu treckt Google na, un dat Muster is middewiel so toverlässig, dat man de Roadmap vun een Lab an de vun’n Naver aflesen kann (wi hebbt dat Kopier-Karussell al Anfang Mai beschreven, dat dreiht sik blots gauer). Intressanter as dat Nakamen is de Utlöser in’t Huus: Hassabis, de verleden Johr noch bremst hett, is siet en Maand nich mehr DeepMind-CEO, Brin drückt op’t Tempo, un veer Weken later steiht en Coding-Modell vör de Döör. Dat Google dorför en Flash-Modell wählt un nich den Billionen-Parameter-Klumpen, wiest, woneem de Reken opgahn deit: Agenten verbrennt Tokens in’n Sekunnentakt, dor sleit gau un günstig dat gröttste Modell in’t Regal.
OpenAI gifft Antwoort op Apple sien Klaag: Apple schall sien Geheemnisse sülvst slecht schuult hebben
OpenAI wiest in’n lopen Striet üm Bedriefsgeheemnisse de Verantwoortung trüch un verklort, Apple mööt sik en mööglichen Affluss sülvst toschrieven. Reuters bericht, dat OpenAI disse Positschoon in en Ingaav in’t Verfohren vertriddt, in dat Apple dat Wegnehmen vun geheeme Informatschonen gellen maakt. Karn vun de Verdedigen is na Dorstellen vun OpenAI, dat Apple de bedrapen Informatschonen nich noog schuult hett; gerichtlich faststellt is dat nich. Juristisch teelt dat op en zentralen Punkt vun’n US-Geheemnisschuul: En Kläger mutt nawiesen, dat he passliche Geheemholensmaten drapen hett, anners gellt en Informatschoon rechtlich nich as en Geheemnis, dat schuult warrn mutt. → Reuters
Synthszr Take: OpenAI treckt den ungemöödlichsten Hevel, den de Geheemnisschuul hergifft: En Geheemnis existeert rechtlich eerst, wenn du bewiesen kannst, dat du dat ok as een behannelt hest. Apple leevt siet Johrteihnten vun den Roop, de stillswiegendste Firma vun de Branche to ween, un jüst düsse Roop warrt nu to de Bewieslast. In de Praxis breekt Geheemnisse an Togriepsrechten, de bi’t Utscheden nie trüchsett worrn sünd, un an deelte Aflagen, op de halve Afdelungen kieken köönt.
Physical Superintelligence start mit 58 Millionen Dollar Seed för virtuelle Physiker
Matt Pines, Alex Klokus un Alexander Wissner-Gross hebbt an’n 1. September 2026 dat Ünnernehmen Physical Superintelligence (PSI) ut dat Verborgene haalt un en Seed-Runn över 58 Millionen Dollar ünner de Leedung vun Breakthrough Energy Ventures bekannt geven. Bedeeligt sünd na de Ankünnigen ünner annern Dragon Global, SV Angel, Susa as ok enkelte Investoren ut dat Ümfeld vun OpenAI, Nvidia, Oracle un Hugging Face. Karn vun dat Anbott is de Plattform Emmy, nöömt na de Mathematikersche Amalie Emmy Noether: Na Angaven vun den Anbeder leggt se Forschungsfragen in Bööm vun überprüfbore Hypothesen uteneen un test disse parallel in en kurateerten Simulatschoonsbestand. As eerste kommerzielle Anwennen nöömt PSI de Multiphysik-Utleggen vun KI-Rekenzentren, op de Eer as ok in’n Orbit, langs Stroom, Köhlen, Nettwark un Compute. Dorneven is PSI technischer Grünnerpartner vun de Fermi Explorer Mission, en gemeennüttig Projekt, dat vör Enn 2029 en Sonde mit en Kilogramm Nutzlast in Richt Alpha Centauri schicken will, för weniger as 15 Millionen Dollar Gesamtkosten. → Unite.AI
Synthszr Take: In de Machbarkeitsstudie steiht de Vermark, dat jedeen quantitative Resultat vun de Plattform sülvst maakt un vun egene Verifikatschoonsagenten narekent worrn is, ahn vullstännige externe Begootachten. Paralleliseerte Hypothesenbööm maakt dat gauer, wat Physiker sowieso an Maschinen delegeert; entscheden warrt Physik wiederhen an’n Meetopbo, un de steiht in keen Simulatschoonsbestand. De eerste Ümsatz kummt ut Stroom-, Köhl- un Nettwarkutleggen för Rekenzentren, also ut bannig goot betahlte Ingenieursoptimierung, de hier ünner de Överschrift vun ne’e Naturgesetten verköfft warrt.
ChatGPT-Warven reckt en Milliarde Run Rate, Europa kriggt Self-Serve-Togang
OpenAI beziffert sien Warvgeschäft in ChatGPT op en annualiseerte Run Rate vun en Milliarde Dollar, keen söss Maanden na den Start. De Tall kummt dör Hoochreken vun den aktuellen Maandümsatz mal twölf tostannen, is also üm un bi 83 Millionen Dollar pro Maand un nich de betherige Johrsümsatz. Parallel dorto maakt de Anbeder siet den 31. August den Ads Manager as Beta in’n Self-Serve-Togang för tolaten Warvdrievende in 31 europääsche Markten apen, de tovör blots över utwählte Agenturpartners inboken kunnen. Dormit köönt ok lütte Ünnernehmen un Startups Kampagnen ahn Agentur opstellen, solang jemehr Kategorie freegeven is un de Anzeigen de internen Richtlinienprüfungen besteiht. Dave Dugan, VP Global Ad Solutions bi OpenAI, snackt na Angaven vun dat Ünnernehmen vun en „nee Kapitel för Warven“ un seggt, de Milliarde in ünner 200 Daag is en Bewies för de Grött vun de Chance. → Techpresso
Synthszr Take: 83 Millionen Dollar in’n Maand sünd Geld, dat een dorför betahlt, in en Antwoort vörtekamen, de de Bruker as Raat leest un nich as Anzeige. Bi Google steiht dat Resultat neven en Anzeigenblock, in’n Chat steiht de Anraden in den sülvigen Satzfluss as ehr Begrünnen. Sobald Marken över den Self-Serve-Manager in 31 Markten sülvst inbookt, warrt jede Produktnennung mit en stille Rückfraag leest: Steiht de dor, wiel se döggt, oder wiel se bookt worrn is?
John Ternus övernimmt Apple: Cook sien Bilanz hangt nu an de KI-Strategie
John Ternus hett an’n 1. September offiziell den Baasposten bi Apple övernahmen un lööst dormit Tim Cook na föffteihn Johr an de Spitz af. Ternus is 51, siet 2001 in’t Ünnernehmen un hett sik as Baas vun de Hardware-Spart en Naam maakt. Cook verlätt Apple nich: He blifft as Executive Chairman an Boord, na Angaven vun dat Ünnernehmen ünner annern för den Uttuusch mit politische Entscheedungsdrägers weltwiet. Sien eersten öffentlichen Optreed as CEO steiht Ternus bi dat jährliche Produktevent an’n 9. September bevör, bi dat na Berichten dat eerste faltbore iPhone vörstellt warrt. Cook warrt in’t Publikum sitten, man nich op de Bühn gahn.
Cook sien Tallenbilanz steiht buten Fraag. De Aktie is in sien Amtstiet üm rund 2.000 Perzent stegen, de Marktweert hett in’n Juli kort fief Billionen Dollar överstegen, un ut 72 Millionen verköffte iPhones in’t Johr 2011 warrt na Schätzungen vun Counterpoint Research dit Johr 255 Millionen. Dorto kummt dat Deenstgeschäft mit Apple TV+, Apple News un iCloud, dat hunnerte Millionen Apparaat-Besitters in Abonnements överföhrt hett. Op de Minussiet staht dat instellte Autoprojekt un de Vision Pro, de as en düür Gerät för VR-Fans överleevt, ahn en Massenmarkt funnen to hebben.
De apen Punkt is de KI-Strategie. De Vision vun Apple Intelligence, de 2024 op de WWDC vörstellt worrn is, weer op Datenschutz utricht, mit persönliche Daten op dat Gerät oder in en schuulte Cloud-Ümgeven. Dat geev Vertögen, un dat Karnstück, dat överarbeidte Siri, kummt eerst nu mit iOS 27, wobi Apple dorbi op Modellen vun Google torüchgrippt. De Verzicht op en egen Frontier-Modell spoort Apple de Summen, de Google, Meta, Microsoft, OpenAI un Anthropic in de Entwicklung vun Modellen un Infrastruktur steken doot, maakt dat Ünnernehmen bi zentrale KI-Funkschonen aver vun Google afhängig.
Ternus arvt todem en Personalproblem un en Kostenfraag. De Baas vun de Foundation Models, Ruoming Pang, de Engineering-Baas Frank Chu un de Design-VP Alan Dye sünd na Meta wesselt, hunnerte fröhere Apple-Mitarbeiders na OpenAI. Wieldat KI-Firmen Chips in groten Stil afnehmt, warrt Spieker knapper un dürer, un Apple gifft disse Kosten an de Kunnen wieder. In de Pipeline staht na Berichten en KI-Home-Hub, AirPods mit Kamera, en Datenbrill un en Roboter-Assistent. → Morning Brew, Axios AI+, Business Insider
Synthszr Take: Steve Ballmer hett Microsoft sien Ümsatz verdreedubbelt un warrt liekers as de Mann in Erinnerung behollen, de dat Smartphone verslapen hett. Cook hett de indrucksvolleren Tallen, 72 Millionen iPhones 2011 gegen 255 Millionen dit Johr, un driggt dat sülve Risiko: En eenzige Plattformfraag entscheedt trüchwarkend över föffteihn Johr operative Exzellenz. Nokia harr 2007 de beteren Fabriken, Blackberry de levere Tastatur, un beide hebbt bi en Software-Wedd verloren, de se för tweetrangig hollen hebbt. Apple lehnt sik nu Google sien Modellen för Siri ut un hett togliek sienen Baas för Foundation Models an Meta verloren, wat för de nächsten Johren en unpläsante Kombinatschoon is. Dat Oordeel över Cook fallt an den Dag, an den OpenAI oder Anthropic egen Hardware in Serie autlevert; dat klappbore iPhone vun’n 9. September tellt dorbi wenig.

