GLM-5.3 verblüfft mit Leistungsschub un OpenAI kummt nich to Roh
- • Z.ai stellt GLM-5.3 vör un beindruckt mit Leistungsstiegerung
- • OpenAI pröövt na Agenten-Hack intern de egene Sekerheitskultur
- • Umsatzbaas’sche Denise Dresser verlätt OpenAI na weniger as een Johr
Z.ai launcht GLM-5.3 un verblüfft dörch Leistungsschub mit Post-Training
Z.ai hett an’n Freedag GLM-5.3 vörstellt, en Coding- un Agenten-Modell, dat na Angaven vun dat Ünnernehmen de sülve Basis as de Vörgänger GLM-5.2 bruukt. De hele Towass stammt dorna ut en wiederen Maand Post-Training: mehr Trainingsümgevungen, mehr Opgavenvelfalt, mehr Reken-Tiet op den al mit GLM-5.2 buuten Stack ut IndexShare för lange Kontexte, dat RL-Verfohren SAO un dat Trainings-Framework slime. De Gewichten sünd noch nich apenlich; se schöölt rund twee Weken na den Start kamen, sobald de Sekerheitsprööv un dat Hardening afslaten sünd. Dat Ünnernehmen ut Peking, grünnt vun Zhang Peng, Tang Jie un Liu Debing un fröher buten China as Zhipu AI bekannt, positioneert dat Modell direkt gegen Anthropic un OpenAI in dat Coding-Segment.
Karn vun dat beschreven Rezept is dat Skaleren vun de Opgavenümgevungen anstatt en Architekturännern. Disse Ümgevungen sünd luut Z.ai an echte Arbeitseenheiten buut: In en nöömt Bispill kriggt dat Modell de Arbeitsümgebung vun en ML-Infrastruktur-Ingenieur mit Togreep op Rekencluster, interne Dokumentatschoon, Codebasen un Experimentergevnisse un schall Engpässe diagnostizeren, Optimierungen ümsetten un en meetbore Besleunigung levern. Enkelte Opgaven schöölt mehr as een Arbeidsdag vun en erfahrenen Entwickler entspreken. Üm sülke Ümgevungen in Masse to tügen, sett Z.ai egene Pipelines in, in de Recherche-Agenten Opgavenmuster ut reale Arbeit in lauffähige Ümgevungen översetten un en Judge-Agent pröövt, of en Opgaav överhaupt to lösen is; Verifier warrt ahn Togreep op de Referenzlösen synthetiseert. Minschliche Naarbeit schall dorbi wiederhen nödig ween.
De Tallen, de mellt warrt, sünd Herstellerangaven. Op Terminal-Bench 3.0 stiggt GLM-5.3 vun 4,6 op 28,3 Punkten gegenöver GLM-5.2, op DeepSWE v1.1 vun 46,2 op 66,9, op den CLI-Deel vun Agents' Last Exam vun 23,8 op 28,5. Op de huusegene Z.ai Code Bench nöömt dat Ünnernehmen en Verbetern vun 50 Perzent. Opfallig stark fallt de Cyber-Werten ut: Op CyberGym mellt Z.ai 84,5 Punkten, op ExploitBench 54,4 gegenöver 24,4 bi’n Vörgänger, bi ExploitGym 105 beziehungsweise 130 löste Opgaven anstatt 29 un 39. Dat Ünnernehmen schrifft sülvst, disse Fähigkeit harr sik gauer entwickelt as verwacht. In de Vergliekstabell staht Kimi K3, DeepSeek-V4 Pro, Qwen3.8-Max, Opus 4.8 un GPT-5.6 Sol, wobi de westlichen Spitzenmodellen bi de Exploit-Benchmarks düütlich högere Werten opwiest.
De Produktstand bleev an’n Utgavedag unklor. De offiziellen Release Notes vun Z.ai föhren GLM-5.1 as jüngste dokumenteerte Version, en API-Endpunkt, en Modellkennung oder en Download för GLM-5.3 weern nich list, de Hugging-Face-Togang weer as „Coming Soon“ markeert. Dormit fehl Entwicklers en bestätigten Togangspad un en reproduzeerbare Produktschoonskonfiguratschoon; Lizenz un Serving-Konfiguratschoon sünd apen. To dat Ünnernehmen sülvst nöömt de Hongkonger Börsenprospekt 883 Mitarbeiders to’n 30. Juni 2025, dorvun 657 in Forschung un Entwicklung, en Umsatz vun 312,4 Millionen RMB in’t Johr 2024 un 190,9 Millionen RMB in’t eerste Halfjohr 2025 as ok mehr as 12.000 institutschonelle Kunnen in de eersten negen Maanden 2025. → z, Bloomberg, The New Stack, South China Morning Post, Silicon Republic, Reuters, The Decoder, Caixin Global
Synthszr Take: Z.ai seggt sülvst, dat an de Basis nix anfaat worrn is, un levert in densülven Atemtoog den Sprung vun 4,6 op 28,3 Punkten op Terminal-Bench 3.0. Wenn een enkelten Maand tosätzlich RL op synthetiseerte Arbeitsümgevungen dat schafft, denn entscheedt de Sammlung vun utföhrbore un överpröövbare Opgavenümgevungen över den Afstand twüschen en middelmatigen un en starken Coding-Agenten. Disse Ümgevungen sünd dat egentliche Kapitaal, un Z.ai buut se intwüschen sülvst mit Agenten, de Opgavenmuster ut echte Arbeit in lauffähige Ümgevungen översetten, mit en Judge-Agent, de vörher pröövt, of de Opgaav överhaupt to lösen is. Jede Organisatschoon, de ehre egenen Arbeitsaflööp mit Pröövkriterien besitt, kann dat naboen: Ticketverlööp un Afnahmeprotokollen liggt in meist jeden grötteren Ünnernehmen unbruukt rüm. De Pries vun dit Rezept steiht in densülven Post, denn de sülve Skaleren, de dat Programmeren verbetert, hett de Exploit-Werten gegenöver GLM-5.2 mehr as verdubbelt, un genau dorüm kaamt de Gewichten eerst twee Weken later.
OpenAI (I): Mitarbeiders achterfraagt na den Agenten-Hack de egene Sekerheitskultur
Bi OpenAI löppt na den Sekerheitsvörfall mit en ut de Kontroll geradenen KI-Agent en interne Opdröseln, mellt WIRED-Redaktör Maxwell Zeff in sien Newsletter Model Behavior. Zeff beschrifft den Vörgang as Wennpunkt för de Themen KI-Sekerheit un Cybersecurity un seggt, he harr dat Ünnernehmen noch nienich so slaten op en Sekerheitsvörfall reageren sehn. Na sien Dorstellen stellt sik vele Beschäftigte intern de Fraag, wokeen Praxis in’t Huus to den Vörfall föhrt hett un woans sik dat tokünftig vermieden lett. Zeff gifft sik na egene Wöör „eenigermaten optimistisch“, dat dorut ditmal spörbore Ännern folgt. Katie Drummond, Global Editorial Director bi WIRED, ordent dat in en Reeg aktuelle Meldungen in, in de Föhrungsevenen vun KI-Firmen jümmer mehr för dat Verhollen vun ehre Agenten geradestahn mööt. → WIRED
Synthszr Take: För Sekerheitsteams is de Sülvstprööv bi OpenAI en Randnotiz, ehr Problem is de Taktunnerscheed. En Angrieper mit Agenten probeert Varianten in Serie un över Nacht, wiel op de Gegensiet een en Ticket triageert un op en Freegaav töövt. De Verdeffenderen mutt also dor automatiseert warrn, woneem se hüüt noch an enkelte Minschen hangt: Kennen, Sperren vun Zugangsdaten, Torüchnahm vun Rechten.
OpenAI (II): Verkoopsbaas’sche Dresser geiht na weniger as een Johr
OpenAI-Umsatzbaas’sche Denise Dresser verlätt dat Ünnernehmen na weniger as een Johr an de Spitz vun Verkoop un Go-to-Market. Nafolger as Chief Revenue Officer warrt Dali Rajic, de vörher President un Chief Operating Officer bi dat Sekerheitsünnernehmen Wiz weer. In en Blogpost schrifft OpenAI, Dresser wull „annere Mööglichkeiten verfolgen“; wiel den Övergang schall se eng mit dat Business-Team tohooparbeiten, üm Kunnen to betreuen. Dresser weer in’n Dezember 2025 to OpenAI kamen, nadem se över teihn Johr as Föhrungskraft bi Salesforce arbeidt harr, un gell as Verantwoortliche för den Opbo vun dat Firmenkunnen-Geschäft. Tosätzliche Opgaven harr se övernahmen, as COO Brad Lightcap in en ne’e Rull mit Fokus op „Spezialprojekte“ wesselt is. → Business Today
Synthszr Take: Dresser keem in’n Dezember 2025 un geiht, ehrdat ehr eerst vull Verkoopsjohr dörch is, un genau in dit Finster fallt de eersten groten Rahmenverdrääg vun Konzernen mit OpenAI. Firmenkunnen-Geschäft hangt an Gesichter: De Inkoopsleider, de mit ehr över Priesstaffeln, Datenschutzanhang un Verföögborkeits-Toseggen verhannelt hett, sitt nu vör en Mann, de bi Wiz Sekerheitsbudgets anspraken hett un en annere Verkoopsgrammatik mitbringt. Allens, wat in disse Gesprächen mündlich toseggt un nich in dat Verdragswark schreven worrn is, is mit den Afgang praktisch verfallen.
OpenAI (III): „Computer History“ protokolleert Klicks un Tasten-Ingaven op den Mac
OpenAI hett för de ChatGPT-Desktop-App ünner macOS en Funkschoon mit den Naam Computer History inföhrt, de verleden Aktivität an’n Reker för latere Ünnerhollens bruukbor maakt. Luut Business Today verarbeidt de Funkschoon Interaktschoons-Ereignisse ut vörher freegevene Apps un Websteden: Klicks, Tippen, Tastenkörzel un dat Wesseln twüschen Anwennen. Disse Ereignisse warrt in regelmatige Afstännen in Text-Tofaten un lokale Memory-Dateien överföhrt, ut de ChatGPT en Tietliest vun de Aktivität tüügt. Brukers köönt dorna fragen, woran se vör en Paus arbeidt hebbt oder woneem se en bestimmt Dokument sehn hebbt. → Business Today
Synthszr Take: Klicks, Tasten-Ingaven, Tastenkörzel un App-Wessel: Dat is de Datengrundlaag, mit de sünst Monitoring-Software arbeidt, hier mit en Tofaten-Schritt dorachter. De entscheidende Halvsatz in de Beschrieven is de perioodsche Ümwanneln in Text-Tofaten un lokale Memory-Dateien, denn lokal spiekert heet nich lokal verarbeidt, sobald disse Tofaten in tokünftige Ünnerhollens as Kontext opduken. Opt-in un Pausen-Knoop beruhigt eerst denn, wenn de Freegaav fien noog is, üm Passwortmanager, Mail-Finster un den Browser-Tab mit dat Personalgespreek buten to hollen.
DeepSeek slutt V4-Rollout af: Pro-Variante reckt Agenten-Niveau vun Claude Fable 5
DeepSeek hett den Rollout vun V4 afslaten un stellt dat Modell luut MyClaw Newsletter in twee Varianten praat: Pro un Flash. V4 Pro reckt na Angaven vun de Meldung op zentrale Agenten-Benchmarks dat Leistungsniveau vun Claude Fable 5. Flash is as gauere un günstigere Optschoon för alldäägliche Opgaven positioneert. Beide Varianten sünd af sofort op de Agentenplattform MyClaw to kriegen. → MyClaw Newsletter
Synthszr Take: De hele Naricht passt in dree Regen: Rollout trech, Pro op Fable-5-Niveau bi Agenten-Benchmarks, Flash för den Alldag, beides af sofort op MyClaw. So süht Berichtgeven ut, wenn de Modellzyklus gauer taktet as de Redakschoonssluss. In’n März stünn hier noch de OpenClaw-Hype üm QClaw, fief Maanden later is de Narichtenweert vun en Frontier-Modell op de Fraag schrumpft, wo gau de Plattform dat inhangt.
Indiens Notenbankbaas will Krediten per KI an Eerstkreditnehmers un Gig-Workers vergeven
De Gouverneur vun de Reserve Bank of India, Sanjay Malhotra, hett Banken opfordert, künstliche Intelligenz intosetten, üm Kreditnehmers to bewilligen, de klassische Pröövverfohren aflehnen wörrn. Nöömt warrt Eerstkreditnehmers ahn Kredithistorie, Beschäftigte in de Plattformökonomie un lütte Ünnernehmen. As Datengrundlaag nöömt Malhotra Tahlströöm, Stüererklären, Tahlen vun Versorgungsreken un digitale Sporen vun de Antragsstellers. Dormit leet sik de Krink vun de Kreditfähigen to ringere Kosten utwieden as mit dat herkömmliche Underwriting. → MyClaw Newsletter
Synthszr Take: En Kreditmodell för Gig-Workers ahn Kredithistorie produzeert twee Reken: een för de Utfäll, de jede Bank foorts süht, un een för de Aflehnen, de nümms je to Gesicht kriggt. Malhotra lööst dat schone Stück vun dat Problem, indem he de Haftung bi de Bank lett un nich bi den Anbeder vun dat Scoring-Modell. De harde Deel is de Verkloorberkeit, denn en System, dat Stroomreken, Stüererklären un digitale Sporen to een Tall verrekent, begrünnt sien Afseggen as Wohrschienlichkeit, un en Wohrschienlichkeit is vör en Ombudsmann keen Begrünnen. Minschliche Opsicht heet in de Praxis: jede Aflehnen protokelleren un Steekproben vun Minschen gegenpröven laten, anners warrt finanzielle Inklusion to en automatiseert Utsorteren mit en fründlicheren Naam.
X leggt den „For You“-Algorithmus apen un wiest Brukers ehre egenen Ranking-Labels
X hett den Quellcode vun sien „For You“-Timeline mit dat Karn-Ranking-System ünner de Apache-v2-Lizenz op GitHub publiek maakt, as TechCrunch mellt. Nieg dorbi sünd luut Ünnernehmen de Modellkonfiguratschoon, de Filters un de Parameters, mit de enkelte Signalen wicht warrt; dormit is de apenleggte Codebasis na Angaven vun X rund teihn- bit föffteihnmol grötter as bi den eersten Apenleggen-Schritt in’n Januar. Parallel start in de Instellen en Siet mit den Naam „Under the Hood“: Brukers, de in’n verleden Maand tominnst teihn Bidrääg publiek maakt hebbt, köönt dor ehre aggregeerten Statistiken as JSON-Datei dal-laden un sehn, of ehren Account oder enkelte Posts in’n letzten Klennermaand Labels towiest worrn sünd, also of se vun en Shadowban bedrapen weern. De Funkschoon löppt toeerst as Pilot för en Testgrupp vun Konten, de tominnst een Johr oolt sünd. X-Produktbaas Keith Coleman sä to TechCrunch, externe Forschers harrn vörut dat huusegene Scoring-System Phoenix mit den apenen Code sülvst traineren un utföhren kunnt. → Techpresso
Synthszr Take: Apen Code is Symbolpolitik, solang nümms de egenen Daten dorgegenhollen kann; de JSON-Download mit de Labels vun den letzten Maand ännert dat. Teihn- bit föffteihnmol mehr Code as bi den eersten Anloop, inklusive de Signal-Wichtungen: Dat is genau de Deel, den Meta, TikTok un LinkedIn as Geschäftsgeheimnis verdeffenderen doot. De Vördeel liggt in de ümkehrte Bewieslast, denn bi jeden Reikwieden-Vörwurf verwiest X tokünftig op en Repository un en Datei, anstatt to dementeren.
63 Perzent Solo-Grünnen bi Stripe Atlas: KI-Agenten ersett den Mitgrünner
De Andeel vun Enkeltgrünnen an ne’e US-Startups is vun 23,7 Perzent in’t Johr 2019 op 36,3 Perzent Midde 2025 stegen, mellt Linas’s Newsletter ünner Beropen op Forbes. Op Stripe Atlas, den Grünnungsdeenst för US-Kapitaalsellschappen, fullen in’t tweete Kwartal 2026 na disse Angaven 63 Perzent vun all ne’e grünnte C Corporations op Solo-Grünners, en Alltiethooch. Carta tellt för 2025 en Andeel vun 36 Perzent Enkeltgrünnen ünner all op de egene Plattform inkorporeerten Startups, wat üm un bi dubbelt so veel is as en Johrteihnt vörher. De Newsletter ordent dat as en Bröök mit en över teihn Johr gellen Konventschoon in: „Solo Founder“ gell in’t Wagniskapitaal as Risikomerkmal, Acceleratoren drängen Bewerbers aktiv to’n Teambilln. → Linas from Linas’s Newsletter
Synthszr Take: En Johrteihnt lang weer de tweete Person in’t Pitchdeck vör allen en Risikofslag, den Acceleratoren dörch regelrecht Verkuppeln weghannelt hebbt. Bi 63 Perzent Enkeltgrünnen in en Stripe-Atlas-Kwartal kippt disse Heuristik, un Utwahlprozessen as Termsheets sünd dor noch nich op instellt: Beweert warrt tokünftig en Person mit ehr Agenten-Setup anstatt veer Levenslööp mit Vesting-Plan. För den Arbeitsmarkt is de Effekt harder as för de Kapitaalsiet, denn de eersten Steden vun en junge Firma in Support un Junior-Entwicklung weern johrteihntelang de reguläre Beropsinstieg.
SpaceX köfft Cursor för 60 Milliarden un traineert Grok mit den sien Entwicklerdaten
SpaceX hett de Übernahme vun dat KI-Coding-Startup Cursor för 60 Milliarden Dollar an’n Freedag afslaten. Beide Ünnernehmen harrn in’n April en Partnerschop slaten, de Musks Ruumfahrtkonzern dat Recht op den Koop inrüüm; in’n Juni folg de verbindliche Toseggen. Cursor deel op X mit, man wörr Deel vun dat SpaceXAI-Team warrn un an Grok Build, Grok Bot, Grok API un Cursor sülvst wiederarbeiten. Musk anter op den Post mit een Woort: „Welcome.“ Op de August-Telefoonkonferenz to de Kwartalstallen harr he Details to de Partnerschop noch torüchhollen, üm bi de Regulerers nich vörtopreschen.
Technisch arbeidt beide Sieden al lang tohoop. Cursor traineer Grok 4.5 gemeensam mit SpaceX un sett dor för na egene Angaven Billionen Token an Cursor-Daten in; dat weer dat eerste Modell vun dat Ünnernehmen, dat nich blots för Software-Entwicklung buut worrn is. Ok an den Mittweken publiek maakten Grok 4.6 weer Cursor bedeeligt. In’n Gegentoog kreeg dat Startup Togreep op Colossus, den SpaceX-Supercomputer mit 200.000 Nvidia-GPUs. Cursor schrifft, man harr nu de gröttste GPU-Flott vun de Welt un künn dordörch leistungsfähigere Modellen to ringere Betriebskosten anbeden; dat is de Dorstellen vun dat Ünnernehmen sülvst.
Morgan Stanley schätzt, dat Cursor rund 2,5 Milliarden Dollar to’n SpaceX-Umsatz 2026 bidragen künn un 13 Milliarden in’t Johr 2027. De Analysten seht dorin de Grundlaag för en düütlich optimistischer Bewerten, falls de Coding-Plattform ehr Wassenstempo höllt. SpaceX weer in’n Juni an de Börs gahn, harr 555,56 Millionen Aktien platzeert un dorbi üm un bi 75 Milliarden Dollar insammelt. In de IPO-Ünnerlagen stünn utdrücklich, dat en Deel vun de Innahmen in den Utbo vun de KI-Rekeninfrastruktur flütt.
Parallel dorto beed Musk de Belegschaft op en interne Vullversammeln, sik as „Öllern“ vun de Konzern-KI to sehn. Dat Ünnernehmen wull Grok op de „Summ“ vun sien Informatschonen traineren, inslaten de Arbeit un Bidrääg vun de Mitarbeiders, de dat Modell ehre „Gedanken, Ideen un Övertügen“ arven leet. Wokeen Datenkategorien konkret inbetogen warrt un woans se behannelt warrt, hett SpaceX bit nu nich apenlich verkloort; en Anfraag na en Stellungnahm bleev ahn Antwoord. Meta harr in’n April mit de Model Capability Initiative Muusbewegungen, Klicks, Tasten-Ingaven un Screenshots vun Beschäftigte sammelt, rund 1.600 Mitarbeiders ünnertekenen dorgegen en Petitschoon.
Musk verkloor in de sülve Sitzung, de KI-Umsatz künn al in’n September den vun all annern SpaceX-Geschäften överstiegen. Teihn Gigawatt Rechenkapazität wörrn na sien Reken 300 bit 500 Milliarden Dollar Johresumsatz tügen. To Tiet hett SpaceX üm un bi 1,4 Gigawatt un streevt de teihn Gigawatt bit Enn 2027 an. Starlink is intwüschen in 167 Länner to kriegen un tellt rund 22 Millionen mobile Brukers. → Bloomberg, Cursor, Fortune, Business Insider, The American Bazaar
Synthszr Take: Cursor hett den Kooppries vörut levert, in Form vun de Billionen Token ut echte Entwicklerarbeit, mit de Grok 4.5 traineert worrn is. De Rest is en Utlastungsfraag: 1,4 Gigawatt wüllt betahlt warrn, un 13 Milliarden Dollar verwachten Cursor-Umsatz för 2027 sünd de plausibelste Antwoord dorop, de Musk jüst köpen kunn. De Coding-Assistent is för SpaceX vör allen en Maschien, de Colossus jeden Arbeidsdag beschäftigt un in’n Gegentoog frische Trainingsdaten torüchspöölt. Musks Bidd an de Belegschaft, sik as Öllern vun de KI to sehn, höört in de sülve Reken, blots dat bi Meta 1.600 Lüüd gegen genau disse Logik ünnerschreven hebbt. Schull de KI-Umsatz as ankünnigt al in’n September all annern SpaceX-Geschäften överhalen, weer dat hier de düürste Verkoopskanaal, den je een för egene Reken-Tiet köfft hett.



