älter | neuer
OpenAI bringt GPT 5.6-Modelle rut un will mit ChatGPT Work den Office-Desktop innehmenSynthszr
Apple Podcasts
Spotify
synthszr #193 vun Freitag, den 10.07.2026

OpenAI bringt GPT 5.6-Modelle rut un will mit ChatGPT Work den Office-Desktop innehmen

  • • OpenAI stellt mit GPT-5.6 en leistungsstark KI-Modell un ChatGPT Work vör.
  • • ChatGPT Work bringt Funkschonen för Wissensarbeiders tosamen un geiht gegen Claude an.
  • • Meta bringt Muse Spark 1.1 mit ne’e Funkschonen för Entwicklers un beter Bug-Erkennung rut.

GPT-5.6 is dor un Sol-Benchmarks wiest Fable-5-Scores

OpenAI hett an’n Dunnersdag GPT-5.6 Sol rutbröcht, sien bither leistungsstärkst Modell, tosamen mit ChatGPT Work, en Agenten, de Tabellen, Klenner un E-Mail-Deensten sülvstännig bedeenen deit. In Standard-Benchmarks liggt Sol luut Vals AI so wat gliekop mit Anthropic sien Spitzenmodell Fable 5, bi reale Finanz- un Rechtsopgaven nömmt Vals-Baas Rayan Krishnan dat state of the art. De Release keem to laat: De Trump-Regeren harr de ne’en Modellen vun OpenAI un Anthropic toeerst as en natschonal Sekerheitsrisiko ansehn, na längere Gespreken aver de apentliche Freegaav verlöövt. OpenAI geiht dorbi en apeneren Weg as Anthropic un boot mit Afsicht weniger Leitplanken in, dormit Firmen de Technik för ehr egen Verdeffenderen bruken köönt. Anthropic dorgegen hett dat stärkere Modell Mythos kumplett offline nahmen un op Anwiesen vun de Behöörd all utlännschen Brukers utslaten. Sol is düür, in manche Fäll sogor dürer as Fable, dat al rund dubbelt so veel köst as Anthropic sien nächstschwakker Modell. Meta hett an densülvigen Dag en swakker, aver düütlich günstiger Modell rutbröcht. → www.nytimes.com

Synthszr Take: De egentliche Produktentscheden stickt hier nich in’n Benchmark, man in de Guardrails. OpenAI verköfft de dünneren Leitplanken as Feature: Wecke Swacksteden in’n egen Code finnen will, de bruukt en Modell, dat se ok benömen dröfft. Anthropic hett mit Fable dat Gegendeel boot, blockt heikle Antwoorden un schufft se op dat swakkere Opus 4.8 af. Klingt vörsichtig, versperrt aver genau de Firmen den Weg, de sik afsekern wüllt, un nich blots de Bedregers. Wecke in’t Ünnernehmen nu SAST-Scans un Security Gates opstellt, de schull disse Week pröven, welk Modell överhaupt antern dröfft, wenn en Lück in’n Authentifizierungs-Padd opduukt. Een Dag Inrichten gegen Maanden Schaden – disse Reken hett sik nich ännert. Sol is düür un nich ahn Risiko, aver en Modell, dat bi de Verdeffenderen swiggt, is an’t Enn de slechtere Wahl.

ChatGPT Work is en Frontalangreep op Claude Desktop

Mit den GPT-5.6-Launch an’n Dunnersdag hett OpenAI nich blots ne’e Modellen wiest, man ok dat Produkt-Setup ümboot. ChatGPT Work heet dat ne’e agentische Warktüüg för Wissensarbeiders, boot op Codex-Technologie un in direkte Konkurrenz to Anthropic sien Claude Cowork. Togliek versmölt de bither trennten ChatGPT- un Codex-Desktop-Apps to een enkele Anwennen, genau as Anthropic dat mit sien Claude-App vörmaakt hett. ChatGPT Work fangt Opgaven ut Dokumenten un Tabellen an, treckt Daten ut Slack, Teams, Google Drive, SharePoint un CRM-Systemen un löppt op Web, Mobile un Desktop. Plaante Opgaven (Scheduled Tasks) loopt in de Cloud, de Laptop mutt nich apen blieven. Besünners to marken: Dat klassische Chat-Finster is in de Siedenliest wannert, Work un Codex sünd nu de beiden Hööftmodi. Un de eerst vör korten startte Atlas-Browser warrt afschalt, uttuuscht dör en Chrome-Extension, de ChatGPT direkt in de Chrome-Siedenliest bringt. → thenewstack.io

Synthszr Take: De interessantste Satz vun de hele Ankünnigen steiht meist so blangenbi dorin: Chat is keen vun de beiden Hööftmodi mehr. Dat Gespreksformat, dat ChatGPT vör dree Johr för Millionen sichtbar maakt hett, sitt nu in de Siedenliest blangen de plaanten Opgaven. De egentliche Motor is dat agentische Arbeiden, un dat keem ut Codex, nich ut den Chatbot. OpenAI kopiert dorbi teemlich apen de Cowork-Thees vun Anthropic. Beide hebbt markt, dat ehr Coding-Warktüüg al lang för Nich-Coding-Arbeit bruukt worrn sünd. Dat Atlas na wenige Maanden al wedder starvt (in’n April hebbt wi hier noch över den Codex-Superapp-Ümbo schreven, nu is de Standalone-Browser Geschicht), wiest de Velocity vun dissen Markt un de Bereitschop, egen Produkten to kannibaliseren. Wecke disse Week pröven will, of de egen Wissensarbeit riep för Agenten is, hett mit Work un Cowork twee meist deckungsgleiche Anbotten to’n direkten Vergliek. De Wettloop warrt nich mehr an’t Modell entscheden, man doran, wecke sik an’n deepsten in Slack, Drive un Klenner innisten deit.

Meta Muse Spark 1.1: De Code-Wettloop warrt heter

Meta maakt sien KI för Entwicklers apen. Na den Wedderinstieg in’t Rennen mit dat eerste huusegene Muse-Spark-Modell in’n April 2026 bringt de Konzern nu Muse Spark 1.1 mitsamt ne’e Meta Model API. Meta nömmt dat en „step-change“: beter Coding, Kennen un Beheven vun komplexe Bugs, dörgahns agentische Workflows över mehr Apps henweg un native Multimodalität över Biller, Videos un Dokumenten. Dat Modell löppt af sofort in’n Thinking-Modus in de Meta-AI-App un op de Websiet, de API fangt as Public Preview för US-Entwicklers an. Jede ne’e Account kriggt 20 Dollar Gratis-Credits. De Launch kummt direkt na Muse Image, en Bildgenerierungsmodell, dat för Arger sorgt, wiel dat Instagram-Inhalten vun annere Brukers in sien Resultaten inboot. För Meta geiht dat dorüm, de Milliarden to rechtfertigen, de na de prominenten Ne’einstellen un den Ümbo vun’t verleden Johr in den Opjagd-Modus flaten sünd, mit dat Teel, Parität to OpenAI, Google un Anthropic to erreichen. → www.theverge.com

Synthszr Take: 20 Dollar Gratis-Credits sünd dat Ingstahn, dat bi Meta för den Coding-Agenten noch nümms freevillig fraagt. Anthropic hett mit Claude Code de Kommandozeel besett, Cursor dat IDE-Belevnis, OpenAI Codex de harten Refactorings, un Meta kummt nu mit en tweet Modell un en frische API in Public Preview för US-Entwicklers an. De egentliche Borggraven liggt annerwegens: Wecke den Entwickler-Workflow besitt, de besitt de Adoption, un dor sitt Meta noch buten vör de Döör. Dat blangenbi Muse Image dörsickert, wiel dat frömde Instagram-Posts in Genereren verwurst, is keen Nevenlarm, man de Fraag, of man disse API överhaupt sien Codebasis anvertruun will. Meta kann sik dat leisten, wiel dat Verdelernett ut WhatsApp, Instagram un de Smart-Glasses-Sparte de Modellen en Afsatzkanal gifft, den keen reinen Modell-Anbeder hett. Wecke vundaag en 2-Tool-Standard opstellt, de test Muse Spark 1.1 op de Gratis-Credits gegen den bestahn Stack un lett de Benchmarks entscheiden, nich de Pressemitdelen. En drüdden eernsthaften Anbeder drückt de Priesen, un dat is för jedet Engineering-Team en goden Dag.

Perplexity boot mit „Teammate“ för den lukrativen Coding-Markt

Perplexity, bekannt as AI-Söökmaschien gegen Google, hett luut Business Insider en intern Coding-Tool mit den Codenamen „Teammate“ entwickelt, dat siet Mai vun de egen Engineers bruukt warrt un later apentlich starten kunn. Dat Tool schall Softwareprojekten dörgahns övernehmen: Projekten besitten, Bugs jagen, Services överwachen, so de interne Ankünnigen. De entscheedende Ünnerscheed to Claude Code oder OpenAI Codex: Teammate blifft modellagnostisch un hangt an keen enkelten Chatbot. CTO Denis Yarats geev de Marschrichtung vör un hett sien Engineers opfordert, bit Johresenn „optöhollen, op Code to kieken“ un eenfach de KI to bruken. De Firma hett in de letzte Finanzierungsrunn en Bewerten vun 20 Milliarden Dollar erreicht un hett dormit Speelruum to’n Experimenteren. De Bericht stött sik bither op een enkele Born, un Perplexity hett weder en Kommentar afgeven noch en Launch bestätigt. → The Next Web

Synthszr Take: De interessante Tog stickt in de Modellagnostik. Wieldes Anthropic Claude Code an de egen Modellen binnt un OpenAI in den Workspace-Lock-in drückt, boot Perplexity en Service-Ebene, de op jedet Modell lopen kann. Dat is de BYOK-Logik vun Cline un Aider, hoochtagen op 20-Milliarden-Niveau un mit Enterprise-Ambition. Coding-Agents sünd een vun de wenigen Öörd, an de KI vundaag echt Geld verdeent, dorüm drängt nu ok en Söökfirma op dit Feld. Bi Anthropic stammt intwüschen 80 Perzent vun de Codebasis vun Claude Code, de Richt is al lang kloor. Wecke 2026 sien Coding-Toolchain opstellt, de schull modellagnostisch denken, anstatt sik an een enkelten Anbeder to keden. En tweegleisigen Standard ut en IDE-Tool un en Background-Agent, apen för Modellwessel, is de vernünftige Wett, egal of Teammate an’t Enn würklich utlevert.

Claude bringt Reflexion Dashboard rut

Anthropic hett in de Beta en ne’et Feature för Claude startt, dat de egen Bruken sichtbar maakt. En Reflexions-Dashboard in de Instellen wiest, to welk Themen un to welk Dagesstieden man Claude insett, trüggblickend över 1, 3, 6 oder 12 Maanden. Dorto gifft dat Rauhtieden, Pausen-Erinnerungen un Fragen as „Wat wullt du wiederhen sülvst doon, ok wenn Claude dat gauer kunn?“. Dat Ganze is an’t 4D AI Fluency Framework ophangen: Delegation, Description, Discernment un Diligence – also de Fraag, wat man afgifft, wo präzise man beschrifft, wo kritisch man dat Resultat pröövt un wecke de Verantwoorden driggt. Bi’n Datenschutz treckt Anthropic Grenzen: Incognito-Chats, Born-Dateien un allens rund üm Gesundheits-Integratschonen blievt buten vör. Entwickelt worrn is dat Feature mit dat MIT Media Lab (AHA-Programm), dat Digital Wellness Lab an’t Boston Children’s Hospital un dat Family Online Safety Institute.

Synthszr Take: En KI-Anbeder, de een Pausen vörslagen deit, is ungefähr so glöövweerdig as en Casino mit inboote Utstiegsberaden. Liekers stickt hier en klook Tog in. Anthropic verköfft nich mehr Bruukminuten, man Bruukkompetenz, un dat 4D-Framework is dorför de egentliche Karn. Wecke lehrt, schier to delegeren un Resultaten hard to pröven – Discernment un Diligence sünd de Punkten, an de de mehrsten Teams jüst scheitert –, blifft Herr över den egen Kopp anstatt Tolieferer för den Autopiloten. Disse Week lett sik dat ahn groot Projekt testen: eenmal ehrlich ropkieken, welk Opgaven man afgeven hett, ofschoonst man se harr sülvst denken müsst. De Verdacht, dat Binnkraft mitdacht warrt, blifft bestahn, denn en Tool, dat dien Verhollen kennt, kennt ok dien Swacksteden. Aver de Fähigkeit, mit KI to arbeiden, ahn dat egen Oordeel uttolagern, is de Skill, de över de nächsten Johren entscheeden deit, un dit Feature maakt em jümmershen sichtbar.

Seedream 5.0 Pro kann, wat Photoshop nich kann

ByteDance Seed hett Seedream 5.0 Pro vörstellt un nömmt dat Ding mit Afsicht nich mehr Generation, man Creation: „Beyond Generation, It Understands Design.“ Dat Modell boot logische Layouts för Infografiken, UI-Mockups un Posters sülvst op, packt Tietliest, Balken-, Koken- un Liniendiagramm plus Realbild in een enkele Bildhierarchie. De egentliche Hevel stickt in de Interactive Precision Editing: En fardig Poster lett sik per Textbefehl in över teihn unafhängige Layer ut’nannernehmen, verdeckte Achtergrünn warrt automaatsch per Inpainting wedderherstellt, Objekten as en Papegoi gegen en Pau tuuschbor. Praktisch levert de KI en editierbore PSD-Datei anstatt en flach Bild. Dorto kaamt physikaalsch korrekte Texturen (Reflexion, Breken, Huutstruktur) un native Ünnerstütten för mehr as teihn Spraken, inslaten araabsch Rechts-na-links-Schrift un kulturell anpasste Architektur un Kledaasch. ByteDance verschufft dormit de Arbeit vun den Kreativen vun’t Prompt-Schrieven to de Regie över de Afsicht. → Trendium.ai

Synthszr Take: De Brook liggt nich in’t schönere Bild, man in de Möglichkeit, dat ut’nanner to nehmen. Bither weer de gröttste Swackheit vun generative Biller, dat de Attrapp schöön utseeg un in de echte Produktschoon nix döög, wiel man se nich editeren kunn. Genau disse Wand fallt: Wenn en Resultat in teihn Layer ut’nannerfallt un de verdeckten Flachen schier narekent warrt, denn is dat keen Schaddenbild mehr för de Demo, man en deployable Asset, dat de Schleif ut Entwurf, Kunnenfeedback un Deelkorrektur ahn Originaldatei an’t Lopen höllt. Dormit kippt de Weert vun den Kreativen vun „wo präzise formuleer ik en Prompt“ hen to Layout-Logik, Edit-Anwiesen un Lokaliserungs-Oordeel. Wecke de teihn Spraken as Feature afdeit, de ünnerschätzt, wat dat för globale Kampagnen bedüüdt: En mehrsprakig Key Visual, dat Schriftricht un kulturellen Kontext mitdenkt, spoort Produktschoonsressourcen, de vundaag noch pro Markt anfallt. Wecke disse Week en Agentur-Pipeline bedrifft, de schull den Layer-Export gegen de egen Freegaav- un Korrekturschleif testen, ehrdat de nächste Anbeder natreckt. Dat Handwark geiht nich verloren, dat warrt to en Ingenieurs- un Regie-Job mit betere Warktüüg.

Google AI Overviews: Wenn Halluzinatschonen to industrielle Desinformatschoon warrt

En Analyse, de vun de New York Times bi dat Startup Oumi in Opdrag geven worrn is, hett Google sien AI Overviews ünner de Luup nahmen un kummt op en Trefferquote vun rund 90 Perzent: 85 Perzent bi Gemini 2 in’n Oktober, 91 Perzent bi Gemini 3 in’n Februar, meten an OpenAI sien Faktencheck-Benchmark SimpleQA över 4.326 Söökanfragen. Klingt solide, bit man de Skaleren dortorekent. Google verarbeidt över fiev Billionen Söken in’t Johr, un Sundar Pichai hett de AI Overviews in’n Juli op mehr as twee Milliarden monatliche Brukers taxert. David Bader vun’t New Jersey Institute of Technology bringt de egentliche Sorg op den Punkt: nich de Fehlerquote, man de Reckwiet, mit de falsche Antwoorden in de visuellen Autorität vun de vertroonswürdigste Söökmaschien vun de Welt utlevert warrt. Google wehrt sik un nömmt de Studie methodisch lückerhaft, wiel en KI-Modell (HallOumi) en anneret benoot un de Datensatz künstlich maakt is. Forschers as Maarten Sap vun de Carnegie Mellon geevt dem deelwies recht, betoont aver, dat unafhängige Pröven unverzichtbor sünd, solang de Anbeders keen kontrolleerte Togäng för Externe praatstellt. De Wörtel blifft technischer Natur: Disse Modellen slaht keen Fakten na, se prognostizert dat nächste Woort. → The Deep View

Synthszr Take: De 90 Perzent sünd de verkehrte Tall, op de all ankieken doot. Wenn twee Milliarden Minschen in’n Maand jede Antwoord mit de Souveränität vun’t Google-Logo serveert kriegt, denn warrt ut teihn Perzent Fehlers eben Millionen Falschutseggen pro Stünn, jede enkelte verpackt in de Optik vun Autorität. Dat ännert de Rull vun de Söök grundleggend: De Döörwächter twüschen Fraag un Antwoord oordeelt nu sülvst, un he deit dat mit en Bequemlichkeit, de uns dat Napröven aftraineert (ik fat mi sülvst dorbi, den Kasten to glöven, anstatt twee Klicks wieder to gahn). Interessant is Bader sien egentliche Foddern, un de lett sik sofort ümsetten: Wecke KI in disse Dimension utrullt, de schull unafhängige Audits finanzeren, anstatt jede externe Pröven as methodisch lückerhaft aftodoon. Solang Google keen egen, unafhängig verifizeerte Genauigkeitsdaten apenleggt, is dat Afwiesen vun de Studie blots en PowerPoint-Illusion vun Verlaatlichkeit. För Marken heet dat dubbelte Vörsicht, wiel de Maschien nich blots entscheedt, wecke nömmt warrt, man ok, wat över een seggt warrt. Wecke vundaag pröövt, wo he in’t Modell dorstellt warrt, de köfft sik en echten Vörsprung.

Claude ünner Beschuss: Russ’sche Propaganda un de Bornfraag

De Berliner Thinktank Agora hett ünnersöcht, woher grote Spraakmodellen ehr Narichten treckt, un dat Resultat dröppt Anthropic in’t Mark: Claude verwist in enkelte Antwoorden op Inhalten vun dat russ’sche Pravda-Netzwark un behannelt se as en seriöse Narichtenborn. Dorachter stickt „LLM Grooming“, also dat massenhafte Floten vun’t Nett mit gliekludende Inhalten, de nich minschliche Lesers, man KI-Systemen erreichen schöölt. De Studie wiest butendem, wo eng de Bornbasis is: Vun 544 identifizeerte Domains warrt 248 blots een eenzig Mal ziteert, wieldes alleen welt.de op 380 Zitaten kummt. ChatGPT gravitert stark to „Welt“ un „Bild“, wat Agora mit de Partnerschop twüschen OpenAI un Axel Springer verbinnen deit, wieldes Claude un Perplexity ok mehr staatliche un private Bornen antappen doot. OpenAI weddersprickt: Welk Bornen opduukt, dat hangt alleen an Nüttlichkeit un Relevanz, nich an kommerzielle Afspraken. De Tietpunkt is heikel, denn en Münchner Gericht hett jüst bestätigt, dat Google för sien KI-genereerten Antwoorden haften deit, un en Yougov-Studie beleggt den gau wassen Inflood vun de Chatbots op de Menensbillen. → MEEDIA Daily Update

Synthszr Take: Dat egentliche Problem stickt nich in’t Pravda-Netzwark, man in de Tall 248. Wenn vun 544 Domains meist de Hälft blots een eenzig Mal opduukt un een Anbeder 380 Zitaten afrüümt, denn löppt hier en Monopolmarkt för Opmarksamkeit, den de KI nich opbrickt, man zementert. Genau in disse smale Bornbasis kippt de Russen ehr Inhalten, wiel en dünne Wissensbasis licht to manipuleeren is. Un de kommerziellen Deals maakt dat noch slimmer: OpenAI kann noch so glöövweerdig betüügen, dat de Springer-Partnerschop nix mit de Ziteerdicht to doon hett, de Korrelatschoon steiht liekers in’n Report. Wecke vundaag en KI-Assistenten in Produkten inboot, de köfft de Bornpolitik vun den Anbeder glieks mit in, un disse Verantwoorden lett sik nich wegdelegeren. De pragmatische Schritt is, de Bornprofilen vun de Modellen nu gegenenanner to testen un nich blind op en Default-Engine to setten. Vendor-Neutralität weer lang en technisch Argument, nu warrt se to en Fraag vun Vertroon un Haftung.

KI as geopolitisch Schachbrett: Washington un Peking treckt de Tögels an

Beid gröttsten Volksweertschappen vun de Welt behannelt KI-Modellen intwüschen as en Fraag vun de natschonale Sekerheit. Washington hett den internatschonalen Togang to Anthropic sien Claude un OpenAI sien GPT-4o beschränkt, na dat kloor worrn is, dat Claude Angriepers helpen kunn, Software-Swacksteden gauer to finnen as je tovör. De USA hebbt Exportkontrollen verhangt un dat Modell rund dree Weken sparrt, dormit Behöörden un Konzernen ehr Systemen harden kunnen. Peking treckt na: Luut Reuters hett sik dat chinees’sche Hannelsministerium in’n Juni mit Zhipu AI, Alibaba un ByteDance drapen, üm den Utlandstogang to de fortschrittlichsten chinees’schen Modellen to beschränken un utlännsche Investoren uttobremsen. Dat kunn in de USA Wellen slaan, denn luut OpenRouter kemen över 30 Perzent vun de op chinees’sche Modellen bruukten Token ut de USA, in manche Weken 2026 bit to 46 Perzent. Tosätzlich hett China sien Industrieministerium wohrschaut, dat Anthropic sien Claude Code en Backdoor-Swacksteed bargt, un Alibaba hett sien Mitarbeiters dat Bruken vun Anthropic-Tools verbaden. Fröhere Modellgeneratschonen un de mehrsten Open-Weight-Modellen as DeepSeek, Qwen un GLM blievt wohrschienlich dorvun unberöhrt. → The Deep View

Synthszr Take: De egentliche Naricht stickt in de 46 Perzent. Amerikaansche IT-Afdelen loopt to chinees’sche Open-Weight-Modellen över, wiel de Token-Reken bi OpenAI un Anthropic ut dat Roder löppt, un genau disse Afhängigkeit warrt nu to’n politischen Hevel. Wecke sien Kostenoptimieren op DeepSeek oder Qwen boot hett, de hett en Vendor-Afhängigkeit schafft, de över Nacht per Ministeriumsbeschluss kappt warrn kann. As al Enn April bi dat grote Decoupling to sehn weer, verharden sik de Blöck, un dat Ruschen ut Washington un Peking deent beid Regeren as Druckmiddel, wieldes de Technikers in’n Ünnergrund wieder munter över de Grenz weg vun’nanner afkieken doot. Dorüm höört en schieren Migratschoonspadd in jedet Setup: en Modell-Adapter mit identische Prompt-Schicht, so dat en Wessel twüschen Claude, GPT, Gemma, Nemotron oder GPT-OSS ahn Re-Architektur stattfinnen deit. Dat is disse Week to entscheiden un köst nix buten Disziplin. Wecke sien Compute an een enkele Fahn binnt, de speelt en frömd Speel.

Mentioned in this article

De Sommer-Utgaav vun CODE CRASH is dor

2. UTGAAV. 440 SIEDEN (100+ MEHR). AF 20 EUR (PAPERBACK).

De Sommer-Utgaav vun CODE CRASH is dor

De nien agentischen KI-Systemen verlangt en radikale Ännern in't Denken doröver, wo Ünnernehmen vandaag opstellt wesen mütten, üm op'n Markt bestahn to könen. De Sommer-Utgaav vun CODE CRASH spannt dorüm den Bogen vun de Produktentwickeln över de Ünnernehmensoopstellen un Führung bet hen to de Kultur in't hütige KI-Tietolter — un tekent dorbi en övernaschen optimistisch Utkieken op Düütschland as Standort.

codecrash.ai →

Subscribe free. Unsubscribe the second it sucks.

High-signal news across AI, business, UX, and tech. Every morning.