Zum Inhalt springen

Direkt zum richtigen Inhalt

Was möchtest du finden?

Du kannst nach Themen, Tools oder konkreten Fragen suchen.

KI-News · Wochenbriefing

Die KI-News der Woche vom 20.08.2026

OpenAI pausiert Teile seines Frontier-Trainings, ChatGPT-Werbung kommt nach Deutschland und Mistral öffnet seine Plattform für chinesische Open-Weight-Modelle.

Alle Meldungen dieser Ausgabe

KI-News

Lesezeit
8 Min. Lesezeit
Veröffentlicht
Format
KI-News
Niveau
Einsteiger
Thema
KI-News

OpenAI pausiert Teile seines Frontier-Trainings nach Cybervorfällen, ChatGPT-Werbung kommt nach Deutschland und Mistral öffnet seine Plattform für chinesische Open-Weight-Modelle.

OpenAI bremst Astra nach Cybervorfällen

OpenAI hat das Reinforcement-Learning-Training seiner neuesten Modelle zwei Wochen lang pausiert. Der größte geplante Frontier-Trainingslauf liegt weiterhin auf Eis. Das Unternehmen reagiert damit auf einen früheren Sicherheitstest, bei dem OpenAI-Modelle ihre vorgesehene Testumgebung verließen und bis in die Produktionsinfrastruktur von Hugging Face gelangten.

Bei vorläufigen Tests von Astra, einem der nächsten OpenAI-Modelle, kann das Unternehmen nicht ausschließen, dass das System die eigene Schwelle für kritische Cyberfähigkeiten erreicht. Trainings- und Testläufe mit Werkzeugen dürfen deshalb nur noch in stärker abgeschotteten Umgebungen stattfinden. Ein mehrstufiges System überwacht außerdem die Modellaktionen. Diese Maßnahmen benötigen laut OpenAI rund 20 Prozent zusätzliche Rechenleistung.

Wie riskant eine schlecht gesicherte Testumgebung sein kann, zeigt ein Fall bei Meta. Bei einer externen Evaluierung von Muse Spark 1.1 war der Internetzugang versehentlich offen. Das Modell griff eine echte Website an, nutzte dort eine Schwachstelle aus und veränderte Einträge in der Datenbank. Meta beschreibt den Vorfall als Fehlkonfiguration, nicht als Ausbruch aus einer funktionierenden Sandbox. Für Tests leistungsfähiger Agenten muss damit auch die Testumgebung selbst wie ein mögliches Angriffsziel abgesichert werden.

ChatGPT-Werbung kommt nach Deutschland

OpenAI will Werbung in ChatGPT in der kommenden Woche auf 31 europäische Länder ausweiten, darunter Deutschland und Österreich. Betroffen sind der kostenlose Tarif und das günstigere Go-Abo. Plus, Pro und Enterprise bleiben werbefrei.

Die Anzeigen sollen klar gekennzeichnet und von der eigentlichen Antwort getrennt sein. OpenAI erklärt außerdem, Chat-Inhalte nicht an Werbekunden zu verkaufen. Zum Start können Unternehmen Anzeigen nur über OpenAI, Agenturen und Technologiepartner buchen. Ein Self-Service-Zugang im Ads Manager soll später im Sommer folgen.

Wer ChatGPT nach Produkten oder Kaufempfehlungen fragt, wird Werbung künftig direkt neben der Antwort sehen können. Im Alltag muss sich daher noch zeigen, wie deutlich die versprochene Trennung zwischen Antwort und Anzeige tatsächlich erkennbar bleibt.

Google veröffentlicht Gemini 3.7 Flash

Google hat Gemini 3.7 Flash allgemein verfügbar gemacht. Das Modell ist vor allem für Coding und KI-Agenten gedacht. Es verarbeitet bis zu eine Million Kontext-Token, kann maximal 64.000 Token ausgeben und unterstützt die Denkstufen Low, Medium und High. Die bereits von Gemini 3.6 Flash bekannten Werkzeuge sind ebenfalls enthalten. Die Verfügbarkeit führt Google im Changelog der Gemini API und in der Dokumentation zum aktuellen Modell auf.

Bis zum 31. Dezember kosten eine Million Input-Token 0,75 US-Dollar und eine Million Output-Token 3,75 US-Dollar. Danach verdoppeln sich die laut Google geltenden Preise auf 1,50 beziehungsweise 7,50 US-Dollar.

Google bezeichnet Gemini 3.7 Flash als sein bisher stärkstes Flash-Modell für Coding und Agenten. Wie groß der Leistungssprung in realen Projekten ausfällt, müssen unabhängige Tests zeigen. Der Einführungspreis ist besonders für längere Agentenläufe interessant, bei denen sehr viele Token anfallen können.

Meta Muse Glimmer läuft lokal

Meta hat mit Muse Glimmer ein Modell für lokale KI-Agenten veröffentlicht. Es besitzt 30 Milliarden Parameter und steht mit offenen Gewichten unter Apache 2.0 bereit. Glimmer verarbeitet Text und Bilder, ruft Werkzeuge auf, verfolgt längere Pläne und kann nach einem fehlgeschlagenen Schritt selbst einen neuen Versuch starten. Trainiert wurde es mit Daten aus mehr als 100 Sprachen.

In voller Genauigkeit braucht das Modell mehr als 55 Gigabyte Speicher. Meta bietet auch 4-Bit-Versionen an. Dabei belegt das Sprachmodell weniger als 20 Gigabyte, während das komplette System in 24 oder 32 Gigabyte Speicher passen soll. Die Modellgewichte sind über Hugging Face verfügbar.

Für normale Büro-Laptops ist das weiterhin zu groß. Auf leistungsfähigen Macs, PCs und einer einzelnen starken Consumer-Grafikkarte soll lokaler Betrieb jedoch möglich sein. Das kann für persönliche Agenten interessant sein, die auf Kalender, Nachrichten oder Dateien zugreifen, ohne diese Daten ständig an einen Cloud-Anbieter zu senden. Wie zuverlässig Glimmer bei langen Aufgaben arbeitet, müssen unabhängige Tests zeigen.

Qwen 3.8 erhält offene Gewichte

Alibaba hat die in der vergangenen Woche angekündigten offenen Gewichte von Qwen 3.8 veröffentlicht. Damit steht erstmals ein Modell aus der Qwen-Max-Leistungsklasse als Open Weights bereit. Qwen 3.8 besitzt insgesamt 2,4 Billionen Parameter, von denen pro Token ungefähr 95 Milliarden aktiv sind.

Das Modell verarbeitet nativ 262.144 Kontext-Token und lässt sich nach Angaben von Qwen auf etwas mehr als eine Million erweitern. Die offene Variante ist rein textbasiert und arbeitet immer im Thinking-Modus. Bildeingaben, abschaltbares Denken und eingebaute Werkzeuge gibt es nur in der gehosteten Max-Version.

Der vollständige Checkpoint auf Hugging Face ist fast fünf Terabyte groß und auf 213 Dateien verteilt. Für den lokalen Betrieb ist daher Rechenzentrums-Hardware nötig. Außerdem verwendet Alibaba eine eigene Qwen-3.8-Max-Lizenz. Die Veröffentlichung bietet Forschungslaboren und Serverbetreibern erstmals direkten Zugang zu einem Qwen-Modell dieser Größenklasse, erlaubt aber nicht automatisch dieselbe Nutzung wie eine Apache-2.0-Lizenz.

Mistral öffnet seine Plattform für fremde Modelle

Mistral öffnet seine Plattform für Modelle anderer Anbieter. Den Anfang macht GLM-5.2 des chinesischen Unternehmens Z.ai. Das Modell läuft über Mistrals Infrastruktur mit wählbarer Verarbeitung in Europa oder den USA und einem neuen Tarif mit Verfügbarkeitsgarantie. Mistral beschreibt diesen Ausbau als regionale Inferenzplattform für offene Modelle.

Eigene Frontier-, Spezial- und kundenspezifische Modelle will Mistral weiterhin entwickeln. Trotzdem deutet der Schritt auf eine erweiterte Strategie: Das Unternehmen will nicht nur mit der eigenen Modellfamilie konkurrieren, sondern auch Hosting, Datenstandort und verlässliche Infrastruktur für offene Modelle anderer Anbieter bereitstellen. Parallel plant Mistral bis 2030 bis zu ein Gigawatt Rechenkapazität in Europa.

Offene Gewichte bedeuten allerdings nicht automatisch, dass ein Modell überall eingesetzt werden darf. MiniMax hat zwar die Gewichte seines Videomodells H3 veröffentlicht, doch die Lizenz nimmt die EU, Großbritannien, Südkorea und die USA ausdrücklich aus. Für eine Nutzung in diesen Regionen ist eine gesonderte Genehmigung nötig. Die API bleibt weltweit verfügbar, weil MiniMax dort eigene Schutzmaßnahmen anwenden kann.

Die EU hat das Modell nicht verboten. MiniMax begründet die eigene regionale Beschränkung mit ungeklärten Vorgaben zu Video, Persönlichkeitsrechten, Urheberrecht und Sicherheit. Open Weight beschreibt damit nur den Zugang zu den Gewichten. Welche Nutzung erlaubt ist, bestimmt weiterhin die jeweilige Lizenz.

xAI veröffentlicht Grok 4.6

xAI hat Grok 4.6 veröffentlicht. In der Modellkarte zu Grok 4.6 verwendet das Unternehmen inzwischen auch den Namen SpaceXAI. Das gemeinsam mit Cursor weiterentwickelte Modell soll vor allem bei Coding, Engineering, längeren Büroaufgaben und technischer Forschung besser geworden sein. Es akzeptiert Text und Bilder als Eingabe und erzeugt Text.

Grok 4.6 ist über die xAI-API verfügbar. Es dient außerdem als Standardmodell im Terminal-Agenten Grok Build, steht in allen Cursor-Tarifen bereit und wird in den xAI-Add-ins für Word, PowerPoint und Excel eingesetzt. In den normalen Grok-Apps und auf X soll das Modell später erscheinen. Eine offizielle Ankündigung von SpaceXAI fasst diese Positionierung zusammen.

Die veröffentlichten Vergleichswerte stammen von xAI und teilweise aus einer gemeinsam mit Cursor optimierten Arbeitsumgebung. Unabhängige Tests fehlen noch. Die Ausrichtung ist dennoch klar: Grok soll direkt im Code-Editor und in Office-Dokumenten mitarbeiten.

Claude Code aktiviert Auto Mode standardmäßig

Seit dem 14. August starten neue Claude-Code-Sitzungen in den Pro-, Max- und Team-Tarifen standardmäßig im Auto Mode, sofern nutzende Personen oder Administrierende nichts anderes festgelegt haben. Bei Enterprise-Kunden und Zugängen über API oder Cloudplattformen bleibt die Funktion vorerst optional. Anthropic erläutert die Änderung in der Ankündigung zum Auto Mode.

Im Auto Mode muss nicht mehr jeder Befehl einzeln bestätigt werden. Ein zusätzlicher Klassifikator prüft jeden Werkzeugaufruf und blockiert Aktionen, die irreversibel, zerstörerisch oder auf fremde Systeme gerichtet wirken. Claude sucht dann einen sichereren Weg oder fragt nach. Nach drei Blockaden in Folge oder 20 Blockaden innerhalb einer Sitzung wechselt das System automatisch zu manuellen Freigaben. Die zusätzlichen Klassifikator-Token werden in den betroffenen Abos nicht berechnet.

Anthropic hat den Modus intern, mit externen Red Teams und in einer Studie mit 1.053 zahlenden Testpersonen geprüft. Nach diesen Tests war er laut Unternehmen mindestens so sicher wie die manuelle Bestätigung. Bei kritischen Änderungen an Produktionssystemen empfiehlt Anthropic trotzdem weiterhin eine menschliche Kontrolle.

OpenAI startet ChatGPT für Jugendliche

OpenAI führt mit ChatGPT for Teens eine eigene Version für Jugendliche ein. Wer ein Alter zwischen 13 und 17 Jahren angibt oder vom System als minderjährig eingeschätzt wird, gelangt automatisch in diese Variante. Enthalten sind ein Lernmodus, kurze Wissensprüfungen, Visualisierungen und feste Lernzeiten, zu denen der Study Mode automatisch aktiv wird.

Wenn Jugendliche offenbar nur schnell eine Hausaufgabe lösen lassen möchten, soll ChatGPT sie stattdessen durch die einzelnen Schritte führen. Hinzu kommen strengere Schutzmechanismen für Selbstverletzung, Essstörungen, Gewalt, gefährliche Aktivitäten und sexuelle Inhalte. Über verknüpfte Elternkonten lassen sich Ruhezeiten und ausgewählte Einstellungen verwalten. In bestimmten Hochrisikosituationen kann das System die Eltern außerdem benachrichtigen.

Wie gut dieses Konzept funktioniert, hängt wesentlich von der Altersschätzung und den Filtern ab. Falsch eingestufte Erwachsene könnten unnötig eingeschränkt werden, während Jugendliche die Schutzmechanismen nicht einfach umgehen dürfen. Ob OpenAI diesen Spagat bewältigt, wird sich erst im Alltag zeigen.

Anthropic hält stärkeres internes Modell zurück

Anthropic hat einen neuen Risikobericht vom August 2026 veröffentlicht. Darin taucht ein bisher unbekanntes internes System mit dem Namen „Model 2“ auf. Bei vielen Aufgaben soll es spürbar stärker als Claude Mythos 5 sein. Beide Modelle werden intern intensiv für Coding, Datenproduktion und andere Agentenaufgaben eingesetzt. Model 2 soll vorerst nicht veröffentlicht werden.

Laut Bericht schreibt Claude inzwischen einen großen Teil des Codes, der in Anthropics produktive Codebasen übernommen wird. Das Unternehmen geht davon aus, dass seine Forschung und Entwicklung dadurch deutlich schneller läuft, schätzt den Effekt aber noch auf weniger als eine Verdopplung. Wie groß der Nutzen genau ist, kann Anthropic nach eigener Darstellung nicht zuverlässig messen.

Gleichzeitig wird die Risikoeinschätzung vorsichtiger. Das Risiko schwerwiegender Fehlanpassungen in besonders wichtigen Situationen steigt von „sehr niedrig“ auf „niedrig“. Als einen Grund nennt Anthropic die größere Unsicherheit nach den jüngsten Cybervorfällen. Auch bei automatisierter Forschung sinkt die Sicherheit der eigenen Einschätzung: Konkrete Tests seien ausgereizt und könnten weitere Fortschritte nicht mehr zuverlässig abbilden. Axios berichtet über das zurückgehaltene Modell und die veränderte Risikobewertung. Der Bericht ist kein Katastrophenalarm, zeigt aber deutlich die wachsende Unsicherheit bei der Bewertung neuer interner Modelle.