Mistral veröffentlicht Large 4 mit 1,05 Billionen Parametern als Open Weights, am selben Tag öffnet Reflection sein 501-Milliarden-Modell Beam. Google zieht parallel die Gratis-Stufe von Gemini zusammen, und OpenAI schaltet Auto-review für jedes ChatGPT-Konto frei.
Mistral Large 4 bringt 1,05 Billionen Parameter als Open Weights
Mistral hat Large 4 veröffentlicht, ein multimodales Mixture-of-Experts-Modell mit frei verfügbaren Gewichten. Die Kennzahlen:
1,05 Billionen Parameter gesamt, 49 Milliarden aktiv pro Token
Granulares MoE plus Vision-Encoder mit 1,6 Milliarden Parametern
Open Weights, betreibbar in eigener Infrastruktur
Die Architektur ist der eigentliche Punkt: Pro Anfrage rechnet nur ein Bruchteil des Modells mit, die Gesamtkapazität bleibt im Billionen-Bereich. Ob daraus der Souveränitäts-Anker für europäische Deployments wird, entscheidet sich an Lizenz und Hardware-Bedarf.
Quelle: Docs
Reflection öffnet Beam mit 501 Milliarden Parametern
Das zwei Jahre alte, von Nvidia finanzierte Labor veröffentlicht sein erstes Open-Weight-Modell: 501 Milliarden Parameter gesamt, 23 Milliarden aktiv pro Anfrage, 23,8 Billionen Tokens im Pretraining. Gebaut ist Beam für Coding, Reasoning und Agenten-Workloads.
Erstmals tritt ein US-Labor mit voller Gewichtsfreigabe gegen die chinesischen Open-Weight-Modelle an, die den Markt seit Monaten bestimmen. Für Unternehmen heißt das: ein westliches Modell im eigenen Rechenzentrum, ohne API-Vertrag. Ob Beam die chinesische Spitze erreicht, bleibt offen, die Benchmarks prüft Reflection nach eigener Angabe noch.
Quelle: Reflection
Google kappt den Gratis-Zugang zu Gemini Flash und Pro
Ab dem 9. Oktober bekommen Gratis-Nutzer von Gemini nur noch Flash Lite. Das reguläre Flash-Modell wandert hinter das Abo Google AI Plus für 4,99 Dollar im Monat, Pro fällt aus genau diesem günstigsten Tarif heraus.
Die Gratis-Stufe war das Einfallstor in Googles Ökosystem, jetzt wird sie zur Verkaufsfläche. Wer Gemini in Workflows, Prototypen oder Schulungen eingebaut hat, kalkuliert ab Freitag mit Lizenzkosten. Preis für das Modell, das heute noch gratis läuft: 4,99 Dollar im Monat.
Quelle: The Verge
Claude-Abo liefert über 5x den API-Gegenwert von GPT-6.1 Sol
Eine Rechnung von SemiAnalysis übersetzt das monatliche Kontingent eines Abos in API-Listenpreise, gemessen an agentischer Dauerlast. Opus 5.5 im Abo kommt dabei auf über 5x den API-Gegenwert gegenüber GPT-6.1 Sol, bei gleichem Abopreis auf beiden Seiten. Der Abstand steckt also im Kontingent. Parallel halbiert OpenAI die Limits im 200-Dollar-ChatGPT-Plan. Ob OpenAI mit dem Preis oder mit dem Kontingent antwortet, zeigt das nächste Plan-Update.
Nvidia stellt die Kredithilfe für seine KI-Clouds zur Debatte
Nvidia überdenkt die Struktur der AI Compute Partnership, die im Sommer angekündigt wurde. Das Modell: Nvidia stützt KI-Cloud-Anbieter mit Kreditabsicherung, damit die Nvidia-Chips einkaufen und vermieten können, und kassiert im Gegenzug einen Anteil an den Mieteinnahmen.
Für jeden, der Rechenleistung einkauft, ist das eine Info über die Statik seines Anbieters: Ein Teil der GPU-Clouds steht auf einer Kreditzusage des Chipherstellers statt auf eigenem Kapital. Bisher finanzierte der Markt die Chips, inzwischen finanziert der Chiphersteller den Markt.
Quelle: The Information
OpenAI schaltet Auto-review gratis für alle ChatGPT-Konten frei
Ein zweiter Agent läuft im Hintergrund mit und prüft jede Aktion des Haupt-Agenten dagegen, was der Nutzer eigentlich wollte. Freizuschalten unter Settings, Permissions, Auto-review, gratis für jeden, der sich über ein ChatGPT-Konto anmeldet.
Bisher blieb als Absicherung nur die Sandbox-Voreinstellung, die jeden einzelnen Schritt bestätigen lässt, bis man entweder im Reflex alles durchklickt oder dem Agenten entnervt Vollzugriff gibt. Auto-review verlegt die Kontrolle eine Ebene höher, von der Einzelfreigabe auf die Absicht. Wie oft der Aufseher dabei selbst nachfragen muss, entscheidet über die Klick-Müdigkeit.
Cursors SDK lenkt Agenten jetzt mitten im Lauf
Das SDK-Update bringt drei Eingriffe, die vorher nicht gingen: run.steer() hängt eine Nachricht an den nächsten Turn, während der Subagent im Hintergrund weiterarbeitet. Hintergrund-Subagenten melden ihr Ergebnis zurück an den Parent, stream() und wait() laufen bis zum letzten durch. Und eigene Tools tragen MCP-Annotationen wie readOnlyHint und destructiveHint, das Modell erkennt den Lookup vor dem Löschbefehl.
Dazu lässt sich Cursors System-Prompt komplett durch einen eigenen ersetzen, Rules, Skills und Tool-Schemas laden trotzdem weiter. Steering und System-Prompts greifen auch bei lokalen TypeScript-Agenten. Der Rollout läuft Account für Account.
Dieselbe MCP-Lücke bei Google, JPMorgan und zwei Behörden
Die Lücke im Protokoll, über das KI-Agenten Werkzeuge und andere Agenten ansprechen, ist kein schlampiger Einzelfall:
Derselbe Fehler bestätigt und gepatcht bei fünf unabhängigen Organisationen
Betroffen: Google, JPMorgan Chase, Weaviate, Frankreichs Digitaldirektion, eine indonesische Stadtverwaltung
Der MCP-Server baut ausgehende Requests aus Adressen, die der Agent liefert, ohne zu prüfen, wohin sie auflösen
Damit entscheidet der Agent, mit wem die Netzwerk-Identität des Servers spricht. Ob der eigene MCP-Server prüft, welche Adressen er aufrufen darf, klärt sich in der Konfiguration.
Quelle: Ars Technica
OpenAI legt ein unsichtbares Wasserzeichen in jeden ChatGPT-Text
Seit gestern rollt OpenAI textGrain aus: Das Modell verschiebt seine Wortwahl so minimal, dass ein statistisches Muster in den Wörtern selbst sitzt. Unsichtbar beim Lesen, auslesbar per Detektor mit geheimem Schlüssel, und es überlebt Copy-Paste.
ChatGPT und Codex: nur in der EU, dafür in allen Tarifen
API weltweit: opt-in, standardmäßig abgeschaltet
Trefferquote bei 1 Prozent Falsch-Positiven: 95 Prozent ab 400 Token
Auslöser ist der EU AI Act. Robust ist das Verfahren allerdings nicht: Werden 25 Prozent der Wörter durch Synonyme ersetzt, fällt die Erkennung auf 17 Prozent.
Quelle: TechCrunch
Berlin und Paris fordern einen Kill-Switch für den China-Handel
Der Brief an von der Leyen fordert ein Instrument, das Drittstaaten bei systemischen Verzerrungen sofort vom Binnenmarkt abschneidet. Auslöser sind Überkapazitäten, Subventionen, Dumping und konzentrierte Lieferketten. Mitgliedstaaten müssten den Einsatz mit qualifizierter Mehrheit stoppen, statt ihn zu genehmigen.
Einseitig ist der Hebel nicht. Seltene Erden, Magnete, Batteriematerialien, Arzneiwirkstoffe, Elektronik: kurzfristig ersetzbar ist davon kaum etwas. Peking kann drosseln, verteuern und europäische Firmen vor Ort treffen. Was der Schalter wert ist, zeigt sich, wenn Peking antwortet.
China führt KI-Kurse landesweit als Schulfach ein
Grund- und weiterführende Schulen im ganzen Land führen allgemeine KI-Kurse im regulären Lehrplan ein. Das Ziel geht ausdrücklich über Bedienkompetenz hinaus: Schüler sollen verstehen, wie diese Systeme rechnen, wo ihre Grenzen liegen und was sie mit Daten tun. Dort wächst damit eine Generation auf, für die Sprachmodelle Werkzeug und Unterrichtsgegenstand gleichzeitig sind. Wann der erste deutschsprachige Lehrplan KI als eigenes Fach führt, ist weiter offen.
arXiv drosselt sich selbst auf zwei Paper pro Monat
Das wichtigste Preprint-Archiv der KI-Forschung kommt mit den eigenen Einreichungen nicht mehr mit und zieht jetzt eine Obergrenze:
September 2016: 9.869 Einreichungen. September 2026: 40.363
In der Informatik hat sich das Volumen versechsfacht
Neues Limit: zwei Paper pro Autor und Kalendermonat, maximal drei offene
Als Grund nennt arXiv dichte, KI-geschriebene Paper von einer kleinen Gruppe Autoren, die das Archiv fluten und einen unverhältnismäßigen Teil der Zeit der freiwilligen Moderatoren verbrauchen.
Quelle: 404media
Chart des Tages: Coding führt die Agenten-Wunschliste mit 103 Nennungen
Quelle: a16z-Analyse
In einer Power-User-Gruppe zu KI-Assistenten entfallen 103 Nennungen auf Coding und technische Automatisierung. Platz zwei, Reise, kommt auf 66. Dahinter folgen Shopping mit 58, Finanzen mit 56 und Agenten-Koordination mit 49. Die klassischen Concierge-Aufgaben landen hinten: Kalender und Termine bei 34, Gastro-Reservierungen bei 16. Für Unternehmen ist das ein Signal, wo die zahlungsbereite Spitze der Nutzer Wert sieht. Die Nachfrage sitzt dort, wo technische Arbeit anfällt.
Tool-Empfehlung: Voicely
Voicely ist eine DSGVO-konforme Diktiersoftware mit KI-gestützter Spracherkennung, die in jeder App läuft. Statt zu tippen, spricht man den Text ein, und zwar im Mailprogramm, im Editor und im Browser gleichermaßen. Für alle in der KI-Bubble, die den eigenen Schreiballtag tatsächlich beschleunigen wollen, ist das ein naheliegender Werkzeugkasten-Eintrag, mehr Infos: voicely.de.













