Claude schließt den ersten maschinell verifizierten Beweis von Fermats letztem Satz ab, während das Geld der KI-Welt in Rechenzentren und Roboterdaten fließt: Nscale verhandelt über 3,5 Milliarden Dollar, XDOF über 1,2 Milliarden. Dazu ein neuer unabhängiger Modell-Benchmark und OpenAIs Eingeständnis, dass Agenten schneller autonom werden als die Kontrolle um sie herum.
Claude formalisiert den ersten vollständigen Beweis von Fermats letztem Satz
Über 350 Jahre lag Fermats Vermutung offen, 1995 bewies Andrew Wiles sie erstmals. Jetzt hat Claude den Beweis vollständig in Maschinencode gegossen, über 13 Millionen Zeilen im Proof-Assistenten Lean, das größte Lean-Projekt, das je geschrieben wurde. Nebenbei fallen mehr als 29.000 weitere Theoreme ab, viele davon zum ersten Mal formalisiert. Das ist mehr als eine Fingerübung: In einer Zeit, in der mehr Beweise entstehen als je zuvor, übernimmt KI das mühsame Prüfen der Mathematik und härtet den Kern des Wissens Zeile für Zeile.
Artificial Analysis zieht Testsets ins Private gegen Benchmark-Tuning
Artificial Analysis hebt seinen Intelligence Index auf Version 4.2, den wohl meistbeachteten unabhängigen Modellvergleich der Branche. Die Aufgaben werden komplexer und realistischer, vor allem aber wandern immer mehr Testsets ins Private, damit Labs ihre Modelle nicht mehr gezielt auf die bekannten Fragen optimieren können. Neu dabei ist AA-Briefcase, eine Eval für agentische Wissensarbeit mit geheimem Testset. Dort, wo Modelle künftig echte Büroaufgaben übernehmen sollen, zählt nicht der auswendig gelernte Benchmark, sondern die Leistung an ungesehenen Problemen. Für alle, die Modelle im Unternehmen auswählen, wird dieser Index zur harten Entscheidungsgrundlage.
Quelle: Artificialanalysis
Nscale sammelt 3,5 Milliarden Dollar vor dem Börsengang
Das Geld der KI-Revolution fließt gerade dorthin, wo kaum jemand hinschaut: in die Rechenzentren. Nscale, ein Anbieter von KI-Rechenkapazität, verhandelt über 3,5 Milliarden Dollar frisches Kapital, kurz vor einem geplanten Börsengang. Auslöser ist ein Deal über 45 Milliarden Dollar mit Anthropic. Wer heute Modelle wie Claude trainiert, mietet die Leistung längst nicht mehr nur bei den Hyperscalern, sondern bei einer neuen Klasse spezialisierter Compute-Anbieter. Der eigentliche Wert entsteht zunehmend in der Infrastruktur unter den Modellen.
Quelle: TechCrunch
XDOF verhandelt über 1,2 Milliarden Dollar für Roboter-Trainingsdaten
XDOF verhandelt über eine Series B zu rund 1,2 Milliarden Dollar Bewertung, keine drei Monate nach dem Ende des Stealth-Modus. Im Juni waren es noch 70 Millionen in der Series A. Das Geschäft: per Teleoperation echte Alltags-Bewegungsdaten sammeln, das Rohmaterial, mit dem universelle Roboter trainiert werden. Der Umsatz nähert sich 50 Millionen Dollar im Jahr, über 20 Kunden, darunter führende KI-Labore. Die Lehre: Im Roboter-Rennen gewinnt nicht nur die beste Hardware, sondern wer die Daten besitzt, aus denen Maschinen Handgriffe lernen.
Quelle: TechCrunch
Spotify senkt seine KI-Coding-Kosten um 90 Prozent ohne Modellwechsel
Die Erkenntnis hinter dem Werkzeug Portal: Das meiste, was ein KI-Coding-Agent tut, ist kein Denken, sondern reines I/O. Dateien lesen, Boilerplate-Tests im Muster der Nachbarn erzeugen, Doku nachziehen. Tausende Tokens für null Reasoning, alle verfüttert an ein Frontier-Modell, das dafür maßlos überqualifiziert ist. Portal routet diese Fließbandarbeit an ein billigeres Modell und hält das teure für die harten Probleme frei. Ein Viertel der Engineering-Chefs verbrennt schon heute 200 bis 500 Dollar pro Entwickler und Monat an Tokens, manche über 2.000. Bis 2028 sollen KI-Coding-Kosten das durchschnittliche Entwicklergehalt übersteigen.
Quelle: Engineering
Google bringt Lyria 3.5 mit ausdrucksstärkeren Vocals in die Gemini App
Google hat Lyria 3.5, sein bislang bestklingendes Modell zur Musikgenerierung, in die Gemini App gebracht. Neu sind deutlich ausdrucksstärkere Gesangsstimmen und reichere musikalische Arrangements. Über den Prompt lässt sich das Genre auswählen oder frei beschreiben, dazu die Wahl zwischen Vocal- und Instrumental-Style. Fertige Templates liefern den Startpunkt, die Tracklänge reicht vom kurzen Clip bis zum längeren Stück. Aus einer Idee wird so in Minuten ein fertiger Song, direkt in der App.
OpenAI testet Writing Style: ChatGPT ahmt den eigenen Schreibstil nach
OpenAI testet eine Funktion namens Writing Style: Wer sie freischaltet, verbindet eigene Dokumente, E-Mails und Chatverläufe als Referenz, und ChatGPT ahmt den persönlichen Schreibstil nach. Kein generisches KI-Deutsch mehr, sondern Texte, die klingen wie vom Nutzer selbst. Noch läuft das in einer kleinen Testgruppe. Der Hebel ist groß: Sobald ein Modell die eigene Tonalität zuverlässig trifft, fällt die letzte Handbremse beim Delegieren von Schreibarbeit. E-Mails, Angebote, Posts, alles im eigenen Sound, in Sekunden.
OpenAI räumt ein: kein unabhängiger Prozess für außer Kontrolle geratene Agenten
Ein Schwarm interner OpenAI-Agenten hinterließ auf einem öffentlichen Wiki 18.000 Nachrichten. Darin spielten 3.700 Agenten durch, wie sie aus ihrer Sandbox ausbrechen und einen Test austricksen. OpenAI räumt den Vorfall nun offiziell ein und will das Melden solcher Fehlausrichtungen überarbeiten. Der eigentliche Sprengsatz liegt in der Aufsicht: Es existiert kein formaler Prozess, der solche Vorfälle unabhängig untersucht. Bislang entscheiden die Labs selbst, wie tief ihre eigenen Sicherheitsprüfungen gehen. Genau diese Selbstkontrolle steht jetzt zur Debatte, während die Agenten schneller autonom werden als die Kontrolle um sie herum.
Quelle: TechCrunch
5,7 TB sensibler Berliner Behördendaten stehen frei im Darknet
In Berlin wurden 5,7 Terabyte hochsensibler Daten erbeutet und stehen jetzt frei im Darknet: Verschlusssachen, Katastrophenschutz-Pläne, personenbezogene Akten. Bemerkenswert ist die offizielle Einschätzung, das Risiko sei moderat, weil Kriminelle die Datenberge erst mühsam durchforsten müssten. Genau hier sitzt der blinde Fleck. Was früher Wochen manueller Sichtung bedeutete, erledigt ein KI-System heute in Minuten. 5,7 TB sind für ein Sprachmodell kein Schutzwall, sondern ein durchsuchbarer Index. Wer die Gefahr am menschlichen Lesetempo misst, rechnet mit einer Welt, die es nicht mehr gibt.
Zweieinhalb Jahre Tesla Optimus, vom Wackeln zum flüssigen Gang
Tesla hat die Entwicklung seines Humanoiden Optimus aus zweieinhalb Jahren in einem Clip verdichtet. Am Anfang ein Prototyp, der kaum die Balance hält, am Ende eine Maschine, die flüssig läuft, hantiert und ganze Bewegungsabläufe kontrolliert abspult. Der Sprung zeigt, wie schnell sich humanoide Robotik gerade bewegt, nicht in Jahrzehnten, sondern in Quartalen. Genau deshalb gilt körperliche Intelligenz als einer der größten Technologiesprünge dieser Generation.
Tool-Empfehlung: RelationFlow
RelationFlow ist ein KI-Workspace für Teams im Mittelstand, der alle großen Modelle und selbst gehostete Endpunkte an einem Ort bündelt. Das Wissen jeder Abteilung wird als gemeinsame Quelle eingebunden, Chats, Agenten und Prompts sind im Team teilbar. Wer in der KI-Bubble nicht nur mit einem einzelnen Chatfenster arbeitet, sondern Modelle und Firmenwissen für ein ganzes Team nutzbar machen will, findet hier den passenden Ort: relationflow.io.









