Nvidias Vera Rubin verspricht 30-fache Effizienz pro Megawatt und macht KI-Agenten damit erst wirtschaftlich. Gleichzeitig löst sich Thomson Reuters von Claude und baut sein eigenes Modell auf Alibabas Qwen, während Mistral eine KI-Achse mit Saudi-Arabien zieht.
Nvidias Vera Rubin liefert 30x mehr Durchsatz pro Megawatt
NVIDIA hat Vera Rubin NVL72 erstmals direkt auf dem Silizium vermessen, und zwar an dem, was Agenten wirklich tun. Das Ergebnis: bis zu 30-facher Durchsatz pro Megawatt und bis zu 35-fach geringere Token-Kosten gegenüber der GB300 NVL72. Gemessen wurde am AgentX-Workload von SemiAnalysis mit echten Coding-Trajektorien auf DeepSeek V4 Pro. Agentische Sessions sind keine kurzen Chats, ihr Kontext wächst über hunderte Schritte auf hunderttausende Token. Bislang zahlen Betreiber vor allem für Wartezeit, und genau diese Rechnung schreibt NVIDIA gerade neu.
Auf derselben Vera-Rubin-Plattform geht der Token-Beschleuniger Groq 3 LPX in volle Produktion. NVIDIA nennt 3.400 Output-Token pro Sekunde auf Gemma 4 31B bei 100.000 Token Kontext, den schnellsten je im Artificial-Analysis-Benchmark gemessenen Wert für dieses Modell, dazu viermal reaktionsschnellere Antworten als die nächstbeste Plattform. Nebius nimmt Groq 3 LPX als erste KI-Cloud über seine Token Factory in Betrieb, Groq selbst folgt. Die harte Währung der nächsten KI-Generation ist nicht mehr nur Intelligenz, sondern das Tempo, mit dem sie handelt.
Am anderen Ende der Skala schiebt Apple Rechenleistung zurück an den Rand. Der neue M6 im Mac mini und der M5 Ultra im Mac Studio zielen erklärtermaßen auf lokale KI-Rechenleistung statt auf Marketing-Taktraten: mehr Durchsatz für neuronale Netze direkt auf dem Schreibtisch, ohne Cloud, ohne Latenz, ohne dass Daten das Gerät verlassen. Während NVIDIA Gigawatt-Hallen füllt, verlagert Apple einen Teil der Inferenz in die Hand des Nutzers. Für Unternehmen heißt das ernsthafte KI-Workloads lokal, mit voller Datenhoheit.
Quelle: Apple
Nvidia wird zum Königsmacher der KI-Branche
Neben den Chips baut Nvidia still ein Beteiligungsimperium auf und sammelt Eigenkapital-Anteile an KI-Firmen ein, zuletzt eine ausgeweitete Beteiligung an Perplexity. Was offiziell nur die Nachfrage nach den eigenen Chips absichert, wird zum zweiten Machthebel: Das Portfolio könnte eines Tages mehr wert sein als das Chip-Geschäft selbst, denkbar sogar als eigenständige Investmentgesellschaft abgespalten. Das Muster erinnert an Kabel-Mogul John Malone: Wer die Distribution kontrolliert, bekommt die Anteile zum Freundschaftspreis. Nvidia kontrolliert heute die Rechenleistung, an der niemand vorbeikommt, der Frontier-Modelle bauen will.
Quelle: The Information
Mistral zieht derweil eine eigene KI-Achse zum Golf und verkündet eine strategische Kooperation mit HUMAIN, dem KI-Vehikel Saudi-Arabiens: gemeinsame Infrastruktur, eigene Frontier-Modelle und der Rollout von KI-Lösungen in der Region, zunächst mit Fokus auf Cybersecurity, Voice und Modelle, die in arabischen Sprachen stark performen. Lokalisierte Frontier-Modelle heißen eigene Rechenzentren, eigenes Training, eigene Sprachhoheit. Während Europa über Souveränität diskutiert, kauft sich der Golf über Kapital direkt in die Modellschicht ein, und der europäische Champion wird zum Infrastruktur-Lieferanten fremder Staatsfonds.
Quelle: Mistral
Wie schnell die KI-Wette kippen kann, zeigt der Hedgefonds Situational Awareness, benannt nach dem KI-Manifest eines OpenAI-Aussteigers. Leopold Aschenbrenner, Mitte zwanzig, wettete hochkonzentriert auf KI-Aktien, ohne Netz, und wurde zur kurzzeitigen Obsession der Wall Street. Ende Juli radierte ein Einbruch bei KI-Werten Milliarden aus dem Fondsvermögen. Jetzt fordert die SEC bei den beteiligten Banken alle Unterlagen an, jene, die den Handel überwachten und die Finanzierung stellten, sollen sämtliche Informationen sichern. Ein konkreter Vorwurf steht noch nicht im Raum, der Fonds kündigt volle Kooperation an.
Quelle: TechCrunch
Thomson Reuters ersetzt Claude durch Alibabas Qwen
Der Informationskonzern Thomson Reuters wollte raus aus der Abhängigkeit von einem einzelnen Frontier-Labor und trainierte ein eigenes Modell auf Basis von Alibabas offenem Qwen. Die Begründung des CTO: Intelligenz bei Frontier-Laboren einzukaufen, statt auf Open Source zu bauen, sei wie ein Haus mieten statt es zu besitzen. Wer sein Kerngeschäft dauerhaft auf fremde Modelle stützt, zahlt Miete und gibt Kontrolle ab. Offene Gewichte drehen das um: einmal aufgesetzt, gehört das Modell dem Unternehmen, samt Daten, Feintuning und Roadmap. Dass ein westlicher Konzern dafür zu einem chinesischen Open-Source-Modell greift, zeigt, wie schnell Qwen zur ernsthaften Basis für Eigenbauten geworden ist.
Anthropic schaltet Enterprise-managed Auth für MCP-Connectors auf Claude in die allgemeine Verfügbarkeit. Die Zugänge zu externen Tools laufen jetzt zentral über OAuth, von der IT verwaltet statt von jedem Nutzer einzeln zusammengeklickt. Mit an Bord sind Asana, Atlassian, Canva, Datadog, Figma, Granola, Linear, Notion, Slack und Supabase, und Entwickler können denselben Mechanismus an ihre eigenen Connectors im Claude-Directory hängen. Aus dem Protokoll-Experiment wird damit Infrastruktur, auf die sich Firmen wirklich verlassen können.
Passend dazu kommt Keenable mit 26 Millionen Dollar Seed-Finanzierung von Accel aus dem Stealth-Modus und baut einen gigantischen Web-Suchindex, der nicht für Menschen gedacht ist, sondern für KI-Agenten. Die Idee: Agenten, die selbstständig recherchieren, buchen und handeln, ersticken an einer Suchinfrastruktur, die für menschliche Augen und Werbeanzeigen optimiert wurde. Sie brauchen strukturierte, maschinenlesbare Treffer in Millisekunden, nicht zehn blaue Links. Wer die Datenschicht besetzt, auf der Agenten die Welt lesen, kontrolliert einen Engpass der kommenden Agenten-Ökonomie.
Quelle: TechCrunch
Chart des Tages: KI-Erwähnungen in Klinik-Notizen steigen auf 730 je Million
Quelle: Protege DataLab, Netzwerk klinischer Datenanbieter
Bis 2023 erwähnten klinische Notizen praktisch nie einen KI-Einsatz. Seither explodiert der Wert: von nahe null auf rund 730 Erwähnungen je Million Notizen im Jahr 2025, für 2026 projiziert auf 1.686. Für Praxen und Kliniken heißt das, dass KI längst im Dokumentationsalltag angekommen ist, nicht mehr nur im Pilotprojekt. Die Kurve zeigt, wie schnell aus einer Randnotiz gelebte Routine wird, sobald ein Werkzeug in der täglichen Arbeit spürbar Zeit spart.
Roboter lernt Federers Vorhand aus dem Fernsehen
Forscher haben einem Unitree G1 das Tennisspielen beigebracht, allein aus Fernseh-Aufnahmen von Federer, Nadal und Djokovic. Das Framework AdaPT plant Bewegungen geschwindigkeitsadaptiv und überträgt sie vom Simulator auf die reale Maschine, präzise genug, um die Schlagsignatur einzelner Profis nachzuahmen. Für den Federer-Modus bekam der Roboter Poloshirt, Shorts und Perücke. Was nach Spielerei aussieht, löst ein ernstes Problem: komplexe menschliche Bewegung ohne mühsames Handcoding aus Videomaterial auf echte Hardware zu bringen.
Tool-Empfehlung: Voicely
Voicely ist eine DSGVO-konforme Diktiersoftware mit KI-gestützter Spracherkennung, die in jeder App läuft. Wer viel schreibt, tippt damit nicht mehr, sondern spricht, und diktiert nach eigener Angabe rund fünfmal schneller. Ein nützlicher Werkzeugkasten-Eintrag für alle in der KI-Bubble, die Produktivität nicht nur diskutieren, sondern ihren eigenen Schreiballtag tatsächlich beschleunigen wollen, mehr Infos: voicely.de.











