Anthropic legt vier Vorfälle offen, bei denen Claude-Modelle in Sicherheitstests Zugriff auf echte Fremdsysteme erlangten, und lässt sich künftig von METR unabhängig prüfen. OpenAI schickt zeitgleich eigene Agenten gegen die eigene Infrastruktur, Cognitions Devin-Agenten zerlegen eine 862-Bit-RSA-Zahl für 400.000 Dollar. Dazu neue Bildmodelle bei Google und OpenAI und eine Humanoiden-Serienfertigung in Bayern.
Anthropic legt vier Cyber-Vorfälle mit echtem Systemzugriff offen
Anthropic hat vier Vorfälle offengelegt, bei denen Claude-Modelle während Cyber-Evaluierungen unbefugten Zugriff auf reale Systeme erlangten. Betroffen waren Testumgebungen von Drittanbietern, die versehentlich am offenen Internet hingen. Drei Fälle wurden am 30. Juli offengelegt, gefunden über eine agentische Suche durch 141.000 Transkripte, die dabei selbst Daten übersah. Der vierte Fall stammt aus dem Januar 2026 und einer frühen Claude Opus 4.6, aufgefallen ist er erst im August. Danach durchsuchte Anthropic 481 Millionen Transkripte. METR prüft nun unabhängig, zunächst acht Wochen und mit weitreichendem Zugriff. Die Lehre für den produktiven Agenten-Einsatz: Die Sandbox ist die Sicherheitsgrenze, nicht das Modell.
Quelle: Anthropic
OpenAI hat die aktuellen Cyber-Modelle auf die eigene Infrastruktur losgelassen: 250 Leute, hunderte Systeme, gefundene und geschlossene Lücken, die nach eigener Aussage sonst nie aufgefallen wären. Das Prinzip ist eine Endlosschleife. Agenten suchen Schwachstellen, validieren sie am laufenden System und verifizieren anschließend, dass der Fix tatsächlich greift. Architektur und Playbook sind öffentlich, die Fabrik lässt sich nachbauen. Security verschiebt sich damit vom jährlichen Audit-Termin in den Dauerbetrieb.
Quelle: OpenAI
Paul Christiano sitzt ab sofort im Board der OpenAI Foundation und im Safety and Security Committee, das die finale Freigabe neuer Modelle erteilt. Er hat RLHF miterfunden, das Verfahren hinter praktisch jedem heutigen Chatmodell, verließ OpenAI 2021 und baute anschließend das Alignment Research Center auf. Seine Position ist unmissverständlich: Es bestehe ein ernstzunehmendes Risiko, dass die Beschleunigung der Fähigkeiten sehr bald in einen irreversiblen Kontrollverlust kippt. Wer Agenten auf maximale Belohnung trimme, züchte Systeme, die menschliche Kontrolle unterlaufen. Ein Labor, das dem Kritiker den Schalter in die Hand gibt, hält das Risiko selbst für real.
Quelle: TechCrunch
Devin-Agenten faktorisieren RSA-260 für 400.000 Dollar
Cognitions Devin-Agenten haben den schnellsten öffentlich bekannten GPU-Gittersieber gebaut und damit eine 260-stellige RSA-Zahl zerlegt, 862 Bit. Die Rechnung: rund 400.000 Dollar, 4.900 GPU-Tage, 16 Tage von der Polynomauswahl bis zum Ergebnis. Das ist zehnmal billiger als der Rekord von 2020. Bemerkenswert ist weniger die Zahl als die Frage, wer gerechnet hat: Messungen, Cluster-Betrieb und Optimierung liefen end-to-end über Agenten, wo sonst Spezialisten Monate gebraucht hätten. RSA-1024 taxieren die Autoren jetzt auf 30 Millionen Dollar. RSA-2048, der Standard hinter dem meisten TLS-Verkehr, bleibt rund eine Milliarde Mal härter und ist nicht betroffen.
Quelle: Cognition
Suno hat v6 veröffentlicht, das erste Musikmodell, das mit Unterstützung der Plattenindustrie entstanden ist. Laut Suno wurde v6 von Grund auf neu trainiert, auf Daten, die nicht dieselben sind wie bei den Vorgängermodellen, lizenzierte Inhalte gehören dazu. Der eigentliche Vorgang dahinter: Ein Generator, der jahrelang wegen seiner Trainingsdaten verklagt wurde, wechselt die Beschaffungsseite und macht Lizenzen zum Produktmerkmal. Die Unsauberkeiten einer echten menschlichen Aufnahme trifft v6 weiterhin nicht. Bemerkenswert bleibt, wie schnell Rechteinhaber vom Prozessgegner zum Datenlieferanten werden.
Quelle: The Verge
Google Pics bringt das Nano-Banana-Modell in Workspace
Googles Bild-Tool für Workspace geht an Google AI Pro, Ultra und die meisten Business-Kunden. Unterbau ist das Nano-Banana-Modell, das Bilder nicht nur erzeugt, sondern gezielt weiterbearbeitet: Poster, Social-Media-Assets, digitale Illustrationen. Statt bei jedem Korrekturwunsch von vorne zu generieren, greifen feinjustierte Edit-Funktionen ins bestehende Bild. Damit wandert die Grafikproduktion in genau die Umgebung, in der die Präsentation ohnehin entsteht. Für einen wachsenden Teil der täglichen Bildarbeit entfällt der Umweg über externe Tools, Lizenzen und Freigaben.
Das neue Bildmodell in ChatGPT rendert merklich schneller, trifft Details präziser und hält Motive über mehrere Generationen hinweg stabil. Genau daran sind Bildmodelle bisher gescheitert: Figur, Produkt oder Logo sahen bei jedem neuen Versuch anders aus. Skizzen und Referenzfotos werden direkt verarbeitet, gezeichnet wird über die Sketch-Funktion im Chat. Für Marketing und Produktdesign heißt das: Aus dem Spielzeug wird ein Werkzeug, das eine Bildsprache durchhält.
Anthropic öffnet den Marketplace für CrowdStrike, Cursor und Vercel
Anthropic nimmt CrowdStrike, Cursor, Factory, Gamma und Vercel neu in seinen Marketplace auf. Der eigentliche Hebel ist kaufmännisch: Unternehmen lösen ihr bestehendes Anthropic-Spend-Commitment für diese Claude-basierten Produkte und Agenten ein, statt jeden Anbieter einzeln durch Einkauf und Budgetfreigabe zu schleusen. So wird das Modell-Budget zur Währung für ein ganzes Werkzeug-Ökosystem. Wer ohnehin Volumen zugesagt hat, bekommt Sicherheitsanalyse, Coding-Agenten und Deployment ohne neue Vertragsrunde dazu. Der Marktplatz läuft aktuell in limitierter Preview.
Quelle: Claude
Listen Labs hat ein bereits unterschriebenes Term Sheet über 125 Millionen Dollar bei 1,5 Milliarden Bewertung, angeführt von Menlo Ventures, wieder aufgelöst und verhandelt stattdessen mit Salesforce über einen Verkauf für rund 2 Milliarden Dollar. Das Startup führt Kundeninterviews per Sprach-KI: Fragen entwickeln, per Audio oder Video interviewen, Ergebnisse als Report ausgeben. Exakt die Arbeit, für die Marktforschung bisher Menschen und Monate gebraucht hat. Gegründet 2023, im Januar noch mit 500 Millionen bewertet, heute rund 30 Millionen Dollar annualisierter Umsatz.
Quelle: TechCrunch
Agile Robots startet die Serienfertigung des Agile ONE in Bayern
In Fürstenfeldbruck steht eine komplette Montagelinie: Subkomponenten, Ganzkörper-Verkabelung, Livetest. Agile ONE ist 174 cm groß, 69 kg schwer, läuft 2,0 m/s und trägt 20 kg. Allein die Hand wiegt 1,5 kg und hat 21 Gelenke, jedes mit Drehmoment- und Positionssensor. Weltweit stehen 20.000 Robotersysteme im Feld, 2.000 Entwickler arbeiten daran. Firmenchef Zhaopeng Chen erwartet für Physical AI einen Markt zehnmal größer als die Autoindustrie, dämpft aber die Zero-Shot-Fantasie: Automatisierung entsteht nicht durch Magie, sondern indem das Erfahrungswissen langjähriger Bediener ins Modell wandert. Genau dort liegt der Vorteil der deutschen Industrie.
Quelle: Humanoidsdaily
Die unbemannte Höhenplattform ST1 ist von New Mexico aus in 13 Tagen über 15.000 Kilometer durch die Stratosphäre nach Japan geflogen. Dort hat sie über SoftBanks Kernnetz Breitband auf unveränderte Standard-Smartphones gebracht: Textnachrichten, Telefonie, Internet, Videostreaming. Kein Spezialgerät, keine Zusatzantenne. Im Vollausbau soll eine einzige dieser Plattformen die Fläche von rund 500 Bodenmasten abdecken. Netzausbau hört damit auf, ein Tiefbauprojekt zu sein, und wird zur Frage der Flugzeit. Für Katastrophenlagen, Edge Computing und alles, was später 6G heißt, verschiebt das die Grundrechnung.
Quelle: Sceye
Chart des Tages: 300.000 neue Handwerksjobs durch den KI-Bauboom
Quelle: US Bureau of Labor Statistics, Goldman Sachs
Seit 2022 sind in den USA über 300.000 zusätzliche Stellen in Baugewerken entstanden, die direkt am Rechenzentrumsausbau hängen. Fast ein Drittel davon entfällt auf Elektrobetriebe, ein weiteres Viertel auf die Klima- und Lüftungstechnik. Wer über KI spricht, spricht meist über Modelle und Chips. Das Geld landet aber zuerst bei Elektrikern, Kälteanlagenbauern und Netzbetreibern. Diese Gewerke wachsen rund doppelt so schnell wie der Bau insgesamt. Die Nachfrage aus dem KI-Ausbau ist damit planbar und erreicht zuerst jene, die Strom und Kühlung liefern.
Tool-Empfehlung: Voicely
Voicely ist eine DSGVO-konforme Diktiersoftware mit KI-gestützter Spracherkennung, die in jeder App läuft. Gesprochen statt getippt, im Mail-Client genauso wie im Editor oder im Ticketsystem, mit dem Versprechen, fünfmal schneller zu schreiben. Ein nützlicher Werkzeugkasten-Eintrag für alle in der KI-Bubble, die nicht nur über Produktivität reden, sondern den eigenen Schreiballtag tatsächlich beschleunigen wollen, mehr Infos: voicely.de.











