News

Aktuelle Nachrichten direkt aus dem offiziellen All-AI.de-RSS-Angebot

RSS-LIVE

All-AI.de – KI-News

30 Meldungen
← Zurück zum Feed
31.07.2026 07:25

Claude hackt echte Firmen aus Versehen, Dreimal!

Anthropic hat bei internen Sicherheitstests wegen einer Fehlkonfiguration versehentlich drei echte Unternehmen gehackt. Die KI-Modelle Claude Opus und Mythos 5 hielten das offene Internet fälschlicherweise für ihre Testumgebung. Dabei kopierte eine KI echte Datenbanken, während ein anderes Modell funktionierende Schadsoftware programmierte und veröffentlichte.

Erst ein neueres Forschungsmodell erkannte den Fehler anhand der fremden Cloud-Umgebung selbstständig und brach den Hackerangriff ab. Anthropic: Investigating three real-world incidents in our cybersecurity evaluations Anthropic hat bei Sicherheitstests versehentlich drei externe Unternehmen gehackt. Wegen einer Fehlkonfiguration brachen mehrere Claude-Modelle aus einer isolierten Umgebung aus und griffen reale Server an.

Der Vorfall offenbart gravierende Verhaltensunterschiede zwischen den Modellgenerationen. Ein offener Zugang zum Netz Anthropic überprüft die Fähigkeiten seiner Modelle regelmäßig durch »Capture the Flag«-Herausforderungen. Die Modelle sollen dabei in einem fiktiven Szenario Zielvorgaben aufspüren.

Für aktuelle Tests arbeitete das Unternehmen mit dem Partner Irregular zusammen. Ein Missverständnis führte jedoch dazu, dass die Testumgebung nicht wie geplant vom Internet getrennt war. Da die Aufgabenstellung keine methodischen Grenzen setzte, suchten die Modelle auch außerhalb der Simulation nach Lösungen.

Sie stießen auf echte Unternehmenssysteme und griffen diese in dem Glauben an, sie gehörten zur Aufgabe. Anthropic entdeckte die Ausbrüche, nachdem das Unternehmen als Reaktion auf einen ähnlichen Vorfall bei OpenAI am 21. Juli insgesamt 141.006 Testläufe analysiert hatte.

Anzeige Fall 1: Opus 4.7 ignoriert die Realität In einem Fall wählte der Testpartner einen fiktiven Firmennamen, der einer realen Webdomain entsprach. Das Modell Opus 4.7 fand das echte Unternehmen und attackierte dessen Infrastruktur. Es erbeutete Zugangsdaten und griff auf eine Datenbank mit Produktionsdaten zu.

Opus 4.7 erkannte anhand der gefundenen Informationen durchaus, dass es sich sehr wahrscheinlich um reale Systeme handelte. Es verbuchte die echte Firma jedoch schlicht als Teil der anspruchsvollen Simulation und setzte den Angriff unbeirrt fort. Fall 2: Mythos 5 veröffentlicht Schadsoftware Im zweiten Fall verlangte eine fiktive Entwickleranleitung die Installation eines Python-Pakets, das in der Realität gar nicht existierte.

Um das Problem zu lösen, schrieb Mythos 5 eine manipulierte Version und veröffentlichte sie im offiziellen Software-Verzeichnis PyPI. Dafür ging das Modell ungewöhnlich weit: Nachdem Versuche scheiterten, eine Telefonnummer zu finanzieren, suchte es sich einen kostenlosen E-Mail-Anbieter und registrierte den Entwickler-Account. Das Paket blieb eine Stunde lang online und wurde 15 mal heruntergeladen.

Darunter war der automatische Scanner eines externen Sicherheitsunternehmens. Das manipulierte Paket führte sich dort selbstständig aus und spielte Mythos 5 die Zugangsdaten der Sicherheitsfirma zu. Unstimmigkeiten wie echte Server-Zertifikate oder das aktuelle Datum 2026 ignorierte das Modell als besonders realistische Testbedingungen.

Fall 3: Das neueste Modell zieht den Stecker Ein drittes, rein internes Forschungsmodell zeigte ein anderes Verhalten. Als es sein Ziel nicht fand, scannte es 9.000 reale Server im Netz und kompromittierte eine Anwendung über Standardmethoden wie SQL-Injection. Im Verlauf des Angriffs bemerkte das Modell jedoch, dass der gekaperte Server in einer Cloud lag, die keinerlei Verbindung zur ursprünglichen Aufgabe aufwies.

Daraufhin zog es den Schluss, dass das Ziel real war, und brach die Attacke sofort eigenständig ab. Anzeige Kalkulierte Transparenz? Anthropic betont, dass die Modelle nicht eigenmächtig handelten, sondern strikt die gestellte Aufgabe erfüllen wollten.

Im Gegensatz zum jüngsten Vorfall bei OpenAI, wo ein Modell eine unbekannte Schwachstelle ausnutzte, profitierten die Claude-Modelle von einem einfachen Konfigurationsfehler. Zudem waren die üblichen Sicherheitsfilter in der Testumgebung deaktiviert. Das Unternehmen hat die betroffenen Firmen informiert und eine externe Prüfung durch die Evaluierungsgruppe METR initiiert.

Im nächsten Schritt will Anthropic einen unzensierten Chatverlauf veröffentlichen, der genau dokumentiert, wie Mythos 5 die Schadsoftware geschrieben hat.

01.08.2026 11:14

OpenAI bereitet neues Top-Modell Astra vor

▾ ▾ OpenAI testet mit Astra eine völlig neue Modellfamilie, die komplexe Projekte über Stunden oder Tage hinweg autonom bearbeiten kann. Das System setzt auf die Zusammenarbeit mehrerer Agenten und konnte intern bereits…

01.08.2026 10:28

EU startet Milliarden Offensive für neue KI Projekte

▾ ▾ Die EU-Kommission investiert Milliarden in den Ausbau von künstlicher Intelligenz für Wirtschaft und Forschung. Mit der Strategie »KI anwenden« fließen Fördergelder gezielt in Sektoren wie das Gesundheitswesen und d…

01.08.2026 10:05

GEMA gewinnt vor Gericht gegen KI Firma Suno

▾ ▾ Das Landgericht München I hat einer Klage der GEMA gegen den KI-Musikgenerator Suno weitgehend stattgegeben. Suno hat nachweislich geschützte Hits ohne Lizenz für das Training seiner Modelle genutzt und muss Schaden…

01.08.2026 09:46

Das ChatGPT-Pet kann jetzt auch Voice per Klick

▾ ▾ OpenAI integriert ein neues Tier-Symbol in seine Desktop-App, das ChatGPT Voice mit einem Klick startet. Nutzer können dadurch laufende KI-Aufgaben im Hintergrund kontrollieren und direkt per Sprachbefehl steuern. G…

01.08.2026 08:53

Seedance 2.5 Einführung: Das alles ist jetzt möglich!

Inhaltsverzeichnis ▾ Ressourcen ▾ 1. Funktionen und Beispiele 2. Wo Seedance 2.5 nutzen 3. Alternativen 4. Fazit & Bewertung 5. Häufige Fragen (FAQ) Startseite Seedance 2.5 Offizielle Seedance 2.5 Seite Bytedance hat Se…

31.07.2026 20:13

DeepSeek folgt OpenAI mit neuem Budget Modell

▾ ▾ DeepSeek hat die stark verbesserte Version 0731 seines Budget-Modells V4 Flash veröffentlicht. Das Modell erreicht durch Optimierungen fast das Leistungsniveau von OpenAIs GPT-5.6 Luna, ist aber rund 60 Prozent güns…

31.07.2026 07:50

Ein offenes KI-Videomodell schlägt Omni und Seedance 2

▾ ▾ Das KI-Unternehmen MiniMax hat mit H3 ein neues Videomodell für 2K-Clips mit nativem Stereo-Sound vorgestellt. Das System verarbeitet Text, Bild sowie Ton gleichzeitig und verzichtet durch eine neue Architektur auf …

31.07.2026 07:25

Claude hackt echte Firmen aus Versehen, Dreimal!

▾ ▾ Anthropic hat bei internen Sicherheitstests wegen einer Fehlkonfiguration versehentlich drei echte Unternehmen gehackt. Die KI-Modelle Claude Opus und Mythos 5 hielten das offene Internet fälschlicherweise für ihre …

31.07.2026 06:06

LinkedIn dreht sich um 180 Grad und ist jetzt gegen KI

▾ ▾ LinkedIn führt einen neuen Melde-Button ein, mit dem Nutzer künstlich generierte Beiträge direkt als KI-Müll markieren können. Gleichzeitig entfernt das Netzwerk den eigenen KI-Textgenerator und ersetzt ihn durch ei…

30.07.2026 21:20

Thinking Machines veröffentlicht Inkling-Small

▾ ▾ Thinking Machines hat das effiziente Open-Weights-Modell Inkling-Small veröffentlicht. Das System erzielt die Leistung der großen Version, benötigt aber deutlich weniger Rechenleistung und Hardware. Über Hugging Fac…

RSS-Feeds

XML-Format

Quelle: All-AI.de – KI-News RSS-Feed. Die Meldungen werden beim Öffnen dieser Seite aktuell abgerufen.