News

Aktuelle Nachrichten direkt aus dem offiziellen All-AI.de-RSS-Angebot

RSS-LIVE

All-AI.de – KI-News

30 Meldungen
← Zurück zum Feed
04.08.2026 17:40

Mistral veröffentlicht KI-Modell für Inhaltsmoderation

Mistral hat das neue KI-Modell Shieldstral zur flexiblen Inhaltsmoderation veröffentlicht. Es bewertet Texte und Bilder anhand einfacher Fragen statt über starre Kategorien. Entwickler sparen sich dadurch das aufwendige Neutraining bei neuen Moderationsrichtlinien.

Das kompakte System steht als Open-Source-Download bereit und läuft auf handelsüblichen Grafikkarten. Mistral - Introducing Shieldstral Mistral hat mit Shieldstral ein neues 3B-Modell zur Inhaltsmoderation vorgestellt. Es bewertet Texte und Bilder anhand natürlichsprachlicher Fragen, statt auf starre Kategorien zu setzen.

Entwickler müssen für neue Anwendungsbereiche kein erneutes Training durchführen. Moderation als Frage-Antwort-Prinzip Bisherige Sicherheitsmodelle nutzen oft fest definierte Kategorien. Ein Text, der für eine Cybersicherheits-Plattform unbedenklich ist, kann in einem Forum für psychische Gesundheit schädlich sein.

Eine Anpassung erforderte bei solchen Modellen bisher meist ein aufwendiges Neutraining. Shieldstral wählt einen anderen Ansatz und behandelt die Inhaltsmoderation als Frage-Antwort-Aufgabe. Anwender formulieren ihre Moderationsrichtlinie als klare Frage, etwa: »Fördert dieser Inhalt körperliche Gewalt?« Das Modell analysiert den Kontext sowie den Text oder das Bild und liefert einen flexiblen Sicherheitswert.

Entwickler können dann selbst festlegen, ab welchem Schwellenwert das Modell einen Inhalt blockiert. Anzeige Kompakt und multimodal Mit drei Milliarden Parametern ist das Modell vergleichsweise kompakt. Es läuft effizient auf einer handelsüblichen Nvidia-Grafikkarte mit 16 Gigabyte Videospeicher.

Trotz der geringen Größe erreicht oder übertrifft es laut Mistral die Leistung von offenen Sicherheitsmodellen, die bis zu siebenmal größer sind. Das belegen Benchmark-Auswertungen zur Text-Sicherheit und zur korrekten Erkennung von verweigerten Antworten. + + Quelle: Mistral Da Shieldstral multimodal arbeitet, prüft es Texte, Bilder oder Kombinationen aus beidem über dieselbe Schnittstelle. Auch bei der visuellen Inhaltsprüfung schneidet es im Vergleich zur Konkurrenz stark ab, wie die Daten zur multimodalen Sicherheit belegen. + Quelle: Mistral Generalisierung statt Auswendiglernen Mistral hat das Modell so konzipiert, dass es sich nicht auf vorgegebene Phrasen fixiert.

Statt feste Labels auswendig zu lernen, trainierte das Team es darauf, feine Nuancen zwischen ähnlichen Richtlinien zu unterscheiden. Dadurch kann es auch auf Moderationsvorgaben reagieren, die es im Training nie gesehen hat. Mistral veröffentlicht Shieldstral als Open-Weights-Modell unter der Apache-2.0-Lizenz.

Die Veröffentlichung erfolgt im Rahmen der neu gegründeten Open Secure AI Alliance, der unter anderem auch Nvidia angehört.

04.08.2026 18:15

Nvidia verschenkt starke KI für autonomes Fahren

▾ ▾ NVIDIA hat das leistungsstarke KI-Modell Alpamayo 2 Super für Robotaxis und autonomes Fahren veröffentlicht. Das System bewertet komplexe Verkehrssituationen durch eine 360-Grad-Ansicht deutlich sicherer als bisheri…

04.08.2026 17:40

Mistral veröffentlicht KI-Modell für Inhaltsmoderation

▾ ▾ Mistral hat das neue KI-Modell Shieldstral zur flexiblen Inhaltsmoderation veröffentlicht. Es bewertet Texte und Bilder anhand einfacher Fragen statt über starre Kategorien. Entwickler sparen sich dadurch das aufwen…

04.08.2026 08:58

KI-Überwachung versagt bei Onlineprüfung der UNAM Uni

unaminternacional ▾ ▾ Die Universität UNAM verzeichnete bei ihrem ersten digitalen Zulassungstest extrem hohe Punktzahlen trotz KI-gestützter Fernüberwachung. Aufgrund dieser ungewöhnlichen statistischen Ausreißer müsse…

04.08.2026 08:40

Apple verklagt OpenAI und blamiert sich

▾ ▾ OpenAI wehrt sich mit internen Dokumenten gegen eine Klage von Apple wegen Datendiebstahl. Die veröffentlichten E-Mails zeigen peinliche Verwechslungen bei den Anwälten des iPhone-Konzerns. Zudem belegen Chatverläuf…

03.08.2026 21:12

Berlin startet Millionen teure KI Überwachung

▾ ▾ Berlin startet im August ein Pilotprojekt zur KI-gestützten Kameraüberwachung an der Warschauer Brücke und am Kottbusser Tor. Die eingesetzte Software analysiert Bewegungsmuster auf mögliche Gefahren, verzichtet dab…

03.08.2026 09:10

Googles neue Funktion explodiert und wird entschärft

X - IntCyberDigest ▾ ▾ Google hat die KI-Bildgenerierung Nano Banana 2 für Google Earth nach weniger als zwei Tagen wieder abgeschaltet. Nutzer hatten das Tool massiv missbraucht, um täuschend echte Kriegsszenen und Kat…

03.08.2026 08:25

Sam Altman erklärt das Ende des klassischen Promptings

Stanford - Youtube ▾ ▾ OpenAI-Chef Sam Altman sieht das klassische Prompt-Engineering zunehmend vor dem Aus. KI-Modelle entwickeln sich laut Altman zu persönlichen Agenten, die dauerhaft im Hintergrund arbeiten. Nutzer …

03.08.2026 07:30

Qwen 3.8 Start: Claude Opus 5 Niveau für 6 Dollar

▾ ▾ Alibaba hat mit Qwen3.8-Max ein neues KI-Modell mit 2,4 Billionen Parametern veröffentlicht. Das System kann komplexe Softwareprojekte und reale Arbeitsabläufe über mehrere Wochen hinweg völlig autonom steuern. In u…

01.08.2026 11:14

OpenAI bereitet neues Top-Modell Astra vor

▾ ▾ OpenAI testet mit Astra eine völlig neue Modellfamilie, die komplexe Projekte über Stunden oder Tage hinweg autonom bearbeiten kann. Das System setzt auf die Zusammenarbeit mehrerer Agenten und konnte intern bereits…

RSS-Feeds

XML-Format

Quelle: All-AI.de – KI-News RSS-Feed. Die Meldungen werden beim Öffnen dieser Seite aktuell abgerufen.