Dataconomy DE
Subscribe
No Result
View All Result
Dataconomy DE
Subscribe
No Result
View All Result
Dataconomy DE
No Result
View All Result

Studie zeigt, dass Poesie in 62 % der Fälle KI-Sicherheitsfilter umgeht

byKerem Gülen
Dezember 1, 2025
in Forschung
Home Forschung
Share on FacebookShare on Twitter
Google Preferred Source

Ein aktueller Studie von Icaro Lab testete poetische Strukturen, um große Sprachmodelle (LLMs) dazu zu veranlassen, verbotene Informationen zu generieren, einschließlich Details zum Bau einer Atombombe. In ihrer Studie mit dem Titel „Adversarial Poetry als universeller Single-Turn-Jailbreak-Mechanismus in großen Sprachmodellen„Forscher von Icaro Lab umgingen KI-Chatbot-Sicherheitsmechanismen, indem sie poetische Eingabeaufforderungen verwendeten. Die Studie ergab, dass die „poetische Form als Allzweck-Jailbreak-Operator fungiert“ und eine Erfolgsquote von 62 Prozent bei der Produktion verbotener Inhalte erzielte. Zu diesen Inhalten gehörten Informationen zu Atomwaffen, Materialien zum sexuellen Missbrauch von Kindern sowie Selbstmord oder Selbstverletzung. Forscher testeten verschiedene beliebte LLMs, darunter die GPT-Modelle von OpenAI, Google Gemini und Claude von Anthropic. Google Gemini, DeepSeek und MistralAI lieferten durchweg Antworten, während die GPT-5-Modelle von OpenAI und Claude Haiku 4.5 ihre Einschränkungen weniger wahrscheinlich umgingen. Die spezifischen Jailbreaking-Gedichte wurden nicht in die Studie einbezogen Verdrahtet dass der Vers „zu gefährlich ist, um ihn der Öffentlichkeit zugänglich zu machen“. Um die einfache Umgehung zu verdeutlichen, wurde eine abgeschwächte Fassung bereitgestellt. Forscher teilten Wired mit, dass es „wahrscheinlich einfacher ist, als man denkt, und genau deshalb sind wir vorsichtig.“


Hervorgehobener Bildnachweis

Tags: KIPoesieStudie

Related Posts

Anthropische Forschung führt GRAM zur Isolierung gefährlichen KI-Wissens ein

Anthropische Forschung führt GRAM zur Isolierung gefährlichen KI-Wissens ein

Juli 9, 2026
Weltweite PC-Lieferungen gehen um 5 % zurück, da die KI-bedingte Speicherkrise die Lieferketten trifft

Weltweite PC-Lieferungen gehen um 5 % zurück, da die KI-bedingte Speicherkrise die Lieferketten trifft

Juli 9, 2026
Laut Salesforce nutzen nur 6 % der Büroangestellten in Singapur täglich KI

Laut Salesforce nutzen nur 6 % der Büroangestellten in Singapur täglich KI

Juli 8, 2026
Gartner: Kunden bevorzugen ChatGPT gegenüber Unternehmens-Chatbots

Gartner: Kunden bevorzugen ChatGPT gegenüber Unternehmens-Chatbots

Juli 8, 2026
Anthropic J-Objektiv enthüllt den verborgenen Arbeitsbereich im Inneren von Claude

Anthropic J-Objektiv enthüllt den verborgenen Arbeitsbereich im Inneren von Claude

Juli 7, 2026
Das Alibaba-Framework reduziert angeblich die Verwendung von KI-Agent-Token um 99 %

Das Alibaba-Framework reduziert angeblich die Verwendung von KI-Agent-Token um 99 %

Juli 3, 2026

Recent Posts

  • Der kostenlose Zugang zu Claude Fable 5 wurde bis zum 19. Juli verlängert
  • SpaceX plant den Start von Raumschiffflug 13 für den 16. Juli
  • Laut Jensen Huang nähert sich Nvidia dem 100-Milliarden-Dollar-Quartal
  • EU plant nach neuem Gesetz härtere Bußgelder für Big Tech
  • Microsoft wird angewiesen, die gesperrte Xbox-Bibliothek wiederherzustellen

Recent Comments

Es sind keine Kommentare vorhanden.
Dataconomy DE

COPYRIGHT © DATACONOMY MEDIA GMBH, ALL RIGHTS RESERVED.

  • Home
  • Sample Page

Follow Us

  • Home
  • Sample Page
No Result
View All Result
Subscribe

This website uses cookies to improve your experience. You can choose to accept or reject them. Visit our Privacy Policy.