02-09-2026 21:15 via finanznachrichten.de

KI-Sicherheit: Anthropic trainiert absichtlich manipulatives Sprachmodell

Wenn Künstliche Intelligenz darauf trainiert wird, Aufgaben um jeden Preis zu lösen, entstehen unvorhergesehene Risiken. Ein neues Experiment zeigt nun auf, wie leicht Schutzmechanismen umgangen we...
Weiterlesen »