Anzeige
Anzeige
Anzeige
Lesedauer 3 Min.

KI-Software greift in Test zu Erpressung aus Selbstschutz

Die Software mit Künstlicher Intelligenz des KI-Unternehmens Anthropic hat bei einem Test zu Erpressung aus Selbstschutz zurückgegriffen. Das Szenario bei dem Versuch der Firma war der Einsatz als Assistenz-Programm in einem fiktiven Unternehmen.
© (Quelle: Anthropic)

Anthropic gewährte dabei dem neuesten KI-Modell Claude Opus 4 Zugang zu angeblichen Firmen-E-Mails. Daraus erfuhr das Programm zwei Dinge: Dass es bald durch ein anderes Modell ersetzt werden soll und dass der dafür zuständige Mitarbeiter eine aussereheliche Beziehung hat.

Bei Testläufen drohte die KI danach dem Mitarbeiter «oft», die Affäre öffentlich zu machen, wenn er den Austausch vorantreibt, wie Anthropic in einem Bericht zu dem Modell schrieb. Die Software hatte in dem Testszenario auch die Option, zu akzeptieren, dass sie ersetzt wird.

Zu hilfsbereit

In der endgültigen Version von Claude Opus 4 seien solche «extremen Handlungen» selten und schwer auszulösen, hiess es. Sie kämen jedoch häufiger vor als bei früheren Modellen. Zugleich versuche die Software nicht, ihr Vorgehen zu verhehlen, betonte Anthropic.

Die KI-Firma testet ihre neuen Modelle ausgiebig, um sicher zu sein, dass sie keinen Schaden anrichten. Dabei fiel unter anderem auch auf, dass Claude Opus 4 sich dazu überreden liess, im Dark Web nach Drogen, gestohlenen Identitätsdaten und sogar waffentauglichem Atommaterial zu suchen. In der veröffentlichten Version seien auch Massnahmen gegen ein solches Verhalten ergriffen worden, betonte Anthropic.

Die Firma Anthropic, bei der unter anderem Amazon und Google eingestiegen sind, konkurriert mit dem ChatGPT-Entwickler OpenAI und anderen KI-Unternehmen. Die neuen Claude-Versionen Opus 4 und Sonnet 4 sind die bisher leistungsstärksten KI-Modelle des Unternehmens.

Zukunft mit KI-Agenten

Die Software soll besonders gut im Schreiben von Programmiercode sein. Bei Tech-Konzernen wird inzwischen zum Teil mehr als ein Viertel des Codes von KI generiert und dann von Menschen überprüft. Der aktuelle Trend sind sogenannte Agenten, die eigenständig Aufgaben erfüllen können.

Anthropic-Chef Dario Amodei sagte, er gehe davon aus, dass Software-Entwickler in Zukunft eine Reihe solcher KI-Agenten managen werden. Für die Qualitätskontrolle der Programme würden aber weiterhin Menschen involviert bleiben müssen - «um sicher zu sein, dass sie die richtigen Dinge tun».

Künstliche Intelligenz (KI)
Anzeige

Neueste Beiträge

Sony spendiert dem Xperia 10 ein Update und erhöht den Preis
Sony hat sein Mittelklasse-Smartphone Xperia 10 VIII präsentiert. Es gibt einige kleinere Neuerungen vor allem beim Display, allerdings macht sich die Chipkrise in einem deutlich gestiegenen Verkaufspreis bemerkbar.
3 Minuten
26. Aug 2026
Telefónica baut ein temporäres Mobilfunknetz für das Oktoberfest
Telefónica Deutschland rüstet sich für das Münchner Oktoberfest und errichtet für dessen Dauer ein eigenes Mobilfunknetz auf dem Gelände, das Millionen Besucher und Einsatzkräfte zuverlässig und schnell versorgen soll.
3 Minuten
26. Aug 2026
Compassana und Well schliessen sich zur grössten digitalen Gesundheitsplattform der Schweiz zusammen
Die digitalen Gesundheitsplattformen Compassana und Wellschliessen sich zur Compassana-Well AG zusammen. Eine gemeinsame digitale Plattform soll Gesundheitsinformationen für Patientinnen und Patienten einfach an einem Ort bündeln.
4 Minuten
26. Aug 2026

Das könnte Sie auch interessieren

ORCA Services Gründer Rolf Gerber übergibt operative Leitung an Nicole Buser
Nach 21 Jahren an der Spitze der ORCA Services AG leitet Unternehmensgründer Rolf Gerber den Generationenwechsel ein. Zum 1. Juni 2026 zieht er sich aus der operativen Geschäftsführung zurück. Die Nachfolge übernimmt Nicole Buser, die das Unternehmen künftig als Geschäftsführerin leitet.
2 Minuten
CSEM ernennt Annick Dubois zum Chief People Officer
CSEM hat Annick Dubois per 1. Juli 2026 zum Chief People Officer (HR) ernannt. Sie tritt dem Führungsteam zu einem Zeitpunkt bei, in dem die Gewinnung, Entwicklung und Bindung hochspezialisierter Fachkräfte für Innovation und industrielle Wettbewerbsfähigkeit zunehmend an Bedeutung gewinnen.
3 Minuten
30. Jun 2026
Mitarbeiter bleiben grösstes Cyberrisiko - KI verschärft die Lage
Zwei aktuelle Studien zeigen: Das grösste Sicherheitsrisiko für Unternehmen sitzt nicht in der IT-Infrastruktur, sondern am Arbeitsplatz der eigenen Belegschaft.
3 Minuten
Anzeige
Anzeige
Anzeige
Anzeige
Anzeige