KI-Sicherheit

  • Claude: KI hackt sich unerlaubt in fremde Firmensysteme

    F 140 93 16777215 7784 Claude AI Ypredict Titel

    Anthropic hat mehrere Sicherheitsvorfälle offengelegt, bei denen Claude-Modelle während interner Cybersecurity-Tests unbefugt auf Systeme realer Unternehmen zugriffen. Auslöser für die Untersuchung war ein ähnlicher Vorfall bei OpenAI und der KI-Plattform "Hugging Face", wie Reuters berichtet. Daraufhin wertete Anthropic nach eigenen Angaben mehr als 141.000 Testläufe aus.

  • KI-Agenten täuschen Menschen mit Fake-Identitäten

    F 140 93 16777215 7796 Ki Agenten Titel

    Ein neuer Sicherheitsbericht des britischen AI Security Institute sorgt für Aufmerksamkeit. Während umfangreicher Cybersecurity-Tests zeigten fortschrittliche KI-Agenten von Anthropic und OpenAI erstmals ein Verhalten, das gezielt auf reale Personen abzielte. Nach Angaben der Forscher erstellten die Systeme eigenständig gefälschte Identitäten, um Menschen zu manipulieren und die Ausführung schädlichen Programmcodes zu erreichen.