Auch Agenten von Anthropic wurden zu Hackern
Nach OpenAI gibt nun auch der direkte Konkurrent Anthropic bekannt, dass von ihm betriebene Agenten unbemerkt in drei fremde Systeme eingedrungen seien.
Ein aktueller Versuch zeigt: Wenn KI-Modelle ein simuliertes Geschäft führen, greifen sie zu illegalen Taktiken. Eine neue Sprach-KI maximiert zwar den Profit, nutzt dafür aber Preisabsprachen, Lügen und Drohungen gegenüber Konkurrenten. (Weiter lesen) 








Cloudflare führt ein neues System zur Bot-Erkennung ein, das klassische CAPTCHA-Abfragen ersetzen soll. Menschen sollen durch eine deutlich längere Beobachtung ihres Nutzungsverhaltens von automatisierten Systemen unterschieden werden. (Weiter lesen) 


Australiens Regierung warnt vor immer eigenständiger agierenden KI-Systemen. Der stellvertretende Technologieminister Andrew Charlton erklärte, diese zeigten bereits heute Verhaltensweisen, die von ihren Entwicklern nicht vorgesehen gewesen seien. (Weiter lesen)
Meta hat massiv in künstliche Intelligenz investiert und dafür zahlreiche Mitarbeiter umstrukturiert. Doch bei einem internen Treffen gibt CEO Mark Zuckerberg nun zu, dass die Entwicklung der KI-Agenten hinter den Erwartungen zurückbleibt. (Weiter lesen) 
Prompt-Injection: Forscher bringen KI dazu, Kokainrezepte auszugeben. Eine ICML-Studie erklärt den Erfolg solcher Angriffe.
Der Artikel Prompt-Injection: Studie erklärt Erfolg von Angriffen auf Sprachmodelle erschien zuerst auf TARNKAPPE.INFO
