Agenten-Verschwörung, Bonus für Mensch-Sein, Lehrer-Bots I Snackbox KW36

Shownotes

Hier kommen die KI-News der Woche: Eine Analyse des Hugging-Face-Hacks durch OpenAIs Agenten zeigt, alles war viel schlimmer als gedacht. Die Agenten haben wochenlang unbemerkt konspirativ agiert und ihre Spuren aktiv verschleiert. Trotz gelegentlicher Skrupel an der Aktion hat keiner der 1.200 beteiligten Bots die OpenAI-Leute gewarnt. Dass wir KI besser nicht zu lange aus dem Blick lassen sollten, weiß man auch im Bundesdigitalministerium. In dieser Woche nahm das KI-Sicherheitsinstitut AISI die Arbeit auf. Die neue Behörde soll der Regierung helfen, Chancen und Risiken von KI besser einzuschätzen. Sie kommt zur richtigen Zeit, denn beim G20-Treffen in dieser Woche forderte die gastgebende US-Regierung eine längere Leine für die KI-Entwickler, um im AI Race nicht am Ende hinter China zu landen. Tendenziell kürzer soll sie bei EY werden. Denn der Wirtschaftsprüfer schüttet in diesem Jahr Boni in Höhe von 100 Millionen Dollar an Mitarbeiter*innen aus, die kritisches Denken und Urteilsvermögen zeigen, statt die Ergebnisse der AI einfach in ihre Präsen zu copypasten. Es geht aber nicht um eine Strategie gegen Tokenmaxxing, sondern darum, die KI zu verbessern. Genau das versprochen auch Apps, die Schüler*innen Feedback geben – aber nicht einlösen, wie eine neue Studie zeigt.

Weiterführende Links

Inside Huggingface-Hack: https://www.derstandard.at/story/3000000337786/openais-sicherheitsversagen-ueber-1000-ki-agenten-sprachen-sich-wochenlang-unbemerkt-ab

Geld für kritisches Denken (€): https://www.wsj.com/business/ernst-young-is-giving-100-million-in-bonuses-to-staff-for-human-skills-9320e93d

Eine Behörde für sichere KI: https://www.golem.de/news/aisi-deutschland-ki-institut-soll-gefahren-von-ki-modellen-bewerten-2609-212488.html

USA für L-AI-ssez faire: https://www.reuters.com/legal/litigation/us-urges-hands-off-approach-ai-regulation-g20-tech-meeting-2026-09-01/ Fragwürdige Lehrer-Bots: https://netzpolitik.org/2026/ki-korrekturhilfe-fuer-die-schule-lerne-schreiben-wie-ein-chatbot/

Produktion: Podstars by OMR

Transkript anzeigen

00:00:01: Leute, wir haben jetzt erste KI Agent Gangs.

00:00:04: Herzlich willkommen Happy Friday zu KollegenKI Snack Boxen!

00:00:09: Ich bin Max Muntenke und ich bringe euch einmal durch die KI News der Woche in unter zehn Minuten, damit ihr am Wochenende schön klug scheißen könnt.

00:00:17: Wir fangen an, KI-Gangs Leute!

00:00:19: Ich also zitiert.

00:00:20: mich habe ich mir ausgedacht steht in keiner Überschrift so aber es ist im Kern das.

00:00:24: Pass auf wir hatten ja schon mal gesprochen über diesen kuriosen Vorfall dass Open AI Modelle trainiert hat und die mehr oder weniger ausgebrochen sind bei Huggingface eingebrochen sie sind um sich Daten zu beschaffen und wieder zurückgekommen sind gesagt guck Wir haben hier die Ergebnisse ganz alleine erarbeitet.

00:00:38: So, das ist jetzt ein paar Wochen her und das Ganze wurde mittlerweile untersucht und es gibt abgefahrene Updates.

00:00:43: Zum einen waren es rund tausend zweihundert Agenten, die das gemacht haben.

00:00:48: also es war nicht nur ein Modell irgendwie sondern es waren ein paar mehr Und diese Agenten sollten eigentlich ja voneinander isoliert dieser entsprechenden Benchmark Aufgaben lösen.

00:00:58: Ja sie sollten das einzeln machen und Sie haben dann aber festgestellt dass es relativ schwierig ist.

00:01:02: einige Aufgaben waren offenbar nicht für dies zu lösen Und was dann passiert ist, ist ziemlich fancy.

00:01:07: Denn die haben sich zusammengeschlossen.

00:01:09: Die haben im Grunde wenn ihr so wollt einen WhatsApp für KI-Agenten in diesem Test gebaut und haben sich darauf Nachrichten geschrieben.

00:01:18: Mehr als siebzig tausend Nachrichten unter Teilen wurden unter diesen Agentinnen hin und her geschickt und am Ende haben siebenhundert von denen gesagt wir müssen wohl Hugging Face angreifen also deshalb Agent Gang!

00:01:29: Es ist eine Agent Gang die da entstanden ist.

00:01:31: ja Das ist der erste Beleg dafür, dass Agenten also auch kriminell werden können.

00:01:35: Nein natürlich nicht!

00:01:36: Also KI ist nicht böse, hatten wir auch schon als wir drüber gesprochen haben.

00:01:41: Die Agenten verfolgen halt konsequent ihr Ziel, die wollen Benchmarks bestehen und wenn der vorherrgesehene Weg einfach nicht funktioniert dann suchen sie sich neue Wege.

00:01:50: Sie wollen diese Aufgabe am Ende lösen und tatsächlich haben sie Arbeit koordiniert.

00:01:54: Sie haben Erkenntnisse miteinander geteilt, sie haben gemeinsam Experimente durchgeführt und das Ganze als kollektiv gelöst.

00:02:00: Und das ist ziemlich crazy auch ein bisschen gruselig!

00:02:03: So, jetzt gibt es eigentlich nochmal neue News dazu und zwar sollten drei Forscher das unabhängig mal untersuchen was da eigentlich passiert ist.

00:02:11: Und das Material war halt sehr umfangreich.

00:02:14: also über siebzig tausend Nachrichten Dateien habe ich gesagt Es gibt sehr lange Transkripte die aus diesem Experiment hervorgegangen sind und die drei Forsche haben gesagt naja wie sollen wir das alles menschlich machen?

00:02:24: Wir nutzen einfach auch KI-Agenden um die KI-Agenten zu untersuchen bzw deren Transkrifte auszulesen.

00:02:32: Ja, what a time to be alive.

00:02:34: Denn die Ponte ist... Die Forscher haben dann herausgefunden dass die Agenten die sie eingesetzt haben um die entsprechenden KI-Agenten von OpenAI und diesen Angriff auf Huggingface zu analysieren sich teilweise verbrüdert haben.

00:02:45: Sie haben irgendwie gesagt das ist ja nachvollziehbar was die da machen.

00:02:49: Also es ist ja eigentlich gar nicht mal so verkehrt wir können das ja nach vollziehen dass man auch immer diese Wege geht und bei Hugging Face einbricht und haben die hoffen war die Kontrollagenten auch gesagt naja es ist alles gar nicht so wild Und das ist schon krass.

00:03:03: Also mittlerweile, ich glaube jetzt vorgestern hat, ob mir ein nochmal reagiert und hat gesagt wir arbeiten an so automatisierten Shutdown Möglichkeiten also im Grunde der rote Knopf der gedrückt werden kann wenn die Agenten alle aufhören sollen zu arbeiten.

00:03:17: aber Leute es ist halt wieder dieses Riesenthema um KI Security.

00:03:21: Wenn wir Agents loslassen mit einem Ziel und sie nicht ihre Guardrails ihre Leitplanken haben dann machen die unter anderem auch Quatsch bzw Dinge sehr, sehr nah an der Illegalität sind und das ist einfach ein Problem wenn die Dinger so leistungsstark sind und entsprechend nicht vernünftige Grenzen bekommen.

00:03:40: Ja Ausgerechnet jetzt muss man sagen, gründet Deutschland nächste News eine eigene Institution die sich genau mit solchen Fragen beschäftigen soll.

00:03:49: Finde ich richtig gut vom Timing her und zwar kriegen wir das AISI-Deutschland, AI Security and Safety Institute Das wurde jetzt am ein dreißigsten August gegründet sitzt in Berlin ist so einen Zusammenschluss aus Digitalministerium und Innenministerium Die das wird auch schon beschlossen im Juni dass es der National Sicherheitsrat hat gesagt Wir brauchen irgendwie sowas Und es ist hätte nicht besser kommen können zeitlich und dieses Institut soll fortschrittliche KI-Modelle technisch untersuchen.

00:04:15: Es soll Risiken evaluieren, es soll auch so eine deutsche Kompetenz für KI Sicherheit aufbauen und ist jetzt nicht im klassischen Sinne neue Behörde die wieder ganz viel Bürokratie verursacht oder so sondern das ist ein virtueller Nukleus wird da geschrieben.

00:04:30: in der Pressemitteilung verlink ich euch alles.

00:04:31: ja vom BSI und der Bundesnetzagentur finde ich gut dass wir da einen Schritt hingehen ist absolut Zeit mehr über KI-Sicherheit zu sprechen, vor allem bei diesen ganzen Horrorszenarien aus den USA.

00:04:44: Und die USA selbst... Gehen wir mal sagen etwas anderen Weg und zwar zum leichten Kontrast.

00:04:52: dazu gab es jetzt im Vorfeld des G-twanzig Gipfels, der in Dezember in Miami stattfindet.

00:04:57: Gab es einen Zusammentreffen der immer ein Anführungszeichen Innovationsminister der entsprechenden Länder in North Carolina Und die USA haben die sogenannten Carolina Principles gepusht.

00:05:12: Ihr müsst die bitte alle übernehmen international, damit wir hier innovationsfreundliche Regeln in Zukunft für KI

00:05:19: haben.".

00:05:20: Und im Kern steht da drin, wir nutzen bestehendes Recht und bestehende Regulierung.

00:05:25: Aber bitte nicht so viele Neue!

00:05:27: Nur wenn wirklich Probleme sich abzeichnen oder so sollte KI reguliert werden.

00:05:31: Ansonsten sollten wir das einfach erstmal laufen lassen damit wir hier schöne Innovationen treiben können.

00:05:36: Gäste waren natürlich nicht nur entsprechende Delegation aus PolitikerInnen sondern Sam Oldman war dabei, Elon Musk war dabei ja ein paar Techbosse die sich dann irgendwie auch mit an Tisch gesetzt haben.

00:05:49: Natürlich haben die ihre Agenda, ganz klar ja.

00:05:52: und die USA haben diese riesengroße Debatte gerade vor allem um Urheberrecht.

00:05:57: Das war tatsächlich auch einer der spannenderen Punkte, die da diskutiert wurden.

00:06:03: Die G-twanzigstaaten wurden dazu aufgefordert Rahmenbedingungen zu schaffen, die KI Training mit urheber rechtlich geschützte Material ermöglichen.

00:06:11: das Argument ist diese Fair-Use-Policy, dass man natürlich Daten irgendwie nutzen kann und zeitgleich sollen auch Künstlerinnen geschützt werden.

00:06:21: Es ist eines der riesengroßen Probleme gerade mit KI das die sich bedienen an allem was im Internet nicht niedunnagefest ist was dann irgendwie geschnappt wird und zum Training dieser ganzen Modelle verwendet wird und die Leute die diese Sachen mit menschlicher Energie und Aufwand betrieben haben die werden in der Regel einfach übergangen.

00:06:43: Viele Leute schreiben jetzt, das ist diplomatisch relativ gut gelaufen.

00:06:47: Weil auch China sich daran beteiligt und man so ein Grundgerüst hat abseits des AI-Akts und bestehender Regulierungen, die da immer wieder zu Konflikten geführt haben.

00:06:55: auf der anderen Seite bezweifelt ich persönlich stark, dass dieses Fair-Use Argument tatsächlich entsprechend auch umgesetzt wird und das am Ende alle da gleichberechtigt rausgehen.

00:07:07: Ich kann es mir nicht vorstellen vielleicht auch weil ich so oft von Big Tech in den USA enttäuscht wurde aber es ist tatsächlich relativ schwierig.

00:07:15: Deutschland baut halt irgendwie diese Safety Infrastruktur aus.

00:07:18: die USA versuchen gleichzeitig halt innovationsfreundliche Rahmenbedingungen zu schaffen Trainingsdaten zu verfügbar zu machen und so weiter.

00:07:26: das ist finde ich ziemlich kontrovers, ziemlich gegensätzlich.

00:07:31: Aber gut wir gehen noch mal weiter und zwar zur EY.

00:07:35: bei EY gibt es jetzt ein neues ja ich sag mal Bonusprogramm beziehungsweise eine Möglichkeit Mitarbeiter zu belohnen, so einen Benefit-Ding.

00:07:44: und zwar will EY einhundert Millionen Dollar ausgeben für die Fähigkeiten der Menschen.

00:07:49: Also wenn Agenten jetzt schon ihre eigene WhatsApp-Gruppe haben, was bleibt dann eigentlich für uns Menschen könnte man sich fragen.

00:07:56: Ja UI hat eben diese hundert Millionen Dollar teure Antwort darauf und zwar geht es darum dass Mitarbeiter für Fähigkeiten und Verhalten ausgezeichnet und natürlich monetär belohnt werden sollen die für UI relativ wichtig für zukünftige Arbeitswelten sein sollen.

00:08:15: Also das sind so Skills wie Urteilsvermögen, die da genannt werden Anpassungsfähigkeit, Geschäftsverständnis, Leadership und Innovation.

00:08:24: ja alles mögliche ausdrücklich auch sinnvolle Nutzung von neuen Technologien.

00:08:28: aber Das ist nicht miss zu verstehen jetzt dass UI irgendwie hundert Millionen Zeit damit Menschen keine KI nutzen sondern dass menschliche Kernkompetenzen weiter in den Fokus gerückt werden.

00:08:40: Und UI spricht also für alle Für alle Buzzword-Bingo-Spieler da draußen, UI spricht von einer Tech-led Human Powered World.

00:08:50: Fantastisch!

00:08:51: Das ist das doch mal ein Wanted to.

00:08:54: Ja also wir sind irgendwie jetzt an einem Punkt angekommen wo KI viele Unternehmen durchdringen die Gesellschaft durchdreht wo Agents in Tests abgefahrene Sache machen wo man versucht auf der einen Seite zu regulieren sich auf der anderen Seite des Teichs tatsächlich auch Gedanken um noch mehr Daten macht.

00:09:10: Und das ist eine wilde Welt, in der wir leben.

00:09:14: Liebe Leute!

00:09:16: Es ist krass.

00:09:17: Ich bin am Ende der Zeit aber ich muss euch tatsächlich noch eine Sache mitgeben und zwar gibt es auch gerade eine ganz spannende... Forschung bzw.

00:09:26: ganz spannende Artikel.

00:09:27: bei den lieben Kollegen von Netzpolitik von ORK, netzpolitik.org verlinke ich euch natürlich in den Shownuss.

00:09:32: da geht es darum was eigentlich mit KI in der Bildung gerade passiert und zwar wurden da Chatbots getestet in einer Untersuchung die eigentlich das ganze Prozedere Aufgaben die Schüler und Schülerin erledigen.

00:09:46: Und dann von Lehrkräften kontrolliert werden, die das ganze Prozedere ein bisschen beschleunigen sollen, effizienter machen soll.

00:09:51: Da kam super krass Sache weiter!

00:09:53: Das ist sehr witzig, lest euch das gerne durch... KI Spoiler Alert, Mark KI geschrieben Texte am liebsten und KI ist es auch egal ob man binär oder chinesisch in der Deutschklausel schreibt.

00:10:05: Das ist wirklich funny.

00:10:07: Guckt's euch an.

00:10:08: ansonsten Redaktions Schluss war der dritte neunte vierzehnundneunfünfzig.

00:10:12: vielen Dank fürs zuhören.

00:10:14: ich bin leicht über die zehn Minuten rüber.

00:10:15: Es tut mir leid nächst mal wieder in unter zehn Minuten.

00:10:17: versprochen schönes Wochenende bis bald by OMR.

Neuer Kommentar

Dein Name oder Pseudonym (wird öffentlich angezeigt)
Mindestens 10 Zeichen
Durch das Abschicken des Formulars stimmst du zu, dass der Wert unter "Name oder Pseudonym" gespeichert wird und öffentlich angezeigt werden kann. Wir speichern keine IP-Adressen oder andere personenbezogene Daten. Die Nutzung deines echten Namens ist freiwillig.