Risikoreiche KI per Red Teaming testen

Programmer people working laptops or smartphones with AI artificial intelligence software engineer coding on laptop computers with technology icons and binary code big data Ai bot digital machine
Bild: ©Bussarin/stock.adobe.com

Die KI-Verordnung der EU sieht vor, dass Künstliche-Intelligenz-Modelle (KI) „für allgemeine Zwecke mit systemischem Risiko“ besonders strikt überprüft werden. In diese Modellkategorie gehören auch populäre generative KI-Modelle wie GPT4 von OpenAI. Forschende vom ZEW Mannheim schlagen nun Rahmenbedingungen vor, wie die Prüfungen solcher Modelle systematisch durchgeführt werden sollten. Der Vorschlag basiert auf einem Forschungsprojekt, das von der Baden-Württemberg Stiftung gefördert wurde.

„Die Prüfung generativer KI mit systemischen Risiken benötigt klar definierte Ziele, abgegrenzte Rollen sowie Anreiz- und Koordinierungssysteme für alle Beteiligten. Nur so sind verlässliche Prüfergebnisse zu erwarten – und diese sollten in standardisierter Form veröffentlicht werden. Um Interessenkonflikte zu vermeiden, sollte die Prüfung durch unabhängige Dritte durchgeführt werden. Als externe Dienstleistung kann so ein spezialisierter Markt für KI-Sicherheitstests entstehen“, fasst Dr. Dominik Rehse, Ko-Autor des Vorschlags und Leiter der ZEW-Nachwuchsforschungsgruppe ’Design digitaler Märkte’, zusammen.

KI-Verordnung sieht Adversarial Testing vor

Die KI-Verordnung sieht vor, dass betreffende KI-Modelle durch sogenanntes Adversarial Testing systematisch auf Schwachstellen geprüft werden. Dabei handelt es sich um Stresstests, die darauf ausgelegt sind, die KI-Modelle durch wiederholte Interaktion zu unerwünschtem Verhalten zu provozieren.

Allerdings sei das Adversarial Testing in der KI-Verordnung nicht genauer geregelt, so Rehse. „Die Vorgabe verweist lediglich auf Verhaltenskodizes und harmonisierte Standards, die nun entwickelt werden. Es gilt, diese Kodizes und Standards so zu gestalten, dass sie zu einer effizienten und effektiven Prüfung führen.“

Per Red Teaming testen

Hierfür eignet sich aus Sicht der ZEW-Wissenschaftler insbesondere das sogenannte Red Teaming. Diese umfassendere Form des geforderten Adversarial Testing bezieht zusätzlich verschiedene Arten von Angriffen auf das Modell selbst ein.

„Internes Red Teaming wird zwar nach eigenem Bekunden von den meisten großen KI-Entwicklungshäusern bereits durchgeführt, allerdings gibt es dafür keine standardisierten Ansätze, auch nicht für KI-Modelle desselben Typs. Dadurch wird der Vergleich der Ergebnisse unnötig erschwert. Vor allem fehlt bei den derzeitigen Versuchen meist ein klar definiertes Ziel, sodass unklar ist, ob und wann ein Modell ausreichend getestet wurde“, kritisiert ZEW-Wissenschaftler Sebastian Valet, Ko-Autor aus dem Forschungsbereich ’Digitale Ökonomie’.

Vier definierte Rollen

Entsprechend müssen für das Red Teaming klare Strukturen und Rollen definiert werden, damit die Potenziale dieses Prüfverfahrens effizient genutzt werden können. Die ZEW-Wissenschaftler schlagen dafür vier definierte Rollen vor, die je eigene Aufgaben, Ziele und Anreize haben, um den Prüfprozess möglichst effizient zu gestalten. Die Rollen sind 1) die Organisatoren der Prüfung, 2) das testende Red-Team, 3) Validierer, die entscheiden, ob tatsächlich ein Fehlverhalten gefunden wurde, und 4) das KI-Entwicklerteam. Jede dieser Rollen sollte dabei von unabhängigen Einheiten ausgefüllt werden. Nur so habe beispielsweise ein testendes Red-Team einen Anreiz seine Aufgabe bestmöglich zu erfüllen, so die Wissenschaftler.



  • Die Ära der kostenlosen KI ist vorbei

    Die Ära der kostenlosen KI ist vorbei

    Die Wirtschaftlichkeit großer Sprachmodelle steht kurz davor, mit der Unternehmensrealität zu kollidieren, schreibt Pegasystems-CEO Alan Trefler (Bild).

    mehr lesen: Die Ära der kostenlosen KI ist vorbei

  • Geschäftsführerwechsel bei der SimPlan Integrations

    Geschäftsführerwechsel bei der SimPlan Integrations

    Im Zuge des 25-jährigen Bestehens der SimPlan Integrations hat die SimPlan Group angekündigt, dass im Jahr 2028 ein geplanter Geschäftsführerwechsel beim Tochterunternehmen stattfinden wird.

    mehr lesen: Geschäftsführerwechsel bei der SimPlan Integrations

  • Was Ausbilder im Maschinen- und Anlagenbau beschäftigt

    Was Ausbilder im Maschinen- und Anlagenbau beschäftigt

    Laut VDMA-Ausbildungsumfrage steht die duale Ausbildung im Maschinen- und Anlagenbau auf einem stabilen Fundament und punktet mit hochmotivierten und zufriedenen Ausbilderinnen und Ausbildern.

    mehr lesen: Was Ausbilder im Maschinen- und Anlagenbau beschäftigt

  • Forterro übernimmt 3E Datentechnik

    Forterro übernimmt 3E Datentechnik

    Forterro, ein europäischer Anbieter von Industriesoftware, hat die geplante Übernahme des Software-Spezialisten 3E Datentechnik bekannt gegeben, dessen Software bei der Konstruktion und Herstellung von Fenstern und Türen zum Einsatz kommt.

    mehr lesen: Forterro übernimmt 3E Datentechnik

  • AutoSim automatisiert die Erstellung digitaler Simulationsmodelle

    AutoSim automatisiert die Erstellung digitaler Simulationsmodelle

    Das Forschungsprojekt AutoSim vereinfacht die Erstellung von Simulationsmodellen für die Produktion. Es kombiniert intelligente Datenverarbeitung mit interoperablen Informationsmodellen.

    mehr lesen: AutoSim automatisiert die Erstellung digitaler Simulationsmodelle

  • SAP investiert in KI-Unternehmen n8n

    SAP investiert in KI-Unternehmen n8n

    SAP investiert in die KI-Automatisierungsplattform n8n, wodurch sich die Bewertung des in Berlin ansässigen Startups auf 5,2Mrd.US$ erhöht und somit mehr als verdoppelt.

    mehr lesen: SAP investiert in KI-Unternehmen n8n

  • BSI veröffentlicht G7-Richtlinie zu SBOM for AI

    BSI veröffentlicht G7-Richtlinie zu SBOM for AI

    Unter der Federführung des BSI und der italienischen Cybersicherheitsbehörde ACN haben die Cybersicherheitsbehörden der G7-Staaten unter Mitwirkung der EU Kommission eine Richtlinie zur Software Bill of Materials (SBOM) for AI…

    mehr lesen: BSI veröffentlicht G7-Richtlinie zu SBOM for AI

  • Was passiert mit dem Menschen, wenn die Roboter kommen?

    Was passiert mit dem Menschen, wenn die Roboter kommen?

    Künstliche Intelligenz automatisiert längst digitale Prozesse. Jetzt übernehmen Roboter auch physische Routinen. Was das für die Menschen bedeutet, beleuchtet Sören Michl, Vice President AI Adoption bei IFS.

    mehr lesen: Was passiert mit dem Menschen, wenn die Roboter kommen?

  • Ein Schritt auf dem Weg zum Quanteninternet?

    Ein Schritt auf dem Weg zum Quanteninternet?

    Seit mehr als 60 Jahren gilt das ‚Bellsche Theorem‘ als Goldstandard, um zu zeigen, dass die Quantenmechanik den Regeln der klassischen Physik widerspricht.

    mehr lesen: Ein Schritt auf dem Weg zum Quanteninternet?

  • Der VDI feiert 170-jähriges Bestehen

    Der VDI feiert 170-jähriges Bestehen

    Vor 170 Jahren, am 12. Mai 1856, wurde der VDI in Alexisbad gegründet. Aus diesem Anlass blickt der Verein zurück und gibt zugleich die Gründung eines neuen Gremiums bekannt.

    mehr lesen: Der VDI feiert 170-jähriges Bestehen

  • Cobot vs. stationär: Wie Roboter in der Fabrik eingesetzt werden

    Cobot vs. stationär: Wie Roboter in der Fabrik eingesetzt werden

    Eine aktuelle Robotik-Studie von Reichelt Elektronik, durchgeführt durch das unabhängige Institut OnePoll, untersucht, welche Arten von Robotern in deutschen Produktionsstätten eingesetzt werden und welche Arbeiten sie übernehmen.

    mehr lesen: Cobot vs. stationär: Wie Roboter in der Fabrik eingesetzt werden

  • Welches Potenzial in Werkerassistenzsystemen steckt

    Welches Potenzial in Werkerassistenzsystemen steckt

    Wie Werkerassistenzsysteme bislang verborgene Effizienzpotenziale aufdecken und warum sie sich oft schon nach wenigen Monaten amortisieren, erklärt Michael Kunze, Geschäftsführer von MKey Solution, einem Spezialisten für Messtechnik und Bildverarbeitung.

    mehr lesen: Welches Potenzial in Werkerassistenzsystemen steckt