Retrieval Augmented Generation als Unterstützung für LLMs

Die Qualität der Antworten von Chatbots, die auf großen Sprachmodellen basieren, hängt von den Trainingsdaten ab: Grundlage sind meist eine Fülle öffentlich zugänglicher Dokumente. Die Verlässlichkeit der Antworten sollten Nutzerinnen und Nutzer kritisch prüfen.
Die Qualität der Antworten von Chatbots, die auf großen Sprachmodellen basieren, hängt von den Trainingsdaten ab: Grundlage sind meist eine Fülle öffentlich zugänglicher Dokumente. Die Verlässlichkeit der Antworten sollten Nutzerinnen und Nutzer kritisch prüfen. – Bild: © Galeanu Mihai/istock.com

Large Language Models (LLM) bzw. große Sprachmodelle liefern in Chatbots auf alltägliche Anfragen häufig gute bis sehr gute Ergebnisse, die oft für eine erste Orientierung mehr als ausreichend sind. Forschende am Fraunhofer IWU geben allerdings zu bedenken, dass Trainingsdatensätze unvollständig oder veraltet sowie einige Informationen unscharf oder gar falsch sein können. Sie raten daher zu einer Überprüfung der erhaltenen Auskünfte. So sollte man sich etwa bei Rechtsfragen nicht ‚blind‘ auf einen Chatbot verlassen. Und was, wenn von den Angaben die Sicherheit von Menschen abhängen kann? Doch wieder selbst eingehend relevante Dokumente studieren?

Retrieval Augmented Generation

Mit Retrieval Augmented Generation (RAG) wollen Forschende am Fraunhofer IWU hier Abhilfe schaffen und zusätzliche Leitplanken für Sprachmodelle schaffen. Das LLM durchleuchtet dann in erster Linie maßgebliche Texte bzw. Textstellen. Das Sprachmodell wird dabei nicht neu trainiert, sondern selektiv erweitert.

Betrieb auch auf Standard-PCs

Als Sprachmodell verwenden die Forschenden LLaMA (Large Language Model Meta AI). Dieses sei groß bzw. leistungsfähig genug und überfordere dennoch nicht Rechenleistung und Grafikkarte eines hochwertigen Standard-PCs. Die Anwendung kann somit auf einem lokalen Rechner betrieben werden und Unternehmen behalten die Hoheit über ihre Daten. Bei weniger sensiblen Daten ist auch der Betrieb in der Cloud möglich.

Wie funktioniert RAG?

Zunächst müssen die ins LLM zu importierenden Daten auf den reinen Text reduziert werden (Cleaning). Sobald dieser in kleinere Abschnitte (Chunks; auffindbare Bausteine) segmentiert ist, folgt der Aufbau eines Suchsystems (Retrieval System), das die Chunks effizient durchsuchen kann. Die Chunks werden nach relevanten Passagen gegliedert und in einer Vektordatenbank abgelegt, also in mathematische Vektoren umgewandelt, die ihre Bedeutung repräsentieren. Auch die Prompts werden in Vektoren umgewandelt. So wird das Modell in die Lage versetzt, nach den in der Anfrage enthaltenen Wörtern zu suchen und gleichzeitig den Prompt tatsächlich zu ‚verstehen‘ (semantische Suche). Das Modell kann jetzt die zu einer Nutzeranfrage passenden Chunks kürzen, neu strukturieren, die wichtigsten Informationen herausfiltern und zu einem verständlichen Zusammenhang kombinieren. Liegt eine konkrete Suchanfrage vor, stehen ausgewählte Chunks zur Verfügung, auf deren Grundlage das Modell faktenbasierte Antworten geben kann. Das Modell nutzt den zusätzlichen Kontext der Chunks und muss nicht neu trainiert werden.

Seiten: 1 2



  • Pal2Rec forscht an sensorbasierter Aktivitätserkennung

    Pal2Rec forscht an sensorbasierter Aktivitätserkennung

    Als Ladungsträger bewegen Paletten Dinge von A nach B. Das im Februar 2024 gestartete Projekt ’Pal2Rec’ untersucht nun, wie sich (Euro-)Paletten eigenständig in logistische Prozesse mittels sensorbasierter Aktivitätserkennung einbeziehen lassen.

    mehr lesen: Pal2Rec forscht an sensorbasierter Aktivitätserkennung

  • Bessere CO2-Bilanz durch additiv gefertigte Komponenten

    Bessere CO2-Bilanz durch additiv gefertigte Komponenten

    Der Autobau kann mit maßgeschneiderten Komponenten die CO2-Bilanz von Werkzeugen und Maschinen verbessern und mit einbaufertigen Komponenten, sogenannten ’Engineered Products’, Leistungssteigerungen bei den Materialeigenschaften erzielen. Das zeigt eine Fallstudie in…

    mehr lesen: Bessere CO2-Bilanz durch additiv gefertigte Komponenten

  • Emissionen von künstlicher Intelligenz beziffern

    Emissionen von künstlicher Intelligenz beziffern

    Auch künstliche Intelligenz verbraucht Ressourcen. Forschende des Instituts für ökologische Wirtschaftsforschung, AlgorithmWatch und des DAI-Labors der TU Berlin fordern daher, die Nachhaltigkeitsauswirkungen von KI über den gesamten Lebenszyklus hinweg stärker…

    mehr lesen: Emissionen von künstlicher Intelligenz beziffern

  • Was Anwender von KI-Anbietern erwarten

    Was Anwender von KI-Anbietern erwarten

    Welche Voraussetzungen müssen erfüllt sein, damit Anwender KI-Anbietern vertrauen können und deren KI-Lösung nutzen? Diese Frage steht im Mittelpunkt des Forschungsprojektes ‘TrustKI’, das Anfang 2023 am Institut für Internet-Sicherheit –…

    mehr lesen: Was Anwender von KI-Anbietern erwarten

  • Materialengpässe in der Industrie weiter rückläufig

    Materialengpässe in der Industrie weiter rückläufig

    12,5 Prozent der Industrieunternehmen klagen nach wie vor über Materialengpässe. Nach Angaben des Ifo Instituts ging der Wert im Vergleich zum Vormonat jedoch erneut zurück.

    mehr lesen: Materialengpässe in der Industrie weiter rückläufig

  • DMG Mori baut Standort München zur Europazentrale aus

    DMG Mori baut Standort München zur Europazentrale aus

    München wird zur Europazentrale von DMG Mori. Der Werkzeugmaschinenhersteller errichtet dort das Business-Quartier ‚Go Four It‘ und mietet zusätzlich Gebäudeflächen.

    mehr lesen: DMG Mori baut Standort München zur Europazentrale aus

  • Xplanis gründet deutsche Tochtergesellschaft

    Xplanis gründet deutsche Tochtergesellschaft

    Xplanis, ein Spezialist für Transport Management Software, steigt in den deutschen Markt ein. Die Geschäftsführung der Xplanis Deutschland GmbH übernimmt Volker Möller.

    mehr lesen: Xplanis gründet deutsche Tochtergesellschaft

  • Mesago zieht positive SPS-Bilanz

    Mesago zieht positive SPS-Bilanz

    In ihrer Messeanalyse zieht die Mesago Messe Frankfurt ein positives Fazit der SPS in Nürnberg. Demnach erfuhr die Veranstaltung großen Zuspruch seitens Ausstellern und Fachbesuchern.

    mehr lesen: Mesago zieht positive SPS-Bilanz

  • WIIT übernimmt Teil von German Edge Cloud

    WIIT übernimmt Teil von German Edge Cloud

    Die WIIT, ein Cloud Computing-Anbieter aus Italien, hat über die deutsche Tochtergesellschaft WIIT AG einen Vertrag zum Erwerb des Geschäftsbereichs Edge & Cloud der zur Friedhelm Loh Group gehörenden German…

    mehr lesen: WIIT übernimmt Teil von German Edge Cloud

  • Aufatmen in der deutschen Automobilindustrie

    Aufatmen in der deutschen Automobilindustrie

    Im Januar hat sich die Stimmung der deutschen Autobauer verbessert. Trotz einiger positiver Signale, gibt das Ifo Institut jedoch noch keine Entwarnung. Unter anderem bereiten Auftragslage und der Fachkräftemangel sorgen.

    mehr lesen: Aufatmen in der deutschen Automobilindustrie

  • Industrielle Instandhaltung, Pumpen, Armaturen und Ventile im Fokus

    Industrielle Instandhaltung, Pumpen, Armaturen und Ventile im Fokus

    Am 21. Februar 2024 starten die Maintenance als Messe für die industrielle Instandhaltung und die Pumps&Valves als Fachmesse für industrielle Pumpen, Armaturen und Ventile. Auf die Fachbesucher warten rund 240…

    mehr lesen: Industrielle Instandhaltung, Pumpen, Armaturen und Ventile im Fokus

  • Führungswechsel bei Schneider Electric DACH

    Führungswechsel bei Schneider Electric DACH

    Stefan Gierse wird mit Wirkung zum April neuer Zone President der DACH-Organisation von Schneider Electric. Der 45-Jährige war zuvor für Siemens tätig.

    mehr lesen: Führungswechsel bei Schneider Electric DACH