Retrieval Augmented Generation als Unterstützung für LLMs

Die Qualität der Antworten von Chatbots, die auf großen Sprachmodellen basieren, hängt von den Trainingsdaten ab: Grundlage sind meist eine Fülle öffentlich zugänglicher Dokumente. Die Verlässlichkeit der Antworten sollten Nutzerinnen und Nutzer kritisch prüfen.
Die Qualität der Antworten von Chatbots, die auf großen Sprachmodellen basieren, hängt von den Trainingsdaten ab: Grundlage sind meist eine Fülle öffentlich zugänglicher Dokumente. Die Verlässlichkeit der Antworten sollten Nutzerinnen und Nutzer kritisch prüfen. – Bild: © Galeanu Mihai/istock.com

Large Language Models (LLM) bzw. große Sprachmodelle liefern in Chatbots auf alltägliche Anfragen häufig gute bis sehr gute Ergebnisse, die oft für eine erste Orientierung mehr als ausreichend sind. Forschende am Fraunhofer IWU geben allerdings zu bedenken, dass Trainingsdatensätze unvollständig oder veraltet sowie einige Informationen unscharf oder gar falsch sein können. Sie raten daher zu einer Überprüfung der erhaltenen Auskünfte. So sollte man sich etwa bei Rechtsfragen nicht ‚blind‘ auf einen Chatbot verlassen. Und was, wenn von den Angaben die Sicherheit von Menschen abhängen kann? Doch wieder selbst eingehend relevante Dokumente studieren?

Retrieval Augmented Generation

Mit Retrieval Augmented Generation (RAG) wollen Forschende am Fraunhofer IWU hier Abhilfe schaffen und zusätzliche Leitplanken für Sprachmodelle schaffen. Das LLM durchleuchtet dann in erster Linie maßgebliche Texte bzw. Textstellen. Das Sprachmodell wird dabei nicht neu trainiert, sondern selektiv erweitert.

Betrieb auch auf Standard-PCs

Als Sprachmodell verwenden die Forschenden LLaMA (Large Language Model Meta AI). Dieses sei groß bzw. leistungsfähig genug und überfordere dennoch nicht Rechenleistung und Grafikkarte eines hochwertigen Standard-PCs. Die Anwendung kann somit auf einem lokalen Rechner betrieben werden und Unternehmen behalten die Hoheit über ihre Daten. Bei weniger sensiblen Daten ist auch der Betrieb in der Cloud möglich.

Wie funktioniert RAG?

Zunächst müssen die ins LLM zu importierenden Daten auf den reinen Text reduziert werden (Cleaning). Sobald dieser in kleinere Abschnitte (Chunks; auffindbare Bausteine) segmentiert ist, folgt der Aufbau eines Suchsystems (Retrieval System), das die Chunks effizient durchsuchen kann. Die Chunks werden nach relevanten Passagen gegliedert und in einer Vektordatenbank abgelegt, also in mathematische Vektoren umgewandelt, die ihre Bedeutung repräsentieren. Auch die Prompts werden in Vektoren umgewandelt. So wird das Modell in die Lage versetzt, nach den in der Anfrage enthaltenen Wörtern zu suchen und gleichzeitig den Prompt tatsächlich zu ‚verstehen‘ (semantische Suche). Das Modell kann jetzt die zu einer Nutzeranfrage passenden Chunks kürzen, neu strukturieren, die wichtigsten Informationen herausfiltern und zu einem verständlichen Zusammenhang kombinieren. Liegt eine konkrete Suchanfrage vor, stehen ausgewählte Chunks zur Verfügung, auf deren Grundlage das Modell faktenbasierte Antworten geben kann. Das Modell nutzt den zusätzlichen Kontext der Chunks und muss nicht neu trainiert werden.

Seiten: 1 2



  • CamLine erwirbt Romaric

    CamLine erwirbt Romaric

    Der MES-Spezialist CamLine übernimmt das US-Softwareunternehmen Romaric und nimmt damit auch intralogistische Transportprozesse in den Blick.

    mehr lesen: CamLine erwirbt Romaric

  • Vorbereitungen für Motek und Bondexpo laufen

    Vorbereitungen für Motek und Bondexpo laufen

    Die Hürden der Automatisierung sinken weiter. Das will die diesjährige 42. Motek, internationale Fachmesse für Produktions- und Montageautomatisierung, zusammen mit der 17. Bondexpo, internationale Fachmesse für Klebtechnologie, zeigen und stellen…

    mehr lesen: Vorbereitungen für Motek und Bondexpo laufen

  • Weniger Studienanfänger in Ingenieurwissenschaften

    Weniger Studienanfänger in Ingenieurwissenschaften

    Die Zahl der offenen Stellen in den Ingenieurberufen ist trotz konjunktureller Eintrübung hoch. Laut VDI Ingenieurmonitor ist die Zahl der Studienanfänger und -anfängerinnen im ersten Hochschulsemester in den Fächern Ingenieurwissenschaften…

    mehr lesen: Weniger Studienanfänger in Ingenieurwissenschaften

  • DFKI und TAIX wollen KI-Spitzenforschung fördern

    DFKI und TAIX wollen KI-Spitzenforschung fördern

    Das Deutsche Forschungszentrum für Künstliche Intelligenz (DFKI) und das Expertennetzwerk Transatlantic AI eXchange (TAIX) planen den Aufbau einer gemeinsamen europäischen KI-Transfer- und Kooperationsbörse. Ziel dieser Partnerschaft ist es, den Transfer…

    mehr lesen: DFKI und TAIX wollen KI-Spitzenforschung fördern

  • Fraunhofer-Institute forschen an neuen Recyclingmöglichkeiten

    Fraunhofer-Institute forschen an neuen Recyclingmöglichkeiten

    Ein Großteil der täglich genutzten Verbrauchs- und Gebrauchsgegenstände besteht aus Kunststoffen, die auf Erdöl basieren. Nur etwas weniger als die Hälfte der dadurch resultierenden kunststoffhaltigen Abfälle wird in Deutschland werkstofflich…

    mehr lesen: Fraunhofer-Institute forschen an neuen Recyclingmöglichkeiten

  • Orderrückgang im Maschinen- und Anlagenbau

    Orderrückgang im Maschinen- und Anlagenbau

    Im Januar blieben die Bestellungen im Maschinen und Anlagenbau 10 Prozent unter dem Vorjahreswert. Mit Blick auf die vergangenen drei Monate ergibt sich ein ähnliches Bild.

    mehr lesen: Orderrückgang im Maschinen- und Anlagenbau

  • Forcam Enisco und Jasan Automation werden Partner

    Forcam Enisco und Jasan Automation werden Partner

    Um die eigene Präsenz in Indien auszubauen und dort ansässige Industrieunternehmen mit MES-Software zu beliefern, arbeitet Forcam Enisco künftig mit Jasan Automation zusammen.

    mehr lesen: Forcam Enisco und Jasan Automation werden Partner

  • Materialengpässe in der Industrie leicht gestiegen

    Materialengpässe in der Industrie leicht gestiegen

    Im Februar berichten wieder mehr Industrieunternehmen von Materialengpässen. Laut Ifo Institut verzeichnen vor allem Unternehmen aus der Chemischen Industrie Zuwächse.

    mehr lesen: Materialengpässe in der Industrie leicht gestiegen

  • Bosch und Microsoft erarbeiten Einsatzmöglichkeiten generativer KI im Auto

    Bosch und Microsoft erarbeiten Einsatzmöglichkeiten generativer KI im Auto

    Gemeinsam mit Microsoft will Bosch generative KI ins Auto bringen, etwa um die Sicherheit für Verkehrsteilnehmer zu erhöhen. Beide Unternehmen wollen zunächst Möglichkeiten der Zusammenarbeit ergründen.

    mehr lesen: Bosch und Microsoft erarbeiten Einsatzmöglichkeiten generativer KI im Auto

  • T-Systems ernennt Christine Knackfuß-Nikolic zur CTO

    T-Systems ernennt Christine Knackfuß-Nikolic zur CTO

    Christine Knackfuß-Nikolic wechselt von der Telekom zu T-Systems und wird dort ab März die Position der CTO übernehmen.

    mehr lesen: T-Systems ernennt Christine Knackfuß-Nikolic zur CTO

  • Prozessdampf nachhaltiger machen

    Prozessdampf nachhaltiger machen

    Für technische Produktionsprozesse, etwa in der chemischen Industrie, kommt zur Wärmeversorgung sogenannter Prozessdampf zum Einsatz. Für die Dampferzeugung werden bisher zumeist fossile Brennstoffe verwendet. Ein Forschungsprojekt will diesen Prozess nun…

    mehr lesen: Prozessdampf nachhaltiger machen

  • Autocrypt und MicroNova arbeiten zusammen

    Autocrypt und MicroNova arbeiten zusammen

    Im Rahmen einer strategischen Partnerschaft wollen die Unternehmen Autocrypt und MicroNova Testlösungen im Bereich der automobilen Cybersicherheit entwickeln.

    mehr lesen: Autocrypt und MicroNova arbeiten zusammen