Retrieval Augmented Generation als Unterstützung für LLMs

Die Qualität der Antworten von Chatbots, die auf großen Sprachmodellen basieren, hängt von den Trainingsdaten ab: Grundlage sind meist eine Fülle öffentlich zugänglicher Dokumente. Die Verlässlichkeit der Antworten sollten Nutzerinnen und Nutzer kritisch prüfen.
Die Qualität der Antworten von Chatbots, die auf großen Sprachmodellen basieren, hängt von den Trainingsdaten ab: Grundlage sind meist eine Fülle öffentlich zugänglicher Dokumente. Die Verlässlichkeit der Antworten sollten Nutzerinnen und Nutzer kritisch prüfen. – Bild: © Galeanu Mihai/istock.com

Large Language Models (LLM) bzw. große Sprachmodelle liefern in Chatbots auf alltägliche Anfragen häufig gute bis sehr gute Ergebnisse, die oft für eine erste Orientierung mehr als ausreichend sind. Forschende am Fraunhofer IWU geben allerdings zu bedenken, dass Trainingsdatensätze unvollständig oder veraltet sowie einige Informationen unscharf oder gar falsch sein können. Sie raten daher zu einer Überprüfung der erhaltenen Auskünfte. So sollte man sich etwa bei Rechtsfragen nicht ‚blind‘ auf einen Chatbot verlassen. Und was, wenn von den Angaben die Sicherheit von Menschen abhängen kann? Doch wieder selbst eingehend relevante Dokumente studieren?

Retrieval Augmented Generation

Mit Retrieval Augmented Generation (RAG) wollen Forschende am Fraunhofer IWU hier Abhilfe schaffen und zusätzliche Leitplanken für Sprachmodelle schaffen. Das LLM durchleuchtet dann in erster Linie maßgebliche Texte bzw. Textstellen. Das Sprachmodell wird dabei nicht neu trainiert, sondern selektiv erweitert.

Betrieb auch auf Standard-PCs

Als Sprachmodell verwenden die Forschenden LLaMA (Large Language Model Meta AI). Dieses sei groß bzw. leistungsfähig genug und überfordere dennoch nicht Rechenleistung und Grafikkarte eines hochwertigen Standard-PCs. Die Anwendung kann somit auf einem lokalen Rechner betrieben werden und Unternehmen behalten die Hoheit über ihre Daten. Bei weniger sensiblen Daten ist auch der Betrieb in der Cloud möglich.

Wie funktioniert RAG?

Zunächst müssen die ins LLM zu importierenden Daten auf den reinen Text reduziert werden (Cleaning). Sobald dieser in kleinere Abschnitte (Chunks; auffindbare Bausteine) segmentiert ist, folgt der Aufbau eines Suchsystems (Retrieval System), das die Chunks effizient durchsuchen kann. Die Chunks werden nach relevanten Passagen gegliedert und in einer Vektordatenbank abgelegt, also in mathematische Vektoren umgewandelt, die ihre Bedeutung repräsentieren. Auch die Prompts werden in Vektoren umgewandelt. So wird das Modell in die Lage versetzt, nach den in der Anfrage enthaltenen Wörtern zu suchen und gleichzeitig den Prompt tatsächlich zu ‚verstehen‘ (semantische Suche). Das Modell kann jetzt die zu einer Nutzeranfrage passenden Chunks kürzen, neu strukturieren, die wichtigsten Informationen herausfiltern und zu einem verständlichen Zusammenhang kombinieren. Liegt eine konkrete Suchanfrage vor, stehen ausgewählte Chunks zur Verfügung, auf deren Grundlage das Modell faktenbasierte Antworten geben kann. Das Modell nutzt den zusätzlichen Kontext der Chunks und muss nicht neu trainiert werden.

Seiten: 1 2



  • MPDV stellt neue MES-Generation vor

    MPDV stellt neue MES-Generation vor

    Hydra X plattformoptimiert und interoperabel MPDV stellt neue MES-Generation vor Softwarehersteller MPDV läutet den Generationswechsel seiner MES-Lösung Hydra ein. Hydra X wird ab dem 1. April als modulare Software auf…

    mehr lesen: MPDV stellt neue MES-Generation vor

  • Ohne die richtigen Informationen funktioniert’s nicht

    Ohne die richtigen Informationen funktioniert’s nicht

    Das Schwestermagazin Industrial Communication Journal bekommt tatkräftige Unterstützung.

    mehr lesen: Ohne die richtigen Informationen funktioniert’s nicht

  • Bund fördert Gaia-X-Leuchtturmprojekte

    Bund fördert Gaia-X-Leuchtturmprojekte

    Gaia-X startet mit einem Förderwettbewerb in die Anwendungsphase. Interessierte können sich dafür noch bis zum 7. Mai bewerben.

    mehr lesen: Bund fördert Gaia-X-Leuchtturmprojekte

  • Sichere Anlagen in der Prozessindustrie

    Sichere Anlagen in der Prozessindustrie

    Die Prozessindustrie stellt spezifische Anforderungen an die Sicherheit ihrer Anlagen. Wesentliche Elemente sind dabei die PLT-Sicherheitseinrichtungen.

    mehr lesen: Sichere Anlagen in der Prozessindustrie

  • Neue Lösungen in Instandhaltung und Service

    Neue Lösungen in Instandhaltung und Service

    Am 20. und 21. April findet das 16. Anwenderforum ‘Einsatz mobiler Lösungen‘ statt. In diesem Jahr als reine Online-Veranstaltung.

    mehr lesen: Neue Lösungen in Instandhaltung und Service

  • Talend wird von Thoma Bravo übernommen

    Talend wird von Thoma Bravo übernommen

    Für 2,4Mrd.US$ will das Private Equity Unternehmen Thoma Bravo den Cloud-Integrator Talend übernehmen. Das Board of Directors von Talend hat der Absichtserklärung zugestimmt.

    mehr lesen: Talend wird von Thoma Bravo übernommen

  • Besserer Schutz bei der Arbeit mit Cobots

    Besserer Schutz bei der Arbeit mit Cobots

    Im Forschungsprojekt ‘Digitale Gefahrenprävention für kollaborative Roboterarbeitsplätze mithilfe einer webbasierten Planungshilfe (CobotPlaner)‘ hat das Fraunhofer IFF im Auftrag der Berufsgenossenschaft Holz und Metall (BGHM) eine webbasierte Planungshilfe entwickelt, die für…

    mehr lesen: Besserer Schutz bei der Arbeit mit Cobots

  • SAP-Kunden überdenken Pläne zur ERP-Umstellung

    SAP-Kunden überdenken Pläne zur ERP-Umstellung

    Die Corona-Pandemie führt bei Firmen zu verzögerten S/4Hana-Umstellungen. Der Befragung zufolge wollen die meisten Unternehmen ihre SAP-Installationen dennoch bis 2025 umgestellt haben. Besonders beliebt sind wohl Hybrid-Cloud-Infrastrukturen.

    mehr lesen: SAP-Kunden überdenken Pläne zur ERP-Umstellung

  • Unternehmen senken F&E-Ausgaben

    Unternehmen senken F&E-Ausgaben

    Im vergangenen Jahr lag der Anteil der F&E-Ausgaben deutscher Unternehmen gemessen am Umsatz bei 3,2 Prozent und damit unter dem Durchschnitt der Vorjahre.

    mehr lesen: Unternehmen senken F&E-Ausgaben

  • Corona-Pandemie gefährdet langfristig Ingenieurarbeitsmarkt

    Corona-Pandemie gefährdet langfristig Ingenieurarbeitsmarkt

    Die Corona-Pandemie hat im dritten Quartal in Folge gravierende Spuren auf dem Ingenieurarbeitsmarkt hinterlassen. Das zeigen die Zahlen für das 4. Quartal 2020 aus dem aktuellen Ingenieurmonitor, den der VDI…

    mehr lesen: Corona-Pandemie gefährdet langfristig Ingenieurarbeitsmarkt

  • Pandemie sorgt für Rekordrückgang des Arbeitsvolumens

    Pandemie sorgt für Rekordrückgang des Arbeitsvolumens

    Mit einem Rückgang um 4,7 Prozent auf 59,64 Milliarden Stunden ist das Arbeitsvolumen im Jahr 2020 aufgrund der Covid-19-Pandemie so stark eingebrochen wie noch nie. Dies geht aus der Anfang…

    mehr lesen: Pandemie sorgt für Rekordrückgang des Arbeitsvolumens

  • IFS bringt Portfolio in die Cloud

    IFS bringt Portfolio in die Cloud

    Der schwedische Softwarehersteller IFS hat die Lösung IFS Cloud vorgestellt. Anwender können damit nach Unternehmensangaben alle IFS-Funktionalitäten, von ERP-System bis zu den produktionsnahen Modulen, als Cloud-System nutzen. Der Cloud-und On-Premise-Betrieb…

    mehr lesen: IFS bringt Portfolio in die Cloud