Retrieval Augmented Generation als Unterstützung für LLMs

Die Qualität der Antworten von Chatbots, die auf großen Sprachmodellen basieren, hängt von den Trainingsdaten ab: Grundlage sind meist eine Fülle öffentlich zugänglicher Dokumente. Die Verlässlichkeit der Antworten sollten Nutzerinnen und Nutzer kritisch prüfen.
Die Qualität der Antworten von Chatbots, die auf großen Sprachmodellen basieren, hängt von den Trainingsdaten ab: Grundlage sind meist eine Fülle öffentlich zugänglicher Dokumente. Die Verlässlichkeit der Antworten sollten Nutzerinnen und Nutzer kritisch prüfen. – Bild: © Galeanu Mihai/istock.com

Large Language Models (LLM) bzw. große Sprachmodelle liefern in Chatbots auf alltägliche Anfragen häufig gute bis sehr gute Ergebnisse, die oft für eine erste Orientierung mehr als ausreichend sind. Forschende am Fraunhofer IWU geben allerdings zu bedenken, dass Trainingsdatensätze unvollständig oder veraltet sowie einige Informationen unscharf oder gar falsch sein können. Sie raten daher zu einer Überprüfung der erhaltenen Auskünfte. So sollte man sich etwa bei Rechtsfragen nicht ‚blind‘ auf einen Chatbot verlassen. Und was, wenn von den Angaben die Sicherheit von Menschen abhängen kann? Doch wieder selbst eingehend relevante Dokumente studieren?

Retrieval Augmented Generation

Mit Retrieval Augmented Generation (RAG) wollen Forschende am Fraunhofer IWU hier Abhilfe schaffen und zusätzliche Leitplanken für Sprachmodelle schaffen. Das LLM durchleuchtet dann in erster Linie maßgebliche Texte bzw. Textstellen. Das Sprachmodell wird dabei nicht neu trainiert, sondern selektiv erweitert.

Betrieb auch auf Standard-PCs

Als Sprachmodell verwenden die Forschenden LLaMA (Large Language Model Meta AI). Dieses sei groß bzw. leistungsfähig genug und überfordere dennoch nicht Rechenleistung und Grafikkarte eines hochwertigen Standard-PCs. Die Anwendung kann somit auf einem lokalen Rechner betrieben werden und Unternehmen behalten die Hoheit über ihre Daten. Bei weniger sensiblen Daten ist auch der Betrieb in der Cloud möglich.

Wie funktioniert RAG?

Zunächst müssen die ins LLM zu importierenden Daten auf den reinen Text reduziert werden (Cleaning). Sobald dieser in kleinere Abschnitte (Chunks; auffindbare Bausteine) segmentiert ist, folgt der Aufbau eines Suchsystems (Retrieval System), das die Chunks effizient durchsuchen kann. Die Chunks werden nach relevanten Passagen gegliedert und in einer Vektordatenbank abgelegt, also in mathematische Vektoren umgewandelt, die ihre Bedeutung repräsentieren. Auch die Prompts werden in Vektoren umgewandelt. So wird das Modell in die Lage versetzt, nach den in der Anfrage enthaltenen Wörtern zu suchen und gleichzeitig den Prompt tatsächlich zu ‚verstehen‘ (semantische Suche). Das Modell kann jetzt die zu einer Nutzeranfrage passenden Chunks kürzen, neu strukturieren, die wichtigsten Informationen herausfiltern und zu einem verständlichen Zusammenhang kombinieren. Liegt eine konkrete Suchanfrage vor, stehen ausgewählte Chunks zur Verfügung, auf deren Grundlage das Modell faktenbasierte Antworten geben kann. Das Modell nutzt den zusätzlichen Kontext der Chunks und muss nicht neu trainiert werden.

Seiten: 1 2



  • Maschinenbauexporte überwinden Tiefpunkt

    Maschinenbauexporte überwinden Tiefpunkt

    Die Maschinenexporte aus Deutschland stabilisieren sich zunehmend. Im September verbuchten die Maschinen- und Anlagenbauer aus Deutschland beim Exportgeschäft ein Minus in Höhe von 7,6 Prozent im Vorjahresvergleich. Im Zeitraum Juli…

    mehr lesen: Maschinenbauexporte überwinden Tiefpunkt

  • 90 Anträge für Campusnetze

    90 Anträge für Campusnetze

    Mit Campusnetzen können Industrieunternehmen ihr eigenes 5G-Netzwerk betreiben. Ein Jahr nach Inkrafttreten der entsprechenden Vergabebedingungen sind bei der Bundesnetzagentur rund 90 Anträge eingegangen.

    mehr lesen: 90 Anträge für Campusnetze

  • Prüfkriterien zur KI-Zertifizierung

    Prüfkriterien zur KI-Zertifizierung

    Um das wirtschaftliche und gesellschaftliche Potential von künstlicher Intelligenz auszuschöpfen, müssen Menschen den Entscheidungen von KI-Systemen und den mit ihnen verbundenen Prozessen vertrauen. Dazu kann eine entsprechende Zertifizierung beitragen. Nach…

    mehr lesen: Prüfkriterien zur KI-Zertifizierung

  • SPS-MAGAZIN zeigt Herbst-Innovationen 2020

    SPS-MAGAZIN zeigt Herbst-Innovationen 2020

    Die Innovationen der Automatisierung im Rampenlicht: Im Sonderteil GROSSER HERBST DER INNOVATIONEN des aktuellen SPS-MAGAZINs präsentieren die führenden Anbieter der Automatisierungstechnik die neuen Produkte und Lösungen, die sie eigentlich auf…

    mehr lesen: SPS-MAGAZIN zeigt Herbst-Innovationen 2020

  • Softeq eröffnet Innovation Lab

    Softeq eröffnet Innovation Lab

    Technologieentwicklung Softeq eröffnet Innovation Lab Das IT-Unternehmen Softeq, mit Hauptsitz in Houston und Dependance unter anderem in München, will mithilfe des Integrated Design and Management Program vom Massachusetts Institute of…

    mehr lesen: Softeq eröffnet Innovation Lab

  • Sicherer Datentransfer mit OPC UA

    Sicherer Datentransfer mit OPC UA

    Genua hat seine Cyber-Diode für OPC UA erweitert. Die Securitylösung lässt den Datentransfer ausschließlich in eine Richtung zu – in Gegenrichtung blockt sie jeden Informationsfluss ab.

    mehr lesen: Sicherer Datentransfer mit OPC UA

  • Thermografiekameras und deren Kalibrierung

    Thermografiekameras und deren Kalibrierung

    Praktisch alle im Handel erhältlichen Thermografiekameras zeigen für die Messpunkte im Kamerabild Temperaturwerte an. Jedoch ist nicht offengelegt, wie der Kalibrierprozess stattgefunden hat.

    mehr lesen: Thermografiekameras und deren Kalibrierung

  • Wieder mehr Beschäftigte in der Industrie

    Wieder mehr Beschäftigte in der Industrie

    Im Vergleich zum Vorjahr verzeichnen die deutschen Industrieunternehmen zwar weniger Beschäftigte, im Vergleich zum August 2020 ist die Zahl der Beschäftigen jedoch erstmals seit einem Jahr wieder gestiegen.

    mehr lesen: Wieder mehr Beschäftigte in der Industrie

  • Webinarserie: IT&Production TechTalks

    Webinarserie: IT&Production TechTalks

    Im November starten die IT&Production-Fachmedien eine eigene Webinarserie – die IT&Production TechTalks. Jedes Webinar bietet drei Vorträge zu einem Schwerpunktthema – u.a. MES/MOM (24. November), Robotic Process Automation (26. November),…

    mehr lesen: Webinarserie: IT&Production TechTalks

  • Richtlinien zum Anlagen-Engineering aktualisiert

    Richtlinien zum Anlagen-Engineering aktualisiert

    Die Richtlinienreihe VDI/VDE 3695 ‚Engineering von Anlagen‘ wurde überarbeitet und an den Stand der Technik, insbesondere an I4.0-Vorgaben, angepasst. Die Reihe unterstützt Engineering-Organisationen dabei, geeignete Maßnahmen zur gezielten Weiterentwicklung der…

    mehr lesen: Richtlinien zum Anlagen-Engineering aktualisiert

  • Barracuda Networks erwirbt Startup Fyde

    Barracuda Networks erwirbt Startup Fyde

    Barracuda hat die Übernahme von des Zero Trust Cybersecurity Startups Fyde mit Sitz in Palo Alto, Kalifornien, und Porto, Portugal, bekanntgegeben, um die Barracuda CloudGen SASE-Plattform um ZTNA-Funktionen zu erweitern.

    mehr lesen: Barracuda Networks erwirbt Startup Fyde

  • Ausgezeichnete Produktfamilie

    Ausgezeichnete Produktfamilie

    Der Bundesverband IT-Sicherheit e.V. (TeleTrusT) hat die SDoT-Produktfamilie als Cross Domain Solution (CDS) von Infodas mit dem diesjährigen Innovationspreis für innovative, vertrauenswürdige und praxistaugliche IT-Sicherheitslösungen ausgezeichnet. 

    mehr lesen: Ausgezeichnete Produktfamilie