Retrieval Augmented Generation als Unterstützung für LLMs

Die Qualität der Antworten von Chatbots, die auf großen Sprachmodellen basieren, hängt von den Trainingsdaten ab: Grundlage sind meist eine Fülle öffentlich zugänglicher Dokumente. Die Verlässlichkeit der Antworten sollten Nutzerinnen und Nutzer kritisch prüfen.
Die Qualität der Antworten von Chatbots, die auf großen Sprachmodellen basieren, hängt von den Trainingsdaten ab: Grundlage sind meist eine Fülle öffentlich zugänglicher Dokumente. Die Verlässlichkeit der Antworten sollten Nutzerinnen und Nutzer kritisch prüfen. – Bild: © Galeanu Mihai/istock.com

Large Language Models (LLM) bzw. große Sprachmodelle liefern in Chatbots auf alltägliche Anfragen häufig gute bis sehr gute Ergebnisse, die oft für eine erste Orientierung mehr als ausreichend sind. Forschende am Fraunhofer IWU geben allerdings zu bedenken, dass Trainingsdatensätze unvollständig oder veraltet sowie einige Informationen unscharf oder gar falsch sein können. Sie raten daher zu einer Überprüfung der erhaltenen Auskünfte. So sollte man sich etwa bei Rechtsfragen nicht ‚blind‘ auf einen Chatbot verlassen. Und was, wenn von den Angaben die Sicherheit von Menschen abhängen kann? Doch wieder selbst eingehend relevante Dokumente studieren?

Retrieval Augmented Generation

Mit Retrieval Augmented Generation (RAG) wollen Forschende am Fraunhofer IWU hier Abhilfe schaffen und zusätzliche Leitplanken für Sprachmodelle schaffen. Das LLM durchleuchtet dann in erster Linie maßgebliche Texte bzw. Textstellen. Das Sprachmodell wird dabei nicht neu trainiert, sondern selektiv erweitert.

Betrieb auch auf Standard-PCs

Als Sprachmodell verwenden die Forschenden LLaMA (Large Language Model Meta AI). Dieses sei groß bzw. leistungsfähig genug und überfordere dennoch nicht Rechenleistung und Grafikkarte eines hochwertigen Standard-PCs. Die Anwendung kann somit auf einem lokalen Rechner betrieben werden und Unternehmen behalten die Hoheit über ihre Daten. Bei weniger sensiblen Daten ist auch der Betrieb in der Cloud möglich.

Wie funktioniert RAG?

Zunächst müssen die ins LLM zu importierenden Daten auf den reinen Text reduziert werden (Cleaning). Sobald dieser in kleinere Abschnitte (Chunks; auffindbare Bausteine) segmentiert ist, folgt der Aufbau eines Suchsystems (Retrieval System), das die Chunks effizient durchsuchen kann. Die Chunks werden nach relevanten Passagen gegliedert und in einer Vektordatenbank abgelegt, also in mathematische Vektoren umgewandelt, die ihre Bedeutung repräsentieren. Auch die Prompts werden in Vektoren umgewandelt. So wird das Modell in die Lage versetzt, nach den in der Anfrage enthaltenen Wörtern zu suchen und gleichzeitig den Prompt tatsächlich zu ‚verstehen‘ (semantische Suche). Das Modell kann jetzt die zu einer Nutzeranfrage passenden Chunks kürzen, neu strukturieren, die wichtigsten Informationen herausfiltern und zu einem verständlichen Zusammenhang kombinieren. Liegt eine konkrete Suchanfrage vor, stehen ausgewählte Chunks zur Verfügung, auf deren Grundlage das Modell faktenbasierte Antworten geben kann. Das Modell nutzt den zusätzlichen Kontext der Chunks und muss nicht neu trainiert werden.

Seiten: 1 2



  • Cybersicherheit für Ethernet-Antriebe

    Cybersicherheit für Ethernet-Antriebe

    Industrielle Netzwerke werden mit dem Internet der Dinge immer offener für die gefürchtete Cyberkriminalität. Umso wichtiger ist es, die kommunizierenden Komponenten davor zu schützen.

    mehr lesen: Cybersicherheit für Ethernet-Antriebe

  • SSD mit mehrschichtigem Datenschutz

    SSD mit mehrschichtigem Datenschutz

    Wem seine Daten wichtig sind, setzt auf mehr als nur eine Sicherheitslösung. Lokale Backup- oder Cloudlösungen sind ein Weg, seine Daten zu sichern. Wird der PC allerdings entwendet, durch Dritte…

    mehr lesen: SSD mit mehrschichtigem Datenschutz

  • Geschäftsklima erholt sich

    Geschäftsklima erholt sich

    Die Corona-Krise hat die deutsch Elektroindustrie in den vergangenen Monaten hart getroffen. Auch der Mai brachte trotz erster Lockerungen Verluste für die Branche.

    mehr lesen: Geschäftsklima erholt sich

  • Wie ist die Stimmung in der Fertigungsindustrie

    Wie ist die Stimmung in der Fertigungsindustrie

    In einer Studie des IIoT-Spezialisten Relayr wurden je 100 Unternehmen in den USA und in Deutschland zu aktuellen Entwicklungen während der Coronakrise befragt. Dabei zeigen sich sogar positive Effekte.

    mehr lesen: Wie ist die Stimmung in der Fertigungsindustrie

  • Cosmo Consult expandiert nach Asien

    Cosmo Consult expandiert nach Asien

    Die Cosmo Consult-Gruppe eröffnet eine Niederlassung in Hongkong und plant darüber hinaus weitere Standorte in Asien.

    mehr lesen: Cosmo Consult expandiert nach Asien

  • Auftragseingang im Maschinenbau weiter rückläufig

    Auftragseingang im Maschinenbau weiter rückläufig

    Wie bereits im April blieb der Auftragseingang der deutschen Maschinenbauer auch im Mai weit unter dem Niveau des Vorjahres. Die Bestellungen blieben 28 Prozent unter dem Vorjahreswert.

    mehr lesen: Auftragseingang im Maschinenbau weiter rückläufig

  • Produktion legt wieder zu

    Produktion legt wieder zu

    Laut statistischem Bundesamt hat sich die Industrie im Mai von den Einbrüchen verursacht durch die Corona-Pandemie etwas erholt. Die Produktion legte zu, verfehlt das Mai-Ergebnis des Vorjahres jedoch um 19,3…

    mehr lesen: Produktion legt wieder zu

  • Drei von vier Unternehmen erwarten schnelle Erholung

    Drei von vier Unternehmen erwarten schnelle Erholung

    Zwei Drittel (66 Prozent) der Unternehmensleiter weltweit sind optimistisch, dass sich der europäische Markt relativ schnell vom wirtschaftlichen Abschwung durch die COVID-19-Pandemie erholen wird. Das geht aus einem Report des…

    mehr lesen: Drei von vier Unternehmen erwarten schnelle Erholung

  • Neuer CSO bei Proalpha

    Neuer CSO bei Proalpha

    Der ERP-Anbieter Proalpha hat einen neuen Chief Sales Officer. Zum 1. Juli hat Michael T. Sander die Position übernommen. Er folgt auf Andree Stachowski.

    mehr lesen: Neuer CSO bei Proalpha

  • Leuze nimmt neues Distributionszentrum in Betrieb

    Leuze nimmt neues Distributionszentrum in Betrieb

    Leuze will bis Ende Juli sein neues Distributionszentrum in Betrieb nehmen.

    mehr lesen: Leuze nimmt neues Distributionszentrum in Betrieb

  • Armin Schnettler wird VDE-Präsident

    Armin Schnettler wird VDE-Präsident

    Der VDE hat mit Prof. Dr. Armin Schnettler einen neuen Präsidenten. Er folgt auf Dr. Gunther Kegel.

    mehr lesen: Armin Schnettler wird VDE-Präsident

  • Plattform für digitale Ausweisdokumente

    Plattform für digitale Ausweisdokumente

    Infineon Technologies bietet mit Secora ID eine einfach zu integrierende Sicherheitsplattform für digitale Ausweisdokumente, die kontaktlos funktionieren.

    mehr lesen: Plattform für digitale Ausweisdokumente