Retrieval Augmented Generation als Unterstützung für LLMs

Die Qualität der Antworten von Chatbots, die auf großen Sprachmodellen basieren, hängt von den Trainingsdaten ab: Grundlage sind meist eine Fülle öffentlich zugänglicher Dokumente. Die Verlässlichkeit der Antworten sollten Nutzerinnen und Nutzer kritisch prüfen.
Die Qualität der Antworten von Chatbots, die auf großen Sprachmodellen basieren, hängt von den Trainingsdaten ab: Grundlage sind meist eine Fülle öffentlich zugänglicher Dokumente. Die Verlässlichkeit der Antworten sollten Nutzerinnen und Nutzer kritisch prüfen. – Bild: © Galeanu Mihai/istock.com

Large Language Models (LLM) bzw. große Sprachmodelle liefern in Chatbots auf alltägliche Anfragen häufig gute bis sehr gute Ergebnisse, die oft für eine erste Orientierung mehr als ausreichend sind. Forschende am Fraunhofer IWU geben allerdings zu bedenken, dass Trainingsdatensätze unvollständig oder veraltet sowie einige Informationen unscharf oder gar falsch sein können. Sie raten daher zu einer Überprüfung der erhaltenen Auskünfte. So sollte man sich etwa bei Rechtsfragen nicht ‚blind‘ auf einen Chatbot verlassen. Und was, wenn von den Angaben die Sicherheit von Menschen abhängen kann? Doch wieder selbst eingehend relevante Dokumente studieren?

Retrieval Augmented Generation

Mit Retrieval Augmented Generation (RAG) wollen Forschende am Fraunhofer IWU hier Abhilfe schaffen und zusätzliche Leitplanken für Sprachmodelle schaffen. Das LLM durchleuchtet dann in erster Linie maßgebliche Texte bzw. Textstellen. Das Sprachmodell wird dabei nicht neu trainiert, sondern selektiv erweitert.

Betrieb auch auf Standard-PCs

Als Sprachmodell verwenden die Forschenden LLaMA (Large Language Model Meta AI). Dieses sei groß bzw. leistungsfähig genug und überfordere dennoch nicht Rechenleistung und Grafikkarte eines hochwertigen Standard-PCs. Die Anwendung kann somit auf einem lokalen Rechner betrieben werden und Unternehmen behalten die Hoheit über ihre Daten. Bei weniger sensiblen Daten ist auch der Betrieb in der Cloud möglich.

Wie funktioniert RAG?

Zunächst müssen die ins LLM zu importierenden Daten auf den reinen Text reduziert werden (Cleaning). Sobald dieser in kleinere Abschnitte (Chunks; auffindbare Bausteine) segmentiert ist, folgt der Aufbau eines Suchsystems (Retrieval System), das die Chunks effizient durchsuchen kann. Die Chunks werden nach relevanten Passagen gegliedert und in einer Vektordatenbank abgelegt, also in mathematische Vektoren umgewandelt, die ihre Bedeutung repräsentieren. Auch die Prompts werden in Vektoren umgewandelt. So wird das Modell in die Lage versetzt, nach den in der Anfrage enthaltenen Wörtern zu suchen und gleichzeitig den Prompt tatsächlich zu ‚verstehen‘ (semantische Suche). Das Modell kann jetzt die zu einer Nutzeranfrage passenden Chunks kürzen, neu strukturieren, die wichtigsten Informationen herausfiltern und zu einem verständlichen Zusammenhang kombinieren. Liegt eine konkrete Suchanfrage vor, stehen ausgewählte Chunks zur Verfügung, auf deren Grundlage das Modell faktenbasierte Antworten geben kann. Das Modell nutzt den zusätzlichen Kontext der Chunks und muss nicht neu trainiert werden.

Seiten: 1 2



  • Was es bei der Container-Nutzung zu beachten gilt

    Was es bei der Container-Nutzung zu beachten gilt

    Die Nutzung von Containertechnologien steigt, was aber gilt es bei der Auswahl zu beachten? Der Software-Entwickler Red Hat gibt Antworten darauf.

    mehr lesen: Was es bei der Container-Nutzung zu beachten gilt

  • Kulturelle Werte ebenso wichtig wie die technologische Innovation

    Kulturelle Werte ebenso wichtig wie die technologische Innovation

    Wenn Unternehmen Digitalisierungsprojekte angehen, tun sie dies oft mit einem externen Partner. Die Frage ist nur mit welchem? IFS hat in einer Studie ermittelt, welche Faktoren bei der Auswahl eine…

    mehr lesen: Kulturelle Werte ebenso wichtig wie die technologische Innovation

  • Software-as-a-Service für die Fertigung

    Software-as-a-Service für die Fertigung

    Die Komplexität des Maschinenparks erschwert es oft, geeignete Parameter für den optimalen Betrieb zu definieren. Hier kommt das Startup FactoryPal ins Spiel, das mit seiner KI-basierten Lösung Abhilfe schaffen will.

    mehr lesen: Software-as-a-Service für die Fertigung

  • Karl Tucholski ist Head of Business Development bei Prime Computer

    Karl Tucholski ist Head of Business Development bei Prime Computer

    Karl Tucholski ist neuer Head of Business Development bei Prime Computer für Deutschland und Österreich.

    mehr lesen: Karl Tucholski ist Head of Business Development bei Prime Computer

  • Nachhaltige Industrie durch neue Technologien

    Nachhaltige Industrie durch neue Technologien

    Bitkom-Studie Nachhaltige Industrie durch neue Technologien Deutsche Unternehmen gehen davon aus, dass Industrie 4.0-Technologien zu einer Reduktion des CO2-Ausstoßes beitragen können. Viele Unternehmen haben sich bereits eine Selbstverpflichtung zu Senkung…

    mehr lesen: Nachhaltige Industrie durch neue Technologien

  • Nach dem Lockdown setzt Erholung ein

    Nach dem Lockdown setzt Erholung ein

    Die Deutsche Wirtschaft erholt sich langsam. Bis das Vorkrisenniveau erreicht wird, könnte es laut Bundeswirtschaftsministerium noch bis 2022 dauern.

    mehr lesen: Nach dem Lockdown setzt Erholung ein

  • Maschinenbau rechnet 2020 mit Produktionsrückgang von 17 Prozent

    Maschinenbau rechnet 2020 mit Produktionsrückgang von 17 Prozent

    Der Maschinen- und Anlagenbau kämpft gegen die Folgen der globalen Corona-Pandemie, aber auch gegen einen nach wie vor belastenden Protektionismus im internationalen Handel. Hinzu kommt ein industrieller Wandel, der sich…

    mehr lesen: Maschinenbau rechnet 2020 mit Produktionsrückgang von 17 Prozent

  • Fraunhofer IFF baut Forschungsstandort aus

    Fraunhofer IFF baut Forschungsstandort aus

    Das Fraunhofer IFF baut eine neue Forschungsfabrik im Magdeburger Wissenschaftshafen. Diese soll im Herbst 2021 fertig sein und neue Forschungsschwerpunkte beheimaten.

    mehr lesen: Fraunhofer IFF baut Forschungsstandort aus

  • KIT forscht an 6G-Technologien

    KIT forscht an 6G-Technologien

    Ein am KIT in Karlsruhe entwickeltes Konzept soll hohe Datenübertragungsraten bei niedrigen Kosten ermöglichen — für die sechste Generation des Mobilfunks. Dabei haben die Forscher die bislang höchste Datenrate in…

    mehr lesen: KIT forscht an 6G-Technologien

  • Industrie erwartet Produktionsplus

    Industrie erwartet Produktionsplus

    Die Produktionserwartungen der deutschen Industrie haben sich laut aktuellen Zahlen des Ifo-Instituts leicht verbessert. Im Maschinenbau kletterten die Erwartungen, nach minus 12 Punkten im Juli, wieder in den positiven Bereich.

    mehr lesen: Industrie erwartet Produktionsplus

  • Expleo bezieht neues Technologiezentrum

    Expleo bezieht neues Technologiezentrum

    Anfang August hat Expleo sein neues Technologiezentrum bezogen. Dort sollen zukünftig Software- und Elektroniksysteme für automobile Anwendungen entwickelt werden.

    mehr lesen: Expleo bezieht neues Technologiezentrum

  • Neues Vorstandsmitglied beim VDMA Robotik + Automation

    Neues Vorstandsmitglied beim VDMA Robotik + Automation

    Der VDMA Fachverband Robotik + Automation hat mit Ralf Winkelmann ein neues Vorstandsmitglied berufen.

    mehr lesen: Neues Vorstandsmitglied beim VDMA Robotik + Automation