Retrieval Augmented Generation als Unterstützung für LLMs

Die Qualität der Antworten von Chatbots, die auf großen Sprachmodellen basieren, hängt von den Trainingsdaten ab: Grundlage sind meist eine Fülle öffentlich zugänglicher Dokumente. Die Verlässlichkeit der Antworten sollten Nutzerinnen und Nutzer kritisch prüfen.
Die Qualität der Antworten von Chatbots, die auf großen Sprachmodellen basieren, hängt von den Trainingsdaten ab: Grundlage sind meist eine Fülle öffentlich zugänglicher Dokumente. Die Verlässlichkeit der Antworten sollten Nutzerinnen und Nutzer kritisch prüfen. – Bild: © Galeanu Mihai/istock.com

Large Language Models (LLM) bzw. große Sprachmodelle liefern in Chatbots auf alltägliche Anfragen häufig gute bis sehr gute Ergebnisse, die oft für eine erste Orientierung mehr als ausreichend sind. Forschende am Fraunhofer IWU geben allerdings zu bedenken, dass Trainingsdatensätze unvollständig oder veraltet sowie einige Informationen unscharf oder gar falsch sein können. Sie raten daher zu einer Überprüfung der erhaltenen Auskünfte. So sollte man sich etwa bei Rechtsfragen nicht ‚blind‘ auf einen Chatbot verlassen. Und was, wenn von den Angaben die Sicherheit von Menschen abhängen kann? Doch wieder selbst eingehend relevante Dokumente studieren?

Retrieval Augmented Generation

Mit Retrieval Augmented Generation (RAG) wollen Forschende am Fraunhofer IWU hier Abhilfe schaffen und zusätzliche Leitplanken für Sprachmodelle schaffen. Das LLM durchleuchtet dann in erster Linie maßgebliche Texte bzw. Textstellen. Das Sprachmodell wird dabei nicht neu trainiert, sondern selektiv erweitert.

Betrieb auch auf Standard-PCs

Als Sprachmodell verwenden die Forschenden LLaMA (Large Language Model Meta AI). Dieses sei groß bzw. leistungsfähig genug und überfordere dennoch nicht Rechenleistung und Grafikkarte eines hochwertigen Standard-PCs. Die Anwendung kann somit auf einem lokalen Rechner betrieben werden und Unternehmen behalten die Hoheit über ihre Daten. Bei weniger sensiblen Daten ist auch der Betrieb in der Cloud möglich.

Wie funktioniert RAG?

Zunächst müssen die ins LLM zu importierenden Daten auf den reinen Text reduziert werden (Cleaning). Sobald dieser in kleinere Abschnitte (Chunks; auffindbare Bausteine) segmentiert ist, folgt der Aufbau eines Suchsystems (Retrieval System), das die Chunks effizient durchsuchen kann. Die Chunks werden nach relevanten Passagen gegliedert und in einer Vektordatenbank abgelegt, also in mathematische Vektoren umgewandelt, die ihre Bedeutung repräsentieren. Auch die Prompts werden in Vektoren umgewandelt. So wird das Modell in die Lage versetzt, nach den in der Anfrage enthaltenen Wörtern zu suchen und gleichzeitig den Prompt tatsächlich zu ‚verstehen‘ (semantische Suche). Das Modell kann jetzt die zu einer Nutzeranfrage passenden Chunks kürzen, neu strukturieren, die wichtigsten Informationen herausfiltern und zu einem verständlichen Zusammenhang kombinieren. Liegt eine konkrete Suchanfrage vor, stehen ausgewählte Chunks zur Verfügung, auf deren Grundlage das Modell faktenbasierte Antworten geben kann. Das Modell nutzt den zusätzlichen Kontext der Chunks und muss nicht neu trainiert werden.

Seiten: 1 2



  • Klassische und Quanten-Algorithmen in Kombination

    Klassische und Quanten-Algorithmen in Kombination

    Im Rahmen eines Forschungsprojekts kombinieren Classiq und Hewlett Packard Enterprise klassisches High-Performance-Computing (HPC) mit Quantencomputing. Ziel ist es, kombinatorischer Optimierungsprobleme zu lösen.

    mehr lesen: Klassische und Quanten-Algorithmen in Kombination

  • Telekom und Trumpf schließen Vertriebspartnerschaft für 5G-System

    Telekom und Trumpf schließen Vertriebspartnerschaft für 5G-System

    Telekom und Trumpf bauen ihre Zusammenarbeit aus. Im Rahmen einer Vertriebspartnerschaft bieten die Unternehmen etwa ein von Trumpf entwickeltes Ortungssystem an, das von T-Systems auf einer Edge-Cloud bereitgestellt wird.

    mehr lesen: Telekom und Trumpf schließen Vertriebspartnerschaft für 5G-System

  • Gründungen auf neuem Tiefststand –  vor allem verarbeitendes Gewerbe betroffen

    Gründungen auf neuem Tiefststand – vor allem verarbeitendes Gewerbe betroffen

    Im Jahr 2018 führten 25 Prozent der jungen Unternehmen im verarbeitenden Gewerbe Marktneuheiten ein. Im aktuellen IAB/ZEW-Gründungspanel ist dieser Wert auf 21 Prozent gesunken. Zudem beobachten die Studienverantwortlichen insgesamt einen…

    mehr lesen: Gründungen auf neuem Tiefststand – vor allem verarbeitendes Gewerbe betroffen

  • Künstliche Intelligenz: Algorithmen und Chips zusammen entwickelt

    Künstliche Intelligenz: Algorithmen und Chips zusammen entwickelt

    Leistungsfähige Mikrochips sind entscheidend für den erfolgreichen Einsatz von künstlicher Intelligenz (KI). Das am Karlsruher Institut für Technologie (KIT) koordinierte Projekt EDAI verfolgt einen neuen Ansatz: Die Forschenden koppeln den…

    mehr lesen: Künstliche Intelligenz: Algorithmen und Chips zusammen entwickelt

  • VDMA-Befragung: Arbeitskräftemangel kostet Umsatz

    VDMA-Befragung: Arbeitskräftemangel kostet Umsatz

    Nur zwei von drei Unternehmen im Maschinenbau können aktuell die Mehrheit ihrer offenen Stellen für Fachkräfte besetzen. Der Arbeitskräftemangel kostet sie nun auch Umsatz.

    mehr lesen: VDMA-Befragung: Arbeitskräftemangel kostet Umsatz

  • Wo Manager zukünftig Cybergefahren sehen

    Wo Manager zukünftig Cybergefahren sehen

    Deutsche und Schweizer C-Level Manager sehen besonders für das Homeoffice Handlungsbedarf, um dort in der Zukunft sensible Daten besser zu schützen. Die Österreicher halten Smart-Building-Technologien für anfällig. Dies zeigen die…

    mehr lesen: Wo Manager zukünftig Cybergefahren sehen

  • Produzenten mit Montage als Teilnehmer gesucht

    Produzenten mit Montage als Teilnehmer gesucht

    Forschende am IPH-Institut für Integrierte Produktion Hannover entwickeln eine Methode, um die Nachhaltigkeit von Automatisierungssystemen zu bewerten und solche Systeme einzuführen. Produzierende Unternehmen können sich am Projekt beteiligen.

    mehr lesen: Produzenten mit Montage als Teilnehmer gesucht

  • Tochterunternehmen Onoff verschmilzt mit SpiraTec

    Tochterunternehmen Onoff verschmilzt mit SpiraTec

    Die Onoff GmbH, eine hundertprozentige Tochterfirma der SpiraTec AG, ist mit der Muttergesellschaft verschmolzen. Die Kombination der Ressourcen, des Knowhows und der Teams soll die Grundlage für die zukünftigen Expansionspläne…

    mehr lesen: Tochterunternehmen Onoff verschmilzt mit SpiraTec

  • Neues Forschungszentrum für die kognitive Produktion entsteht

    Neues Forschungszentrum für die kognitive Produktion entsteht

    Das Fraunhofer-Institut für Werkzeugmaschinen und Umformtechnik IWU hat den Bau des neuen Forschungszentrums begonnen. Im Neubau soll dann an Systemen im Sinn einer kognitiven Produktion geforscht werden. Konkreter ist damit…

    mehr lesen: Neues Forschungszentrum für die kognitive Produktion entsteht

  • 86 Prozent finden DSGVO-Umsetzung schwierig

    86 Prozent finden DSGVO-Umsetzung schwierig

    Für 86 Prozent der Firmen ist es sehr herausfordernd, die DSGVO umzusetzen, ergab eine Umfrage von Piwik Pro. Doch dass Konformität und ihre Marketingaktivitäten vereinbar seien, gaben 90 Prozent der…

    mehr lesen: 86 Prozent finden DSGVO-Umsetzung schwierig

  • SuperOffice-CEO Jentoft geht nach 18 Jahren

    SuperOffice-CEO Jentoft geht nach 18 Jahren

    Der CRM-Softwareanbieter SuperOffice hat Lars Engbork zum neuen CEO ernannt. Er übernimmt die Leitung von Gisle Jentoft, der das norwegische Unternehmen 18 Jahre lang geführt hat. Seit 2020 hält der…

    mehr lesen: SuperOffice-CEO Jentoft geht nach 18 Jahren

  • Transferprojekt vermittelt Blockchain-Wissen für KMU

    Transferprojekt vermittelt Blockchain-Wissen für KMU

    Im neu gestarteten Projekt DUH-IT sollen KMU aus Dortmund, Unna und Hamm den Einsatz von Blockchain-Technologie in der Lieferkettengestaltung erkunden. So wollen das Fraunhofer IML und die TU Dortmund die…

    mehr lesen: Transferprojekt vermittelt Blockchain-Wissen für KMU