Retrieval Augmented Generation als Unterstützung für LLMs

Die Qualität der Antworten von Chatbots, die auf großen Sprachmodellen basieren, hängt von den Trainingsdaten ab: Grundlage sind meist eine Fülle öffentlich zugänglicher Dokumente. Die Verlässlichkeit der Antworten sollten Nutzerinnen und Nutzer kritisch prüfen.
Die Qualität der Antworten von Chatbots, die auf großen Sprachmodellen basieren, hängt von den Trainingsdaten ab: Grundlage sind meist eine Fülle öffentlich zugänglicher Dokumente. Die Verlässlichkeit der Antworten sollten Nutzerinnen und Nutzer kritisch prüfen. – Bild: © Galeanu Mihai/istock.com

Large Language Models (LLM) bzw. große Sprachmodelle liefern in Chatbots auf alltägliche Anfragen häufig gute bis sehr gute Ergebnisse, die oft für eine erste Orientierung mehr als ausreichend sind. Forschende am Fraunhofer IWU geben allerdings zu bedenken, dass Trainingsdatensätze unvollständig oder veraltet sowie einige Informationen unscharf oder gar falsch sein können. Sie raten daher zu einer Überprüfung der erhaltenen Auskünfte. So sollte man sich etwa bei Rechtsfragen nicht ‚blind‘ auf einen Chatbot verlassen. Und was, wenn von den Angaben die Sicherheit von Menschen abhängen kann? Doch wieder selbst eingehend relevante Dokumente studieren?

Retrieval Augmented Generation

Mit Retrieval Augmented Generation (RAG) wollen Forschende am Fraunhofer IWU hier Abhilfe schaffen und zusätzliche Leitplanken für Sprachmodelle schaffen. Das LLM durchleuchtet dann in erster Linie maßgebliche Texte bzw. Textstellen. Das Sprachmodell wird dabei nicht neu trainiert, sondern selektiv erweitert.

Betrieb auch auf Standard-PCs

Als Sprachmodell verwenden die Forschenden LLaMA (Large Language Model Meta AI). Dieses sei groß bzw. leistungsfähig genug und überfordere dennoch nicht Rechenleistung und Grafikkarte eines hochwertigen Standard-PCs. Die Anwendung kann somit auf einem lokalen Rechner betrieben werden und Unternehmen behalten die Hoheit über ihre Daten. Bei weniger sensiblen Daten ist auch der Betrieb in der Cloud möglich.

Wie funktioniert RAG?

Zunächst müssen die ins LLM zu importierenden Daten auf den reinen Text reduziert werden (Cleaning). Sobald dieser in kleinere Abschnitte (Chunks; auffindbare Bausteine) segmentiert ist, folgt der Aufbau eines Suchsystems (Retrieval System), das die Chunks effizient durchsuchen kann. Die Chunks werden nach relevanten Passagen gegliedert und in einer Vektordatenbank abgelegt, also in mathematische Vektoren umgewandelt, die ihre Bedeutung repräsentieren. Auch die Prompts werden in Vektoren umgewandelt. So wird das Modell in die Lage versetzt, nach den in der Anfrage enthaltenen Wörtern zu suchen und gleichzeitig den Prompt tatsächlich zu ‚verstehen‘ (semantische Suche). Das Modell kann jetzt die zu einer Nutzeranfrage passenden Chunks kürzen, neu strukturieren, die wichtigsten Informationen herausfiltern und zu einem verständlichen Zusammenhang kombinieren. Liegt eine konkrete Suchanfrage vor, stehen ausgewählte Chunks zur Verfügung, auf deren Grundlage das Modell faktenbasierte Antworten geben kann. Das Modell nutzt den zusätzlichen Kontext der Chunks und muss nicht neu trainiert werden.

Seiten: 1 2



  • Nostradamus arbeitet an europäischer Quanten-Testinfrastruktur

    Nostradamus arbeitet an europäischer Quanten-Testinfrastruktur

    Kommunikationsnetz mit Quantenverschlüsselung Nostradamus arbeitet an europäischer Quanten-Testinfrastruktur Ein von der Telekom geführtes Konsortium verantwortet den Aufbau von Quanten-Testinfrastruktur für Europa. Die Europäische Union will damit die Sicherheit ihrer Kommunikationsnetze,…

    mehr lesen: Nostradamus arbeitet an europäischer Quanten-Testinfrastruktur

  • Unternehmen ziehen gemischte LkSG-Bilanz

    Unternehmen ziehen gemischte LkSG-Bilanz

    Ein Jahr Lieferkettensorgfaltspflichtengesetz Unternehmen ziehen gemischte LkSG-Bilanz Eine Studie von IntegrityNext zeigt, dass Unternehmen ab 3.000 Mitarbeitenden eine mäßig positive Bilanz nach dem ersten Jahr des Lieferkettensorgfaltspflichtengesetzes (LkSG) ziehen. Als…

    mehr lesen: Unternehmen ziehen gemischte LkSG-Bilanz

  • Umati eröffnet Showroom in China

    Umati eröffnet Showroom in China

    Ab sofort können sich Interessierte auch in China live von den Vorteilen offener, standardisierter Schnittstellen auf Basis von OPC UA überzeugen und Umati besser kennenlernen. Die gemeinsame Konnektivitätsinitiative von VDW…

    mehr lesen: Umati eröffnet Showroom in China

  • Vagner Rego wird neuer Chef von Atlas Copco

    Vagner Rego wird neuer Chef von Atlas Copco

    Ab Mai in neuer Position Vagner Rego wird neuer Chef von Atlas Copco Zum 1. Mai übernimmt der Brasilianer Vagner Rego beim schwedischen Industriekonzern Atlas Copco die Position des Präsidenten…

    mehr lesen: Vagner Rego wird neuer Chef von Atlas Copco

  • Mehr Sicherheit für 5G/6G-Infrastrukturen

    Mehr Sicherheit für 5G/6G-Infrastrukturen

    Forschungsprojekt RealSec5G Mehr Sicherheit für 5G/6G-Infrastrukturen Im Projekt ’RealSec5G’ sollen die Anforderungen der Datensicherheit in Kommunikationsgeräten für 5G/6G-Infrastrukturen in einem deterministischen Time-Sensitive-Netzwerk (TSN) erprobt werden. Im Projekt konzipiert das Fraunhofer-Institut…

    mehr lesen: Mehr Sicherheit für 5G/6G-Infrastrukturen

  • Synostik stellt Geschäftsführer Maik Ekert vor

    Synostik stellt Geschäftsführer Maik Ekert vor

    Mit sofortiger Wirkung Synostik stellt Geschäftsführer Maik Ekert vor Der IT-Dienstleister Synostik gibt Veränderungen in der Führungsebene bekannt und hat Maik Ekert mit sofortiger Wirkung zum Geschäftsführer ernannt.

    mehr lesen: Synostik stellt Geschäftsführer Maik Ekert vor

  • Aleph Alpha erweitert Führungsteam

    Aleph Alpha erweitert Führungsteam

    Jan Hiesserich ist neuer Vice President of Strategy & Communications bei Aleph Alpha. Er kommt vom US-Datenanalyse-Spezialisten Palantir Technologies zum Heidelberger KI-Startup.

    mehr lesen: Aleph Alpha erweitert Führungsteam

  • Fabian Kuttenkeuler leitet Vertrieb

    Fabian Kuttenkeuler leitet Vertrieb

    Wechsel bei Kontron Electronics Fabian Kuttenkeuler leitet Vertrieb Kontron Electronics hat einen neuen Vertriebsleiter. Fabian Kuttenkeuler übernimmt das Amt von Franz Ott, der neuer Business Development Manager des Unternehmens wird.

    mehr lesen: Fabian Kuttenkeuler leitet Vertrieb

  • KI und Hochleistungscomputer beschleunigen Forschung

    KI und Hochleistungscomputer beschleunigen Forschung

    Materialwissenschaft KI und Hochleistungscomputer beschleunigen Forschung Forschende gehen davon aus, ihre Arbeit mit einer Kombination aus künstlicher Intelligenz (KI) und Cloud Computing auf ein Tempo beschleunigen zu können, das bis…

    mehr lesen: KI und Hochleistungscomputer beschleunigen Forschung

  • Antrieb 4.0: Forschung für zukunftsfähige Antriebslösungen

    Antrieb 4.0: Forschung für zukunftsfähige Antriebslösungen

    Antriebe der Zukunft entwickeln Antrieb 4.0: Forschung für zukunftsfähige Antriebslösungen Im Forschungsprojekt Antrieb 4.0 sollen Ansätze für mehr Effizienz und Nachhaltigkeit in Antriebssystemen entwickelt werden. Ein Use Case zielt darauf…

    mehr lesen: Antrieb 4.0: Forschung für zukunftsfähige Antriebslösungen

  • Die industrielle Bildverarbeitung in der Automobilbranche

    Die industrielle Bildverarbeitung in der Automobilbranche

    Vergleich zwischen Deutschland und Großbritannien Die industrielle Bildverarbeitung in der Automobilbranche 43 Prozent der deutschen Automotive-Unternehmen setzen KI in der Bildverarbeitung ein. In Großbritannien sind es mehr als die Hälfte.…

    mehr lesen: Die industrielle Bildverarbeitung in der Automobilbranche

  • Warum Unternehmen zu einem APS-System greifen

    Warum Unternehmen zu einem APS-System greifen

    Im Maschinen- und Anlagenbau sind effiziente Fertigungs- und Planungsprozesse unerlässlich. Advanced-Planning-and-Scheduling-Systeme (APS) gewinnen in diesem Zusammenhang an Bedeutung. Der Aachener Softwarespezialist Inform hat in einer Kundenbefragung die Ziele und Einflussfaktoren…

    mehr lesen: Warum Unternehmen zu einem APS-System greifen