Retrieval Augmented Generation als Unterstützung für LLMs

Die Qualität der Antworten von Chatbots, die auf großen Sprachmodellen basieren, hängt von den Trainingsdaten ab: Grundlage sind meist eine Fülle öffentlich zugänglicher Dokumente. Die Verlässlichkeit der Antworten sollten Nutzerinnen und Nutzer kritisch prüfen.
Die Qualität der Antworten von Chatbots, die auf großen Sprachmodellen basieren, hängt von den Trainingsdaten ab: Grundlage sind meist eine Fülle öffentlich zugänglicher Dokumente. Die Verlässlichkeit der Antworten sollten Nutzerinnen und Nutzer kritisch prüfen. – Bild: © Galeanu Mihai/istock.com

Large Language Models (LLM) bzw. große Sprachmodelle liefern in Chatbots auf alltägliche Anfragen häufig gute bis sehr gute Ergebnisse, die oft für eine erste Orientierung mehr als ausreichend sind. Forschende am Fraunhofer IWU geben allerdings zu bedenken, dass Trainingsdatensätze unvollständig oder veraltet sowie einige Informationen unscharf oder gar falsch sein können. Sie raten daher zu einer Überprüfung der erhaltenen Auskünfte. So sollte man sich etwa bei Rechtsfragen nicht ‚blind‘ auf einen Chatbot verlassen. Und was, wenn von den Angaben die Sicherheit von Menschen abhängen kann? Doch wieder selbst eingehend relevante Dokumente studieren?

Retrieval Augmented Generation

Mit Retrieval Augmented Generation (RAG) wollen Forschende am Fraunhofer IWU hier Abhilfe schaffen und zusätzliche Leitplanken für Sprachmodelle schaffen. Das LLM durchleuchtet dann in erster Linie maßgebliche Texte bzw. Textstellen. Das Sprachmodell wird dabei nicht neu trainiert, sondern selektiv erweitert.

Betrieb auch auf Standard-PCs

Als Sprachmodell verwenden die Forschenden LLaMA (Large Language Model Meta AI). Dieses sei groß bzw. leistungsfähig genug und überfordere dennoch nicht Rechenleistung und Grafikkarte eines hochwertigen Standard-PCs. Die Anwendung kann somit auf einem lokalen Rechner betrieben werden und Unternehmen behalten die Hoheit über ihre Daten. Bei weniger sensiblen Daten ist auch der Betrieb in der Cloud möglich.

Wie funktioniert RAG?

Zunächst müssen die ins LLM zu importierenden Daten auf den reinen Text reduziert werden (Cleaning). Sobald dieser in kleinere Abschnitte (Chunks; auffindbare Bausteine) segmentiert ist, folgt der Aufbau eines Suchsystems (Retrieval System), das die Chunks effizient durchsuchen kann. Die Chunks werden nach relevanten Passagen gegliedert und in einer Vektordatenbank abgelegt, also in mathematische Vektoren umgewandelt, die ihre Bedeutung repräsentieren. Auch die Prompts werden in Vektoren umgewandelt. So wird das Modell in die Lage versetzt, nach den in der Anfrage enthaltenen Wörtern zu suchen und gleichzeitig den Prompt tatsächlich zu ‚verstehen‘ (semantische Suche). Das Modell kann jetzt die zu einer Nutzeranfrage passenden Chunks kürzen, neu strukturieren, die wichtigsten Informationen herausfiltern und zu einem verständlichen Zusammenhang kombinieren. Liegt eine konkrete Suchanfrage vor, stehen ausgewählte Chunks zur Verfügung, auf deren Grundlage das Modell faktenbasierte Antworten geben kann. Das Modell nutzt den zusätzlichen Kontext der Chunks und muss nicht neu trainiert werden.

Seiten: 1 2



  • Kuka gründet neues Segment für Software- und Digitalgeschäft

    Kuka gründet neues Segment für Software- und Digitalgeschäft

    Kuka hat einen neuen Geschäftsbereich gegründet. Mit Kuka Digital will der Robotik- und Automatisierungsspezialist aus Augsburg sein Software- und Digitalgeschäft erweitern.

    mehr lesen: Kuka gründet neues Segment für Software- und Digitalgeschäft

  • Zu viele Fernzugriffs-Tools machen OT-Umgebungen angreifbar

    Zu viele Fernzugriffs-Tools machen OT-Umgebungen angreifbar

    55 Prozent der Unternehmen setzen in ihren OT-Umgebungen vier oder mehr Remote-Access-Tools ein, 33 Prozent sogar mindestens sechs.

    mehr lesen: Zu viele Fernzugriffs-Tools machen OT-Umgebungen angreifbar

  • Fraunhofer-Forschende entwickeln Robotersystem zur Qualitätssicherung im 3D-Druck

    Fraunhofer-Forschende entwickeln Robotersystem zur Qualitätssicherung im 3D-Druck

    Können 3D-gedruckte Bauteile in der Luftfahrt eingesetzt werden? Im Projekt Enabl3D entwickeln Forschende nun eine ausreichende Qualitätssicherung für diesen Zweck.

    mehr lesen: Fraunhofer-Forschende entwickeln Robotersystem zur Qualitätssicherung im 3D-Druck

  • Event-Doppelpack zu KI, Daten und Quantencomputing

    Event-Doppelpack zu KI, Daten und Quantencomputing

    Am 25. und 26. September 2024 finden im Kosmos Berlin der AI & Data Summit und der Quantum Summit des Bitkom statt. Im Fokus der Veranstaltungen stehen Anwendungsfälle rund um…

    mehr lesen: Event-Doppelpack zu KI, Daten und Quantencomputing

  • VDMA-Umfrage zu Forschung im Maschinenbau

    VDMA-Umfrage zu Forschung im Maschinenbau

    Wie und wo forscht und entwickelt der deutsche Maschinenbau? Dazu hat der Branchenverband VDMA 400 Firmen befragt. Demnach ist das Innovationstempo hoch und soll weiter steigen. Auch wenn die Unternehmen…

    mehr lesen: VDMA-Umfrage zu Forschung im Maschinenbau

  • Industrieleistung bricht um zwei Prozent ein

    Industrieleistung bricht um zwei Prozent ein

    Deutschlands Wirtschaft könnte 2024 auf der Stelle treten. Nach aktuellen Berechnungen korrigiert das Ifo-Institut das voraussichtliche Wirtschaftswachstum von 0,4 auf null Prozent, die Industrie schrumpft sogar um zwei Prozent. Dafür…

    mehr lesen: Industrieleistung bricht um zwei Prozent ein

  • Maximilian Köpke wird COO/CFO bei Convista

    Maximilian Köpke wird COO/CFO bei Convista

    Das Beratungshaus Convista hat Maximilian Köpke in einer Doppelrolle als COO und CFO ins Boot geholt. Zuvor war der Manager als Partner bei der Boston Consulting Group angestellt.

    mehr lesen: Maximilian Köpke wird COO/CFO bei Convista

  • Fakuma 2024 liefert neue Ansätze für die Kunststoffverarbeitung

    Fakuma 2024 liefert neue Ansätze für die Kunststoffverarbeitung

    Auf der diesjährigen Fakuma, internationale Fachmesse für Kunststoffverarbeitung, vom 15. bis 19. Oktober 2024 wird es neben der Ausstellung auch ein breites Rahmenprogramm geben. Erstmals wird etwa der Karriere-Freitag Teil…

    mehr lesen: Fakuma 2024 liefert neue Ansätze für die Kunststoffverarbeitung

  • Sebastian Spicker wird Managing Director DACH bei IFS

    Sebastian Spicker wird Managing Director DACH bei IFS

    Sebastian Spicker hat die Position des Managing Director DACH bei IFS übernommen.

    mehr lesen: Sebastian Spicker wird Managing Director DACH bei IFS

  • IFS kauft Copperleaf Technologies

    IFS kauft Copperleaf Technologies

    Der schwedische Anbieter von Business-Software IFS kauft Copperleaf Technologies. Das kanadische Unternehmen bietet Analytics-Software etwa für die Investitionsplanung und soll rund eine Milliarde kanadische Dollar kosten, rund 670 Millionen Euro.

    mehr lesen: IFS kauft Copperleaf Technologies

  • Wie steht es um KI und IoT bei unseren Nachbarn?

    Wie steht es um KI und IoT bei unseren Nachbarn?

    Wie etabliert sind Robotik, KI, ML, Big Data und IoT in den europäischen Ländern? Und wie schneidet Deutschland im Vergleich ab? Das hat Reichelt Elektronik Menschen in Deutschland, Frankreich, Italien…

    mehr lesen: Wie steht es um KI und IoT bei unseren Nachbarn?

  • Tech-Festival für Co-Creation in der Automatisierung

    Tech-Festival für Co-Creation in der Automatisierung

    Die vernetzte Fabrik, Datenräume und Automatisierung sind nur einige der Themen, die am 6. November in der Gläsernen Manufaktur Dresden im Mittelpunkt stehen. Für das Event Hub:Disrupt organisieren die Veranstalter…

    mehr lesen: Tech-Festival für Co-Creation in der Automatisierung