Retrieval Augmented Generation als Unterstützung für LLMs

Die Qualität der Antworten von Chatbots, die auf großen Sprachmodellen basieren, hängt von den Trainingsdaten ab: Grundlage sind meist eine Fülle öffentlich zugänglicher Dokumente. Die Verlässlichkeit der Antworten sollten Nutzerinnen und Nutzer kritisch prüfen.
Die Qualität der Antworten von Chatbots, die auf großen Sprachmodellen basieren, hängt von den Trainingsdaten ab: Grundlage sind meist eine Fülle öffentlich zugänglicher Dokumente. Die Verlässlichkeit der Antworten sollten Nutzerinnen und Nutzer kritisch prüfen. – Bild: © Galeanu Mihai/istock.com

Large Language Models (LLM) bzw. große Sprachmodelle liefern in Chatbots auf alltägliche Anfragen häufig gute bis sehr gute Ergebnisse, die oft für eine erste Orientierung mehr als ausreichend sind. Forschende am Fraunhofer IWU geben allerdings zu bedenken, dass Trainingsdatensätze unvollständig oder veraltet sowie einige Informationen unscharf oder gar falsch sein können. Sie raten daher zu einer Überprüfung der erhaltenen Auskünfte. So sollte man sich etwa bei Rechtsfragen nicht ‚blind‘ auf einen Chatbot verlassen. Und was, wenn von den Angaben die Sicherheit von Menschen abhängen kann? Doch wieder selbst eingehend relevante Dokumente studieren?

Retrieval Augmented Generation

Mit Retrieval Augmented Generation (RAG) wollen Forschende am Fraunhofer IWU hier Abhilfe schaffen und zusätzliche Leitplanken für Sprachmodelle schaffen. Das LLM durchleuchtet dann in erster Linie maßgebliche Texte bzw. Textstellen. Das Sprachmodell wird dabei nicht neu trainiert, sondern selektiv erweitert.

Betrieb auch auf Standard-PCs

Als Sprachmodell verwenden die Forschenden LLaMA (Large Language Model Meta AI). Dieses sei groß bzw. leistungsfähig genug und überfordere dennoch nicht Rechenleistung und Grafikkarte eines hochwertigen Standard-PCs. Die Anwendung kann somit auf einem lokalen Rechner betrieben werden und Unternehmen behalten die Hoheit über ihre Daten. Bei weniger sensiblen Daten ist auch der Betrieb in der Cloud möglich.

Wie funktioniert RAG?

Zunächst müssen die ins LLM zu importierenden Daten auf den reinen Text reduziert werden (Cleaning). Sobald dieser in kleinere Abschnitte (Chunks; auffindbare Bausteine) segmentiert ist, folgt der Aufbau eines Suchsystems (Retrieval System), das die Chunks effizient durchsuchen kann. Die Chunks werden nach relevanten Passagen gegliedert und in einer Vektordatenbank abgelegt, also in mathematische Vektoren umgewandelt, die ihre Bedeutung repräsentieren. Auch die Prompts werden in Vektoren umgewandelt. So wird das Modell in die Lage versetzt, nach den in der Anfrage enthaltenen Wörtern zu suchen und gleichzeitig den Prompt tatsächlich zu ‚verstehen‘ (semantische Suche). Das Modell kann jetzt die zu einer Nutzeranfrage passenden Chunks kürzen, neu strukturieren, die wichtigsten Informationen herausfiltern und zu einem verständlichen Zusammenhang kombinieren. Liegt eine konkrete Suchanfrage vor, stehen ausgewählte Chunks zur Verfügung, auf deren Grundlage das Modell faktenbasierte Antworten geben kann. Das Modell nutzt den zusätzlichen Kontext der Chunks und muss nicht neu trainiert werden.

Seiten: 1 2



  • Neuer Head of Product bei Insys Icom

    Neuer Head of Product bei Insys Icom

    Insys Icom ernennt René Al-Abid zum Head of Product. Der bisherige Produktmanager soll in seiner neuen Rolle die systematische Verankerung von Security-, Compliance- und Governance-Anforderungen über das gesamte Produktportfolio hinweg…

    mehr lesen: Neuer Head of Product bei Insys Icom

  • Q.Ant macht Lars Bach zum Vice President Operations

    Q.Ant macht Lars Bach zum Vice President Operations

    Das Stuttgarter Tech-Unternehmen Q.Ant baut sein Managementteam weiter aus: Dr. Lars Bach (Bild) hat zum 1. Februar die neu geschaffene Position des Produktionsverantwortlichen als Vice President Operations übernommen.

    mehr lesen: Q.Ant macht Lars Bach zum Vice President Operations

  • Dauerkrisen kosten Deutschland fast eine Billion Euro

    Dauerkrisen kosten Deutschland fast eine Billion Euro

    Corona, Kriege oder die Amtszeit von US-Präsident Donald Trump haben die deutsche Wirtschaft seit 2020 stark belastet.

    mehr lesen: Dauerkrisen kosten Deutschland fast eine Billion Euro

  • IT&Production AI Conference 2026

    IT&Production AI Conference 2026

    KI verändert die industrielle IT. Das Versprechen: Effizienzgewinne, Kostenvorteile und Risikoreduktion entlang der gesamten Wertschöpfungskette.

    mehr lesen: IT&Production AI Conference 2026

  • Webinar: Unified Namespace und IIoT – Datenraum für die Smart Factory

    Webinar: Unified Namespace und IIoT – Datenraum für die Smart Factory

    Der Unified Namespace soll alle Produktions- und Geschäftsdaten aus Maschinen, Sensoren und Systemen in einem gemeinsamen Echtzeit-Raum verfügbar machen – eine Single Source of Truth entsteht.

    mehr lesen: Webinar: Unified Namespace und IIoT – Datenraum für die Smart Factory

  • Forescout ernennt Regional Director für Zentraleuropa

    Forescout ernennt Regional Director für Zentraleuropa

    Forescout Technologies, ein Spezialist für Cybersicherheit, hat die Ernennung von Dirk Decker (Bild) zum Regional Director für Zentraleuropa bekanntgegeben.

    mehr lesen: Forescout ernennt Regional Director für Zentraleuropa

  • Immer weniger Arbeitsplätze hängen vom China-Geschäft ab

    Immer weniger Arbeitsplätze hängen vom China-Geschäft ab

    Die Anzahl der Arbeitsplätze in Deutschland, die vom Export nach China abhängen, ist seit 2021 um rund 40% gesunken, wie eine neue Analyse des Instituts der deutschen Wirtschaft (IW) zeigt.

    mehr lesen: Immer weniger Arbeitsplätze hängen vom China-Geschäft ab

  • Mehr IT-Dienstleister erleben Vorwürfe wegen Schlechtleistung

    Mehr IT-Dienstleister erleben Vorwürfe wegen Schlechtleistung

    Gegen zwei Drittel der IT-Dienstleister wurden im vergangenen Jahr seitens ihrer Auftraggeber Vorwürfe wegen angeblicher Schlechtleistung erhoben.

    mehr lesen: Mehr IT-Dienstleister erleben Vorwürfe wegen Schlechtleistung

  • Enbik und Edgecon gründen Service-Büro

    Enbik und Edgecon gründen Service-Büro

    Enbik, ein in Taiwan beheimateter Hersteller für Industrial Edge Computing und IT-Hardware, und Edgecon gründen in Deggendorf ein Logistik- und Service-Büro für den deutschsprachigen Raum.

    mehr lesen: Enbik und Edgecon gründen Service-Büro

  • Wenn KI-Modelle zum Angriffsziel werden

    Wenn KI-Modelle zum Angriffsziel werden

    Zur Münchner Sicherheitskonferenz (13. bis 15. Februar) hat die Google Threat Intelligence Group (GTIG) einen Bericht veröffentlicht, mit dem die Verfasser die Debatte um KI-gestützte Bedrohungen auf eine operative Ebene…

    mehr lesen: Wenn KI-Modelle zum Angriffsziel werden

  • Ein Tag ohne Internet und alles steht still

    Ein Tag ohne Internet und alles steht still

    Laut einer Untersuchung des Bitkom ist die deutsche Wirtschaft schlecht auf hybride Bedrohungen wie Stromausfälle, Sabotage oder durch Ransomware lahmgelegte Fabriken vorbereitet.

    mehr lesen: Ein Tag ohne Internet und alles steht still

  • Heitec übernimmt Artschwager + Kohl

    Heitec übernimmt Artschwager + Kohl

    Artschwager + Kohl Software ist seit Januar 2026 Teil der Heitec-Gruppe.

    mehr lesen: Heitec übernimmt Artschwager + Kohl