Retrieval Augmented Generation als Unterstützung für LLMs

Die Qualität der Antworten von Chatbots, die auf großen Sprachmodellen basieren, hängt von den Trainingsdaten ab: Grundlage sind meist eine Fülle öffentlich zugänglicher Dokumente. Die Verlässlichkeit der Antworten sollten Nutzerinnen und Nutzer kritisch prüfen.
Die Qualität der Antworten von Chatbots, die auf großen Sprachmodellen basieren, hängt von den Trainingsdaten ab: Grundlage sind meist eine Fülle öffentlich zugänglicher Dokumente. Die Verlässlichkeit der Antworten sollten Nutzerinnen und Nutzer kritisch prüfen. – Bild: © Galeanu Mihai/istock.com

Large Language Models (LLM) bzw. große Sprachmodelle liefern in Chatbots auf alltägliche Anfragen häufig gute bis sehr gute Ergebnisse, die oft für eine erste Orientierung mehr als ausreichend sind. Forschende am Fraunhofer IWU geben allerdings zu bedenken, dass Trainingsdatensätze unvollständig oder veraltet sowie einige Informationen unscharf oder gar falsch sein können. Sie raten daher zu einer Überprüfung der erhaltenen Auskünfte. So sollte man sich etwa bei Rechtsfragen nicht ‚blind‘ auf einen Chatbot verlassen. Und was, wenn von den Angaben die Sicherheit von Menschen abhängen kann? Doch wieder selbst eingehend relevante Dokumente studieren?

Retrieval Augmented Generation

Mit Retrieval Augmented Generation (RAG) wollen Forschende am Fraunhofer IWU hier Abhilfe schaffen und zusätzliche Leitplanken für Sprachmodelle schaffen. Das LLM durchleuchtet dann in erster Linie maßgebliche Texte bzw. Textstellen. Das Sprachmodell wird dabei nicht neu trainiert, sondern selektiv erweitert.

Betrieb auch auf Standard-PCs

Als Sprachmodell verwenden die Forschenden LLaMA (Large Language Model Meta AI). Dieses sei groß bzw. leistungsfähig genug und überfordere dennoch nicht Rechenleistung und Grafikkarte eines hochwertigen Standard-PCs. Die Anwendung kann somit auf einem lokalen Rechner betrieben werden und Unternehmen behalten die Hoheit über ihre Daten. Bei weniger sensiblen Daten ist auch der Betrieb in der Cloud möglich.

Wie funktioniert RAG?

Zunächst müssen die ins LLM zu importierenden Daten auf den reinen Text reduziert werden (Cleaning). Sobald dieser in kleinere Abschnitte (Chunks; auffindbare Bausteine) segmentiert ist, folgt der Aufbau eines Suchsystems (Retrieval System), das die Chunks effizient durchsuchen kann. Die Chunks werden nach relevanten Passagen gegliedert und in einer Vektordatenbank abgelegt, also in mathematische Vektoren umgewandelt, die ihre Bedeutung repräsentieren. Auch die Prompts werden in Vektoren umgewandelt. So wird das Modell in die Lage versetzt, nach den in der Anfrage enthaltenen Wörtern zu suchen und gleichzeitig den Prompt tatsächlich zu ‚verstehen‘ (semantische Suche). Das Modell kann jetzt die zu einer Nutzeranfrage passenden Chunks kürzen, neu strukturieren, die wichtigsten Informationen herausfiltern und zu einem verständlichen Zusammenhang kombinieren. Liegt eine konkrete Suchanfrage vor, stehen ausgewählte Chunks zur Verfügung, auf deren Grundlage das Modell faktenbasierte Antworten geben kann. Das Modell nutzt den zusätzlichen Kontext der Chunks und muss nicht neu trainiert werden.

Seiten: 1 2



  • Aufatmen in der deutschen Automobilindustrie

    Aufatmen in der deutschen Automobilindustrie

    Im Januar hat sich die Stimmung der deutschen Autobauer verbessert. Trotz einiger positiver Signale, gibt das Ifo Institut jedoch noch keine Entwarnung. Unter anderem bereiten Auftragslage und der Fachkräftemangel sorgen.

    mehr lesen: Aufatmen in der deutschen Automobilindustrie

  • Industrielle Instandhaltung, Pumpen, Armaturen und Ventile im Fokus

    Industrielle Instandhaltung, Pumpen, Armaturen und Ventile im Fokus

    Am 21. Februar 2024 starten die Maintenance als Messe für die industrielle Instandhaltung und die Pumps&Valves als Fachmesse für industrielle Pumpen, Armaturen und Ventile. Auf die Fachbesucher warten rund 240…

    mehr lesen: Industrielle Instandhaltung, Pumpen, Armaturen und Ventile im Fokus

  • Führungswechsel bei Schneider Electric DACH

    Führungswechsel bei Schneider Electric DACH

    Stefan Gierse wird mit Wirkung zum April neuer Zone President der DACH-Organisation von Schneider Electric. Der 45-Jährige war zuvor für Siemens tätig.

    mehr lesen: Führungswechsel bei Schneider Electric DACH

  • Rückgang schwächt sich leicht ab

    Rückgang schwächt sich leicht ab

    Der Orderrückgang des Maschinen- und Anlagenbaus hat sich im Dezember 2023 etwas abgeschwächt – unter dem Strich vermeldet der VDMA für das gesamte Jahr aber dennoch ein zweistelliges Minus der…

    mehr lesen: Rückgang schwächt sich leicht ab

  • Jörg von Ploetz zum CEO ernannt

    Jörg von Ploetz zum CEO ernannt

    Jörg von Ploetz löst Rüdiger Weihs an der Spitze des Softwareunternehmens Böhme & Weihs ab. Von Ploetz war zuvor COO des Qualitätsmanagement-Spezialisten.

    mehr lesen: Jörg von Ploetz zum CEO ernannt

  • Wie Hacker im Darknet Innentäter anwerben

    Wie Hacker im Darknet Innentäter anwerben

    Hacker und Cyberkriminelle bieten im Darknet nicht nur ihre Dienste an oder verkaufen dort erbeutete Datensätze. Sie suchen auch Komplizen, wie etwa unzufriedenen Mitarbeitern. Manchmal bieten diese ihre Dienste sogar…

    mehr lesen: Wie Hacker im Darknet Innentäter anwerben

  • Ein Motorrad fürs Wasserstoffzeitalter

    Ein Motorrad fürs Wasserstoffzeitalter

    Ein deutsch-tschechisches Konsortium aus Forschungseinrichtungen und Unternehmen arbeitet im Projekt Hydrocycle an einem Wasserstoff-Motorrad. Unter anderem wollen die Partner einen neuartigen Brennstoffzellenstack entwickeln

    mehr lesen: Ein Motorrad fürs Wasserstoffzeitalter

  • Verbände üben Kritik am AI Act

    Verbände üben Kritik am AI Act

    Regeln für künstliche Intelligenz Verbände üben Kritik am AI Act In dieser Woche wird Deutschland voraussichtlich grünes Licht für den aktuellen Entwurf des EU AI Acts geben. Verbände äußern jedoch…

    mehr lesen: Verbände üben Kritik am AI Act

  • Hesthaven neuer KIT-Präsident

    Hesthaven neuer KIT-Präsident

    Jan S. Hesthaven folgt auf Holger Hanselka Hesthaven neuer KIT-Präsident Prof. Jan S. Hesthaven wird neuer Präsident des Karlsruher Instituts für Technologie. Er folgt auf Prof. Holger Hanselka, der Mitte…

    mehr lesen: Hesthaven neuer KIT-Präsident

  • Nostradamus arbeitet an europäischer Quanten-Testinfrastruktur

    Nostradamus arbeitet an europäischer Quanten-Testinfrastruktur

    Kommunikationsnetz mit Quantenverschlüsselung Nostradamus arbeitet an europäischer Quanten-Testinfrastruktur Ein von der Telekom geführtes Konsortium verantwortet den Aufbau von Quanten-Testinfrastruktur für Europa. Die Europäische Union will damit die Sicherheit ihrer Kommunikationsnetze,…

    mehr lesen: Nostradamus arbeitet an europäischer Quanten-Testinfrastruktur

  • Unternehmen ziehen gemischte LkSG-Bilanz

    Unternehmen ziehen gemischte LkSG-Bilanz

    Ein Jahr Lieferkettensorgfaltspflichtengesetz Unternehmen ziehen gemischte LkSG-Bilanz Eine Studie von IntegrityNext zeigt, dass Unternehmen ab 3.000 Mitarbeitenden eine mäßig positive Bilanz nach dem ersten Jahr des Lieferkettensorgfaltspflichtengesetzes (LkSG) ziehen. Als…

    mehr lesen: Unternehmen ziehen gemischte LkSG-Bilanz

  • Umati eröffnet Showroom in China

    Umati eröffnet Showroom in China

    Ab sofort können sich Interessierte auch in China live von den Vorteilen offener, standardisierter Schnittstellen auf Basis von OPC UA überzeugen und Umati besser kennenlernen. Die gemeinsame Konnektivitätsinitiative von VDW…

    mehr lesen: Umati eröffnet Showroom in China