Retrieval Augmented Generation als Unterstützung für LLMs

Die Qualität der Antworten von Chatbots, die auf großen Sprachmodellen basieren, hängt von den Trainingsdaten ab: Grundlage sind meist eine Fülle öffentlich zugänglicher Dokumente. Die Verlässlichkeit der Antworten sollten Nutzerinnen und Nutzer kritisch prüfen.
Die Qualität der Antworten von Chatbots, die auf großen Sprachmodellen basieren, hängt von den Trainingsdaten ab: Grundlage sind meist eine Fülle öffentlich zugänglicher Dokumente. Die Verlässlichkeit der Antworten sollten Nutzerinnen und Nutzer kritisch prüfen. – Bild: © Galeanu Mihai/istock.com

Large Language Models (LLM) bzw. große Sprachmodelle liefern in Chatbots auf alltägliche Anfragen häufig gute bis sehr gute Ergebnisse, die oft für eine erste Orientierung mehr als ausreichend sind. Forschende am Fraunhofer IWU geben allerdings zu bedenken, dass Trainingsdatensätze unvollständig oder veraltet sowie einige Informationen unscharf oder gar falsch sein können. Sie raten daher zu einer Überprüfung der erhaltenen Auskünfte. So sollte man sich etwa bei Rechtsfragen nicht ‚blind‘ auf einen Chatbot verlassen. Und was, wenn von den Angaben die Sicherheit von Menschen abhängen kann? Doch wieder selbst eingehend relevante Dokumente studieren?

Retrieval Augmented Generation

Mit Retrieval Augmented Generation (RAG) wollen Forschende am Fraunhofer IWU hier Abhilfe schaffen und zusätzliche Leitplanken für Sprachmodelle schaffen. Das LLM durchleuchtet dann in erster Linie maßgebliche Texte bzw. Textstellen. Das Sprachmodell wird dabei nicht neu trainiert, sondern selektiv erweitert.

Betrieb auch auf Standard-PCs

Als Sprachmodell verwenden die Forschenden LLaMA (Large Language Model Meta AI). Dieses sei groß bzw. leistungsfähig genug und überfordere dennoch nicht Rechenleistung und Grafikkarte eines hochwertigen Standard-PCs. Die Anwendung kann somit auf einem lokalen Rechner betrieben werden und Unternehmen behalten die Hoheit über ihre Daten. Bei weniger sensiblen Daten ist auch der Betrieb in der Cloud möglich.

Wie funktioniert RAG?

Zunächst müssen die ins LLM zu importierenden Daten auf den reinen Text reduziert werden (Cleaning). Sobald dieser in kleinere Abschnitte (Chunks; auffindbare Bausteine) segmentiert ist, folgt der Aufbau eines Suchsystems (Retrieval System), das die Chunks effizient durchsuchen kann. Die Chunks werden nach relevanten Passagen gegliedert und in einer Vektordatenbank abgelegt, also in mathematische Vektoren umgewandelt, die ihre Bedeutung repräsentieren. Auch die Prompts werden in Vektoren umgewandelt. So wird das Modell in die Lage versetzt, nach den in der Anfrage enthaltenen Wörtern zu suchen und gleichzeitig den Prompt tatsächlich zu ‚verstehen‘ (semantische Suche). Das Modell kann jetzt die zu einer Nutzeranfrage passenden Chunks kürzen, neu strukturieren, die wichtigsten Informationen herausfiltern und zu einem verständlichen Zusammenhang kombinieren. Liegt eine konkrete Suchanfrage vor, stehen ausgewählte Chunks zur Verfügung, auf deren Grundlage das Modell faktenbasierte Antworten geben kann. Das Modell nutzt den zusätzlichen Kontext der Chunks und muss nicht neu trainiert werden.

Seiten: 1 2



  • 159.000 offene Stellen in Ingenieurberufen

    159.000 offene Stellen in Ingenieurberufen

    Die Zahl der offenen Stellen in Ingenieurberufen bewegt sich im vierten Quartal 2023 weiter auf hohem Niveau. Besonders Berufsfelder mit Klimaschutz- und Digitalisierungsbezug weisen im aktuellen VDI/IW-Ingenieurmonitor eine hohe Engpasskennziffer…

    mehr lesen: 159.000 offene Stellen in Ingenieurberufen

  • Infosys übernimmt In-tech

    Infosys übernimmt In-tech

    In-Tech wird Teil von Infosys. Dies gaben die Unternehmen am Donnerstag bekannt. Der Abschluss der Übernahme wird für das zweite Quartal 2024 erwartet.

    mehr lesen: Infosys übernimmt In-tech

  • Materialverfügbarkeit nähert sich dem Vor-Corona-Niveau

    Materialverfügbarkeit nähert sich dem Vor-Corona-Niveau

    Die deutsche Industrie hat kaum noch mit Materialknappheit zu kämpfen. Laut Ifo Institut bewegt sich die Materialverfügbarkeit in Richtung Vor-Corona-Niveau.

    mehr lesen: Materialverfügbarkeit nähert sich dem Vor-Corona-Niveau

  • KI mit synthetischen Daten anlernen

    KI mit synthetischen Daten anlernen

    Technologien auf Basis künstlicher Intelligenz (KI) benötigen Trainingsdaten. Diese zügig und in ausreichender Stückzahl zu generieren, stellt Anwender in der verarbeitenden Industrie oft vor Herausforderungen. Das Fraunhofer IGD arbeitet daher…

    mehr lesen: KI mit synthetischen Daten anlernen

  • 11,5 Tage Produktionsverlust durch ineffiziente Kommunikation

    11,5 Tage Produktionsverlust durch ineffiziente Kommunikation

    Ineffiziente Kommunikation im Unternehmen führt laut einer Studie von Grammarly zu einem Produktionsverlust von mehr als 11 Tagen pro Jahr. Die dafür befragten Fachkräfte berichten zudem, dass sie einen große…

    mehr lesen: 11,5 Tage Produktionsverlust durch ineffiziente Kommunikation

  • Warum menschenähnliche Chatbots anders beleidigt werden

    Warum menschenähnliche Chatbots anders beleidigt werden

    Virtuelle Assistenten, sogenannte Chatbots, kommen auf vielen Unternehmenswebseiten zum Einsatz. Eine Studie der TU Dresden hat untersucht, ob Fehler von Chatbots zu aggressivem Verhalten bei ihren Nutzerinnen und Nutzern führen…

    mehr lesen: Warum menschenähnliche Chatbots anders beleidigt werden

  • Valantic und Forcam Enisco vereinbaren strategische Partnerschaft

    Valantic und Forcam Enisco vereinbaren strategische Partnerschaft

    Das Beratungs- und Software-Haus Valantic und der Softwarespezialist Forcam Enisco mit Sitz in Böblingen haben eine strategische Partnerschaft geschlossen. Schwerpunkt der Kooperation soll auf Vernetzungs- und Analyse-Produkten für Fertiger liegen.

    mehr lesen: Valantic und Forcam Enisco vereinbaren strategische Partnerschaft

  • Baustart für neues MPDV-Gebäude in Mosbach

    Baustart für neues MPDV-Gebäude in Mosbach

    Am Unternehmenssitz in Mosbach errichtet MPDV ein neues Bürogebäude. Auf 2.800m² sollen 170 Arbeitsplätze entstehen. Zudem wird die MPDV-Junior-Akademie dort Räumlichkeiten beziehen.

    mehr lesen: Baustart für neues MPDV-Gebäude in Mosbach

  • Achema 2024 mit Angeboten für Nachwuchskräfte

    Achema 2024 mit Angeboten für Nachwuchskräfte

    Im Mittelpunkt des Achema-Auftakts am 10. Juni steht die Frage, wie sich die Prozessindustrie in einer Welt im Wandel erfolgreich positionieren kann. An allen fünf Messetagen sollen zudem zahlreiche Angebote…

    mehr lesen: Achema 2024 mit Angeboten für Nachwuchskräfte

  • Weniger deutsche Unternehmen abhängig von Vorprodukten aus China

    Weniger deutsche Unternehmen abhängig von Vorprodukten aus China

    Im Vergleich zu einer Untersuchung kurz vor Beginn Kriegs in der Ukraine, geben in einer aktuellen Untersuchung des Ifo Instituts weniger Unternehmen an, auf Vorprodukte aus China angewiesen zu sein.

    mehr lesen: Weniger deutsche Unternehmen abhängig von Vorprodukten aus China

  • Nachhaltigkeitsthemen im Datenmanagement abbilden

    Nachhaltigkeitsthemen im Datenmanagement abbilden

    Technologien wie Robotic Process Automation (RPA) oder künstliche Intelligenz (KI) können Unternehmen beim Management von ESG-Daten unterstützen. Der Softwarespezialist Blue Prism beleuchtet die Möglichkeiten.

    mehr lesen: Nachhaltigkeitsthemen im Datenmanagement abbilden

  • Ein Stück näher am Quanteninternet

    Ein Stück näher am Quanteninternet

    Das Quanteninternet verspricht signifikante Verbesserungen in verschiedenen technologischen Schlüsselbereichen. Um dieses jedoch im bestehenden Glaserfasernetz zu realisieren, sind Quantenfrequenzkonverter nötig, die die Wellenlänge von Photonen an das Telekomband (1.550nm) anpassen…

    mehr lesen: Ein Stück näher am Quanteninternet