Retrieval Augmented Generation als Unterstützung für LLMs

Die Qualität der Antworten von Chatbots, die auf großen Sprachmodellen basieren, hängt von den Trainingsdaten ab: Grundlage sind meist eine Fülle öffentlich zugänglicher Dokumente. Die Verlässlichkeit der Antworten sollten Nutzerinnen und Nutzer kritisch prüfen.
Die Qualität der Antworten von Chatbots, die auf großen Sprachmodellen basieren, hängt von den Trainingsdaten ab: Grundlage sind meist eine Fülle öffentlich zugänglicher Dokumente. Die Verlässlichkeit der Antworten sollten Nutzerinnen und Nutzer kritisch prüfen. – Bild: © Galeanu Mihai/istock.com

Large Language Models (LLM) bzw. große Sprachmodelle liefern in Chatbots auf alltägliche Anfragen häufig gute bis sehr gute Ergebnisse, die oft für eine erste Orientierung mehr als ausreichend sind. Forschende am Fraunhofer IWU geben allerdings zu bedenken, dass Trainingsdatensätze unvollständig oder veraltet sowie einige Informationen unscharf oder gar falsch sein können. Sie raten daher zu einer Überprüfung der erhaltenen Auskünfte. So sollte man sich etwa bei Rechtsfragen nicht ‚blind‘ auf einen Chatbot verlassen. Und was, wenn von den Angaben die Sicherheit von Menschen abhängen kann? Doch wieder selbst eingehend relevante Dokumente studieren?

Retrieval Augmented Generation

Mit Retrieval Augmented Generation (RAG) wollen Forschende am Fraunhofer IWU hier Abhilfe schaffen und zusätzliche Leitplanken für Sprachmodelle schaffen. Das LLM durchleuchtet dann in erster Linie maßgebliche Texte bzw. Textstellen. Das Sprachmodell wird dabei nicht neu trainiert, sondern selektiv erweitert.

Betrieb auch auf Standard-PCs

Als Sprachmodell verwenden die Forschenden LLaMA (Large Language Model Meta AI). Dieses sei groß bzw. leistungsfähig genug und überfordere dennoch nicht Rechenleistung und Grafikkarte eines hochwertigen Standard-PCs. Die Anwendung kann somit auf einem lokalen Rechner betrieben werden und Unternehmen behalten die Hoheit über ihre Daten. Bei weniger sensiblen Daten ist auch der Betrieb in der Cloud möglich.

Wie funktioniert RAG?

Zunächst müssen die ins LLM zu importierenden Daten auf den reinen Text reduziert werden (Cleaning). Sobald dieser in kleinere Abschnitte (Chunks; auffindbare Bausteine) segmentiert ist, folgt der Aufbau eines Suchsystems (Retrieval System), das die Chunks effizient durchsuchen kann. Die Chunks werden nach relevanten Passagen gegliedert und in einer Vektordatenbank abgelegt, also in mathematische Vektoren umgewandelt, die ihre Bedeutung repräsentieren. Auch die Prompts werden in Vektoren umgewandelt. So wird das Modell in die Lage versetzt, nach den in der Anfrage enthaltenen Wörtern zu suchen und gleichzeitig den Prompt tatsächlich zu ‚verstehen‘ (semantische Suche). Das Modell kann jetzt die zu einer Nutzeranfrage passenden Chunks kürzen, neu strukturieren, die wichtigsten Informationen herausfiltern und zu einem verständlichen Zusammenhang kombinieren. Liegt eine konkrete Suchanfrage vor, stehen ausgewählte Chunks zur Verfügung, auf deren Grundlage das Modell faktenbasierte Antworten geben kann. Das Modell nutzt den zusätzlichen Kontext der Chunks und muss nicht neu trainiert werden.

Seiten: 1 2



  • MES zwischen On-Premise und Cloud-Betrieb

    MES zwischen On-Premise und Cloud-Betrieb

    Der MES-Anbieter Proxia Software kapselt Funktionen seiner Software, um Anwendern mehr Flexibilität beim Cloud-Betrieb ihres Produktionssteuerungssystems zu ermöglichen. Eine Datenvorverarbeitung im sogenannten Fog Layer soll durch eine geringere Anzahl an…

    mehr lesen: MES zwischen On-Premise und Cloud-Betrieb

  • Zwei Neuzugänge bei Igel

    Zwei Neuzugänge bei Igel

    Christiane Ohlgart und Kris Hamner verstärken das Management-Team von Igel. Ohlgart wird als neue Finanzchefin und Hamner als neuer Personalchef zum Executive Team in San Francisco stoßen.

    mehr lesen: Zwei Neuzugänge bei Igel

  • Einheitliche Standards für die Industrie 4.0

    Einheitliche Standards für die Industrie 4.0

    In dem vom Bundesministerium für Wirtschaft und Energie geförderten Forschungsprojekt InterOpera wollen Forscherinnen und Forscher zusammen mit der Industrie einheitliche Methoden zur Umsetzung der Verwaltungsschale in der Praxis erarbeiten.

    mehr lesen: Einheitliche Standards für die Industrie 4.0

  • BSI fordert den Crashtest für Cyber-Sicherheit

    BSI fordert den Crashtest für Cyber-Sicherheit

    In seinem Branchenbild Automotive spricht sich das Bundesamt für Sicherheit in der Informationstechnik dafür aus, auch die Cybersicherheit in der Lieferkette der Automobilbauer bzw. in einem frühen Entwicklungsstadium in den…

    mehr lesen: BSI fordert den Crashtest für Cyber-Sicherheit

  • Schnittstellen validieren in regulierten Industrien

    Schnittstellen validieren in regulierten Industrien

    Die Richtlinie VDI/VDE 3516 Blatt 6 ‚Validierung im GxP-Umfeld – Validierung von Schnittstellen‘ ist im August 2021 erschienen. Sie lässt sich zur Validierung von Schnittstellen zwischen computergestützten Systemen im regulierten…

    mehr lesen: Schnittstellen validieren in regulierten Industrien

  • Motek 2021: Montagetechnik-Messe mit echten Menschen

    Motek 2021: Montagetechnik-Messe mit echten Menschen

    Fachbesucher der industriellen Automatisierungsbranche treffen sich vom 5. bis 8. Oktober auf dem Messeduo Motek/Bondexpo in Stuttgart. Beide Messen sollen als Präsenzmesse stattfinden.

    mehr lesen: Motek 2021: Montagetechnik-Messe mit echten Menschen

  • Materialmangel der Industrie verschärft sich

    Materialmangel der Industrie verschärft sich

    Der Materialmangel in der deutschen Industrie hat sich weiter verschärft. 69,2 Prozent der Industriefirmen in Deutschland klagten im August laut einer Umfrage des Ifo Instituts über Engpässe und Probleme bei…

    mehr lesen: Materialmangel der Industrie verschärft sich

  • T-Systems und Google arbeiten an souveräner Cloud

    T-Systems und Google arbeiten an souveräner Cloud

    Gemeinsam wollen T-Systems und Google Cloud ab Mitte 2022 eine souveräne Cloud für Deutschland zur Verfügung stellen. Der Betrieb der Cloud unterliegt dabei der Kontrolle von T-Systems.

    mehr lesen: T-Systems und Google arbeiten an souveräner Cloud

  • Open Industry 4.0 Alliance und Packaging Valley arbeiten zusammen

    Open Industry 4.0 Alliance und Packaging Valley arbeiten zusammen

    Open Industry 4.0 Alliance und Packaging Valley wollen gemeinsam die herstellerübergreifende Integration in der Verpackungsindustrie realisieren. Die Schwerpunkte der Zusammenarbeit liegen auf Master Data Management, Plant Analytics und Predictive Maintenance.

    mehr lesen: Open Industry 4.0 Alliance und Packaging Valley arbeiten zusammen

  • Pepperl+Fuchs übernimmt Aava

    Pepperl+Fuchs übernimmt Aava

    Das finnische Unternehmen Aava gehört ab sofort zur Pepperl+Fuchs-Gruppe. Das Unternehmen bietet u.a. Tablet Computer für die Industrie ab.

    mehr lesen: Pepperl+Fuchs übernimmt Aava

  • Manufacturing Execution-Systeme im Vergleich

    Manufacturing Execution-Systeme im Vergleich

    Der vom Trovarit Competence Center MES in Zusammenarbeit mit dem Fraunhofer Institut Produktionstechnik und Automatisierung (IPA) und dem VDI herausgegebene ’Aachener Marktspiegel Business Software – MES/Fertigungssteuerung 2021/2022‘, untersucht das Angebot…

    mehr lesen: Manufacturing Execution-Systeme im Vergleich

  • Weniger Kurzarbeit im August

    Weniger Kurzarbeit im August

    In Deutschland waren im August nach Angaben des Ifo Instituts 688.000 Menschen in Kurzarbeit, ein deutlicher Rückgang im Vergleich zum Vormonat. Die Lieferengpässe in der Industrie hatten demnach kaum Auswirkungen…

    mehr lesen: Weniger Kurzarbeit im August