Retrieval Augmented Generation als Unterstützung für LLMs

Die Qualität der Antworten von Chatbots, die auf großen Sprachmodellen basieren, hängt von den Trainingsdaten ab: Grundlage sind meist eine Fülle öffentlich zugänglicher Dokumente. Die Verlässlichkeit der Antworten sollten Nutzerinnen und Nutzer kritisch prüfen.
Die Qualität der Antworten von Chatbots, die auf großen Sprachmodellen basieren, hängt von den Trainingsdaten ab: Grundlage sind meist eine Fülle öffentlich zugänglicher Dokumente. Die Verlässlichkeit der Antworten sollten Nutzerinnen und Nutzer kritisch prüfen. – Bild: © Galeanu Mihai/istock.com

Large Language Models (LLM) bzw. große Sprachmodelle liefern in Chatbots auf alltägliche Anfragen häufig gute bis sehr gute Ergebnisse, die oft für eine erste Orientierung mehr als ausreichend sind. Forschende am Fraunhofer IWU geben allerdings zu bedenken, dass Trainingsdatensätze unvollständig oder veraltet sowie einige Informationen unscharf oder gar falsch sein können. Sie raten daher zu einer Überprüfung der erhaltenen Auskünfte. So sollte man sich etwa bei Rechtsfragen nicht ‚blind‘ auf einen Chatbot verlassen. Und was, wenn von den Angaben die Sicherheit von Menschen abhängen kann? Doch wieder selbst eingehend relevante Dokumente studieren?

Retrieval Augmented Generation

Mit Retrieval Augmented Generation (RAG) wollen Forschende am Fraunhofer IWU hier Abhilfe schaffen und zusätzliche Leitplanken für Sprachmodelle schaffen. Das LLM durchleuchtet dann in erster Linie maßgebliche Texte bzw. Textstellen. Das Sprachmodell wird dabei nicht neu trainiert, sondern selektiv erweitert.

Betrieb auch auf Standard-PCs

Als Sprachmodell verwenden die Forschenden LLaMA (Large Language Model Meta AI). Dieses sei groß bzw. leistungsfähig genug und überfordere dennoch nicht Rechenleistung und Grafikkarte eines hochwertigen Standard-PCs. Die Anwendung kann somit auf einem lokalen Rechner betrieben werden und Unternehmen behalten die Hoheit über ihre Daten. Bei weniger sensiblen Daten ist auch der Betrieb in der Cloud möglich.

Wie funktioniert RAG?

Zunächst müssen die ins LLM zu importierenden Daten auf den reinen Text reduziert werden (Cleaning). Sobald dieser in kleinere Abschnitte (Chunks; auffindbare Bausteine) segmentiert ist, folgt der Aufbau eines Suchsystems (Retrieval System), das die Chunks effizient durchsuchen kann. Die Chunks werden nach relevanten Passagen gegliedert und in einer Vektordatenbank abgelegt, also in mathematische Vektoren umgewandelt, die ihre Bedeutung repräsentieren. Auch die Prompts werden in Vektoren umgewandelt. So wird das Modell in die Lage versetzt, nach den in der Anfrage enthaltenen Wörtern zu suchen und gleichzeitig den Prompt tatsächlich zu ‚verstehen‘ (semantische Suche). Das Modell kann jetzt die zu einer Nutzeranfrage passenden Chunks kürzen, neu strukturieren, die wichtigsten Informationen herausfiltern und zu einem verständlichen Zusammenhang kombinieren. Liegt eine konkrete Suchanfrage vor, stehen ausgewählte Chunks zur Verfügung, auf deren Grundlage das Modell faktenbasierte Antworten geben kann. Das Modell nutzt den zusätzlichen Kontext der Chunks und muss nicht neu trainiert werden.

Seiten: 1 2



  • Open Community Experience feiert Premiere in Mainz

    Open Community Experience feiert Premiere in Mainz

    Vom 22. bis 24. Oktober 2024 feiert die OCX in Mainz Premiere und bringt Open Source Communities zusammen. Der Fokus der Veranstaltung liegt auf den Bereichen Automotive und Mobility, Development…

    mehr lesen: Open Community Experience feiert Premiere in Mainz

  • Stehen humanoide Roboter bald am Fließband?

    Stehen humanoide Roboter bald am Fließband?

    Humanoide Roboter könnten ab 2025 serienreif sein. Das prognostiziert die Managementberatung Horváth und geht weiter davon aus, dass sich mit diesen Robotern mehr als 50 Prozent der manuellen Tätigkeiten automatisieren…

    mehr lesen: Stehen humanoide Roboter bald am Fließband?

  • Mehr Cyberangriffe, weniger Plagiatsfälle

    Mehr Cyberangriffe, weniger Plagiatsfälle

    Rund ein Viertel der Maschinen- und Anlagenbauer berichtet von signifikanten Cybersicherheitsvorfällen in den vergangenen zwei Jahren. Plagiatsfälle gingen in diesem Zeitraum hingegen zurück.

    mehr lesen: Mehr Cyberangriffe, weniger Plagiatsfälle

  • Stand der OT-Sicherheit

    Stand der OT-Sicherheit

    Ein neuer Bericht von ABI Research und Palo Alto Networks über den Stand der OT-Sicherheit hat ergeben, dass im vergangenen Jahr eines von vier Industrieunternehmen angab, seinen Betrieb aufgrund eines…

    mehr lesen: Stand der OT-Sicherheit

  • Forschungsbeirat und Plattform Industrie 4.0 bleiben bei 4.0

    Forschungsbeirat und Plattform Industrie 4.0 bleiben bei 4.0

    Im Rahmen der Hannover Messe 2024 haben der Forschungsbeirat Industrie 4.0 sowie die Plattform Industrie 4.0 Stellung zum Umgang mit dem Begriff ‚Industrie 5.0‘ genommen.

    mehr lesen: Forschungsbeirat und Plattform Industrie 4.0 bleiben bei 4.0

  • Maschinenbau rechnet nicht mit Konjunkturerholung

    Maschinenbau rechnet nicht mit Konjunkturerholung

    Besorgt blicken die Entscheidungsträger im Maschinen- und Anlagenbau auf die konjunkturelle Entwicklung in Deutschland.

    mehr lesen: Maschinenbau rechnet nicht mit Konjunkturerholung

  • Sprint zur Cyber Resilience Act-Konformität

    Sprint zur Cyber Resilience Act-Konformität

    Wie erfüllt Open Source Software die Anforderungen des europäischen Cyber Resilience Act? Auf Basis etablierter Prozesse wollen die Apache Software Foundation, die Blender Foundation, die OpenSSL Software Foundation, die PHP…

    mehr lesen: Sprint zur Cyber Resilience Act-Konformität

  • Wie KI und Mensch im Team zusammenarbeiten

    Wie KI und Mensch im Team zusammenarbeiten

    In einer neuen Expertise mit dem Titel ‘künstliche Intelligenz und industrielle Arbeit’ des Forschungsbeirats Industrie 4.0 zeigen das Fraunhofer IEM und das Fraunhofer IML Gestaltungsoptionen und Handlungsfelder auf, wie KI…

    mehr lesen: Wie KI und Mensch im Team zusammenarbeiten

  • VDMA: -7% für europäische Bildverarbeitungsindustrie

    VDMA: -7% für europäische Bildverarbeitungsindustrie

    Basierend auf den neuesten VDMA-Umfragen, verzeichnete die europäische Bildverarbeitungsindustrie 2023 einen Umsatzrückgang von 7%. Die VDMA Fachabteilung Machine Vision rechnet mit einem weiteren Umsatzrückgang von 3% für das laufende Jahr.

    mehr lesen: VDMA: -7% für europäische Bildverarbeitungsindustrie

  • Industrie noch zurückhaltend bei Manufacturing-X

    Industrie noch zurückhaltend bei Manufacturing-X

    Manufacturing-X ist vielen Unternehmen zwar ein Begriff. Allerdings haben sich bisher die meisten Industrieunternehmen noch nicht näher mit dem Datenökosystem befasst.

    mehr lesen: Industrie noch zurückhaltend bei Manufacturing-X

  • 159.000 offene Stellen in Ingenieurberufen

    159.000 offene Stellen in Ingenieurberufen

    Die Zahl der offenen Stellen in Ingenieurberufen bewegt sich im vierten Quartal 2023 weiter auf hohem Niveau. Besonders Berufsfelder mit Klimaschutz- und Digitalisierungsbezug weisen im aktuellen VDI/IW-Ingenieurmonitor eine hohe Engpasskennziffer…

    mehr lesen: 159.000 offene Stellen in Ingenieurberufen

  • Infosys übernimmt In-tech

    Infosys übernimmt In-tech

    In-Tech wird Teil von Infosys. Dies gaben die Unternehmen am Donnerstag bekannt. Der Abschluss der Übernahme wird für das zweite Quartal 2024 erwartet.

    mehr lesen: Infosys übernimmt In-tech