Retrieval Augmented Generation als Unterstützung für LLMs

Die Qualität der Antworten von Chatbots, die auf großen Sprachmodellen basieren, hängt von den Trainingsdaten ab: Grundlage sind meist eine Fülle öffentlich zugänglicher Dokumente. Die Verlässlichkeit der Antworten sollten Nutzerinnen und Nutzer kritisch prüfen.
Die Qualität der Antworten von Chatbots, die auf großen Sprachmodellen basieren, hängt von den Trainingsdaten ab: Grundlage sind meist eine Fülle öffentlich zugänglicher Dokumente. Die Verlässlichkeit der Antworten sollten Nutzerinnen und Nutzer kritisch prüfen. – Bild: © Galeanu Mihai/istock.com

Large Language Models (LLM) bzw. große Sprachmodelle liefern in Chatbots auf alltägliche Anfragen häufig gute bis sehr gute Ergebnisse, die oft für eine erste Orientierung mehr als ausreichend sind. Forschende am Fraunhofer IWU geben allerdings zu bedenken, dass Trainingsdatensätze unvollständig oder veraltet sowie einige Informationen unscharf oder gar falsch sein können. Sie raten daher zu einer Überprüfung der erhaltenen Auskünfte. So sollte man sich etwa bei Rechtsfragen nicht ‚blind‘ auf einen Chatbot verlassen. Und was, wenn von den Angaben die Sicherheit von Menschen abhängen kann? Doch wieder selbst eingehend relevante Dokumente studieren?

Retrieval Augmented Generation

Mit Retrieval Augmented Generation (RAG) wollen Forschende am Fraunhofer IWU hier Abhilfe schaffen und zusätzliche Leitplanken für Sprachmodelle schaffen. Das LLM durchleuchtet dann in erster Linie maßgebliche Texte bzw. Textstellen. Das Sprachmodell wird dabei nicht neu trainiert, sondern selektiv erweitert.

Betrieb auch auf Standard-PCs

Als Sprachmodell verwenden die Forschenden LLaMA (Large Language Model Meta AI). Dieses sei groß bzw. leistungsfähig genug und überfordere dennoch nicht Rechenleistung und Grafikkarte eines hochwertigen Standard-PCs. Die Anwendung kann somit auf einem lokalen Rechner betrieben werden und Unternehmen behalten die Hoheit über ihre Daten. Bei weniger sensiblen Daten ist auch der Betrieb in der Cloud möglich.

Wie funktioniert RAG?

Zunächst müssen die ins LLM zu importierenden Daten auf den reinen Text reduziert werden (Cleaning). Sobald dieser in kleinere Abschnitte (Chunks; auffindbare Bausteine) segmentiert ist, folgt der Aufbau eines Suchsystems (Retrieval System), das die Chunks effizient durchsuchen kann. Die Chunks werden nach relevanten Passagen gegliedert und in einer Vektordatenbank abgelegt, also in mathematische Vektoren umgewandelt, die ihre Bedeutung repräsentieren. Auch die Prompts werden in Vektoren umgewandelt. So wird das Modell in die Lage versetzt, nach den in der Anfrage enthaltenen Wörtern zu suchen und gleichzeitig den Prompt tatsächlich zu ‚verstehen‘ (semantische Suche). Das Modell kann jetzt die zu einer Nutzeranfrage passenden Chunks kürzen, neu strukturieren, die wichtigsten Informationen herausfiltern und zu einem verständlichen Zusammenhang kombinieren. Liegt eine konkrete Suchanfrage vor, stehen ausgewählte Chunks zur Verfügung, auf deren Grundlage das Modell faktenbasierte Antworten geben kann. Das Modell nutzt den zusätzlichen Kontext der Chunks und muss nicht neu trainiert werden.

Seiten: 1 2



  • Geschäftsleitung bei IPG neu strukturiert

    Geschäftsleitung bei IPG neu strukturiert

    Nach mehr als 20 Jahren operativer Tätigkeit hat der bisherige CEO und Co-Founder der IPG Group, Marco Rohrer, das Präsidium im Verwaltungsrat der IPG Gruppe übernommen. Claudio Fuchs wird somit…

    mehr lesen: Geschäftsleitung bei IPG neu strukturiert

  • Wieder mehr Menschen in Kurzarbeit

    Wieder mehr Menschen in Kurzarbeit

    Nach Angaben des Ifo Instituts ist die Zahl der Kurzarbeitenden in Deutschland im Dezember auf 879.000 Menschen gestiegen. Vor allem in der Automobilindustrie ist der Anteil an Beschäftigten in Kurzarbeit…

    mehr lesen: Wieder mehr Menschen in Kurzarbeit

  • Autonomer Rennwagen der TU München fährt zum Vizetitel

    Autonomer Rennwagen der TU München fährt zum Vizetitel

    Im Rahmen der Autonomous Challenge @CES hat das Team der Technischen Universität München den 2. Platz belegt. Bei Geschwindigkeiten von bis zu 270km/h belegte am Ende das Team aus Mailand…

    mehr lesen: Autonomer Rennwagen der TU München fährt zum Vizetitel

  • Tobias Klein wird CFO bei Prime Computer

    Tobias Klein wird CFO bei Prime Computer

    Prime Computer hat Tobias Klein zum Chief Financial Officer ernannt. In seiner neuen Position soll er die globale Finanzorganisation des Unternehmens leiten.

    mehr lesen: Tobias Klein wird CFO bei Prime Computer

  • Industrial Digital Twin Association und Open Industry 4.0 Alliance arbeiten zusammen

    Industrial Digital Twin Association und Open Industry 4.0 Alliance arbeiten zusammen

    Im Rahmen einer strategischen Partnerschaft wollen die Industrial Digital Twin Association und Open Industry 4.0 Alliance zusammenarbeiten. Erste Kooperationsprojekte werden Ende Januar vorgestellt.

    mehr lesen: Industrial Digital Twin Association und Open Industry 4.0 Alliance arbeiten zusammen

  • Kritische Berichte über KI in der Unterzahl

    Kritische Berichte über KI in der Unterzahl

    Über künstliche Intelligenz wird in der Medienlandschaft weitgehend positiv berichtet, so eine Analyse des KI-Spezialisten SAS. Laut Analyse ist der überwiegende Teil der Berichterstattung dabei entweder deutlich kritisch oder deutlich…

    mehr lesen: Kritische Berichte über KI in der Unterzahl

  • Aus Auvesy und MDT Software wird Auvesy-MDT

    Aus Auvesy und MDT Software wird Auvesy-MDT

    Auvesy und MDT Software schließen sich zur Auvesy-MDT zusammen und wollen künftig unter der neuen Marke Softwarelösungen für die industrielle Automatisierung anbieten.

    mehr lesen: Aus Auvesy und MDT Software wird Auvesy-MDT

  • Spielerisch zu mehr MES-Knowhow

    Spielerisch zu mehr MES-Knowhow

    Was ist eigentlich eine Smart Factory? Dieser Frage nähert sich die MPDV-Gruppe spielerisch und hat dafür die App MyFactoryMania auf den Markt gebracht.

    mehr lesen: Spielerisch zu mehr MES-Knowhow

  • Fellowmind übernimmt ERP-Spezialisten Applabs

    Fellowmind übernimmt ERP-Spezialisten Applabs

    Der Microsoft Gold-Partner Fellowmind treibt seine Wachstumsstrategie weiter voran und hat mit Applabs ein drittes deutsches Unternehmen übernommen.

    mehr lesen: Fellowmind übernimmt ERP-Spezialisten Applabs

  • NTI Kailer eröffnet Standort in Burgau

    NTI Kailer eröffnet Standort in Burgau

    NTI Kailer expandiert mit einem weiterem Standort im Burgau (Bayern). Insgesamt verfügt das Unternehmen somit über 11 Niederlassungen in Deutschland.

    mehr lesen: NTI Kailer eröffnet Standort in Burgau

  • Gesellschaftlichen Problemen mit technischem Fortschritt entgegentreten

    Gesellschaftlichen Problemen mit technischem Fortschritt entgegentreten

    Technologien können die Welt verbessern und beispielsweise bei der Bewältigung des Klimawandels helfen. Das geht aus dem Bosch Tech Compass hervor.

    mehr lesen: Gesellschaftlichen Problemen mit technischem Fortschritt entgegentreten

  • FIS-Geschäftsführung ordnet sich neu

    FIS-Geschäftsführung ordnet sich neu

    Nachdem Wolfgang Ebner und Frank Schöngarth in diesem Jahr ihren Ruhestand antreten, hat sich die FIS-Geschäftsleitung neu geordnet. Die Nachfolge der scheidenden Geschäftsführer treten Dieter Ball und Dirk Schneider an.

    mehr lesen: FIS-Geschäftsführung ordnet sich neu