Forschungsprojekt OpenGPT-X veröffentlicht großes KI-Sprachmodell

Stock market trading with AI Artificial Intelligence technology
Bild: ©flyalone/stock.adobe.com


Das große KI-Sprachmodell des Forschungsprojekts OpenGPT-X steht ab sofort auf Hugging Face zum Download bereit: ’Teuken-7B’ wurde von Grund auf mit den 24 Amtssprachen der EU trainiert und umfasst sieben Milliarden Parameter. Akteure aus Forschung und Unternehmen können das kommerziell einsetzbare Open-Source-Modell für ihre eigenen Anwendungen der künstlichen Intelligenz (KI) nutzen. Damit haben die Partner des vom Bundesministerium für Wirtschaft und Klimaschutz (BMWK) geförderten Konsortialprojekts OpenGPT-X unter der Leitung der Fraunhofer-Institute für Intelligente Analyse- und Informationssysteme IAIS und für Integrierte Schaltungen IIS ein großes KI-Sprachmodell als frei verwendbares Open-Source-Modell mit europäischer Perspektive auf den Weg gebracht.

„Im Projekt OpenGPT-X haben wir in den vergangenen zwei Jahren mit starken Partnern aus Forschung und Wirtschaft die grundlegende Technologie für große KI-Fundamentalmodelle erforscht und entsprechende Modelle trainiert. Wir freuen uns, dass wir jetzt unser Modell weltweit frei zur Verfügung stellen und damit eine aus der öffentlichen Forschung stammende Alternative für Wissenschaft und Unternehmen bieten können“, sagt Prof. Dr. Stefan Wrobel, Institutsleiter am Fraunhofer IAIS. „Unser Modell hat seine Leistungsfähigkeit über eine große Bandbreite an Sprachen gezeigt, und wir hoffen, dass möglichst viele das Modell für eigene Arbeiten und Anwendungen adaptieren oder weiterentwickeln werden. So wollen wir sowohl innerhalb der wissenschaftlichen Community als auch gemeinsam mit Unternehmen unterschiedlicher Branchen einen Beitrag leisten, um den steigenden Bedarf nach transparenten und individuell anpassbaren Lösungen der generativen künstlichen Intelligenz zu adressieren.“

Multilingual entwickelt

Teuken-7B ist eines der wenigen KI-Sprachmodelle, die von Grund auf multilingual entwickelt wurden. Es enthält ca. 50 Prozent nicht-englische Pretraining-Daten und wurde in allen 24 europäischen Amtssprachen trainiert. Die Projektbeteiligten sehen darin etwa Möglichkeiten für internationale Unternehmen mit mehrsprachigen Kommunikationsbedarfen sowie Produkt- und Serviceangeboten. Die Bereitstellung als Open-Source-Modell erlaubt es Unternehmen und Organisationen, eigene angepasste Modelle in realen Anwendungen zu betreiben. Sensible Daten können im Unternehmen verbleiben.

Prof. Dr.-Ing. Bernhard Grill, Institutsleiter am Fraunhofer IIS, betont die Bedeutung für sicherheitsrelevante Anwendungen: »Mit dem hier veröffentlichten, von Grund auf vollkommen eigenständig trainierten Sprachmodell demonstrieren die Projektpartner ihre Fähigkeit, eigene große Modelle erzeugen zu können. Der damit verbundene Zugriff auf ein großes KI-Sprachmodell ermöglicht Anwendungen, die ohne nicht einsehbare Fremd-Komponenten eine sehr viel bessere Kontrolle über diese Technologie bieten – zum Beispiel für spezifische, besonders auch sicherheitskritische Anwendungen im Automobilbereich, in der Robotik, der Medizin oder dem Finanzwesen. Durch Training mit den für den konkreten Anwendungsfall relevanten Daten und die Verwendung anwendungsspezifischer Architekturen können für Unternehmen so individuelle KI-Lösungen geschaffen werden, die ohne Black-Box-Komponenten auskommen.“

Das OpenGPT-X-Team widmete sich neben dem Modelltraining auch zahlreichen Forschungsfragen, zum Beispiel wie multilinguale KI-Sprachmodelle energie- und kosteneffizienter trainiert und betrieben werden können. Dazu wurde im Projekt ein multilingualer ’Tokenizer’ entwickelt. Dessen Aufgabe ist es, Wörter in einzelne Wortbestandteile zu zerlegen – je weniger Token, desto (energie-)effizienter und schneller generiert ein Sprachmodell die Antwort. Wie die Forschenden mitteilen, führte die Entwicklung zu einer Reduzierung der Trainingskosten im Vergleich zu anderen multilingualen Tokenizern, wie etwa Llama3 oder Mistral. Dies komme insbesondere bei europäischen Sprachen mit langen Wörtern wie Deutsch, Finnisch oder Ungarisch zum Tragen, so die Beteiligten. Auch im Betrieb von mehrsprachigen KI-Anwendungen können damit Effizienzsteigerungen erreicht werden.

In dieser Abbildung ist die Sprachverteilung von Teuken-7B-v0.4 dargestellt. Neben Code enthält Teuken-7B-v0.4 ca. 50% nicht-englischen Text aus 23 europäischen Ländern und nur ca. 40% englische Pretraining-Daten.
In dieser Abbildung ist die Sprachverteilung von Teuken-7B-v0.4 dargestellt. Neben Code enthält Teuken-7B-v0.4 ca. 50% nicht-englischen Text aus 23 europäischen Ländern und nur ca. 40% englische Pretraining-Daten. – Bild: ©Fraunhofer IAIS

Gaia-X-kompatibel

Das Verbundprojekt OpenGPT-X wurde im Rahmen des BMWK-Förderprogramms ’Innovative und praxisnahe Anwendungen und Datenräume im digitalen Ökosystem Gaia-X’ gefördert. Somit ist Teuken-7B auch über die Gaia-X Infrastruktur zugänglich. Akteure im Gaia-X-Ökosystem können so Sprachanwendungen entwickeln und in konkrete Anwendungsszenarien in ihren jeweiligen Domänen überführen.

In die Modellentwicklung sind wichtige Forschungsergebnisse aus dem OpenGPT-X-Projekt eingeflossen, wie beispielsweise Tools und Technologien, um sehr große Datenmengen aufzubereiten, leistungsfähige europäische HPC-Infrastrukturen zu nutzen und ein effizientes Modelltraining durchzuführen. Trainiert wurde Teuken-7B mithilfe des Supercomputers Juwels am Forschungszentrum Jülich. Neben den beiden Fraunhofer-Instituten und dem Forschungszentrum Jülich haben der KI Bundesverband, die TU Dresden, das Deutsche Forschungszentrum für Künstliche Intelligenz (DFKI), Ionos, Aleph Alpha, ControlExpert sowie der Westdeutsche Rundfunk (WDR) als Partner an OpenGPT-X mitgearbeitet. Die in OpenGPT-X entstandene Technologie bietet den Partnern auch zukünftig die Basis für das Training weiterer eigener Modelle.

Das Anfang 2022 gestartete Forschungsprojekt steht nun kurz vor dem Abschluss. Es läuft noch bis zum 31. März 2025, so dass weitere Optimierungen und Evaluierungen der Modelle erfolgen können.



  • Corona bremst Robotik und Automation stärker als erwartet

    Corona bremst Robotik und Automation stärker als erwartet

    VDMA Robotik+Automation rechnet für das laufende Jahr mit einem Umsatzrückgang von mindestens 20 Prozent. Vor Ausbruch der Pandemie ging der Verband von einem Rückgang von 10 Prozent aus.

    mehr lesen: Corona bremst Robotik und Automation stärker als erwartet

  • Schmersal-Gruppe nach Cyberangriff wieder handlungsfähig

    Schmersal-Gruppe nach Cyberangriff wieder handlungsfähig

    Der Anruf kam am 20. Mai um 16.45 Uhr: Die Schmersal-Gruppe wurde von offizieller Seite informiert, dass Cyberkriminelle einen gezielten Angriff auf das Firmennetzwerk planen. Nach einer Verifikation des Anrufs…

    mehr lesen: Schmersal-Gruppe nach Cyberangriff wieder handlungsfähig

  • Gemeinsamer Standard für unterschiedliche Ortungslösungen

    Gemeinsamer Standard für unterschiedliche Ortungslösungen

    Ein Zusammenschluss von rund 60 Unternehmen aus Europa, Amerika und Asien hat mit ‘Omlox‘ einen Ortungsstandard für die Industrie eingeführt. Die weltweie Koordination wird durch die Profibus Nutzerorganisation übernommen.

    mehr lesen: Gemeinsamer Standard für unterschiedliche Ortungslösungen

  • Kleinserienproduktion für die Elektromobilität

    Kleinserienproduktion für die Elektromobilität

    Im Forschungsprojekt ‘ProeK‘ haben die Projektpartner untersucht, wie sich die Produktion von Kleinserien bei Elektrofahrzeugen verbessern lässt. Beteiligt waren u.a. Elektrofahrzeughersteller und Forschungspartner wie das WZL der RWTH Aachen.

    mehr lesen: Kleinserienproduktion für die Elektromobilität

  • Erwartungen an Konjunktur im Juni steigen

    Erwartungen an Konjunktur im Juni steigen

    Insgesamt steigen die Erwartungen an die Konjunktur für den Monat Juni 2020, haben die Volkswirte beim ZEW ermittelt. Viele exportorientierte wie der Maschinen- und Fahrzeugbau teilen diese positive Einschätzung noch…

    mehr lesen: Erwartungen an Konjunktur im Juni steigen

  • PSI übernimmt Prognosesoftwareanbieter Prognos Energy

    PSI übernimmt Prognosesoftwareanbieter Prognos Energy

    Der Softwareanbieter PSI hat Prognos Energy übernommen. Das Unternehmen aus Potsdam ist auf Einspeisungsprognosen aus erneuerbaren Energien spezialisiert.

    mehr lesen: PSI übernimmt Prognosesoftwareanbieter Prognos Energy

  • Maschinenbau will trotz Corona weiter ausbilden

    Maschinenbau will trotz Corona weiter ausbilden

    Laut einer aktuellen Umfrage des VDMA unter 600 Mitgliedsfirmen gehen 68 Prozent davon aus, dass sie künftig genauso viele gewerblich-technische Ausbildungsplätze anbieten können, wie vor der Corona-Pandemie.

    mehr lesen: Maschinenbau will trotz Corona weiter ausbilden

  • Industrie 4.0 im Maschinenbau im Trend

    Industrie 4.0 im Maschinenbau im Trend

    Im Rahmen der Marktstudie ‚Industrielle Kommunikation/Industrie 4.0 2020‘ gaben im Januar/Februar 2020 mehr als 300 Maschinenbauunternehmen Auskunft über das Einsatzverhalten und über zukünftige Entwicklungen in den Bereichen Kommunikationstechnologien und Industrie…

    mehr lesen: Industrie 4.0 im Maschinenbau im Trend

  • Cyberattacken oft zu spät entdeckt

    Cyberattacken oft zu spät entdeckt

    Mangelnde Reaktionsgeschwindigkeit ist für den Mittelstand die größte Herausforderung bei Cyberangriffen. Dabei stehen laut einer Studie von Deloitte Mitarbeiter bei der Abwehr von Risiken im Brennpunkt. Phishing-Mails, Betrugs-Websites und Erpressungssoftware…

    mehr lesen: Cyberattacken oft zu spät entdeckt

  • KI ist wichtig, die Umsetzung läuft noch schleppend

    KI ist wichtig, die Umsetzung läuft noch schleppend

    Die Unternehmen sprechen der künstlichen Intelligenz eine herausragende Bedeutung zu, tun sich aber schwer damit, die Technologie praktisch einzusetzen. Dies geht aus einer branchenübergreifenden Umfrage des Digitalverbands Bitkom unter 603…

    mehr lesen: KI ist wichtig, die Umsetzung läuft noch schleppend

  • Hilpert vertreibt Critical Manufacturing-MES in der Schweiz

    Hilpert vertreibt Critical Manufacturing-MES in der Schweiz

    Das MES von Critical Manufacturing können Schweizer Unternehmen künftig auch von Hilpert Electronic beziehen. Der Spezialist für Applikationen rund um die Mikroelektronikfertigung ist neuer Vertriebspartner des weltweit agierenden MES-Herstellers mit…

    mehr lesen: Hilpert vertreibt Critical Manufacturing-MES in der Schweiz

  • Algorithmen automatisiert trainieren

    Algorithmen automatisiert trainieren

    Durch künstliche Intelligenz (KI) können Maschinen Objekte erkennen. Dafür werden Algorithmen mit Bilddaten manuell trainiert. Das am Karlsruher Institut für Technologie (KIT) entstandene Start-up Kimoknow hat eine Technologie entwickelt, um…

    mehr lesen: Algorithmen automatisiert trainieren