Soofi - Sovereign Open Source Foundation Models

Ein offenes KI-Sprachmodell für die Industrie

Startschuss für die erste Release-Phase

Mit der Soofi-Modellfamilie entsteht eine transparente Alternative zu außereuropäischen KI-Modellen – für Unternehmen, Verwaltung, Forschung und Start-ups. Mit der Veröffentlichung des Pretraining-Tech-Reports zu »Soofi S« ist der erste Meilenstein des Projekts erreicht. Das Modell erscheint sowohl als Basismodell als auch mit Instruction-Tuning und bildet das Fundament für weitere, größere Soofi-Modelle – darunter spezialisierte Varianten für Dialog-, Reasoning- und Agentenanwendungen. »Soofi S« wird dort eingesetzt werden können, wo KI-Anwendungen nachvollziehbar, anpassbar und auf eigener oder souveräner Infrastruktur betrieben werden sollen.

Aktuell im Praxistest mit Industriepartnern

»Soofi S« wird derzeit gemeinsam mit ausgewählten Industriepartnern getestet und weiter optimiert. So sammeln wir früh Erfahrungen aus echten Einsatzkontexten und richten das Modell gezielt an den Anforderungen aus der Wirtschaft aus. In einigen Wochen steht »Soofi S« dann allen Interessierten frei zur Verfügung.

+++ Unser kleines Entwicklerteam kann Feedback aus der Open-Source-Community erst nach Abschluss dieser Testphase entgegennehmen. Bis dahin ist der freie Zugriff bewusst eingeschränkt (Closed Beta). Wir wissen, dass viele von euch »Soofi S« ausprobieren möchten, und melden uns bei allen Interessierten, sobald ein erweitertes Testing möglich ist. Wir freuen uns darauf, das Modell gemeinsam mit der Community sowie weiteren interessierten Unternehmen und Organisationen noch besser zu machen. Vielen Dank für euer Verständnis! Anfragen gerne an: contact@soofi.info +++

Open-Source

Die technische Dokumentation umfasst:

  • Modellgewichte 
  • Trainingsmethodik
  • Datenaufbereitung 
  • eingesetzte Datenpipelines

Damit wird »Soofi S« für Unternehmen, Behörden und Forschung prüfbar und für spezifische Anwendungsfelder anpassbar.

 

Datenmischung und Effizienz

  • Mit 27 Billionen Token trainiertes 30B Mixture-of-Experts-Hybrid-Mamba-Modell 
  • für Deutsch und Englisch (starker Fokus auf Deutsch)
  • nur 3B von 30B Parametern aktiv, wodurch es weniger Rechenleistung verbraucht
  • stärkstes vollständig offenes Modell seiner Größenordnung, hält mit oder übertrifft Benchmarks für Deutsch und Englisch (vor Olmo 3 32B und Apertus 70B)

Europäische Infrastruktur

  • Compute: Trainiert auf der souveränen Industrial AI Cloud der Telekom in München
  • Architektur: Das Team forscht aktuell an eigenen Architekturen als weiteren Baustein eines europäischen Modell-Stacks. »Soofi S« nutzt die Open-Source Architektur Nemotron 3 Nano von NVIDIA.

 

Technische Infos & Forschung

 

Pretraining Tech-Report

Alle technischen Infos zu den Ergebnissen des Pretrainings von »Soofi S«.

Testen des Modells

Das kleine Entwicklerteam kann das Feedback der Open-Source-Community erst nach der aktuellen Testphase mit der Industrie entgegennehmen. Wir informieren alle Interessierten über die Freischaltung von »Soofi S«. Anfragen an: contact@soofi.info

 

Forschung Generative KI

Welche Schwerpunkte hat das Fraunhofer IAIS in der Entwicklung und Spezialisierung generativer Modelle? In welchen Forschungskooperationen und -projekten arbeiten wir? Antworten finden Sie auf unserer Forschungsseite Generative KI.

Über Soofi

Sovereign Open Source Foundation Models

Soofi (Sovereign Open Source Foundation Models) ist ein deutsches und europäisch eingebettetes Konsortialprojekt zur Entwicklung souveräner KI-Basismodelle. Gemeinsam arbeiten führende deutsche Forschungseinrichtungen, Universitäten und KI-Start-ups in einem Konsortium an der Entwicklung souveräner Open-Source Foundation Models. Die Partner bringen ihre Expertise aus KI-Forschung, Open-Source-Entwicklung und praktischer Anwendung ein.

Fraunhofer IAIS: Dr. Nicolas Flores-Herr, Dr. Mehdi Ali, Dr. Michael Fromm, Dr. Max Lübbering Fraunhofer IIS: Jan Plogsties, Dr. Viktor Hangya, Dr. Lucas Weber Deutsches Forschungszentrum für Künstliche Intelligenz: Prof. Dr. Antonio Krüger, Prof. Dr. Philipp Slusallek, Dr. Daniel Porta, Dr. Simon Ostermann Julius-Maximilians-Universität Würzburg, CAIDAS: Prof. Dr. Andreas Hotho, Jan Pfister, Julia Wunderle Leibniz Universität Hannover, Forschungszentrum L3S: Prof. Dr. Wolfgang Nejdl, Dr. Simon Gottschalk Technische Universität Darmstadt, hessian.AI: Prof. Dr. Kristian Kersting, Ruben Härle, Lukas Helff, Maurice Kraus, Sebastian Sztwiertnia Berliner Hochschule für Technik: Prof. Dr. Alexander Löser, Tom Röhr Ellamind: Dr. Jan Philipp Harries, Björn Plüster, Maximilian Idahl Merantix Momentum: Dr. Stefan Dietzel, Dr. Patrick Putzky, Dr. Martin Genzel

Koordiniert wird das Konsortium vom KI Bundesverband. Gefördert wird das Projekt vom Bundesministerium für Wirtschaft und Energie (PCEI-CIS / 8ra).