Beschreibung

huggingface.co/Fugaku-LLM ist die Modellseite von Fugaku-LLM, einem Sprachmodell mit verbesserten Japanisch-Fähigkeiten, das von einem Konsortium unter Beteiligung von RIKEN, Tokyo Institute of Technology, Tohoku-Universität, Fujitsu, Universität Nagoya, CyberAgent und Kotoba Technologies auf dem Supercomputer Fugaku trainiert wurde.

🛡️ Datenschutz: Das Modell kann lokal oder selbst gehostet betrieben werden; Quellcode und Modell sind öffentlich auf GitHub und Hugging Face verfügbar. Bei Betrieb auf eigener Hardware fließen Daten nicht an die Entwickler ab, soweit aus der Dokumentation ersichtlich. Das Projekt ist laut Pressemitteilung japanischen Forschungseinrichtungen zugeordnet. Für Drittplattformen ist ein AVV/DPA nicht öffentlich dokumentiert, daher sollte für personenbezogene Daten vorab ein AVV/DPA geprüft werden.

Das Tool richtet sich an Forschende und Unternehmen, die ein offenes japanisches Sprachmodell für Forschung und Geschäftsanwendungen selbst betreiben wollen.

Tool-Details & Features

💰 Preise: Kostenloser Download; laut Pressemitteilung für Forschung und kommerzielle Nutzung unter Einhaltung der Lizenz; konkrete Lizenzbedingungen sind auf den geprüften Seiten nicht genannt.

⚙️ Technik: 13 Mrd. Parameter, von Grund auf mit 380 Mrd. Token auf 13.824 Fugaku-Knoten trainiert; etwa 60 Prozent der Trainingsdaten sind Japanisch, ergänzt um Englisch, Mathematik und Code; Megatron-DeepSpeed wurde auf Fugaku portiert.

👥 Zielgruppe: Forschende, Entwickler und Unternehmen mit eigener Rechen-Infrastruktur.

🔗 Integrationen: Veröffentlichung auf Hugging Face (Basis-, Instruct- und GGUF-Variante) und GitHub.

📊 Funktionen: Japanische Textgenerierung und Dialog; laut Pressemitteilung mittlerer MT-Bench-Wert von 5,5 auf Japanisch.

Vor- & Nachteile

✅ Vorteile: Von Grund auf trainiert statt weitertrainiert, daher nachvollziehbare Datenbasis; offene Verfügbarkeit; läuft lokal.

❌ Nachteile: Mit 13 Mrd. Parametern kleiner als viele aktuelle Modelle; Lizenzdetails auf den geprüften Seiten nicht erläutert; Betrieb erfordert Hardware und technisches Know-how.

Für wen geeignet?

Perfekt für Forschende und Entwickelnde, die ein offenes, nachvollziehbar trainiertes japanisches Sprachmodell nutzen wollen.

  • Keine Kommentare vorhanden.
  • Rezension erstellen

    KI-Radar24 Assistent Findet passende KI-Tools & beantwortet Fragen

    Zuletzt aktualisiert am 06.10.2026