Zum Hauptinhalt springen
SprachmodellOffene Gewichte

Naive-N0.5-Flash

NaiveAI

Veröffentlicht
-
Datenstand
3. Oktober 2026

Naive-N0.5-Flash kombiniert Sliding-Window Attention mit DeepSeek Sparse Attention für ein 1M-Token-Kontextfenster. Der offene MoE-Checkpoint richtet sich auf Coding und KI-Forschung und aktiviert 15,5 seiner 309 Milliarden Parameter pro Token.

NaiveAI veröffentlicht die Gewichte unter MIT. Die Modellkarte dokumentiert die Bereitstellung in FP8 auf NVIDIA-Hardware.

Technische Daten und Zugang

AngabeWert und Quelle
Modellkennung
NaiveAI/Naive-N0.5-FlashQuelle
Modellklasse
Mixture-of-Experts-Modell für Coding und KI-ForschungQuelle
Parameter
309 Milliarden insgesamt, 15,5 Milliarden aktivQuelle
Kontextfenster
1M Token laut ModellkarteQuelle
Architektur
Hybrid aus Sliding-Window Attention und DeepSeek Sparse AttentionQuelle
Lizenz