Zum Hauptinhalt springen
SprachmodellOpen Source

Ling-3.0-tiny

InclusionAI

Veröffentlicht
-
Datenstand
3. Oktober 2026

Ling-3.0-tiny bringt InclusionAIs hybride Attention-Architektur in einen 7,9B-Checkpoint mit 1,3 Milliarden aktiven Parametern. Je drei Kimi-Delta-Attention-Schichten wechseln sich mit einer Multi-Head-Latent-Attention-Schicht ab. Der Hersteller dokumentiert lokale Tests auf DGX Spark und Apple-Silicon-Macs.

InclusionAI veröffentlicht BF16-, FP8- und INT4-Gewichte unter MIT. Das Modell verarbeitet 262.144 Token Kontext und ist auch über den in der Modellkarte verlinkten OpenRouter-Zugang verfügbar.

Technische Daten und Zugang

AngabeWert und Quelle
Parameter
7,9 MilliardenQuelle
Aktive Parameter
1,3 Milliarden pro TokenQuelle
Kontextfenster
262.144 TokenQuelle
Gewichte
BF16, FP8 und INT4Quelle
Lizenz
Zugang
Lokale Gewichte; die Modellkarte verlinkt inclusionai/ling-3.0-tiny:free auf OpenRouterQuelle