Zum Hauptinhalt springen
SpezialmodellOpen Weights

Qwen-Drive-1.0-4B

Qwen

Veröffentlicht
3. September 2026
Datenstand
3. Oktober 2026

Qwen-Drive-1.0-4B ist ein offenes Vision-Language-Modell für autonomes Fahren. Ein Qwen3.5-4B-VLM bleibt als gemeinsamer Kern erhalten, während ein BEV-Wahrnehmungskopf 3D-Erkennung, semantische Belegung und Kartensegmentierung ergänzt. Ein Planning Expert erzeugt zukünftige Fahrzeugtrajektorien.

Die Hugging-Face-Veröffentlichung enthält den VLM-Checkpoint sowie getrennte planner-sft-, planner-rl- und perception-Module. Die Apache-2.0-Gewichte laufen lokal. Das Modell ist auf Fahrszenen, Wahrnehmung, Visual Question Answering und Bewegungsplanung spezialisiert, nicht auf allgemeine Chataufgaben.

Technische Daten und Zugang

AngabeWert und Quelle
Modellkennung
Qwen/Qwen-Drive-1.0-4BQuelle
Modellklasse
Vision-Language-Modell für autonomes FahrenQuelle
Parameter
4 Milliarden im gemeinsamen VLMQuelle
Wahrnehmung
3D-Objekterkennung, semantische Belegung und BEV-KartensegmentierungQuelle
Planung
Planungs-Experten für direkte und reasoning-basierte TrajektorienQuelle
Lizenz
Apache-2.0Quelle