- Startseite
- KI-Modelle
- Ember-1
SprachmodellForschungsvorschau
Ember-1
Fireworks Research
- Veröffentlicht
- 23. September 2026
- Datenstand
- 3. Oktober 2026
Ember-1 soll das lange Reasoning von Kimi K3 gezielt verkürzen. Fireworks hat den Checkpoint anhand von Aufgabenfeedback nachtrainiert und berichtet für sieben Benchmarks und zwei Kunden-A/B-Tests von 35-50 % kürzeren Denkprozessen ohne Genauigkeitsverlust. Fireworks stellt Ember-1 als zeitlich begrenzte Forschungsvorschau über die eigene API bereit.
Messungen ohne passende Vergleichswerte
Für diese Messungen fehlen passende Vergleichswerte unter gleichen Testbedingungen. Die Originalwerte und Quellen bleiben hier nachlesbar.
Terminal-Bench 2.1 (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 82
- Bewertung
- 82
- Messgröße
- Terminal-Bench 2.1
- Einheit
- %
- Kategorie
- source-specific
- Richtung
- Mehr ist besser
- Quellentyp
- vendor-reported
- Auswertung
- fireworks.ai
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Vom Anbieter veröffentlichter Wert. Fireworks vendor table; agent-task setup details not sufficient for cross-source comparison.
- Einordnung
- Quellenspezifische Beobachtung, keine gemeinsame Vergleichsgruppe.
SWE-bench Verified (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 92.2
- Bewertung
- 92.2
- Messgröße
- SWE-bench Verified
- Einheit
- %
- Kategorie
- source-specific
- Richtung
- Mehr ist besser
- Quellentyp
- vendor-reported
- Auswertung
- fireworks.ai
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Vom Anbieter veröffentlichter Wert. Fireworks vendor table; agent-task setup details not sufficient for cross-source comparison.
- Einordnung
- Quellenspezifische Beobachtung, keine gemeinsame Vergleichsgruppe.
SWE-Interact (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 20
- Bewertung
- 20
- Messgröße
- SWE-Interact
- Einheit
- %
- Kategorie
- source-specific
- Richtung
- Mehr ist besser
- Quellentyp
- vendor-reported
- Auswertung
- fireworks.ai
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Vom Anbieter veröffentlichter Wert. Fireworks vendor table; agent-task setup details not sufficient for cross-source comparison.
- Einordnung
- Quellenspezifische Beobachtung, keine gemeinsame Vergleichsgruppe.
DeepSWE 1.1 (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 75.2
- Bewertung
- 75.2
- Messgröße
- DeepSWE 1.1
- Einheit
- %
- Kategorie
- source-specific
- Richtung
- Mehr ist besser
- Quellentyp
- vendor-reported
- Auswertung
- fireworks.ai
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Vom Anbieter veröffentlichter Wert. Fireworks vendor table; agent-task setup details not sufficient for cross-source comparison.
- Einordnung
- Quellenspezifische Beobachtung, keine gemeinsame Vergleichsgruppe.
tau2 Airline (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 66
- Bewertung
- 66
- Messgröße
- tau2 Airline
- Einheit
- %
- Kategorie
- source-specific
- Richtung
- Mehr ist besser
- Quellentyp
- vendor-reported
- Auswertung
- fireworks.ai
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Vom Anbieter veröffentlichter Wert. Fireworks vendor table; agent-task setup details not sufficient for cross-source comparison.
- Einordnung
- Quellenspezifische Beobachtung, keine gemeinsame Vergleichsgruppe.
Quellen und Datenstand
Alle Angaben verweisen auf die zugrunde liegende Dokumentation oder das jeweilige Leaderboard.
| Art | Nachweis und Datenstand |
|---|---|
| Recherchestand | Recherchestand 4. Oktober 2026. 1 Quellen-URLs geprüft. Das dokumentiert die geprüften Quellen, nicht sämtliche Veröffentlichungen zu diesem Modell. |
| Weitere Quelle | Fireworks Ember-1 announcement (abgerufen 3. Oktober 2026; 4. Oktober 2026) · Fireworks Ember-1 announcement · Redaktionelle Beschreibung geprüft am 4. Oktober 2026 |