- Startseite
- KI-Modelle
- Granite 4.2 3B
SprachmodellOffene Gewichte
Granite 4.2 3B
IBM
- Veröffentlicht
- 25. August 2026
- Datenstand
- 3. Oktober 2026
Granite 4.2 3B folgt innerhalb von IBMs neuer Reihe einem kürzeren Trainingsplan als 8B und 30B. Die kompakte Version erhält Reasoning- und Coding-Training, durchläuft aber nicht deren zusätzlichen Agentenblock mit Software-, Terminal- und Suchaufgaben.
IBM veröffentlicht das dichte Modell mit 3 Milliarden Parametern unter Apache 2.0. Wie die größeren Varianten kann es zwischen Antworten mit und ohne Denkprozess wechseln.
Messungen ohne passende Vergleichswerte
Für diese Messungen fehlen passende Vergleichswerte unter gleichen Testbedingungen. Die Originalwerte und Quellen bleiben hier nachlesbar.
tau3-bench (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 45.78
- Bewertung
- 45.78
- Messgröße
- tau3-bench reported score
- Einheit
- Keine Einheit angegeben
- Kategorie
- source-specific
- Richtung
- Mehr ist besser
- Quellentyp
- vendor-reported
- Auswertung
- Provider model card
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Vom Anbieter veröffentlichter Wert. IBM official technical breakdown; agent/coding values and missing sampling details are not cross-source comparable.
- Einordnung
- Quellenspezifische Beobachtung, keine gemeinsame Vergleichsgruppe. Die Quelle benennt für diesen Zahlenwert keine Einheit oder Skala.
BFCL v4 (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 52.41
- Bewertung
- 52.41
- Messgröße
- BFCL v4 reported score
- Einheit
- Keine Einheit angegeben
- Kategorie
- source-specific
- Richtung
- Mehr ist besser
- Quellentyp
- vendor-reported
- Auswertung
- Provider model card
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Vom Anbieter veröffentlichter Wert. IBM official technical breakdown; agent/coding values and missing sampling details are not cross-source comparable.
- Einordnung
- Quellenspezifische Beobachtung, keine gemeinsame Vergleichsgruppe. Die Quelle benennt für diesen Zahlenwert keine Einheit oder Skala.
ProfBench (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 32.1
- Bewertung
- 32.1
- Messgröße
- ProfBench reported score
- Einheit
- Keine Einheit angegeben
- Kategorie
- source-specific
- Richtung
- Mehr ist besser
- Quellentyp
- vendor-reported
- Auswertung
- Provider model card
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Vom Anbieter veröffentlichter Wert. IBM official technical breakdown; agent/coding values and missing sampling details are not cross-source comparable.
- Einordnung
- Quellenspezifische Beobachtung, keine gemeinsame Vergleichsgruppe. Die Quelle benennt für diesen Zahlenwert keine Einheit oder Skala.
AIME25 (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 78.33
- Bewertung
- 78.33
- Messgröße
- AIME25 reported score
- Einheit
- Keine Einheit angegeben
- Kategorie
- source-specific
- Richtung
- Mehr ist besser
- Quellentyp
- vendor-reported
- Auswertung
- Provider model card
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Vom Anbieter veröffentlichter Wert. IBM official technical breakdown; agent/coding values and missing sampling details are not cross-source comparable.
- Einordnung
- Quellenspezifische Beobachtung, keine gemeinsame Vergleichsgruppe. Die Quelle benennt für diesen Zahlenwert keine Einheit oder Skala.
GPQA (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 54.8
- Bewertung
- 54.8
- Messgröße
- GPQA reported score
- Einheit
- Keine Einheit angegeben
- Kategorie
- source-specific
- Richtung
- Mehr ist besser
- Quellentyp
- vendor-reported
- Auswertung
- Provider model card
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Vom Anbieter veröffentlichter Wert. IBM official technical breakdown; agent/coding values and missing sampling details are not cross-source comparable.
- Einordnung
- Quellenspezifische Beobachtung, keine gemeinsame Vergleichsgruppe. Die Quelle benennt für diesen Zahlenwert keine Einheit oder Skala.
LCBench v6 (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 69.71
- Bewertung
- 69.71
- Messgröße
- LCBench v6 reported score
- Einheit
- Keine Einheit angegeben
- Kategorie
- source-specific
- Richtung
- Mehr ist besser
- Quellentyp
- vendor-reported
- Auswertung
- Provider model card
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Vom Anbieter veröffentlichter Wert. IBM official technical breakdown; agent/coding values and missing sampling details are not cross-source comparable.
- Einordnung
- Quellenspezifische Beobachtung, keine gemeinsame Vergleichsgruppe. Die Quelle benennt für diesen Zahlenwert keine Einheit oder Skala.
SciCode (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 24.11
- Bewertung
- 24.11
- Messgröße
- SciCode reported score
- Einheit
- Keine Einheit angegeben
- Kategorie
- source-specific
- Richtung
- Mehr ist besser
- Quellentyp
- vendor-reported
- Auswertung
- Provider model card
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Vom Anbieter veröffentlichter Wert. IBM official technical breakdown; agent/coding values and missing sampling details are not cross-source comparable.
- Einordnung
- Quellenspezifische Beobachtung, keine gemeinsame Vergleichsgruppe. Die Quelle benennt für diesen Zahlenwert keine Einheit oder Skala.
MMLU-Pro (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 67.84
- Bewertung
- 67.84
- Messgröße
- MMLU-Pro reported score
- Einheit
- Keine Einheit angegeben
- Kategorie
- source-specific
- Richtung
- Mehr ist besser
- Quellentyp
- vendor-reported
- Auswertung
- Provider model card
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Vom Anbieter veröffentlichter Wert. IBM official technical breakdown; agent/coding values and missing sampling details are not cross-source comparable.
- Einordnung
- Quellenspezifische Beobachtung, keine gemeinsame Vergleichsgruppe. Die Quelle benennt für diesen Zahlenwert keine Einheit oder Skala.
IFBench Prompt (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 74.33
- Bewertung
- 74.33
- Messgröße
- IFBench Prompt reported score
- Einheit
- Keine Einheit angegeben
- Kategorie
- source-specific
- Richtung
- Mehr ist besser
- Quellentyp
- vendor-reported
- Auswertung
- Provider model card
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Vom Anbieter veröffentlichter Wert. IBM official technical breakdown; agent/coding values and missing sampling details are not cross-source comparable.
- Einordnung
- Quellenspezifische Beobachtung, keine gemeinsame Vergleichsgruppe. Die Quelle benennt für diesen Zahlenwert keine Einheit oder Skala.
RULER 64K (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 67.52
- Bewertung
- 67.52
- Messgröße
- RULER 64K reported score
- Einheit
- Keine Einheit angegeben
- Kategorie
- source-specific
- Richtung
- Mehr ist besser
- Quellentyp
- vendor-reported
- Auswertung
- Provider model card
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Vom Anbieter veröffentlichter Wert. IBM official technical breakdown; agent/coding values and missing sampling details are not cross-source comparable.
- Einordnung
- Quellenspezifische Beobachtung, keine gemeinsame Vergleichsgruppe. Die Quelle benennt für diesen Zahlenwert keine Einheit oder Skala.
RULER 128K (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 55.3
- Bewertung
- 55.3
- Messgröße
- RULER 128K reported score
- Einheit
- Keine Einheit angegeben
- Kategorie
- source-specific
- Richtung
- Mehr ist besser
- Quellentyp
- vendor-reported
- Auswertung
- Provider model card
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Vom Anbieter veröffentlichter Wert. IBM official technical breakdown; agent/coding values and missing sampling details are not cross-source comparable.
- Einordnung
- Quellenspezifische Beobachtung, keine gemeinsame Vergleichsgruppe. Die Quelle benennt für diesen Zahlenwert keine Einheit oder Skala.
Quellen und Datenstand
Alle Angaben verweisen auf die zugrunde liegende Dokumentation oder das jeweilige Leaderboard.
| Art | Nachweis und Datenstand |
|---|---|
| Recherchestand | Recherchestand 4. Oktober 2026. 1 Quellen-URLs geprüft. Das dokumentiert die geprüften Quellen, nicht sämtliche Veröffentlichungen zu diesem Modell. |
| Weitere Quelle | IBM Granite 4.2 announcement (abgerufen 3. Oktober 2026) · IBM Granite 4.2 announcement · Redaktionelle Beschreibung geprüft am 4. Oktober 2026 |
| Weitere Quelle | IBM Granite 4.2 technical report (abgerufen 4. Oktober 2026) · IBM Granite 4.2 technical report · Redaktionelle Beschreibung geprüft am 4. Oktober 2026 |