- Startseite
- KI-Modelle
- Ling 3.1 Flash
SprachmodellAktiv
Ling 3.1 Flash
InclusionAI
- Veröffentlicht
- -
- Datenstand
- 3. Oktober 2026
Ling 3.1 Flash aktiviert 25 Milliarden seiner insgesamt 560 Milliarden Parameter pro Token. InclusionAIs hybrides Reasoning-Modell verarbeitet im Vercel AI Gateway 262K Token Kontext und richtet sich auf längere Code-, Dokument- und Agentenaufgaben.
Vercel bietet das Modell bis zum 13. Oktober 2026 kostenlos an. Danach beginnt die normale Modellkennung mit der Abrechnung, während die gesonderte Kennung inclusionai/ling-3.1-flash-free keine Anfragen mehr bedient.
Messungen ohne passende Vergleichswerte
Für diese Messungen fehlen passende Vergleichswerte unter gleichen Testbedingungen. Die Originalwerte und Quellen bleiben hier nachlesbar.
Artificial Analysis Intelligence Index (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 41.0906200397391
- Bewertung
- 41.0906200397391
- Messgröße
- Artificial Analysis Intelligence Index
- Einheit
- points
- Benchmark-Version
- Artificial Analysis Intelligence Index v4.3.2
- Kategorie
- source-specific
- Richtung
- Mehr ist besser
- Quellentyp
- independent-evaluator
- Auswertung
- Artificial Analysis
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Unabhängige Evaluation. Artificial Analysis independent evaluation on dedicated hardware; the exact page identifies Ling 3.1 Flash as reasoning-enabled with 2,000 reasoning tokens.
- Einordnung
- Quellenspezifische Beobachtung, keine gemeinsame Vergleichsgruppe.
AA-Briefcase (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 1400.35
- Bewertung
- 1400.35
- Messgröße
- AA-Briefcase
- Einheit
- elo
- Benchmark-Version
- AA-Briefcase v1.1
- Kategorie
- source-specific
- Richtung
- Mehr ist besser
- Quellentyp
- independent-evaluator
- Auswertung
- Artificial Analysis
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Unabhängige Evaluation. 91-task agentic knowledge-work evaluation; the AA page describes a combined Elo over rubric pass rate, analytical-quality Elo and presentation Elo.
- Einordnung
- Quellenspezifische Beobachtung, keine gemeinsame Vergleichsgruppe.
GDPval-AA (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 1621.75
- Bewertung
- 1621.75
- Messgröße
- GDPval-AA
- Einheit
- elo
- Benchmark-Version
- GDPval-AA v2.1
- Kategorie
- source-specific
- Richtung
- Mehr ist besser
- Quellentyp
- independent-evaluator
- Auswertung
- Artificial Analysis
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Unabhängige Evaluation. 220 real-world work tasks, agent loop with shell/web access via Stirrup, blind pairwise comparisons; AA evaluator result for the exact Ling 3.1 Flash slug.
- Einordnung
- Quellenspezifische Beobachtung, keine gemeinsame Vergleichsgruppe.
AutomationBench-AA (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 0.6174373352506193
- Bewertung
- 0.6174373352506193
- Messgröße
- AutomationBench-AA
- Einheit
- ratio
- Benchmark-Version
- AutomationBench-AA (dataset version 1.0.6 noted on evaluator page)
- Kategorie
- source-specific
- Richtung
- Mehr ist besser
- Quellentyp
- independent-evaluator
- Auswertung
- Artificial Analysis
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Unabhängige Evaluation. 657 simulated SaaS workflow tasks across six business domains; exact model result from AA's dedicated-hardware evaluator.
- Einordnung
- Quellenspezifische Beobachtung, keine gemeinsame Vergleichsgruppe.
Terminal-Bench (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 0.333333333333333
- Bewertung
- 0.333333333333333
- Messgröße
- Terminal-Bench
- Einheit
- ratio
- Benchmark-Version
- Terminal-Bench 4.0
- Kategorie
- source-specific
- Richtung
- Mehr ist besser
- Quellentyp
- independent-evaluator
- Auswertung
- Artificial Analysis
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Unabhängige Evaluation. AA page states pass@1 averaged over three repeats per task with the mini-swe-agent harness; exact Ling result.
- Einordnung
- Quellenspezifische Beobachtung, keine gemeinsame Vergleichsgruppe.
SciCode (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 0.540509259259259
- Bewertung
- 0.540509259259259
- Messgröße
- SciCode
- Einheit
- ratio
- Benchmark-Version
- SciCode current AA implementation
- Kategorie
- source-specific
- Richtung
- Mehr ist besser
- Quellentyp
- independent-evaluator
- Auswertung
- Artificial Analysis
- Status
- disputed
- Abrufdatum
- 2026-10-04
- Methodik
- Unabhängige Evaluation. 288 test-set subproblems from scientist-curated laboratory problems; independent AA evaluation of the exact checkpoint.
- Einordnung
- Quellenspezifische Beobachtung, keine gemeinsame Vergleichsgruppe. Die Auswertung ist beim Evaluator noch als „Under review“ markiert.
Humanity's Last Exam (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 0.394346617238183
- Bewertung
- 0.394346617238183
- Messgröße
- Humanity's Last Exam
- Einheit
- ratio
- Benchmark-Version
- Humanity's Last Exam current AA implementation
- Kategorie
- source-specific
- Richtung
- Mehr ist besser
- Quellentyp
- independent-evaluator
- Auswertung
- Artificial Analysis
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Unabhängige Evaluation. Independent AA evaluation; exact Ling 3.1 Flash result, with reasoning enabled as reported on the exact model page.
- Einordnung
- Quellenspezifische Beobachtung, keine gemeinsame Vergleichsgruppe.
GDP.pdf (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 0.1
- Bewertung
- 0.1
- Messgröße
- GDP.pdf
- Einheit
- ratio
- Benchmark-Version
- GDP.pdf current AA implementation
- Kategorie
- source-specific
- Richtung
- Mehr ist besser
- Quellentyp
- independent-evaluator
- Auswertung
- Artificial Analysis
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Unabhängige Evaluation. 100 professional-document tasks across ten domains; all-pass means every atomic criterion passes.
- Einordnung
- Quellenspezifische Beobachtung, keine gemeinsame Vergleichsgruppe.
CritPt (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 0.18
- Bewertung
- 0.18
- Messgröße
- CritPt
- Einheit
- ratio
- Benchmark-Version
- CritPt current AA implementation
- Kategorie
- source-specific
- Richtung
- Mehr ist besser
- Quellentyp
- independent-evaluator
- Auswertung
- Artificial Analysis
- Status
- disputed
- Abrufdatum
- 2026-10-04
- Methodik
- Unabhängige Evaluation. 70 test challenges (71 including one example), run without an agent harness against the authors' grading server.
- Einordnung
- Quellenspezifische Beobachtung, keine gemeinsame Vergleichsgruppe. Die Auswertung ist beim Evaluator noch als „Under review“ markiert.
AA-Omniscience Index (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 2.216666666666667
- Bewertung
- 2.216666666666667
- Messgröße
- AA-Omniscience Index
- Einheit
- points
- Benchmark-Version
- AA-Omniscience current AA implementation
- Kategorie
- source-specific
- Richtung
- Mehr ist besser
- Quellentyp
- independent-evaluator
- Auswertung
- Artificial Analysis
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Unabhängige Evaluation. 6,000 factuality/hallucination questions across six domains; independent AA evaluation of exact Ling 3.1 Flash.
- Einordnung
- Quellenspezifische Beobachtung, keine gemeinsame Vergleichsgruppe.
AA-LCR (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 0.83
- Bewertung
- 0.83
- Messgröße
- AA-LCR
- Einheit
- ratio
- Benchmark-Version
- AA-LCR v1.1
- Kategorie
- source-specific
- Richtung
- Mehr ist besser
- Quellentyp
- independent-evaluator
- Auswertung
- Artificial Analysis
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Unabhängige Evaluation. 100 long-context questions over 10k-100k-token documents; score is the average pass rate from the AA equality-checker evaluation.
- Einordnung
- Quellenspezifische Beobachtung, keine gemeinsame Vergleichsgruppe.
Quellen und Datenstand
Alle Angaben verweisen auf die zugrunde liegende Dokumentation oder das jeweilige Leaderboard.