- Startseite
- KI-Modelle
- Universal-3.6 Pro Realtime
Universal-3.6 Pro Realtime
AssemblyAI
- Veröffentlicht
- 29. September 2026
- Datenstand
- 3. Oktober 2026
- Modellklasse
- Zugang
AssemblyAI beschreibt Universal-3.6 Pro Realtime als direkte Weiterentwicklung von Universal-3.5 Pro für Sprachagenten und Telefonie. Das Modell wurde für kurze Äußerungen und schwierige Bedingungen wie laute Räume, Akzente und Telefonleitungen trainiert. Die API erkennt 32 Sprachen automatisch und sendet während des Gesprächs Transkripttext.
AssemblyAI verwendet an der bestehenden Streaming-Schnittstelle die Kennung universal-3-6-pro. Der Listenpreis beträgt 0,45 $ pro Audiostunde, mit volumenabhängigen Rabatten.
Technische Daten und Zugang
| Angabe | Wert und Quelle |
|---|---|
| Modellklasse | Streaming-SpracherkennungQuelle |
| Zugang | AssemblyAI APIQuelle |
| Eingabe | Laufendes AudioQuelle |
| Ausgabe | TranskriptQuelle |
| API-Modellkennung | universal-3-6-proQuelle |
| Sprachen | 32 Sprachen mit automatischer ErkennungQuelle |
| Streaming | Echtzeitmodell für die bestehende AssemblyAI-Streaming-SchnittstelleQuelle |
Messungen ohne passende Vergleichswerte
Für diese Messungen fehlen passende Vergleichswerte unter gleichen Testbedingungen. Die Originalwerte und Quellen bleiben hier nachlesbar.
entity error rate (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 14.4
- Bewertung
- 14.4
- Messgröße
- entity error rate
- Einheit
- %
- Benchmark-Version
- source version not stated
- Kategorie
- audio
- Richtung
- Weniger ist besser
- Quellentyp
- vendor-reported
- Auswertung
- AssemblyAI announcement
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Vom Anbieter veröffentlichter Wert. Same setup
- Einordnung
- Quellenspezifische Beobachtung. Sie begründet keine vergleichbare modellübergreifende Testkohorte.
exact transcript rate (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 87
- Bewertung
- 87
- Messgröße
- score
- Einheit
- %
- Benchmark-Version
- source version not stated
- Kategorie
- audio
- Richtung
- Mehr ist besser
- Quellentyp
- independent-evaluator
- Auswertung
- AssemblyAI announcement
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Unabhängige Evaluation. Same public run
- Einordnung
- Die Quelle dokumentiert ein separates Evaluator-Setup. Diese Beobachtung wird nicht mit dem Anbieter-Benchmark von AssemblyAI zusammengeführt.
WER (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 5.19
- Bewertung
- 5.19
- Messgröße
- word error rate
- Einheit
- %
- Benchmark-Version
- source version not stated
- Kategorie
- audio
- Richtung
- Weniger ist besser
- Quellentyp
- vendor-reported
- Auswertung
- AssemblyAI announcement
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Vom Anbieter veröffentlichter Wert. 12,460 scripted caller scenarios, real speakers, three noise environments, 12 speaker groups; competitors via public streaming APIs at defaults and same scoring
- Einordnung
- Quellenspezifische Beobachtung. Sie begründet keine vergleichbare modellübergreifende Testkohorte.
lowest WER (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 2.2
- Bewertung
- 2.2
- Messgröße
- word error rate
- Einheit
- %
- Benchmark-Version
- source version not stated
- Kategorie
- audio
- Richtung
- Weniger ist besser
- Quellentyp
- independent-evaluator
- Auswertung
- Coval benchmark
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Unabhängige Evaluation. Continuously updated seven-day real voice-agent window
- Einordnung
- Die Quelle dokumentiert ein separates Evaluator-Setup. Diese Beobachtung wird nicht mit dem Anbieter-Benchmark von AssemblyAI zusammengeführt.
Pipecat pooled semantic WER (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 0.96
- Bewertung
- 0.96
- Messgröße
- word error rate
- Einheit
- %
- Benchmark-Version
- source version not stated
- Kategorie
- audio
- Richtung
- Weniger ist besser
- Quellentyp
- independent-evaluator
- Auswertung
- AssemblyAI announcement
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Unabhängige Evaluation. Public code/results, same harness; rendered 2026-09-28
- Einordnung
- Die Quelle dokumentiert ein separates Evaluator-Setup. Diese Beobachtung wird nicht mit dem Anbieter-Benchmark von AssemblyAI zusammengeführt.
Veröffentlichte Preise
Die Preise gelten für die jeweils genannte Einheit. Auflösung, Ausgabelänge und Anbieter können die Kosten verändern.
- Preis
- 0,45 $ pro Audiostunde; Mengenrabatte verfügbarQuelle
Quellen und Datenstand
Alle Angaben verweisen auf die zugrunde liegende Dokumentation oder das jeweilige Leaderboard.
| Art | Nachweis und Datenstand |
|---|---|
| Recherchestand | Recherchestand 4. Oktober 2026. 2 Quellen-URLs geprüft. Das dokumentiert die geprüften Quellen, nicht sämtliche Veröffentlichungen zu diesem Modell. |
| Weitere Quelle | AssemblyAI Universal-3.6 Pro Realtime (abgerufen 3. Oktober 2026; 4. Oktober 2026) · AssemblyAI Universal-3.6 Pro Realtime · Redaktionelle Beschreibung geprüft am 3. Oktober 2026 |
| Weitere Quelle | Coval benchmark (abgerufen 4. Oktober 2026) |