Zum Hauptinhalt springen
AudiomodellAktiv

MAI-Voice-2

Microsoft

Veröffentlicht
2. Juni 2026
Datenstand
3. Oktober 2026
Modellklasse
Sprachen

MAI-Voice-2 ist Microsofts frühere Foundry-Sprachsynthese mit 15 unterstützten Sprachen. Eine Referenzaufnahme von 5 bis 60 Sekunden kann für Stimmenklonen dienen, wobei Microsoft Einwilligungs-Schutzvorkehrungen beschreibt.

Microsoft veröffentlichte MAI-Voice-2 am 2. Juni 2026. Die Foundry-Modellkennung für die Audioausgabe lautet mai-voice-2.

Technische Daten und Zugang

AngabeWert und Quelle
Modellklasse
SprachsyntheseQuelle
Zugang
Microsoft Foundry APIQuelle
Eingabe
Text und ReferenzaufnahmeQuelle
Ausgabe
AudioQuelle
API-Modellkennung
mai-voice-2Quelle
Sprachen
15 SprachenQuelle
Stimmklonen
Referenzaufnahme von 5 bis 60 Sekunden mit Einwilligungs-SchutzvorkehrungenQuelle