- Startseite
- KI-Modelle
- Perceptron Mk1.5
Perceptron Mk1.5
Perceptron
- Veröffentlicht
- 25. September 2026
- Datenstand
- 3. Oktober 2026
Perceptron Mk1.5 ist ein multimodales Modell für verkörperte Agenten. Es nimmt Text, Bilder, Video und Audio auf und gibt Text, Punkte, Boxen, Polygone, Clips sowie zeitbasierte Objektspuren aus. Perceptron nennt Drohnen, Roboterhunde, Smart Glasses und Smartphones als Einsatzumgebungen.
Der Zugang läuft über die Perceptron Platform und das SDK mit der API-Kennung perceptron-mk1.5. Perceptron nennt 32K Token multimodalen Kontext. Das Modell versteht Audioeingaben und unterstützt Werkzeugaufrufe. Die API kostet 0,15 $ je 1 Mio. Eingabetoken und 1,50 $ je 1 Mio. Ausgabetoken.
Technische Daten und Zugang
| Angabe | Wert und Quelle |
|---|---|
| Modellklasse | Multimodales Steuerungsmodell für verkörperte AgentenQuelle |
| Modalitäten | Text, Bilder, Video und Audio als EingabeQuelle |
| Ausgabe | Text, Punkte, Boxen, Polygone, Clips und ObjektspurenQuelle |
| API-Kennung | perceptron-mk1.5Quelle |
| Kontextfenster | 32K Token multimodaler Kontext (Herstellerangabe)Quelle |
Messungen ohne passende Vergleichswerte
Für diese Messungen fehlen passende Vergleichswerte unter gleichen Testbedingungen. Die Originalwerte und Quellen bleiben hier nachlesbar.
DailyOmni accuracy (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 74.67
- Bewertung
- 74.67
- Messgröße
- percent
- Einheit
- %
- Kategorie
- audio-visual
- Richtung
- Mehr ist besser
- Quellentyp
- vendor-reported
- Auswertung
- Perceptron
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Vom Anbieter veröffentlichter Wert. Figure 4 audio-visual evaluation.
WorldSense accuracy (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 50.32
- Bewertung
- 50.32
- Messgröße
- percent
- Einheit
- %
- Kategorie
- audio-visual
- Richtung
- Mehr ist besser
- Quellentyp
- vendor-reported
- Auswertung
- Perceptron
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Vom Anbieter veröffentlichter Wert. Figure 4 audio-visual evaluation.
OmniBench accuracy (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 51.05
- Bewertung
- 51.05
- Messgröße
- percent
- Einheit
- %
- Kategorie
- audio-visual
- Richtung
- Mehr ist besser
- Quellentyp
- vendor-reported
- Auswertung
- Perceptron
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Vom Anbieter veröffentlichter Wert. Figure 4 audio-visual evaluation.
AVHBench accuracy (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 80.56
- Bewertung
- 80.56
- Messgröße
- percent
- Einheit
- %
- Kategorie
- audio-visual
- Richtung
- Mehr ist besser
- Quellentyp
- vendor-reported
- Auswertung
- Perceptron
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Vom Anbieter veröffentlichter Wert. Figure 4 audio-visual evaluation.
LiveVQA-W accuracy (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 56
- Bewertung
- 56
- Messgröße
- percent
- Einheit
- %
- Kategorie
- audio-visual
- Richtung
- Mehr ist besser
- Quellentyp
- vendor-reported
- Auswertung
- Perceptron
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Vom Anbieter veröffentlichter Wert. Figure 5; four samples, majority vote, and tools; mean of two benchmark levels.
EgoSchema hard accuracy, Figure 3 (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 63.75
- Bewertung
- 63.75
- Messgröße
- percent
- Einheit
- %
- Kategorie
- egocentric-video
- Richtung
- Mehr ist besser
- Quellentyp
- vendor-reported
- Auswertung
- Perceptron
- Status
- disputed
- Abrufdatum
- 2026-10-04
- Methodik
- Vom Anbieter veröffentlichter Wert. Abbildung 3, egocentrische Evaluation.
- Einordnung
- Die abschließende Videotabelle derselben Seite nennt 61,3 für EgoSchema hard. Beide Beobachtungen bleiben erhalten, weil ihr Umfang ungeklärt ist.
EgoSchema hard accuracy, final table (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 61.3
- Bewertung
- 61.3
- Messgröße
- percent
- Einheit
- %
- Kategorie
- egocentric-video
- Richtung
- Mehr ist besser
- Quellentyp
- vendor-reported
- Auswertung
- Perceptron
- Status
- disputed
- Abrufdatum
- 2026-10-04
- Methodik
- Vom Anbieter veröffentlichter Wert. Abschließende Videobenchmark-Tabelle.
- Einordnung
- Abbildung 3 derselben Seite nennt 63,75 für EgoSchema hard. Beide Beobachtungen bleiben erhalten, weil ihr Umfang ungeklärt ist.
Molmo2-Track center-F1 (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 0.647
- Bewertung
- 0.647
- Messgröße
- ratio
- Einheit
- ratio
- Kategorie
- tracking
- Richtung
- Mehr ist besser
- Quellentyp
- vendor-reported
- Auswertung
- Perceptron
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Vom Anbieter veröffentlichter Wert. Figure 2 tracking evaluation.
Molmo2-Track point-HOTA (Messwert, Testbedingungen und Quelle anzeigen)
- Originalwert
- 0.628
- Bewertung
- 0.628
- Messgröße
- ratio
- Einheit
- ratio
- Kategorie
- tracking
- Richtung
- Mehr ist besser
- Quellentyp
- vendor-reported
- Auswertung
- Perceptron
- Status
- active
- Abrufdatum
- 2026-10-04
- Methodik
- Vom Anbieter veröffentlichter Wert. Figure 2 tracking evaluation.
Quellen und Datenstand
Alle Angaben verweisen auf die zugrunde liegende Dokumentation oder das jeweilige Leaderboard.
| Art | Nachweis und Datenstand |
|---|---|
| Recherchestand | Recherchestand 4. Oktober 2026. 1 Quellen-URLs geprüft. Das dokumentiert die geprüften Quellen, nicht sämtliche Veröffentlichungen zu diesem Modell. |
| Ungeklärt | egoschema-hard-configuration Originalwortlaut The provider page gives 63.75 in Figure 3 and 61.3 in its final video table. Both are preserved and neither is selected as the canonical value. |
| Weitere Quelle | Perceptron Mk1.5 announcement (abgerufen 3. Oktober 2026; 4. Oktober 2026) · Perceptron Mk1.5 announcement · Redaktionelle Beschreibung geprüft am 3. Oktober 2026 |