JEVLAB NEWS Research & data
Einführung des multimodalen Modells Jev-Omni
AI-assisted summaries and translations. Check original sources for context and performance claims.
Der Entwickler Akhila hat Jev-Omni vorgestellt, ein auf Gemma 4 12B basierendes multimodales Modell, das Text, Bilder, Audio und Video verarbeiten kann. Das Projekt zielt darauf ab, die Entscheidungsfindung von KI-Agenten über verschiedene Medientypen hinweg zu beschleunigen.
Übersetzte Zusammenfassung · AI-assisted; check the original.
Der gesamte Thread auf einen Blick
Eigene KI-gestützte Zusammenfassungen der zusammenhängenden Beiträge von CHOI. Bilder und Videos gehören ihren Urhebern. Aussagen wurden nicht unabhängig überprüft.
Funktionen und Geschwindigkeit
Laut Choi bewertet das Modell Entscheidungswahrscheinlichkeiten. Auf H200-Hardware erreicht es schnelle Verarbeitungszeiten, wie 26 ms für Bilder und 31 ms für Audio, wobei der Entwickler einräumt, dass die Leistung noch unter der von Jev liegt.
Verfügbarkeit
Jev-Omni wurde unter der Apache 2.0-Lizenz veröffentlicht. Interessierte Nutzer können das Modell und die zugehörigen Ressourcen direkt über die Hugging Face-Plattform abrufen.
Source notes
This is a linked resource, not an independent verification of performance, cost or results. Check the original for current details.
- Collected
- 2026-09-23
- Discovered via
- www.threads.com
Top 10
Supporter
- Wallpets 144 Klicks87d left
W
- Walltank 129 Klicks87d left
W
- CChowder 78 Klicks87d left
- Falconer 65 Klicks87d left
F - Lemonpod 101 Klicks87d left
L
- Menta 54 Klicks87d left
M - Sway 46 Klicks87d left
S
- Peon-Ping 44 Klicks87d left
P - Zeron 104 Klicks87d left
Z
- Guideless 37 Klicks87d left
G