JEVLAB NEWS Research & data
Lancement du modèle multimodal Jev-Omni
AI-assisted summaries and translations. Check original sources for context and performance claims.
Le développeur Akhila a introduit Jev-Omni, un modèle multimodal basé sur Gemma 4 12B capable de traiter du texte, des images, de l'audio et de la vidéo. Ce projet open source vise à accélérer la prise de décision pour les agents IA sur divers types de médias.
Résumé traduit · AI-assisted; check the original.
Tout le fil en un coup d’œil
Résumés indépendants, assistés par IA, des publications liées de CHOI. Les images et vidéos appartiennent à leurs créateurs. Les affirmations ne sont pas vérifiées indépendamment.
Capacités et performances
Selon Choi, Jev-Omni utilise Gemma 4 12B pour évaluer des probabilités décisionnelles. Sur un système H200, le modèle affiche des temps de traitement rapides, notamment 26 ms pour les images et 31 ms pour l'audio, bien que ses performances globales restent inférieures à celles de Jev.
Disponibilité du projet
Le modèle Jev-Omni a été publié sous licence Apache 2.0. Les détails techniques et les fichiers du projet sont accessibles via la plateforme Hugging Face pour les développeurs intéressés.
Source notes
This is a linked resource, not an independent verification of performance, cost or results. Check the original for current details.
- Collected
- 2026-09-23
- Discovered via
- www.threads.com
Top 10
Supporter
- Wallpets 144 clics87d left
W
- Walltank 129 clics87d left
W
- CChowder 78 clics87d left
- Falconer 65 clics87d left
F - Lemonpod 101 clics87d left
L
- Menta 54 clics87d left
M - Sway 46 clics87d left
S
- Peon-Ping 44 clics87d left
P - Zeron 104 clics87d left
Z
- Guideless 37 clics87d left
G