Retour au labo

JEVLAB NEWS Research & data

Lancement du modèle multimodal Jev-Omni

AI-assisted summaries and translations. Check original sources for context and performance claims.

Le développeur Akhila a introduit Jev-Omni, un modèle multimodal basé sur Gemma 4 12B capable de traiter du texte, des images, de l'audio et de la vidéo. Ce projet open source vise à accélérer la prise de décision pour les agents IA sur divers types de médias.

Résumé traduit · AI-assisted; check the original.

Voir l’original

Tout le fil en un coup d’œil

Résumés indépendants, assistés par IA, des publications liées de CHOI. Les images et vidéos appartiennent à leurs créateurs. Les affirmations ne sont pas vérifiées indépendamment.

  1. Capacités et performances
  2. Disponibilité du projet

Capacités et performances

Selon Choi, Jev-Omni utilise Gemma 4 12B pour évaluer des probabilités décisionnelles. Sur un système H200, le modèle affiche des temps de traitement rapides, notamment 26 ms pour les images et 31 ms pour l'audio, bien que ses performances globales restent inférieures à celles de Jev.

@choi.openai · Publication originale ↗

Disponibilité du projet

Le modèle Jev-Omni a été publié sous licence Apache 2.0. Les détails techniques et les fichiers du projet sont accessibles via la plateforme Hugging Face pour les développeurs intéressés.

Source notes

This is a linked resource, not an independent verification of performance, cost or results. Check the original for current details.

Collected
2026-09-23
Discovered via
www.threads.com

Top 10

Supporter

  1. Wallpets
  2. Walltank
  3. Chowder
  4. Falconer
  5. Lemonpod
  6. Menta
  7. Sway
  8. Peon-Ping
  9. Zeron
  10. Guideless
Supporters