Zurück zum Labor

JEVLAB NEWS Research & data

Einführung des multimodalen Modells Jev-Omni

AI-assisted summaries and translations. Check original sources for context and performance claims.

Der Entwickler Akhila hat Jev-Omni vorgestellt, ein auf Gemma 4 12B basierendes multimodales Modell, das Text, Bilder, Audio und Video verarbeiten kann. Das Projekt zielt darauf ab, die Entscheidungsfindung von KI-Agenten über verschiedene Medientypen hinweg zu beschleunigen.

Übersetzte Zusammenfassung · AI-assisted; check the original.

Original öffnen

Der gesamte Thread auf einen Blick

Eigene KI-gestützte Zusammenfassungen der zusammenhängenden Beiträge von CHOI. Bilder und Videos gehören ihren Urhebern. Aussagen wurden nicht unabhängig überprüft.

  1. Funktionen und Geschwindigkeit
  2. Verfügbarkeit

Funktionen und Geschwindigkeit

Laut Choi bewertet das Modell Entscheidungswahrscheinlichkeiten. Auf H200-Hardware erreicht es schnelle Verarbeitungszeiten, wie 26 ms für Bilder und 31 ms für Audio, wobei der Entwickler einräumt, dass die Leistung noch unter der von Jev liegt.

@choi.openai · Originalbeitrag ↗

Verfügbarkeit

Jev-Omni wurde unter der Apache 2.0-Lizenz veröffentlicht. Interessierte Nutzer können das Modell und die zugehörigen Ressourcen direkt über die Hugging Face-Plattform abrufen.

Source notes

This is a linked resource, not an independent verification of performance, cost or results. Check the original for current details.

Collected
2026-09-23
Discovered via
www.threads.com

Top 10

Supporter

  1. Wallpets
  2. Walltank
  3. Chowder
  4. Falconer
  5. Lemonpod
  6. Menta
  7. Sway
  8. Peon-Ping
  9. Zeron
  10. Guideless
Supporters