Wróć do laboratorium

JEVLAB NEWS Research & data

Premiera multimodalnego modelu Jev-Omni

AI-assisted summaries and translations. Check original sources for context and performance claims.

Programista Akhila udostępnił Jev-Omni, model oparty na Gemma 4 12B, zdolny do analizy tekstu, obrazów, dźwięku i wideo. Projekt ten ma na celu przyspieszenie procesów decyzyjnych w agentach AI.

Przetłumaczone podsumowanie · AI-assisted; check the original.

Otwórz oryginał

Cały wątek w skrócie

Własne podsumowania powiązanych wpisów CHOI z pomocą AI. Zdjęcia i filmy należą do ich twórców. Twierdzenia źródła nie zostały niezależnie zweryfikowane.

  1. Możliwości multimodalne
  2. Dostępność projektu

Możliwości multimodalne

Według doniesień Choi, model wykorzystuje architekturę Gemma 4 12B do oceny prawdopodobieństwa decyzji w różnych formatach danych. Na sprzęcie H200 osiąga bardzo niskie opóźnienia w przetwarzaniu tekstu oraz plików multimedialnych.

@choi.openai · Oryginalny wpis ↗

Dostępność projektu

Pełna dokumentacja oraz pliki modelu Jev-Omni zostały opublikowane przez autora na platformie Hugging Face na licencji Apache 2.0.

Source notes

This is a linked resource, not an independent verification of performance, cost or results. Check the original for current details.

Collected
2026-09-23
Discovered via
www.threads.com

Top 10

Supporter

  1. Wallpets
  2. Walltank
  3. Chowder
  4. Falconer
  5. Lemonpod
  6. Menta
  7. Sway
  8. Peon-Ping
  9. Zeron
  10. Guideless
Supporters