Voltar ao laboratório

JEVLAB NEWS Research & data

Lançamento do modelo multimodal Jev-Omni

AI-assisted summaries and translations. Check original sources for context and performance claims.

O desenvolvedor Akhila apresentou o Jev-Omni, um modelo multimodal baseado no Gemma 4 12B capaz de processar texto, áudio, imagem e vídeo. O projeto foca em agilizar a tomada de decisões em agentes de IA, expandindo as capacidades de processamento para além de apenas dados textuais.

Resumo traduzido · AI-assisted; check the original.

Ver original

Toda a sequência num relance

Resumos próprios com apoio de IA das publicações conectadas de CHOI. Imagens e vídeos pertencem aos seus criadores. As afirmações não foram verificadas de forma independente.

  1. Capacidades e Desempenho
  2. Disponibilidade do Projeto

Capacidades e Desempenho

O Jev-Omni utiliza a arquitetura Gemma 4 12B para avaliar probabilidades em diferentes mídias. Segundo o autor, o modelo apresenta latências baixas em hardware H200, embora o próprio desenvolvedor reconheça que o desempenho atual ainda é inferior ao do Jev original.

@choi.openai · Publicação original ↗

Disponibilidade do Projeto

O código e os recursos do Jev-Omni foram disponibilizados publicamente sob a licença Apache 2.0. Interessados podem acessar os arquivos e detalhes técnicos diretamente através da plataforma Hugging Face.

Source notes

This is a linked resource, not an independent verification of performance, cost or results. Check the original for current details.

Collected
2026-09-23
Discovered via
www.threads.com

Top 10

Supporter

  1. Wallpets
  2. Walltank
  3. Chowder
  4. Falconer
  5. Lemonpod
  6. Menta
  7. Sway
  8. Peon-Ping
  9. Zeron
  10. Guideless
Supporters