JEVLAB NEWS Research & data
Lançamento do modelo multimodal Jev-Omni
AI-assisted summaries and translations. Check original sources for context and performance claims.
O desenvolvedor Akhila apresentou o Jev-Omni, um modelo multimodal baseado no Gemma 4 12B capaz de processar texto, áudio, imagem e vídeo. O projeto foca em agilizar a tomada de decisões em agentes de IA, expandindo as capacidades de processamento para além de apenas dados textuais.
Resumo traduzido · AI-assisted; check the original.
Toda a sequência num relance
Resumos próprios com apoio de IA das publicações conectadas de CHOI. Imagens e vídeos pertencem aos seus criadores. As afirmações não foram verificadas de forma independente.
Capacidades e Desempenho
O Jev-Omni utiliza a arquitetura Gemma 4 12B para avaliar probabilidades em diferentes mídias. Segundo o autor, o modelo apresenta latências baixas em hardware H200, embora o próprio desenvolvedor reconheça que o desempenho atual ainda é inferior ao do Jev original.
Disponibilidade do Projeto
O código e os recursos do Jev-Omni foram disponibilizados publicamente sob a licença Apache 2.0. Interessados podem acessar os arquivos e detalhes técnicos diretamente através da plataforma Hugging Face.
Source notes
This is a linked resource, not an independent verification of performance, cost or results. Check the original for current details.
- Collected
- 2026-09-23
- Discovered via
- www.threads.com
Top 10
Supporter
- Wallpets 144 cliques87d left
W
- Walltank 129 cliques87d left
W
- CChowder 78 cliques87d left
- Falconer 65 cliques87d left
F - Lemonpod 101 cliques87d left
L
- Menta 54 cliques87d left
M - Sway 46 cliques87d left
S
- Peon-Ping 44 cliques87d left
P - Zeron 104 cliques87d left
Z
- Guideless 37 cliques87d left
G