Voltar ao laboratório

github / Research & data

jev-benchmark

AI-assisted summaries and translations. Check original sources for context and performance claims.

themsquared · Idioma original: English

Este repositório fornece um benchmark reproduzível para o Jev da TypeSafe AI, avaliando seu desempenho na classificação de risco de chamadas de ferramentas de agentes. Ele testa a precisão, latência e a confiabilidade das pontuações de confiança em cenários claros, ambíguos e adversários.

Resumo traduzido · AI-assisted; check the original.

Ver original
JEVLAB decorative pixel illustration; not source mediaJEVLAB ART

Source notes

This is a linked resource, not an independent verification of performance, cost or results. Check the original for current details.

Collected
2026-09-21
Discovered via
awesomejev.com

Top 10

Sponsor

  1. Wallpets $125
  2. Walltank $85
  3. Chowder $50
  4. Falconer $45
  5. Lemonpod $40
  6. Menta $35
  7. Sway $30
  8. Peon-Ping $25
  9. Zeron $20
  10. Guideless $15
Patrocinar