github / Research & data
jev-benchmark
AI-assisted summaries and translations. Check original sources for context and performance claims.
Este repositorio ofrece un benchmark reproducible para Jev de TypeSafe AI, evaluando su rendimiento en la clasificación de riesgos de llamadas a herramientas de agentes. Analiza la precisión, latencia y la fiabilidad de las puntuaciones de confianza en escenarios claros, ambiguos y adversarios.
Resumen traducido · AI-assisted; check the original.
Source notes
This is a linked resource, not an independent verification of performance, cost or results. Check the original for current details.
- Collected
- 2026-09-21
- Discovered via
- awesomejev.com
Top 10
Sponsor
- Wallpets 94 clics$125
W
- Walltank 109 clics$85
W
- CChowder 61 clics$50
- Falconer 52 clics$45
F - Lemonpod 92 clics$40
L
- Menta 38 clics$35
M - Sway 36 clics$30
S
- Peon-Ping 32 clics$25
P - Zeron 94 clics$20
Z
- Guideless 27 clics$15
G