github / Research & data
jev-benchmark
AI-assisted summaries and translations. Check original sources for context and performance claims.
Questo repository fornisce un benchmark riproducibile per Jev di TypeSafe AI, valutandone le prestazioni nella classificazione del rischio delle chiamate agli strumenti degli agenti. Esamina l'accuratezza, la latenza e l'affidabilità dei punteggi di confidenza in scenari chiari, ambigui e avversari.
Sintesi tradotta · AI-assisted; check the original.
Source notes
This is a linked resource, not an independent verification of performance, cost or results. Check the original for current details.
- Collected
- 2026-09-21
- Discovered via
- awesomejev.com
Top 10
Sponsor
- Wallpets 94 clic$125
W
- Walltank 109 clic$85
W
- CChowder 61 clic$50
- Falconer 52 clic$45
F - Lemonpod 92 clic$40
L
- Menta 38 clic$35
M - Sway 36 clic$30
S
- Peon-Ping 32 clic$25
P - Zeron 94 clic$20
Z
- Guideless 27 clic$15
G