github / Research & data
jev-benchmark
AI-assisted summaries and translations. Check original sources for context and performance claims.
Ce dépôt propose un benchmark reproductible pour Jev de TypeSafe AI, évaluant ses performances dans la classification des risques liés aux appels d'outils par des agents. Il examine la précision, la latence et la fiabilité des scores de confiance sur des scénarios variés.
Résumé traduit · AI-assisted; check the original.
Source notes
This is a linked resource, not an independent verification of performance, cost or results. Check the original for current details.
- Collected
- 2026-09-21
- Discovered via
- awesomejev.com
Top 10
Sponsor
- Wallpets 94 clics$125
W
- Walltank 109 clics$85
W
- CChowder 61 clics$50
- Falconer 52 clics$45
F - Lemonpod 92 clics$40
L
- Menta 38 clics$35
M - Sway 36 clics$30
S
- Peon-Ping 32 clics$25
P - Zeron 94 clics$20
Z
- Guideless 27 clics$15
G