github / Research & data
jev-benchmark
AI-assisted summaries and translations. Check original sources for context and performance claims.
Repositori ini menyediakan tolok ukur yang dapat direproduksi untuk Jev dari TypeSafe AI, mengevaluasi kinerjanya dalam klasifikasi risiko pemanggilan alat agen. Ini menguji akurasi, latensi, dan keandalan skor kepercayaan di berbagai skenario tugas yang jelas, ambigu, dan adversarial.
Ringkasan terjemahan · AI-assisted; check the original.
Source notes
This is a linked resource, not an independent verification of performance, cost or results. Check the original for current details.
- Collected
- 2026-09-21
- Discovered via
- awesomejev.com
10 teratas
Sponsor
- Wallpets 94 klik$125
W
- Walltank 109 klik$85
W
- CChowder 61 klik$50
- Falconer 52 klik$45
F - Lemonpod 92 klik$40
L
- Menta 38 klik$35
M - Sway 36 klik$30
S
- Peon-Ping 32 klik$25
P - Zeron 94 klik$20
Z
- Guideless 27 klik$15
G