github / Research & data
jev-benchmark
AI-assisted summaries and translations. Check original sources for context and performance claims.
Kho lưu trữ này cung cấp một bộ chuẩn có thể tái lập cho Jev của TypeSafe AI, đánh giá hiệu suất của nó trong việc phân loại rủi ro khi gọi công cụ của tác nhân. Nó kiểm tra độ chính xác, độ trễ và độ tin cậy của điểm tin cậy trong các kịch bản nhiệm vụ rõ ràng, mơ hồ và đối nghịch.
Tóm tắt đã dịch · AI-assisted; check the original.
Source notes
This is a linked resource, not an independent verification of performance, cost or results. Check the original for current details.
- Collected
- 2026-09-21
- Discovered via
- awesomejev.com
Top 10
Sponsor
- Wallpets 94 lượt nhấp$125
W
- Walltank 109 lượt nhấp$85
W
- CChowder 61 lượt nhấp$50
- Falconer 52 lượt nhấp$45
F - Lemonpod 92 lượt nhấp$40
L
- Menta 38 lượt nhấp$35
M - Sway 36 lượt nhấp$30
S
- Peon-Ping 32 lượt nhấp$25
P - Zeron 94 lượt nhấp$20
Z
- Guideless 27 lượt nhấp$15
G