Wróć do laboratorium

github / Research & data

jev-benchmark

AI-assisted summaries and translations. Check original sources for context and performance claims.

themsquared · Język oryginału: English

To repozytorium udostępnia powtarzalny benchmark dla Jev od TypeSafe AI, oceniający jego wydajność w klasyfikacji ryzyka wywołań narzędzi przez agentów. Testuje dokładność, opóźnienia oraz wiarygodność wyników pewności w jasnych, niejednoznacznych i kontradyktoryjnych scenariuszach zadań.

Przetłumaczone podsumowanie · AI-assisted; check the original.

Otwórz oryginał
JEVLAB decorative pixel illustration; not source mediaJEVLAB ART

Source notes

This is a linked resource, not an independent verification of performance, cost or results. Check the original for current details.

Collected
2026-09-21
Discovered via
awesomejev.com

Top 10

Sponsor

  1. Wallpets $125
  2. Walltank $85
  3. Chowder $50
  4. Falconer $45
  5. Lemonpod $40
  6. Menta $35
  7. Sway $30
  8. Peon-Ping $25
  9. Zeron $20
  10. Guideless $15
Sponsoruj