Retour au labo

github / Research & data

jev-benchmark

AI-assisted summaries and translations. Check original sources for context and performance claims.

themsquared · Langue d’origine: English

Ce dépôt propose un benchmark reproductible pour Jev de TypeSafe AI, évaluant ses performances dans la classification des risques liés aux appels d'outils par des agents. Il examine la précision, la latence et la fiabilité des scores de confiance sur des scénarios variés.

Résumé traduit · AI-assisted; check the original.

Voir l’original
JEVLAB decorative pixel illustration; not source mediaJEVLAB ART

Source notes

This is a linked resource, not an independent verification of performance, cost or results. Check the original for current details.

Collected
2026-09-21
Discovered via
awesomejev.com

Top 10

Sponsor

  1. Wallpets $125
  2. Walltank $85
  3. Chowder $50
  4. Falconer $45
  5. Lemonpod $40
  6. Menta $35
  7. Sway $30
  8. Peon-Ping $25
  9. Zeron $20
  10. Guideless $15
Sponsoriser