Volver al laboratorio

github / Research & data

jev-benchmark

AI-assisted summaries and translations. Check original sources for context and performance claims.

themsquared · Idioma original: English

Este repositorio ofrece un benchmark reproducible para Jev de TypeSafe AI, evaluando su rendimiento en la clasificación de riesgos de llamadas a herramientas de agentes. Analiza la precisión, latencia y la fiabilidad de las puntuaciones de confianza en escenarios claros, ambiguos y adversarios.

Resumen traducido · AI-assisted; check the original.

Ver original
JEVLAB decorative pixel illustration; not source mediaJEVLAB ART

Source notes

This is a linked resource, not an independent verification of performance, cost or results. Check the original for current details.

Collected
2026-09-21
Discovered via
awesomejev.com

Top 10

Sponsor

  1. Wallpets $125
  2. Walltank $85
  3. Chowder $50
  4. Falconer $45
  5. Lemonpod $40
  6. Menta $35
  7. Sway $30
  8. Peon-Ping $25
  9. Zeron $20
  10. Guideless $15
Patrocinar