Back to explore

Jev logra el 100% de finalización de tareas en el benchmark WebMCP

Jev combinado con Mercury 2.5 usando WebMCP resolvió el 100% de las tareas en un benchmark, con un costo de modelo aproximadamente 112 veces menor que GPT-6 Astra usando computer use con ejecución de código.

We just ran Jev on our WebMCP benchmark. The result: basically broke the benchmark. Jev + Mercury 2.5 (a fast, low-cost LLM) using WebMCP solved 100% of the tasks at roughly 112× lower model cost than GPT-6 Astra using computer use with code execution. Compared to Astra using

Jev logra el 100% de finalización de tareas en el benchmark WebMCP 1
· 2 mil likesOpen on X