Back to explore

Jev достигает 100% выполнения задач в бенчмарке WebMCP

Jev в сочетании с Mercury 2.5, использующий WebMCP, решил 100% задач в бенчмарке, при примерно в 112 раз меньшей стоимости модели, чем GPT-6 Astra с computer use и выполнением кода.

We just ran Jev on our WebMCP benchmark. The result: basically broke the benchmark. Jev + Mercury 2.5 (a fast, low-cost LLM) using WebMCP solved 100% of the tasks at roughly 112× lower model cost than GPT-6 Astra using computer use with code execution. Compared to Astra using

Jev достигает 100% выполнения задач в бенчмарке WebMCP 1
· 2 тыс. likesOpen on X