Back to explore

Jev отлично показал себя в бенчмарке WebMCP

В бенчмарке WebMCP Jev в одиночку на сыром DOM выполняет 25/49 задач. В сочетании с выбором инструментов WebMCP и генерацией аргументов Mercury 2.5 результат достигает 49/49, а стоимость модели примерно в 112 раз ниже, чем у GPT-6 Astra.

🧪 The WebMCP benchmark by @0xidanlevin is the best stress test so far. Jev alone on the raw DOM: 25/49 tasks. Jev picking WebMCP tools + Mercury 2.5 writing args: 49/49, ~112x lower model cost than GPT-6 Astra. https://webmcp.com/benchmark

Jev отлично показал себя в бенчмарке WebMCP 1
· 0 likesOpen on X