Nnikhil mudholkar@nikhilmudholkar𝕏 作者在 1,565 封德语和英语工业供应商商务邮件的 10 类分类基准上测试了 Jev,发现其准确率不及 Gemini,但更关注错误出现的模式,并仍有意将其投入生产。
Aaron Levie 表示 Jev 可帮助智能体在工作流、数据分类和判断调用中做出快速决策,并展示 Box 与 Jev 的演示,从 Box 拉取事件报告。
Fatih Yildiz 表示 TypeSafe AI 的 Jev 在可观测性决策模型用例中很有前景,并提到在 edge_delta 使用前沿模型进行运营优先级评分、事件路由等决策时延迟累积,正在测试 Jev。