它连字都不会写,凭什么重构 Computer Use?Jev 毫秒级单选题与 WebMCP 协同真相
拿到 TypeSafe AI 开放内测的决策模型 Jev 之后,很多习惯了 ChatGPT 和 Claude 的开发者第一反应往往是困惑:它甚至连一段通顺的文字都不会写,无法生成任意字符串,怎么能被称为“操控电脑的神器”?然而,当它被接入浏览器与桌面自动化管线时,开源社区却集体炸开了锅——订机票 7 秒搞定、界面单步决策仅需 90 毫秒、单次任务模型成本骤降至 0.001 美元。
在过去很长一段时间里,让自回归大模型操作电脑宛如看一场 2 FPS 的慢速 PPT:每点一次鼠标,都要等千亿参数模型慢悠悠“写一篇小论文”。为什么一个只会做“单选题”的模型能将传统截图式 Computer Use 彻底干趴?当它与 WebMCP 结合时,为何能将基准评测成功率直接拉满到 100%,并将运行成本狂砍 112 倍?本文将为你深度拆解这场正在颠覆智能体底层逻辑的“分流革命”。