JEF
TypeSafe公司提供的云端快速判断器API服务,用于AI编程和浏览器自动化场景中的轻量决策加速,减少主模型往返延迟和token消耗
时间轴 (近 90 天)
国产开源智能体 CyberCode 在 1.1.24 版本接入了 JEF 快速判断器
JEF 在 CyberCode 中扮演快速判断器角色,负责轻量判断类决策,主模型继续承担规划、写代码和最终核验
JEF 是 TypeSafe 公司提供的云端 API 服务,并非通用开源组件,模型架构和训练细节未完全公开
JEF 的设计思路来源于 LLM 推理加速领域的推测解码(Speculative Decoding)和模型级联(Model Cascading)概念
在编码场景中,JEF 会批量判断较早的只读工具结果哪些值得保留、哪些可以缩短,且近期内容、错误信息和原始对话历史会受到保护不被误删
在浏览器场景中,页面状态进入 JEF 后一次请求同时选择动作和目标,点击、填表、勾选、滚动等操作不必每步都回主模型
当判断不确定、动作空间不支持或页面发生变化时,控制权会交回主模型
Browser Use 公布的航班搜索案例中,使用 JEF 的中位耗时从 9.45 秒降到约 7.09 秒
CyberCode 目前还没有真实 JEF 接入的端到端测速数据,文中数字都是算力假设而非实测
JEF 智能裁剪的默认等待预算是 800 毫秒,超时就沿用原有流程
还有 1 条时间轴事件
全部知识事实 (11)
使用云端 JEF 时候选上下文或页面内容会发送到云端
50%待验证JEF 在 CyberCode 中扮演快速判断器角色,负责轻量判断类决策,主模型继续承担规划、写代码和最终核验
50%待验证JEF 是 TypeSafe 公司提供的云端 API 服务,并非通用开源组件,模型架构和训练细节未完全公开
50%待验证JEF 的设计思路来源于 LLM 推理加速领域的推测解码(Speculative Decoding)和模型级联(Model Cascading)概念
50%待验证在编码场景中,JEF 会批量判断较早的只读工具结果哪些值得保留、哪些可以缩短,且近期内容、错误信息和原始对话历史会受到保护不被误删
50%待验证在浏览器场景中,页面状态进入 JEF 后一次请求同时选择动作和目标,点击、填表、勾选、滚动等操作不必每步都回主模型
50%待验证当判断不确定、动作空间不支持或页面发生变化时,控制权会交回主模型
50%待验证Browser Use 公布的航班搜索案例中,使用 JEF 的中位耗时从 9.45 秒降到约 7.09 秒
50%待验证CyberCode 目前还没有真实 JEF 接入的端到端测速数据,文中数字都是算力假设而非实测
50%待验证JEF 智能裁剪的默认等待预算是 800 毫秒,超时就沿用原有流程
50%待验证国产开源智能体 CyberCode 在 1.1.24 版本接入了 JEF 快速判断器
50%