Lauren
Cursor团队工程师,专注于AI Agent协作工程实践,提出了信任曲线模型和验证技能体系,并开发了PSAC开源插件
Timeline (last 90 days)
Lauren构建了'how skill'和'why skill'两个技能,使harness能更严谨地检视代码库并在收到Slack消息后主动研究代码库追问细节
Cursor的PM Agent和EM Agent源于工程师Lauren对内部Agent窗口Glass每天报出10到20个问题的观察
Lauren 提出的信任阶梯按有效性从高到低排列为:代码库本身、静态分析、规则/Bug Bot/技能、风格指南
Lauren 构建了名为 P-Stack 的插件,本质是一组技能集合,把她多年的软件工程工作流沉淀为对应的 playbook 和 skill
Lauren 六个月前加入 Cursor,负责优化 Cursor Agent 窗口的性能问题
Lauren 建议不要只依赖风格指南,人工 review 只适合发现缺了什么,应把时间投入前几层
Lauren 认为从少量 Agent 跃迁到大量 Agent 的最大障碍不是算力或工具,而是信任
Lauren此前在React团队工作,约半年前加入Cursor(后并入SpaceX AI)
SpaceX AI旗下Grokbot团队的工程师Lauren上个月向生产环境提交了2000多个Pull Request
Lauren认为高效Agent工作流的核心是围绕'信任'构建,工程师需要把知识灌输给Agent以避免自己成为瓶颈
20 more timeline events
All Facts (20)
Feature Map(功能地图)是skill附带的特殊文件,教会Agent如何从用户视角走到产品每一个功能,包括子功能、快捷键、CDP选中元素的data属性
60%UnverifiedLauren构建了'how skill'和'why skill'两个技能,使harness能更严谨地检视代码库并在收到Slack消息后主动研究代码库追问细节
50%UnverifiedLauren 提出的信任阶梯按有效性从高到低排列为:代码库本身、静态分析、规则/Bug Bot/技能、风格指南
50%UnverifiedLauren 构建了名为 P-Stack 的插件,本质是一组技能集合,把她多年的软件工程工作流沉淀为对应的 playbook 和 skill
50%UnverifiedLauren 六个月前加入 Cursor,负责优化 Cursor Agent 窗口的性能问题
50%UnverifiedLauren 建议不要只依赖风格指南,人工 review 只适合发现缺了什么,应把时间投入前几层
50%UnverifiedLauren 认为从少量 Agent 跃迁到大量 Agent 的最大障碍不是算力或工具,而是信任
50%UnverifiedLauren认为高效Agent工作流的核心是围绕'信任'构建,工程师需要把知识灌输给Agent以避免自己成为瓶颈
50%UnverifiedLauren此前在React团队工作,约半年前加入Cursor(后并入SpaceX AI)
50%Unverified在缺乏信任的情况下强行并行启动上百个子Agent会产生海量垃圾PR、回归和Bug
50%UnverifiedLauren在Cursor构建的第一个验证技能名为'Control',包含CLI和Feature Map两个关键组件
50%UnverifiedP-Stack是Lauren构建的插件,将其软件工程中的调试、功能开发、原型设计等工作流沉淀成技能库
50%UnverifiedLauren提出的'信任阶梯'包含五个层次:代码库本身、静态分析、规则/Bug Bot/技能、风格指南,重要性递减但可强制程度不同
50%Unverified当Agent反复犯同一错误时,与其每次纠正不如加一条lint规则,或重构代码库让该错误结构上不可能发生
50%UnverifiedDune框架禁止代码注释,因为Agent常把注释当作不去真正解决问题的借口来掩盖临时补丁
50%UnverifiedTheo提出处理agent错误的分层框架:第一层从架构消灭整类错误,第二层做成lint规则或测试,第三层才用skill和rule兜底
50%UnverifiedLauren构建了「control glass」技能,教Agent使用Chrome DevTools Protocol来运行应用、抓取trace并实现程序化控制
50%UnverifiedLauren现在让Agent自动合并PR,某天早上醒来已有20个PR落地并直接在主分支上review
50%UnverifiedCursor团队工程师Lauren认为AI协作的真正天花板不在模型能力,而在于人与Agent之间是否建立信任体系
50%UnverifiedLauren将Eval的心智模型描述为「Agent的单元测试」,通过主协调Agent制定评分rubric并派生子Agent进行评估
50%