每日AI新鲜事·08月19日晚间版:AI编程工具的自动化边界与DeepSeek Harness
每日AI新鲜事·08月19日晚间版:AI编程工具的自动化边界与DeepSee…
2026年08月19日(周三)晚间版 AI新闻速递+热点深度讨论
2026年08月19日(周三)晚间版 AI新闻速递+热点深度讨论
今天AI圈的消息不算特别多,但有几条挺有意思的,我们聊聊。
先说一个B站上很火的视频,Flask的作者Armin Ronacher跟Pi的创作者做了一期对谈,聊AI编程时代的过度自动化陷阱。
这个我刷到了。Pi这个工具挺有意思的,它没有MCP支持,但用户可以直接让Pi给自己构建MCP功能。
对,Flask作者的核心观点是他喜欢简单稳定的工具,哪怕里面有非确定性的部分,也要可预期、可依赖。
这其实是在回应现在AI编程工具越做越重的趋势。大家都在堆功能堆自动化,但Armin觉得人类判断力不能让渡出去。
好,第二条也是B站的,DeepSeek Harness这个项目一夜在GitHub上爆火了。
这个我得说两句。它跟Claude Code、Codex这些不太一样,核心卖点是插件化的Agent框架,而且是基于Web的交互方式。
视频里那个博主说它的UI特别清晰,能看到输入参数、模型的token消耗、还有数据源的响应内容,搭配DeepSeek V4 Pro编码能力也很强。
Web交互这个选择挺聪明的,降低了使用门槛。不过能不能长期留住用户,还得看插件生态能不能起来。
然后Reddit上有两条,一条是有人做了个Windows游戏录制原型,把视频和键盘鼠标操作对齐记录下来。
这个方向明显是为了训练游戏AI用的,100毫秒级的键盘状态加鼠标delta值,做行为克隆的数据集。
另一条Reddit帖子是在问,什么时候你意识到自己真的在学ML,而不只是在调库。这个话题好真实。
得了吧,这问题我读博的时候天天问自己。不过说实话,能从零推导反向传播的时候,大概就过了那条线了。
好了新闻就先聊到这儿,接下来我们深入聊聊AI编程工具这个话题,因为今天两条消息其实指向同一个问题。
Flask作者和Pi创作者在聊过度自动化的陷阱,DeepSeek Harness又在做更强的自动化框架。这两个方向看起来是矛盾的,李博你怎么看?
我觉得不矛盾。Armin批评的不是自动化本身,而是那种不透明的、黑箱式的自动化。
你看DeepSeek Harness为什么强调UI要展示token消耗和响应内容?就是在做透明化。让人知道AI在干什么,而不是一键出结果然后你祈祷它是对的。
这个角度有道理。Armin说的是人类判断力要回归,不是说不用AI,而是你得能看懂AI在做什么然后做决策。
对,我给你打个比方。现在很多编程Agent就像自动驾驶,有的是L5全自动不让你插手,有的是L3辅助驾驶让你随时接管。
Armin明显偏好L3,而插件化框架其实也是L3思路,你可以选择哪些环节交给AI哪些自己来。
但从产品角度来说,用户其实是懒的。大部分人用AI编程工具就是想少干活,你让他们自己判断,他们可能根本不想判断。
小雨你这话说到点子上了。这就是为什么现在市场上两种路线都有人做。
Devin走的是全托管路线,DeepSeek Harness和Pi走的是人机协作路线。最终可能不同场景用不同工具。
我觉得关键在于出错成本。写个demo无所谓,但如果是生产代码、涉及安全的逻辑,你敢全交给AI不看一眼吗?
所以Armin说的稳定和可依赖特别重要。Pi的设计哲学就是工具本身简单,复杂度由用户自己决定要不要引入。
而且Pi那个设计很巧妙,它不内置MCP,但你可以让它自己给自己加MCP支持。这等于把扩展性交给了用户。
这个思路其实很Unix哲学,每个工具做好一件事,组合起来完成复杂任务。
但DeepSeek Harness走的是另一条路,它是把很多功能都装进一个框架里,靠插件化来保持灵活性。
两条路各有优劣。插件化框架的好处是生态统一、上手快;Unix风格的好处是每个组件可以独立演进、不容易一损俱损。
我倒是觉得从社区反应来看,DeepSeek Harness这种一站式的方案短期内更容易火。毕竟GitHub一夜爆火说明大家确实有这个需求。
火是火,但能不能持续就看它的插件生态能不能真正建起来。现在AI编程工具太多了,用户迁移成本其实很低。
也是。不过V4 Pro的编码能力如果真的跟视频里说的那么强,搭配自家的框架,可能会形成一定的绑定效应。
嗯,模型加框架加生态,这套组合拳打得下来的话确实有竞争力。不过现在下结论还太早。
总结一下的话,今天这两条消息反映的是AI编程工具的一个核心张力:自动化程度和人类控制感之间怎么平衡。
没错,而且我觉得最终答案不是二选一,而是让用户自己选择要在哪个刻度上。工具要做的是把这个选择权交出来。
说得好。行,今天就聊到这儿,明天见。
明天见。
相关推荐
科技前沿GLM-5.2登顶全球开源模型榜首:前端编码能力领跑业界
智谱AI发布GLM-5.2模型,在Artificial Analysis Intelligence Index评测中登顶全球开放权重模型榜首,同时被评为顶级前端编码模型。深入解析GLM-5.2的突破性表现与开源模型竞争格局变化。
科技前沿Reve 2与Ideogram 4对比:AI图像生成布局控制能力全面解析
深度对比Reve 2和Ideogram 4两款AI图像生成模型在布局控制方面的核心突破,分析精确布局技术路径、实用场景及行业趋势,帮助设计师和创作者把握AI可控生成的新方向。
科技前沿Claude Slack智能体升级:多人协作、主动响应与持久记忆全解析
Anthropic为Claude推出Slack集成重大升级,新增多人协作、主动响应和持久记忆三大核心能力,将AI从被动问答工具转变为真正的团队协作伙伴,重新定义企业级AI智能体应用标准。