把DeepSeek网页塞进Harness:用免费算力改本地代码的实测

用Chrome扩展+Harness插件桥接DeepSeek网页版,免费实现本地文件读写与代码修改。
B站UP主大炮开发了一套桥接方案,通过Harness插件与Chrome扩展,将DeepSeek免费网页版接入本地开发环境,让其具备读取文件、修改代码等Agent能力,绕过付费API。实测中免费网页版生成动画仅耗时5分56秒,优于API高推力档的不稳定表现,接近低推力档效果。但"生成代码"与"修改真实项目"难度差异显著,前者只需返回完整代码,后者需要稳定的工具调用循环。经过20多个版本迭代,针对上下文过长、工具调用格式错误等问题逐一打磨后,本地修改链路才最终跑通。项目已开源,当前稳定版支持DeepSeek,其他网页适配仍在验证中,整体方案验证了免费网页算力接入本地开发流程的可行性。
一个大胆的想法:让网页版模型直接干活
付费的模型API固然稳定,但对个人开发者来说,每天调用产生的费用不容小觑。B站UP主大炮把目光投向了另一条路——DeepSeek的网页版是免费的,能不能让它绕过API,直接接入本地开发环境帮忙读文件、改代码?
他给出的答案是一套桥接方案:一个装在Harness里的插件,加上一个Chrome扩展,按照特定格式在两端传输数据。这样一来,Harness就能把网页对话窗口当成模型API来调用,而背后的算力完全免费。
简单理解,Harness是模型配套的工作环境,通常只有接入模型API后才能工作。这套插件的价值在于,它把"必须付费调API"这个前提给拆掉了。当屏幕上打出一句"你好"并同步显示网页输出结果时,就意味着桥接正式成功——不仅能在思考过程中看到网页的实时反馈,还能通过内嵌窗口直达对应的任务对话。

Harness 是一类为AI模型提供工具调用能力的运行框架(也常被称为Agent框架或编排层),它负责将用户指令拆解为具体操作,并调用文件读写、代码执行、终端命令等本地工具。常见的同类工具还有Continue、Cursor、Cline等VS Code插件。这类框架的核心价值在于让模型不只是"聊天",而是能真正操作文件系统、完成多步骤任务。通常情况下,Harness必须通过官方API与模型通信——API密钥既是身份验证,也是计费入口。这套桥接方案的创新之处,就在于用Chrome扩展模拟了"假API端点",让Harness以为自己在和正常的模型接口通话,实则请求被转发到了浏览器里已登录的网页对话窗口。
免费网页版真的够强吗?一场反常识的测试
真正让作者意外的,是网页版模型的实际表现。他选了一个经典测试:生成"骑壶骑自行车"的动效(一个茶壶蹬自行车的动画)。
结果颇具戏剧性:
- API调用的DeepSeek V4.1 Flash(低推力档):耗时9分02秒,背景要素、踏板和腿部同步转动都基本达标。
- API高推力档:反而翻车了,第一次生成的结果无法正常运行,第二次修改后素材还在画面里乱飞。
- 免费网页版:只花了5分56秒,整体效果已经很接近API低推力档。
这组对比很容易让人得出"免费网页版吊打付费API"的结论,但作者保持了清醒。他指出这个测试本身有个bug:网页模型只要把一份完整代码从云端发回来,就能生成动画,这并不能证明它有能力在本地"修改"文件。生成一段代码和改完一个真实项目,完全是两回事。

从"生成"到"修改":难度的真正门槛
为了验证真实能力,作者让网页模型对已经生成的本地动效文件做二次修改。前两次都失败了——一次卡在上下文过长,一次卡在工具调用的适配。
但失败中也露出了希望:模型已经开始连续调用工具了。它先读取真实文件、拿到结果,再决定怎么修改;Harness把执行结果交回网页,网页再提出下一步操作。这个"读取—决策—执行—反馈"的循环已经转起来了,只是还不稳定。
作者把接下来的工作总结成几条传输细节的打磨:
- 上下文太长就分段整理历史,保留近期结果,必要时换一个网页对话带着进度继续。
- 工具调用要先检查是否符合要求,再交给Harness执行。
- 回答格式不对就把具体错误交回模型纠正,依然不对就停止,绝不猜着执行。
这些看似琐碎的细节,直接决定了模型能不能连续干活。

这里的"工具调用"(Tool Use / Function Calling)是指模型在回答时不只输出文本,而是按照预定格式输出结构化指令,要求外部程序执行某个操作并把结果反馈回来。例如模型可以输出"读取文件 animation.js 的第30-80行",由Harness实际执行后再将内容返回给模型。这一机制是Agent能力的基础,但也对模型输出格式的稳定性要求极高——哪怕多一个换行或少一个括号,解析就会失败。网页版模型的输出并非为工具调用专门优化,因此早期版本频繁出现格式错误,需要额外的校验与纠错逻辑来兜底。
20多个版本后:本地修改终于跑通
经过前后20多个版本的迭代,本地修改任务终于完整跑通。作者以最初简单提示词生成的动画为基础,让模型自行发挥继续升级。
结果是可见的进步:腿部增加了骨骼结构,可以调整蹬车速度,背景也能切换时间。模型确实完成了完整链路——读取原文件、写入修改、调用工具检查,最后直接打开成品确认修改真实生效。
到了这一步,"把网页塞进Harness"才算真正有了实际价值。沿着同样的思路,作者还成功接通了豆包网页的调用。

能接通只是起点:还有多少路要走
作者也坦言,接通只是第一步。网页模型到底能完成多大体量的项目开发、如何最大化利用每天的免费额度,这些都仍待实践检验。
目前项目已经开源,按说明把插件装进Harness、运行配对工具即可开始使用,详细步骤和排障方法都在项目说明里。需要注意的是,当前开源的稳定版先支持DeepSeek,其他网页的适配还在继续验证中。
作者的下一步计划是只用网页模型从零做一个更完整的项目,探索它的能力极限。对于想省下API费用、又愿意折腾的开发者来说,这套方案提供了一个值得尝试的思路——尽管它离"稳定生产力工具"还有距离,但已经证明了免费网页算力接入本地开发流程的可行性。
相关推荐

OpenCode 入门到实战全攻略:AI编程工具安装与配置指南
OpenCode 是一款开源 AI 编程工具。本文梳理其入门到实战全流程:桌面端与 WSL 两种安装方式、模型与规则配置、Agent 分类、自定义命令工具、MCP 服务集成及 SQL 复用,助你系统上手 OpenCode。

10美元AI编程套餐怎么选?Go与Code额度对比拆解
DeepSeek涨价后,10美元AI编程套餐Go和Code怎么选?本文按Mimo、千问、DeepSeek V4、Kimi等常用模型逐一对比两家额度,揭示总额度背后的选购逻辑与请求次数口径陷阱。

多LLM对话真能提升任务表现吗?一个严谨实验设计的启示
一位研究者设计了一套严谨的对照实验,试图隔离多LLM来回对话与单向共享、自我精炼等机制的真实增益。本文解析其实验设计、预算核算与三个开放问题,为多智能体研究提供参考。