Sider Code:用自然语言改造任意网页的AI浏览器扩展

当网页规则由你定义
过去三十年,互联网的运行逻辑始终由网站开发者单方面制定:按钮放在哪里、信息如何排布、功能是否存在——用户只能被动接受。而 Sider Code 这款登上 Product Hunt 榜单第五名的 Chrome 扩展,试图彻底改写这一权力关系。
它的核心主张简单而新颖:用一句大白话,就能改造你每天依赖的任何网站。你只需在 Sider 扩展中告诉它某个页面应该如何工作,它便能理解页面结构、自动编写代码,并即时应用这一改动。这一功能在上线后迅速获得 115 票支持和 33 条评论,被归类于 Chrome 扩展、生产力工具与人工智能三大领域。

从"被动接受"到"主动重塑":Sider Code 解决了什么痛点
每个人都有对某些网站的"不满清单":某个购物网站的价格排序太隐蔽、某个新闻站点的广告过于扰人、某个后台工具缺少一个批量操作按钮。传统的解决方式要么是安装专门的浏览器脚本(需要懂代码),要么是寻找现成的插件(往往没有精准匹配的)。
在 Sider Code 出现之前,普通用户定制网页最常见的途径是使用 Tampermonkey 或 Greasemonkey 等用户脚本管理器。这些工具允许用户安装社区编写的 JavaScript 脚本,实现去广告、自动翻页、界面美化等功能。Greasy Fork 等平台上积累了数以万计的现成脚本。然而,这一生态存在明显门槛:如果没有现成脚本能精确满足需求,用户就必须自己编写或修改 JavaScript 代码,这对非技术人群几乎不可能。
Sider Code 的价值在于把这个门槛降到了零。它将"改造网页"这件原本属于开发者的技术活,转化为一句自然语言指令。背后的 AI 会完成三个关键步骤:
-
理解页面——解析当前网页的 DOM 结构与内容语义。DOM(Document Object Model,文档对象模型)是浏览器将 HTML 文档解析后生成的树状结构表示,每一个 HTML 标签——从最外层的
<html>到具体的按钮、段落、图片——都会成为这棵树上的一个节点。传统的网页修改工具要求使用者熟悉 DOM 查询方法(如document.querySelector),而 Sider Code 的突破在于让 AI 自动完成这一步骤:大语言模型不仅能识别 DOM 的层级关系,还能结合页面可见文本推断出每个元素的功能含义——比如判断某个<div>是广告容器而非正文区域——从而生成精准的操作指令。 -
编写代码——根据你的诉求生成相应的脚本或样式修改;
-
执行变更——直接在页面上应用效果,所见即所得。
更重要的是,用户可以保存并管理这些自定义功能,让改动持久化,而不是刷新页面后就消失。这意味着你可以为常用网站积累一套属于自己的"增强补丁"。
AI 代码生成能力在浏览器端的场景化落地
大语言模型驱动的网页自动化
Sider Code 本质上是"AI 代码生成"能力在浏览器端的一次场景化落地。它与 GitHub Copilot、Cursor 等面向专业开发者的编程助手不同,目标用户是普通网民,追求的是零代码、即时见效的体验。
这种产品形态之所以成为可能,得益于当前主流大语言模型(如 GPT-4、Claude 等)对前端代码的深度理解能力。这些模型在训练数据中包含了 GitHub 上海量的开源前端代码,使它们对 HTML、CSS 和 JavaScript 的掌握达到了相当高的水准。多项基准测试显示,这些模型能够正确生成涉及 DOM 操作、CSS 选择器编写、事件监听绑定等任务的代码片段,准确率在常见场景下可超过 80%。更关键的是,大语言模型还具备将自然语言意图映射到具体前端操作的「语义桥接」能力——例如将「把所有价格标红」翻译为对特定 class 元素施加 CSS color 属性的操作。这种能力的成熟正是 Sider Code 这类产品得以成立的技术前提。
这种产品形态反映了一个明显趋势:随着大语言模型对网页结构和前端代码的理解能力提升,"自然语言即界面"的交互范式正从概念走向实用。「自然语言即界面」(Natural Language as Interface)是人机交互领域近年来最受关注的范式转变之一,其核心理念是用户不再需要学习特定的图形界面操作或编程语法,而是通过日常语言表达意图,由 AI 系统完成意图到操作的转换。这一范式的早期形态可以追溯到 Siri、Alexa 等语音助手,但它们受限于固定的指令集和有限的执行能力。大语言模型的出现使其发生了质变——模型能够理解开放域的复杂指令,并将其转化为可执行的代码或 API 调用。在浏览器场景中,这意味着用户说「把这个页面的侧边栏隐藏掉」就等同于编写了一段 CSS display:none 的规则,交互成本从分钟级降到了秒级。用户不再需要学习正则表达式、CSS 选择器或 JavaScript,就能获得过去只有程序员才能实现的网页定制化能力。
便利与安全风险并存
当然,将 AI 生成的代码直接注入到用户浏览的网页中,也带来了值得关注的问题。首先是安全性——注入脚本可能与网站原有逻辑冲突,甚至在敏感页面(如网银、支付)引入风险。
从技术层面看,Chrome 扩展的脚本注入机制基于 Manifest V3 架构下的 Content Scripts 系统。扩展可以向匹配的网页注入 JavaScript 和 CSS,这些脚本运行在与网页本身隔离的「isolated world」中,理论上无法直接访问页面的 JavaScript 变量。然而,通过 DOM 操作,注入脚本仍然可以读取页面上所有可见内容,包括表单中的敏感数据。对于网银、支付等高风险页面,注入脚本如果修改了表单提交逻辑或劫持了点击事件,可能导致严重的安全后果。此外,AI 生成的代码本身可能存在逻辑漏洞——例如不当的 XSS(跨站脚本攻击)风险或数据泄露路径——这要求此类产品必须建立严格的代码审查和沙箱执行机制。
其次是兼容性——网站前端一旦改版,此前生成的自定义功能可能失效,需要重新调整。此外,页面内容的解析也涉及隐私边界,用户需要清楚扩展能读取哪些数据。
这些都是自然语言编程类工具走向成熟必须解决的课题。Sider Code 强调用户对功能拥有"保存和控制"权,可以看作是在便利性与可控性之间寻求平衡的初步尝试。
Sider 生态的延伸布局:从阅读辅助到网页改写
你可能没注意到,Sider Code 并非孤立产品,而是 Sider 这一 AI 助手品牌生态的组成部分。Sider 本身已是知名的浏览器 AI 侧边栏工具,覆盖网页总结、翻译、写作辅助等功能。此次推出 Code 功能,实际上是把 AI 的能力从"读懂网页、辅助阅读"进一步延伸到"改写网页、重构交互"。
AI 浏览器侧边栏工具是 2023 年以来增长最快的 Chrome 扩展品类之一。除 Sider 外,该赛道的代表产品还包括 Monica、Merlin、MaxAI 等,它们通常整合多个大语言模型(GPT-4、Claude、Gemini 等),为用户提供网页摘要、翻译、对话问答、写作辅助等功能。Sider 的差异化在于其较早建立了多模型切换和多功能集成的产品框架,用户基础已达数百万级。从信息理解(总结、翻译)到功能操作(代码注入、界面改写)的跃迁,标志着 AI 侧边栏工具正从「被动信息辅助」进化为「主动环境改造」,这也是整个赛道下一阶段竞争的核心战场。
从产品策略看,这是一条清晰的能力升级路径:先做信息层的理解与生成,再做功能层的操作与定制。对于一个已积累用户基础的浏览器扩展而言,这样的功能叠加既能提升用户黏性,也拓展了差异化竞争空间。
结语:网页主权正在向用户转移
Sider Code 的意义或许不止于一个实用小工具。它代表了一种理念的转变——网页的最终形态不再完全由开发者决定,用户开始拥有塑造自身数字环境的能力。
当然,从一个上线不久的 Product Hunt 产品到真正改变人们的上网习惯,中间还有很长的路要走:AI 生成代码的准确率、跨网站的稳定性、安全边界的划定,都将决定它能否被大规模采用。但至少,它清晰地勾勒出了一个方向:在 AI 加持下,普通人正逐步夺回对互联网界面的定义权。
核心要点
相关推荐

llama.cpp本地部署Qwen模型教程:显卡适配与参数调优实战
详解llama.cpp本地部署Qwen系列模型的完整流程,涵盖NVIDIA/AMD/Intel显卡适配方案、GGUF模型选择、KV缓存量化、上下文长度优化及OpenAI兼容接口接入,助你零成本在本地高效运行大语言模型。

杀出重围人类分裂:布拉格关卡空间设计深度解析
深度解析《杀出重围:人类分裂》布拉格城区的空间设计精髓,从紧凑密度、垂直层次、多路径关卡哲学到环境叙事,剖析这座赛博朋克都市为何成为沉浸式模拟游戏的教科书级案例。

烧掉117亿Token:谁是最强网络安全AI模型?
一项消耗117亿Token的大规模实验对主流大语言模型的网络安全能力进行了系统评测。本文解析为何通用基准无法衡量AI安全实力,以及垂直领域深度评测对企业AI选型的关键意义。