[控场AI]
· 5 分钟阅读· 2,520 字

Google Gemini 3.6 Flash实测:速度与成本领先,编码能力存明显短板

Google Gemini 3.6 Flash实测:速度与成本领先,编码能力存明显短板

谷歌一次发布三款Flash模型

近日,Google一口气推出了三款Flash系列模型:Gemini 3.6 Flash、Gemini 3.5 Flash Lite以及面向网络安全领域的Gemini 3.5 Flash Cyber。从整体定位来看,这次发布的核心卖点并非能力的飞跃,而是极致的Token节省响应速度提升——这恰恰是谷歌目前主推的方向:更快、更便宜。

三款模型各有专长,形成了清晰的产品矩阵:

  • Gemini 3.5 Flash Lite:主打性价比与速度的平衡,专注于超高速、高吞吐量任务,例如大规模产品数据抓取、批量发票翻译、高并发的Agent设计任务。
  • Gemini 3.5 Flash Cyber:专为网络安全场景设计,能够自动检测项目中的漏洞并辅助修复,是一款典型的垂直领域定制模型。
  • Gemini 3.6 Flash:本次发布的旗舰Flash模型,主打速度与成本优势。

Gemini 3.6 Flash 模型界面

从定价来看,3.6 Flash的输出Token为7.5美元/百万,输入为1.5美元/百万。相比3.5 Flash,输入价格保持不变,输出价格进一步下降。谷歌显然希望用更低的成本和更快的响应速度吸引大规模、高并发的应用场景,而非追求单点能力的极限。

如何免费使用这几款新模型

对于普通用户来说,体验这几款模型的门槛非常低,目前有两条免费路径。

路径一:通过 Google AI Studio 体验

第一种方式是通过 AI Studio。打开 AI Studio 官网,使用 Google 账号登录后,进入模型选择界面,在 Gemini 系列中即可看到刚发布的 3.6 Flash、3.5 Flash Lite 等模型,全部免费可用。

AI Studio 还支持自定义思考程度(Thinking Level),用户可根据任务复杂度调整模型的推理深度,非常适合做横向测评对比。

路径二:通过 Gemini 网页端体验

第二种方式是直接访问 Gemini 网页端(gemini.google.com)。选择 3.6 Flash 后即可输入提示词获取结果。经实测,网页端与 AI Studio 的生成结果基本一致,底层调用的是同一模型,用户可根据使用习惯自由选择入口。

实测:3.6 Flash 的编码能力令人意外

为了检验 Gemini 3.6 Flash 的真实水平,测试采用了一个相对典型的前端编码任务——「帮我开发一个3D坦克大战」,思考程度设置为 High。

结果出人意料。3.6 Flash 仅用 42 秒便完成了代码编写,速度确实惊人。但点击预览时,画面却是一片黑屏,游戏无法正常运行。

3.6 Flash 生成结果黑屏问题

随后反馈黑屏问题并要求修复,模型很快给出了新版本,预览依然是黑屏。说个细节,模型甚至将问题归咎于「可能是网络原因」,但从后续的复现测试来看,这与网络毫无关系。

与 Gemini 3.5 Flash 的横向对比

为了排除平台或偶然因素,测试者用完全相同的提示词让 3.5 Flash 执行同样的任务。

3.5 Flash 对比测试结果

对比结果非常鲜明:

  • Gemini 3.5 Flash:生成速度明显慢于 3.6 Flash,但一次成型,生成的 3D 坦克大战可以正常运行,具备完整的 3D 效果和可玩性,重新开始等交互功能均正常。
  • Gemini 3.6 Flash:速度快、价格低,但连续多次尝试均未能生成可运行的成品,始终停留在黑屏状态。

这一对比揭示了一个反直觉的现象:尽管 3.6 Flash 定位更新、输出成本更低、响应更快,但在实际的前端编码任务中,表现反而弱于上一代的 3.5 Flash。

网页端复现:问题并非来自平台

为进一步排除 AI Studio 平台本身的影响,测试者在 Gemini 网页端用 3.6 Flash 执行了同样的任务,并将生成结果保存为 HTML 文件本地打开。

网页端本地 HTML 测试

结果与 AI Studio 完全一致——同样是纯黑屏,游戏无法运行。这也印证了黑屏并非平台 Bug 或网络波动造成的,而是 Gemini 3.6 Flash 模型本身在前端游戏开发类任务上的能力短板。

总结:适合工具型场景,复杂任务建议另择模型

综合本次实测,可以得出以下几点判断:

第一,3.6 Flash 的速度与成本优势是真实的。 42 秒完成代码生成的速度远超 3.5 Flash,输出成本也进一步降低,与谷歌「更快、更便宜」的产品定位高度吻合。

第二,3.6 Flash 在前端复杂编码任务上存在明显短板。 一个并不算复杂的 3D 游戏开发任务,3.6 Flash 多次尝试均告失败,反而是上一代 3.5 Flash 一次成型。新模型未必在所有维度都优于旧模型,这一点值得开发者注意。

第三,模型选择应回归实际场景。 对于简单任务、高并发、大批量处理场景,3.6 Flash 或 3.5 Flash Lite 凭借速度和成本优势更具性价比;需要高质量、一次成型的编码任务,3.5 Flash 仍是更稳妥的选择;网络安全场景则可优先考虑专项优化的 3.5 Flash Cyber。

对开发者和普通用户而言,好消息是这几款模型都可以通过 Google AI Studio 或 Gemini 网页端免费体验。在正式投入生产使用前,建议结合自己的实际任务做几轮对比测试,用真实数据而非营销话术来决定最终的模型选型。

分享:

相关推荐