每日AI新鲜事·08月26日晚间版:GLM-5.3来袭与机器人破百米纪录
每日AI新鲜事·08月26日晚间版:GLM-5.3来袭与机器人破百米纪录
2026年08月26日(周三)晚间版 AI新闻速递+热点深度讨论
2026年08月26日(周三)晚间版 AI新闻速递+热点深度讨论
今天AI圈消息不少,而且有一条特别炸裂的,机器人跑百米居然跑赢博尔特了。
对,我刷到的时候也愣了一下,9.39秒,比博尔特的9.58快了将近两毫秒级别的差距。
等等,那可不是两毫秒,是快了将近0.2秒呢。好,我们先从新闻速递开始聊吧。
来吧来吧。
第一条就是Reddit机器人版块的,今年世界机器人运动会上,一个机器人跑百米跑出了9.39秒。
这个帖子标题写的是Kid Goku speed is right around the corner,意思是小悟空的速度快实现了。虽然有点中二,但确实够震撼。
关键是去年我们还在讨论机器人能不能平稳跑步,今年就直接破人类纪录了。
不过要注意,这类比赛的机器人形态不一定是人形的,可能是多足或者轮式混合。但即便如此,机械系统能做到这个加速度和稳定性,还是很说明问题的。
好,第二条来自Hacker News,OpenAI发了一篇博客,说他们发现并打断了一个来自俄罗斯的隐蔽影响力行动。
就是有人用AI工具来大规模生成虚假信息做舆论操控,OpenAI这边检测到之后把相关账户封了。
这种事其实之前也有过,但每次看到都觉得挺严峻的。AI被用来做disinformation,这是个持续的攻防战。
对,而且OpenAI算是比较主动披露的,其他平台不一定都会公开讲。
第三条也挺有意思,Hacker News上有篇文章叫I miss the old Claude Code。
标题就很直白,怀念旧版Claude Code。作者的核心观点是focus才是最重要的feature,暗示新版功能多了反而让体验变散了。
这个我太能理解了,做产品的时候加功能容易,但保持核心体验的专注感特别难。
嗯,工具类产品一旦膨胀,用户心智负担就上来了。不过帖子评论还是零,说明可能共鸣没那么广泛。
最后一条轻松点的,Reddit上有人问ThinkPad T14 Gen 2配48G内存能跑什么本地模型。
i7-1165G7嘛,没有独显,纯CPU推理的话,跑个7B的模型问题不大,13B可能就比较勉强了。48G内存倒是够装模型权重的。
感觉这种帖子现在越来越多了,大家都想在自己手头的设备上玩本地模型。
对,本地推理的门槛确实在降低,但期望值也要管理好。
好了新闻就先聊到这儿,接下来我们聊一个特别值得展开的话题。李博你看到唐杰教授发的那条推了吗?
GLM-5.3 is coming,focusing on coding。看到了,清华智谱这边要出新模型了,而且明确说聚焦编程能力。
这个时间点挺有意思的,现在AI编程赛道已经非常拥挤了,Claude Code、Cursor、Windsurf、Augment全都在。
但你注意,GLM走的路线不太一样。它是模型层面的能力提升,不是做IDE插件或者Agent工具。这意味着它可以作为底层能力供给者。
你的意思是,它可能更像是给第三方编程工具提供模型接口,而不是自己做终端产品?
至少从公告来看是这样。国内做AI编程工具的团队其实一直缺一个足够强的国产编程模型,之前大家要么用GPT系列要么用Claude。
这倒是个真实痛点。合规性、延迟、成本,用海外模型做编程助手在国内企业落地确实有很多摩擦。
没错。而且从5.3这个版本号来看,他们迭代速度很快,说明编程方向是战略级投入。
那你觉得focusing on coding这个定位,跟通用大模型比,有什么具体的技术差异?
主要几个方面吧。一是训练数据的配比,代码数据占比会大幅提高。二是评估标准,像HumanEval、SWE-bench这些编程benchmark会成为主要优化目标。
三是推理链路可能会针对代码生成做专门优化,比如更长的上下文窗口、更好的函数级理解。
说到这个,Twitter上还有一条相关的热帖,Logan K发的,说increase your level of ambition。虽然不是直接讲技术,但我觉得跟现在AI编程领域的军备竞赛氛围很搭。
Logan K是OpenAI那边的对吧。他还发了一条说what a privilege it is to be tested,互动量也很高。
对,两条加起来快四千互动了。你怎么解读这种发言?
我觉得这反映的是一线从业者的心态。现在AI行业竞争强度太大了,每个人都被push到极限,但同时又觉得这种被考验本身是种特权。
有点凡尔赛的感觉,但我能理解。能站在这个赛道上参与竞争,本身就是一种筛选后的结果。
对,而且这种心态跟GLM-5.3的发布其实是同一个背景——所有人都在加速,你不提升ambition就会被甩开。
回到GLM-5.3,你觉得它出来之后对国内AI编程生态会有什么实质影响?
我觉得最直接的影响是降低国内开发者使用AI编程助手的门槛。之前用Claude Code需要翻墙加海外支付,体验链路太长了。
而且企业客户对数据安全的顾虑也会减少,毕竟代码是核心资产。
没错。不过话说回来,编程能力的评估其实很难。benchmark分数高不代表实际使用体验好,这中间的gap还挺大的。
就像之前社区讨论的,为什么你的本地模型感觉比实际分数差——配置和使用方式的影响很大。
对,prompt engineering、上下文管理、跟IDE的集成度,这些都会影响最终体验。模型只是其中一环。
所以GLM-5.3即使模型能力够强,还是得看生态配合。有没有好的工具把它包装成开发者友好的产品。
这就是为什么我说它可能走的是底层供给路线。让生态里的其他玩家来做上层体验,智谱专注把模型能力做到位。
这个分工思路倒是挺清晰的。好,那我们今天就聊到这儿吧。
嗯,明天见。
明天见!
相关推荐
科技前沿AI行业罕见平静日:递归自我改进暗流涌动
AI领域迎来罕见的平静一天,多个资讯源集体沉默。但平静背后,递归自我改进(RSI)研究仍在持续推进。解读AI行业发展节奏与从业者应对策略。
科技前沿GLM-5.2登顶全球开源模型榜首:前端编码能力领跑业界
智谱AI发布GLM-5.2模型,在Artificial Analysis Intelligence Index评测中登顶全球开放权重模型榜首,同时被评为顶级前端编码模型。深入解析GLM-5.2的突破性表现与开源模型竞争格局变化。
科技前沿Reve 2与Ideogram 4对比:AI图像生成布局控制能力全面解析
深度对比Reve 2和Ideogram 4两款AI图像生成模型在布局控制方面的核心突破,分析精确布局技术路径、实用场景及行业趋势,帮助设计师和创作者把握AI可控生成的新方向。