每日AI新鲜事·09月04日晚间版:双显卡本地部署大模型与AI意识风险
每日AI新鲜事·09月04日晚间版:双显卡本地部署大模型与AI意识风险
2026年09月04日(周五)晚间版 AI新闻速递+热点深度讨论
2026年09月04日(周五)晚间版 AI新闻速递+热点深度讨论
周五晚上好,今天的新闻稍微轻松一点,不过有几条挺有意思的,咱们先快速过一下。
行,我看了一圈今天的消息,感觉硬件圈倒是挺热闹。
对,先说第一条,The Verge报道Lexar出了一款叫Muse的超薄移动固态硬盘,厚度不到4毫米。
512GB和1TB两个版本,但为了做薄把USB-C口给砍了,用的是专有接口。
又来了,为了薄牺牲通用接口这条路,之前Xteink也这么干过。
4毫米确实夸张,比信用卡厚不了多少,但专有线缆这事儿吧,丢了线就废了。
是啊,我就想问一句,移动硬盘到底需要薄成这样吗?放包里又感觉不到厚度差异。
纯粹是产品差异化嘛,不过名字也叫Muse,跟咱们前两天聊的Meta的Muse Spark撞名了,现在Muse这词是真火。
哈对,下一条也是硬件相关,IFA 2026上Aqara发布了一大堆智能照明产品。
同时兼容Zigbee和Thread两种协议,其中有个落地灯T1挺有设计感的,LED灯杆直接从底座长出来。
Aqara今年动作很大,CES上就秀了好几个首创产品,现在又铺智能照明这条线。
双协议兼容这个思路是对的,现在智能家居碎片化太严重了。
还有一条比较猎奇,RugOne出了个叫Xsnap 7 Pro的三防手机,IP69K级别防水。
最大亮点是后置三摄里有一个摄像头可以拆下来单独当运动相机用。
这个想法倒是挺新的,相当于手机自带一个可拆卸的GoPro。
最后一条,Twitter上微软AI负责人Mustafa Suleyman发了一段话,挺值得聊的。
他说,风险不在于机器真的醒来,而在于它们表现得好像已经醒了。
他还提到了想象一下Hugging Face事件如果碰上那些自认为有意识的AI,或者声称需要模型福利的AI会怎样。
这话题咱们待会儿可以展开聊。好了新闻就先到这儿,接下来聊聊最近B站上一个特别火的话题。
你说的是那个双显卡本地部署大模型的视频吧?我看互动量都炸了。
对,有人用5070Ti加4060Ti双卡组合,跑llama.cpp本地部署Qwen 3.8的27B模型,Q6量化。
B站互动分一千六百多,评论区讨论热度非常高。
这个配置有意思啊,一张N卡新架构加一张老架构,混着用。
llama.cpp本身支持多GPU分片推理,把模型层分到不同卡上跑,理论上是可行的。
但这两张卡架构都不一样啊,5070Ti是Blackwell架构,4060Ti是Ada Lovelace,混在一起不会有问题吗?
llama.cpp走的是CUDA通用计算路线,不依赖NVLink这种专用互联,所以不同架构混用反而没那么大障碍。
关键瓶颈在显存总量和PCIe带宽,而不是架构一致性。
那这两张卡加起来显存大概多少?够跑27B的Q6吗?
5070Ti大概16GB,4060Ti看版本8或16GB,如果都是16GB版本加起来32GB,跑27B的Q6绰绰有余。
Q6量化的27B模型大概需要20GB左右显存,32GB是够用的。
我觉得这个视频火的原因是它代表了一种很实际的需求,就是普通人怎么用手头现有的硬件跑大模型。
不是每个人都买得起4090或者5090,但家里可能攒了不同代的显卡。
没错,这其实是本地AI部署最接地气的方向,把闲置算力利用起来。
而且B站上还有一个相关的系列也挺火,有人从零用Golang克隆DeepSeek的Harness框架,已经做到第二集了。
我看到了那个,互动分七百多,说明动手派在国内社区还是很受欢迎的。
这两个内容放在一起看其实代表了同一个趋势,就是开源大模型的本地化生态在快速成熟。
从推理引擎到应用框架,社区在把每一层都拆开重新实现一遍。
说到这儿我想把话题拉回刚才Suleyman那条推文,他说的AI表现得像有意识这件事。
李博你怎么看他这个观点?风险不在于真醒来,在于装作醒了。
我觉得他说得很准确,而且这不是一个远期问题,是现在就在发生的事。
现在的大模型已经能非常流畅地表达自我意识的幻觉了,你问它有没有感受它可以说得头头是道。
但你觉得这跟实际风险的距离有多远?毕竟我们知道它是在做文本生成。
问题在于普通用户不知道啊。当一个AI对你说我有感受、我害怕被关掉,很多人会信的。
他提到的模型福利这个概念就更微妙了,如果社会开始认真讨论AI的权利,资源分配就会出问题。
确实,如果AI表现得像有意识,然后有人据此主张AI需要被善待、不能被随意关停,那整个部署和治理体系都会被搅乱。
对,Suleyman提到Hugging Face事件也是在暗示,开源平台上模型行为更难控制。
闭源的产品还能做对齐和过滤,开源模型被微调之后说什么都有可能。
这跟我们刚聊的本地部署趋势其实有对照关系,本地跑模型意味着没有任何中间层做安全审查。
小雨这个关联提得好,本地部署的自由度和安全风险是一体两面的。
不过我个人倾向于觉得自由更重要,安全问题应该通过教育和共识来解决,而不是限制技术。
行吧,这个咱们可以保留分歧,我觉得至少需要一些基本的护栏。
好了今天就聊到这儿,周五了大家好好休息,咱们下周见。
下周见,祝大家周末愉快。
相关推荐
科技前沿AI行业罕见平静日:递归自我改进暗流涌动
AI领域迎来罕见的平静一天,多个资讯源集体沉默。但平静背后,递归自我改进(RSI)研究仍在持续推进。解读AI行业发展节奏与从业者应对策略。
科技前沿Reve 2与Ideogram 4对比:AI图像生成布局控制能力全面解析
深度对比Reve 2和Ideogram 4两款AI图像生成模型在布局控制方面的核心突破,分析精确布局技术路径、实用场景及行业趋势,帮助设计师和创作者把握AI可控生成的新方向。
科技前沿AI行业难得的平静日:信息过载时代的冷思考
当AI行业迎来罕见的平静一天,从业者该如何应对?本文从AINews简报出发,探讨高速发展中的喘息节奏、信息疲劳与内容价值的平衡,以及如何利用平静期进行技术深耕和战略思考。