共 95 篇相关文章

Databricks在百万行生产级代码库上对主流编程Agent进行系统测试,揭示Token单价误导成本判断、开源模型GLM 5.2可挑战高难任务、Harness框架决定实际表现等关键发现,为企业AI编程工具选型提供实战参考。

腾讯正式开源混元3(Hunyuan V3),295B MoE架构、21B激活参数,官方宣称超越DeepSeek-V4-Pro。支持FP8量化、vLLM/SGLang部署,但256K上下文与不支持多模态成为核心短板。本文深度解析其架构特性、横向对比与实际部署方案。

腾讯混元HY3正式版正式开源,API定价低至1元/百万tokens输入,在Agent、推理、编码及长上下文领域显著提升,以Apache 2.0协议发布。同日美团开源万亿参数模型LongCat 2.0,首个在5万张国产算力卡上完成推理的万亿模型。

智谱GLM-5.2疑似进入测试阶段,Anthropic正式发布旗舰模型Claude Fable 5并获业界广泛认可;摩尔线程开源国产GPU首个全链路代码大模型MusaCoder,谷歌推出支持70+语言的Gemini实时翻译模型。一文速览本期AI行业核心动态。

6月23日AI行业密集爆料:Claude Sonnet 5百万上下文窗口曝光、智谱市值破万亿港元涨超20倍、阿里发布视频模型Happy Horse 1.1、Sakana AI推出多模型编排系统,本文逐一梳理当日重点动态与行业趋势。

开源模型GLM-5.2因极低使用门槛和出色的网络安全能力引发媒体关注。本文深度解析"开源AI威胁论"背后的真实逻辑,探讨开放性与安全性的核心张力,以及监管收紧对开源AI生态的潜在影响。

开放权重≠能本地运行。本文深度拆解GLM 5.2、DeepSeek等大模型的硬件门槛、显存瓶颈、电费成本与并行限制,揭示开源大模型真正的价值:推动云端竞争,而非让普通人在家复刻前沿效果。

GLM-5.2凭借74.4分的Frontiers-WE成绩超越GPT-5.5,跻身开源权重模型编程能力第一。MIT开源许可支持本地部署,Vercel CEO公开背书,开源与闭源旗舰的差距正在快速收窄。

智谱AI旗舰模型GLM-5.2深度实测:100万token上下文、强悍编程能力、成熟智能体工作流,价格仅为主流前沿模型五分之一。本文涵盖官网测试、Cursor集成、MCP工具联动及生产环境迁移方案,帮你判断它是否值得纳入工具箱。

OpenAI顶配模型将集成至Codex编程环境,在Cerebras晶圆级芯片上实现750 Token/秒推理速度。本文深度解析MoE架构原理、订阅体系调整动向,以及腾讯混元、Longcat 2.0等开源模型的同步突破,帮助开发者把握AI编程工具的选择策略。

OpenAI发布GPT-5.6系列三款模型Soul、Terra、Luna,旗舰Soul支持50万Token上下文,实测31分钟生成宝可梦RPG。同步追踪Fable 5解禁进展、GLM 5.5传言及Grok 4.5私测动态,前沿AI竞赛最新格局一文读懂。

Meta扎克伯格公开表示AI进展慢于预期,叠加算力出售消息,费城半导体指数两日累跌近12%。摩根大通警告芯片需求前景,OpenAI拟献股政府换监管支持,Palantir CEO炮轰头部AI公司——本文深度解析本轮AI投资市场暴跌背后的多重逻辑。

智谱AI发布第五代大模型GLM 5.2,MIT协议完全开源可商用。Code V3评测全球第三、96分S级,开源模型排名第一;百万Token上下文真实可用,长程任务稳定不掉链。本文从编码能力、上下文可靠性、MoE架构及现实短板四维度全面拆解。

一位开发者在实测中发现,GPT-5.5始终无法解决思维导图组件的垂直居中问题,切换至GLM-5.2后很快得到有效方案。本文深入分析两款模型的能力差异,以及多模型协作在AI编程实践中的实用价值。

智谱GLM 5.2的崛起正加速AI大模型能力平权化进程。本文深度解析基础模型商品化趋势、推理成本持续下探背后的利润率崩塌逻辑,以及应用层企业、基础模型厂商各自面临的机遇与挑战,为AI从业者和投资者提供前瞻性参考。

AI编程助手Devin正式支持Kimi K2.7与GLM 5.2两款大模型,桌面端与CLI双端可用。7月5日前Pro、Max及Teams用户使用两款新模型不消耗任何配额,结合FrontierCode Extended强劲评测表现,是团队评估AI编程工具的绝佳窗口。

中国智谱GLM开源模型以GPT-5.5 15%的成本逼近顶级闭源模型,HBM内存短缺引发AI通胀,太空数据中心经济账浮出水面。深度解析AI产业竞争的三大新战线:开源模型、HBM供应链与算力基建革命。

美团AI编程工具CatPaw(酷爪)深度实测:免费提供GLM-5.2模型,500点额度能否撑过一天?本文揭露其真实编码能力、频繁网络报错的痛点,以及与Cursor、CodeBuddy的横向对比,帮你判断是否值得一试。

本周AI行业密集更新:Anthropic旗舰编程模型全球重新上线并引入安全分类器,谷歌新一代Gemini Flash检查点悄然测试,视频生成赛道速度与质量博弈加剧,Figure AI机器人正式进驻宝马工厂。一文梳理本周最值得关注的AI进展。

深度实测智谱AI GLM4开源旗舰模型,在Design Arena榜单排名第一,前端开发超越Claude 3.5和Gemini。详细对比落地页生成、Spotify复刻、3D游戏开发等场景表现,成本仅为Claude Opus的六分之一。