#大模型
共 271 篇相关文章

Gemini 4 Argon 发布:百万 Token 输出,基准领先 GPT-6 Astra
Google 发布 Gemini 4 Argon,输出上限提升至 100 万 Token。软件工程基准得分 77.9% 领先 GPT-6 Astra 与 Cloud Opus 5.5,开放范围限 API 与 Ultra 订阅者,本文解析其能力、价格与定位。

Gemini 4 Argon发布:谷歌凭多项基准测试重回第一梯队
谷歌发布Gemini 4 Argon,在办公流程Automation Bench、长视频理解LVBench和长流程编程Deep SWE三项基准测试中超越GPT-6 Astra与Claude Opus 5.5,重回AI第一梯队。本文解读其核心优势与三家竞争格局。

AI日报:谷歌Gemini 4 Argon登场,蚂蚁Ling-3.1发布,OpenAI点名蒸馏攻击
AI日报速览:谷歌Gemini 4 Argon发布支持百万Token,蚂蚁Ling-3.1-flash上线,OpenAI点名月之暗面相关的蒸馏攻击,DeepSeek适配华为昇腾,英伟达推出AI代理CPU等9条前沿动态。

Google最强模型Gemini 4 Argon发布:多项基准登顶,内部评价却存分歧
Google DeepMind 发布最强模型 Gemini 4 Argon,在 Automation Bench、VALS、多模态理解等多项基准登顶,超越 Opus 5.5 与 GPT-6 Astra。但 Bloomberg 报道称内部员工认为其编程实战表现不及跑分。本文解析其性能、定价与争议。

谷歌发布Gemini 4 Argon:主打编程与网络安全的最强模型
谷歌发布最新Gemini 4 Argon模型,定位为专注编程与网络安全的主力工具,并称其为迄今最强大的Gemini模型。本文解析其定位、应用方向与行业竞争背景。

Gemini 4发布争议:是真突破还是Google式"纸面发布"?
Reddit社区热议Gemini 4发布:共识认为它只是"宣布"而非真正上线,被批Google式"纸面发布"。文章梳理交付质疑、2美元/10美元定价争议、长期主义辩护与行业发布疲劳等多方观点。

AI竞赛进入尴尬期:技术领先不再是唯一变量
AI竞赛进入尴尬期:当各家大模型能力趋同、benchmark差距缩小,技术领先不再是唯一决胜变量。本文解析AI竞争下半场的产品化、成本效率与生态博弈新格局。

OpenAI 发布 GPT-6.1 Sol:价格仅 Astra 五分之一,Codex 与 ChatGPT 齐更新
OpenAI 发布 GPT-6.1 Sol,价格低至 Astra 五分之一,缓存输入每百万 Token 仅 0.10 美元。同时 Codex 支持多端运行与安全扫描,ChatGPT Space 与 Dots 强化团队协作,附国产开源与竞品最新动态。

GPT-6.1 Sol仅7天替换GPT-6 Sol,逼近Astra级智能
GPT-6.1 Sol在GPT-6 Sol发布仅7天后即完成替换,并宣称逼近Astra级智能。本文解读这一超快迭代背后的行业趋势、对开发者的影响及应对建议。

GPT-6 Luna白菜价发布:AI价格战全面开打
OpenAI发布GPT-6系列Sol与Luna模型,Luna百万token仅0.1美元输入,直逼开源白菜价。本文拆解AI价格战、缓存重构降本90%、Sol对决Claude Opus 5.5及开源阵营反击,附终极买家选型指南。

AI周报:GPT-6双模型降价、Atlas进厂、Qwen-Image 2.1开源权重
本周AI周报:OpenAI发布GPT-6 Sol/Luna并下调API价格,Anthropic推出Claude Opus 5.5,阿里开源Qwen-Image 2.1权重,波士顿动力Atlas进入现代汽车工厂训练,平头哥公布训练推理芯片。一文看懂大模型、机器人与AI硬件最新动态。

GPT-6双模型发布API降价50%,AI大模型集体降价潮来袭
OpenAI发布GPT-6 Sol和Luna模型,API价格大降50%;Anthropic上线Cloud Opus 5.5成本降40%;高通骁龙8跑通300亿参数模型,AI大模型降价潮与端侧突破全解读。

Anthropic与OpenAI同日降价:AI主战场从性能转向成本
Anthropic与OpenAI同日相隔101分钟发布降价版模型,Opus 5.5对比GPT-6 Sol/Luna,降幅口径暗藏猫腻。本文剖析AI主战场从性能转向成本的深层逻辑,以及法律AI公司Harvey的账本困境与自研突围。

GPT-6.1 Sol 发布:同价拿到逼近顶级模型的智能,成本仅五分之一
OpenAI 发布 GPT-6.1 Sol,沿用 GPT-6 Sol 定价却将性能拉到接近顶级模型 Astra 的水平,多项跑分成本仅为其五分之一。本文逐项拆解其价格、编程、计算机操作、科研等跑分表现与适用场景。

Claude Sonnet 5.5将发布,国内大厂紧急对标Meta Muse
Claude Sonnet 5.5或将发布,Meta Muse登顶App Store引发国内字节、腾讯紧急对标,DeepSeek Harness 0.2更新、英伟达发布智能体安全平台,一文速览近期AI大模型与智能体最新动态。

Claude Sonnet 4.5发布提速30%,Grok 4.8泄露信号浮现
Anthropic 发布 Claude Sonnet 新版,速度提升超 30%、成本最多降 30% 且价格不变;Grok 4.8 泄露信号出现在 Cursor 模型列表;Nvidia 联合百家伙伴推出 Agent 安全平台,Devin、Manus、ElevenLabs 等工具集体更新。

Claude Sonnet 5.5正式发布:速度更快、成本减半,性能逼近旗舰
Anthropic正式发布Claude Sonnet 5.5,运行速度更快、API定价减半,性能逼近旗舰Opus 5.5,在Terminal Bench编程测试中反超旗舰,Artificial Analysis排名全球第二。

Claude Sonnet 5.5发布:更快更省的Opus搭档
Anthropic 发布 Claude Sonnet 5.5,速度提升30%、成本省30%,编程能力接近 Opus 5.5。本文解读其定位、跑分、Effort档位机制、价格与安全防护,全面剖析这款更快更省的 Opus 搭档。

