#大模型
共 301 篇相关文章

AI周报:GPT-6双模型降价、Atlas进厂、Qwen-Image 2.1开源权重
本周AI周报:OpenAI发布GPT-6 Sol/Luna并下调API价格,Anthropic推出Claude Opus 5.5,阿里开源Qwen-Image 2.1权重,波士顿动力Atlas进入现代汽车工厂训练,平头哥公布训练推理芯片。一文看懂大模型、机器人与AI硬件最新动态。

GPT-6双模型发布API降价50%,AI大模型集体降价潮来袭
OpenAI发布GPT-6 Sol和Luna模型,API价格大降50%;Anthropic上线Cloud Opus 5.5成本降40%;高通骁龙8跑通300亿参数模型,AI大模型降价潮与端侧突破全解读。

Anthropic与OpenAI同日降价:AI主战场从性能转向成本
Anthropic与OpenAI同日相隔101分钟发布降价版模型,Opus 5.5对比GPT-6 Sol/Luna,降幅口径暗藏猫腻。本文剖析AI主战场从性能转向成本的深层逻辑,以及法律AI公司Harvey的账本困境与自研突围。

GPT-6.1 Sol 发布:同价拿到逼近顶级模型的智能,成本仅五分之一
OpenAI 发布 GPT-6.1 Sol,沿用 GPT-6 Sol 定价却将性能拉到接近顶级模型 Astra 的水平,多项跑分成本仅为其五分之一。本文逐项拆解其价格、编程、计算机操作、科研等跑分表现与适用场景。

Claude Sonnet 5.5将发布,国内大厂紧急对标Meta Muse
Claude Sonnet 5.5或将发布,Meta Muse登顶App Store引发国内字节、腾讯紧急对标,DeepSeek Harness 0.2更新、英伟达发布智能体安全平台,一文速览近期AI大模型与智能体最新动态。

Claude Sonnet 4.5发布提速30%,Grok 4.8泄露信号浮现
Anthropic 发布 Claude Sonnet 新版,速度提升超 30%、成本最多降 30% 且价格不变;Grok 4.8 泄露信号出现在 Cursor 模型列表;Nvidia 联合百家伙伴推出 Agent 安全平台,Devin、Manus、ElevenLabs 等工具集体更新。

Claude Sonnet 5.5正式发布:速度更快、成本减半,性能逼近旗舰
Anthropic正式发布Claude Sonnet 5.5,运行速度更快、API定价减半,性能逼近旗舰Opus 5.5,在Terminal Bench编程测试中反超旗舰,Artificial Analysis排名全球第二。

Claude Sonnet 5.5发布:更快更省的Opus搭档
Anthropic 发布 Claude Sonnet 5.5,速度提升30%、成本省30%,编程能力接近 Opus 5.5。本文解读其定位、跑分、Effort档位机制、价格与安全防护,全面剖析这款更快更省的 Opus 搭档。

AI大模型测试从入门到实战:评估三层体系全解析
AI大模型测试完整入门指南:解析从传统断言到AI评估的范式转移,详解大模型、知识库、智能体三层评估体系,以及Promptfoo工具选型与版本固定实战要点。

Dify从部署到搭建智能体全流程实战教程
本文基于B站实战教程,系统讲解Dify从Docker安装部署、MySQL配置到搭建智能体的全流程,涵盖聊天助手、文本生成、Agent、ChatFlow、Workflow五大应用及大模型接入方法,是AI大模型初学者的入门指南。

FDE企业级AI落地实战:为什么90%传统企业项目会烂尾
本文解析FDE前向部署工程师岗位与企业级AI落地实战,剖析为何90%传统企业AI项目从Demo到生产会烂尾,涵盖模型脱节、ROI难量化、业务安全割裂三大痛点及财务报销多模态案例复盘。

AI Agent到底是什么?用替室友上课讲透智能体核心原理
AI Agent智能体到底是什么?本文用替室友上课的通俗比喻,讲透智能体的理解命令、任务拆分、大模型调用与规则驱动四大核心原理,帮你从零入门Agent开发,破除智能体"完全自主"的认知误区。

AI Agent智能体开发六步法:从入门到业务落地实战指南
一套完整的AI Agent智能体开发六步法,从工具使用、提示词编写到大型项目实战落地,帮助新手系统入门Agent开发,避开Demo跑不通、上线崩溃等常见坑。

SME空间记忆引擎:开源AI记忆插件夺长期记忆第一
独立开发者开源 SME 空间记忆引擎,在 40 道题盲评对战中以 96.7% 击败 MEM0、GRAFFITY 等五大方案,夺得长期记忆插件第一。本文解析其空间分区、动态衰减、可解释检索机制及工程性能。

零基础Agent开发学习路线:三步进阶大模型实战
一份零基础Agent开发学习路线解读:从提示词工程、RAG知识库搭建到多智能体协作实战,三步进阶大模型应用开发,附各阶段核心技术栈与客观评价。

OpenAI三档新模型解析:Astra、Sol、Luna怎么选
OpenAI推出GPT-6三档新模型Astra、Sol、Luna,价格相差近百倍。本文解析三款模型的API定价、编程与办公性能基准、安全压力测试数据,帮你搞清普通人和企业该如何选型。

GPT-6 Sol与Luna发布:价格砍半、性能追平Opus
OpenAI发布GPT-6 Sol与Luna两款模型,价格较上代腰斩,Luna成本已低于DeepSeek,企业自动化任务性能反超Opus 5,编程效率翻倍。本文解析其性能、价格与国内可用渠道。

Claude Sonnet 5.5 发布:跑分登顶第2,速度快30%成本降30%
Anthropic 发布 Claude Sonnet 5.5,Artificial Analysis 跑分 56 分总排名第2,速度快30%、成本降30%,超越 Fable 和 Astra。但其 Token 使用量偏高,实际每任务成本值得关注。

Claude Sonnet 5.5 登陆 Databricks:三大云平台统一治理
Anthropic 的 Claude Sonnet 5.5 现已登陆 Databricks,覆盖 AWS、Azure、GCP 三大云平台,由 Unity Gateway 统一治理。它在编码与智能体场景效率更高,文档理解达到 Opus 5 级别准确度,并可结合 Agent Bricks 构建企业级智能体。

Anthropic抢发Opus 5.5与Sonnet 5.5,OpenAI Dev Day迎来变数
Anthropic被曝在OpenAI Dev Day前夕推出Opus 5.5与Sonnet 5.5,社区称其性能超过Sol和Astra,而OpenAI据传将有20多项发布。本文梳理这场时机微妙的大模型竞争。