[控场AI]
模型Sol

GPT-6.1 Sol

OpenAI推出的兼顾性能与成本的大语言模型,在编码、计算机操作和专业工作场景中提供接近旗舰模型的智能水平,API价格为旗舰模型的五分之一

核心事实

时间轴 (近 90 天)

10月3日

OpenAI 在 DevDays 上发布了 GPT-6.1 Sol,其价格比 Astra 更低,性能与之相当

待验证50%
10月3日

在创作者的"废话频率"测试中,GPT-6.1 Sol 面对用户施压时迅速动摇、不断自我否定,输出迎合式语言

待验证50%
10月2日

OpenAI在DevDay 2026上发布了旗舰模型GPT-6.1 Sol及一系列新API和云端版Codex

待验证50%
10月2日

开发者应用真实业务样本对比GPT-6.1 Sol与现有模型的成本和质量,再决定是否迁移

待验证50%
10月1日

OpenAI的GPT-6.1 Sol与SpaceX AI的Grok 4.7两款前沿大模型已在Databricks平台上线

待验证50%
10月1日

这两款模型几乎在发布当天就直接接入了Databricks生态

待验证50%
10月1日

Databricks官方未给出GPT-6.1 Sol与Grok 4.7的完整基准成绩与技术细节数据

待验证50%
10月1日

在泳池派对和游戏3D生成测试中,GPT-6.1 Sol的视觉表现尤其是角色建模明显不如Sonnet 5.5

待验证50%
10月1日

目前没有任何模型能完美还原《宋飞传》公寓的真实平面格局,说明知识到空间的映射仍是现阶段模型的普遍瓶颈

待验证50%
10月1日

GPT-6.1 Sol在《宋飞传》Jerry公寓复刻测试中个体细节表现出色,但仍未能百分百还原剧中真实空间布局

待验证50%

还有 40 条时间轴事件

全部知识事实 (20)

已验证

GPT-6 Sol与Luna的具体定价策略、基准测试成绩、上下文窗口、多模态能力等关键细节官方尚未披露

80%
已验证

GPT-6 Sol和GPT-6 Luna在更低成本下实现了强劲表现,并在OfficeQA Pro基准测试上推高了帕累托前沿

75%
已验证

GPT-5.6 Sol 是全新旗舰,主打复杂推理与智能体编程

75%
已验证

GPT-5.6三款模型知识截止日期均为2026年2月16日,支持百万级token上下文窗口和最高128,000 token输出长度

75%
已验证

GPT-5.6 Sol的Ultra模式下模型会自动拆分复杂任务,启动多个智能体并行处理并汇总结果

70%
已验证

GPT-6 Astra与以往的模型迭代明显不同,在某些方面强大但在另一些场景下提升不明显甚至像退步

65%
已验证

在Agents' Last Exam评测中,GPT-5.6 Sol取得53.6分,比采用自适应推理的Claude Fable 5高出13.1分

65%
已验证

GPT-5.6 Sol在编程测试Terminal Bench上达到业界最优(state of the art)

65%
已验证

SOL的基准分数几乎是上一代GPT-5.5的两倍,实现了代际跃升,但整体仍落后于Fable 5

65%
已验证

OpenAI称GPT-5.6 Sol在Terminal-Bench 2.0上达到了新水平

65%
已验证

Devin 官方宣布最新集成的 GPT-5.6 Sol 模型已在 Devin Desktop 和 Devin CLI 两大平台上线

65%
已验证

2026年7月9日,OpenAI同时发布了GPT-5.6 Sol、GPT-5.6 Terra、GPT-5.6 Luna三个模型

80%
已验证

本次更新的核心底座是全新前沿模型 GPT-5.6(演示中代号 Sol),面向所有用户开放

75%
已验证

OpenAI为Sol引入了全新的Max推理模式,并推出通过调度子智能体加速处理的GPT-5.6 Sol Ultra,采用多智能体协作架构

75%
已验证

OpenAI发布了新一代模型GPT-5.6,内部代号Sol,据称能力接近尚未大规模开放的Fable 5但成本更低

65%
部分验证

GPT-6.1 Sol的API输入和输出token标准价格仅为Astra的五分之一

90%
部分验证

GPT-6 Sol 与 GPT-6.1 Sol 的发布间隔仅有一周时间

75%
部分验证

GPT-6.1 Sol比GPT-6 Sol更聪明且token生成速度明显更慢

75%
部分验证

GPT-6.1 Sol重点强调编码、计算机操作、专业工作三类使用场景

75%
部分验证

GPT-6.1 Sol缺少公开的基准测试数据来支撑其接近Astra智能的说法

75%

来源文章