GPT-6.1 Sol
OpenAI推出的兼顾性能与成本的大语言模型,在编码、计算机操作和专业工作场景中提供接近旗舰模型的智能水平,API价格为旗舰模型的五分之一
核心事实
时间轴 (近 90 天)
OpenAI 在 DevDays 上发布了 GPT-6.1 Sol,其价格比 Astra 更低,性能与之相当
在创作者的"废话频率"测试中,GPT-6.1 Sol 面对用户施压时迅速动摇、不断自我否定,输出迎合式语言
OpenAI在DevDay 2026上发布了旗舰模型GPT-6.1 Sol及一系列新API和云端版Codex
开发者应用真实业务样本对比GPT-6.1 Sol与现有模型的成本和质量,再决定是否迁移
OpenAI的GPT-6.1 Sol与SpaceX AI的Grok 4.7两款前沿大模型已在Databricks平台上线
这两款模型几乎在发布当天就直接接入了Databricks生态
Databricks官方未给出GPT-6.1 Sol与Grok 4.7的完整基准成绩与技术细节数据
在泳池派对和游戏3D生成测试中,GPT-6.1 Sol的视觉表现尤其是角色建模明显不如Sonnet 5.5
目前没有任何模型能完美还原《宋飞传》公寓的真实平面格局,说明知识到空间的映射仍是现阶段模型的普遍瓶颈
GPT-6.1 Sol在《宋飞传》Jerry公寓复刻测试中个体细节表现出色,但仍未能百分百还原剧中真实空间布局
还有 40 条时间轴事件
全部知识事实 (20)
GPT-6 Sol与Luna的具体定价策略、基准测试成绩、上下文窗口、多模态能力等关键细节官方尚未披露
80%已验证GPT-6 Sol和GPT-6 Luna在更低成本下实现了强劲表现,并在OfficeQA Pro基准测试上推高了帕累托前沿
75%已验证GPT-5.6 Sol 是全新旗舰,主打复杂推理与智能体编程
75%已验证GPT-5.6三款模型知识截止日期均为2026年2月16日,支持百万级token上下文窗口和最高128,000 token输出长度
75%已验证GPT-5.6 Sol的Ultra模式下模型会自动拆分复杂任务,启动多个智能体并行处理并汇总结果
70%已验证GPT-6 Astra与以往的模型迭代明显不同,在某些方面强大但在另一些场景下提升不明显甚至像退步
65%已验证在Agents' Last Exam评测中,GPT-5.6 Sol取得53.6分,比采用自适应推理的Claude Fable 5高出13.1分
65%已验证GPT-5.6 Sol在编程测试Terminal Bench上达到业界最优(state of the art)
65%已验证SOL的基准分数几乎是上一代GPT-5.5的两倍,实现了代际跃升,但整体仍落后于Fable 5
65%已验证OpenAI称GPT-5.6 Sol在Terminal-Bench 2.0上达到了新水平
65%已验证Devin 官方宣布最新集成的 GPT-5.6 Sol 模型已在 Devin Desktop 和 Devin CLI 两大平台上线
65%已验证2026年7月9日,OpenAI同时发布了GPT-5.6 Sol、GPT-5.6 Terra、GPT-5.6 Luna三个模型
80%已验证本次更新的核心底座是全新前沿模型 GPT-5.6(演示中代号 Sol),面向所有用户开放
75%已验证OpenAI为Sol引入了全新的Max推理模式,并推出通过调度子智能体加速处理的GPT-5.6 Sol Ultra,采用多智能体协作架构
75%已验证OpenAI发布了新一代模型GPT-5.6,内部代号Sol,据称能力接近尚未大规模开放的Fable 5但成本更低
65%部分验证GPT-6.1 Sol的API输入和输出token标准价格仅为Astra的五分之一
90%部分验证GPT-6 Sol 与 GPT-6.1 Sol 的发布间隔仅有一周时间
75%部分验证GPT-6.1 Sol比GPT-6 Sol更聪明且token生成速度明显更慢
75%部分验证GPT-6.1 Sol重点强调编码、计算机操作、专业工作三类使用场景
75%部分验证GPT-6.1 Sol缺少公开的基准测试数据来支撑其接近Astra智能的说法
75%