待验证50% 置信事实精确时间
GPT-6 Astra的测试覆盖了代码编写、调试、重构到端到端任务执行的各类场景
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/9/11
首次发现
有效期至:2026/12/10
来源
涉及实体
相关事实
待验证GPT-5.6在编写或修改代码时会更频繁地调用Skills、执行本地命令查看文件、检查运行环境、进行测试验证78% 相似部分验证GPT-6 Astra具备多线程协调能力,可以同时维持多个任务的上下文状态78% 相似待验证GPT-6 Astra能够操作建模软件和游戏引擎,具备看屏幕、点击界面、检查作品并继续修改的代理能力78% 相似待验证GPT-6 Astra是OpenAI的多模态大模型,设计目标是处理文本、图像、音频等多种输入输出77% 相似待验证GPT-5、Grok 4等模型在基准测试(如HumanEval、SWE-bench)上表现优异,但这些测试通常是单次代码生成,与需要多轮工具调用的真实工程任务存在显著差距76% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/900520API
curl https://kongchang.com/api/v1/knowledge/claims/900520MCP
get_claim(id=900520)