[
控场AI
]
知识动态
实体
播客
深度
开发者
关于
Get CLI
EN
基准
Deep Squeeze
用于评估AI模型编程或推理能力的基准测试
时间轴 (近 90 天)
9月12日
在Deep Squeeze测试中,旧模型得分49%,Gemini 3.7 Flash跃升至65.3%
待验证
50%
全部知识事实 (1)
待验证
在Deep Squeeze测试中,旧模型得分49%,Gemini 3.7 Flash跃升至65.3%
50%
来源文章
谷歌Antigravity+Gemini 3.7 Flash:AI从写代码到自主交付的质变
9月12日