[控场AI]
模型

Gemini 1.5 Pro

Google推出的多模态大语言模型,支持高达100万tokens的超长上下文窗口,适合处理超长文档、视频等复杂任务

核心事实

时间轴 (近 90 天)

10月1日

Gemini 1.5 Pro的输出上限通常在8,192至32,768 token区间

待验证50%
9月22日

在横向对比模型定价时,估算完成同一任务的月度账单比单纯比较每百万Token的标牌价更具参考意义,因为不同模型完成同一任务所消耗的Token数量可能差异显著

待验证50%
9月12日

前沿级别(frontier-grade)是AI行业用来描述当前最顶尖大模型能力层次的术语,通常指代GPT-4、Claude 3、Gemini Ultra等模型

已验证75%
8月27日

图生词(Image-to-Text)利用多模态大语言模型的视觉理解能力,将视觉特征映射到自然语言描述

待验证50%
8月16日

Gemini已支持200万Token上下文,Claude支持20万Token,千问已推进到100万Token级别

已过期85%
7月24日

在MMLU、HumanEval等主流基准测试上,Claude 3.5、GPT-4o、Gemini 1.5 Pro、Grok-2之间的分差已压缩至统计误差范围内

已验证70%
7月21日

Qwen3-4B在多项推理类评测指标上已与DeepSeek V3或GPT-4o相差无几

已验证65%
7月16日

GPT-4、Claude 3.5 Sonnet、Gemini 1.5 Pro等新一代大语言模型在HumanEval、SWE-bench等代码能力基准测试上的得分已大幅超越此前版本

已验证70%

全部知识事实 (13)

已验证

GPT-3时代的上下文窗口仅有2,048个Token,而Google Gemini已支持百万级Token,Claude支持200K Token,GPT-4 Turbo支持128K Token

90%
已验证

Gemini 1.5 Pro的上下文窗口已扩展至100万token,相当于约75万个英文单词

85%
已验证

Gemini 1.5 Pro 由 Google DeepMind 开发,具备原生多模态能力和与 Google Workspace 的深度集成

80%
已验证

Google Gemini 1.5 Pro 支持最高 100 万 token 的上下文窗口并具备原生多模态能力

80%
已验证

前沿级别(frontier-grade)是AI行业用来描述当前最顶尖大模型能力层次的术语,通常指代GPT-4、Claude 3、Gemini Ultra等模型

75%
已验证

Claude 3.5和Gemini 1.5 Pro已将上下文窗口扩展至100K乃至百万token级别

75%
已验证

在MMLU、HumanEval等主流基准测试上,Claude 3.5、GPT-4o、Gemini 1.5 Pro、Grok-2之间的分差已压缩至统计误差范围内

70%
已验证

GPT-4、Claude 3.5 Sonnet、Gemini 1.5 Pro等新一代大语言模型在HumanEval、SWE-bench等代码能力基准测试上的得分已大幅超越此前版本

70%
已验证

Qwen3-4B在多项推理类评测指标上已与DeepSeek V3或GPT-4o相差无几

65%
待验证

LLM的上下文窗口已从早期的4K token扩展到Gemini 1.5 Pro的百万token量级

60%
待验证

Gemini 1.5 Pro的输出上限通常在8,192至32,768 token区间

50%
待验证

在横向对比模型定价时,估算完成同一任务的月度账单比单纯比较每百万Token的标牌价更具参考意义,因为不同模型完成同一任务所消耗的Token数量可能差异显著

50%
待验证

图生词(Image-to-Text)利用多模态大语言模型的视觉理解能力,将视觉特征映射到自然语言描述

50%

来源文章