Gemini 1.5 Pro
Google推出的多模态大语言模型,支持高达100万tokens的超长上下文窗口,适合处理超长文档、视频等复杂任务
核心事实
时间轴 (近 90 天)
Gemini 1.5 Pro的输出上限通常在8,192至32,768 token区间
在横向对比模型定价时,估算完成同一任务的月度账单比单纯比较每百万Token的标牌价更具参考意义,因为不同模型完成同一任务所消耗的Token数量可能差异显著
前沿级别(frontier-grade)是AI行业用来描述当前最顶尖大模型能力层次的术语,通常指代GPT-4、Claude 3、Gemini Ultra等模型
图生词(Image-to-Text)利用多模态大语言模型的视觉理解能力,将视觉特征映射到自然语言描述
Gemini已支持200万Token上下文,Claude支持20万Token,千问已推进到100万Token级别
在MMLU、HumanEval等主流基准测试上,Claude 3.5、GPT-4o、Gemini 1.5 Pro、Grok-2之间的分差已压缩至统计误差范围内
Qwen3-4B在多项推理类评测指标上已与DeepSeek V3或GPT-4o相差无几
GPT-4、Claude 3.5 Sonnet、Gemini 1.5 Pro等新一代大语言模型在HumanEval、SWE-bench等代码能力基准测试上的得分已大幅超越此前版本
全部知识事实 (13)
GPT-3时代的上下文窗口仅有2,048个Token,而Google Gemini已支持百万级Token,Claude支持200K Token,GPT-4 Turbo支持128K Token
90%已验证Gemini 1.5 Pro的上下文窗口已扩展至100万token,相当于约75万个英文单词
85%已验证Gemini 1.5 Pro 由 Google DeepMind 开发,具备原生多模态能力和与 Google Workspace 的深度集成
80%已验证Google Gemini 1.5 Pro 支持最高 100 万 token 的上下文窗口并具备原生多模态能力
80%已验证前沿级别(frontier-grade)是AI行业用来描述当前最顶尖大模型能力层次的术语,通常指代GPT-4、Claude 3、Gemini Ultra等模型
75%已验证Claude 3.5和Gemini 1.5 Pro已将上下文窗口扩展至100K乃至百万token级别
75%已验证在MMLU、HumanEval等主流基准测试上,Claude 3.5、GPT-4o、Gemini 1.5 Pro、Grok-2之间的分差已压缩至统计误差范围内
70%已验证GPT-4、Claude 3.5 Sonnet、Gemini 1.5 Pro等新一代大语言模型在HumanEval、SWE-bench等代码能力基准测试上的得分已大幅超越此前版本
70%已验证Qwen3-4B在多项推理类评测指标上已与DeepSeek V3或GPT-4o相差无几
65%待验证LLM的上下文窗口已从早期的4K token扩展到Gemini 1.5 Pro的百万token量级
60%待验证Gemini 1.5 Pro的输出上限通常在8,192至32,768 token区间
50%待验证在横向对比模型定价时,估算完成同一任务的月度账单比单纯比较每百万Token的标牌价更具参考意义,因为不同模型完成同一任务所消耗的Token数量可能差异显著
50%待验证图生词(Image-to-Text)利用多模态大语言模型的视觉理解能力,将视觉特征映射到自然语言描述
50%