[控场AI]
模型GPT-4o Mini

GPT-4o-mini

GPT-4o-mini是OpenAI推出的轻量级大语言模型,属于GPT-4o系列的精简版本。该模型在保留较强自然语言理解与生成能力的同时,具有更低的推理成本和更快的响应速度,适用于对延迟和成本敏感的应用场景,如文本分类、摘要生成、对话系统及多智能体协作等任务。

核心事实

时间轴 (近 90 天)

8月23日

轻量模型(如GPT-4o-mini、Claude 3 Haiku、Gemini Flash)的调用成本通常只有旗舰模型的1/10到1/50

待验证50%
8月23日

GPT-4o相比GPT-4降价约50%

待验证60%
7月18日

旗舰模型的单次调用成本往往是轻量模型的10至50倍

待验证50%
7月13日

GPT-4 Turbo的调用成本相比初代GPT-4降低了约80%

待验证50%
7月12日

旗舰模型(如GPT-4o、Claude 3.5 Sonnet)与轻量模型(如GPT-4o-mini、Claude Haiku)在价格上可相差10-20倍,但在大量常规任务上性能差距并不显著

待验证50%
7月10日

Anthropic、OpenAI等公司的公开定价数据显示每百万Token的推理成本约在0.5-15美元区间

已验证65%
5月31日

中间层轻量模型(如Claude 3 Haiku、GPT-4o-mini)价格约为旗舰模型的1/10至1/20

已验证65%

全部知识事实 (7)

来源文章