GPT-4o-mini
GPT-4o-mini是OpenAI推出的轻量级大语言模型,属于GPT-4o系列的精简版本。该模型在保留较强自然语言理解与生成能力的同时,具有更低的推理成本和更快的响应速度,适用于对延迟和成本敏感的应用场景,如文本分类、摘要生成、对话系统及多智能体协作等任务。
Core Facts
Timeline (last 90 days)
轻量模型(如GPT-4o-mini、Claude 3 Haiku、Gemini Flash)的调用成本通常只有旗舰模型的1/10到1/50
GPT-4o相比GPT-4降价约50%
旗舰模型的单次调用成本往往是轻量模型的10至50倍
GPT-4 Turbo的调用成本相比初代GPT-4降低了约80%
旗舰模型(如GPT-4o、Claude 3.5 Sonnet)与轻量模型(如GPT-4o-mini、Claude Haiku)在价格上可相差10-20倍,但在大量常规任务上性能差距并不显著
Anthropic、OpenAI等公司的公开定价数据显示每百万Token的推理成本约在0.5-15美元区间
GPT-4o的调用成本约为GPT-4o-mini的15-20倍
中间层轻量模型(如Claude 3 Haiku、GPT-4o-mini)价格约为旗舰模型的1/10至1/20
All Facts (8)
GPT-4o的调用成本约为GPT-4o-mini的15-20倍
80%VerifiedAnthropic、OpenAI等公司的公开定价数据显示每百万Token的推理成本约在0.5-15美元区间
65%Verified中间层轻量模型(如Claude 3 Haiku、GPT-4o-mini)价格约为旗舰模型的1/10至1/20
65%UnverifiedGPT-4o相比GPT-4降价约50%
60%Unverified轻量模型(如GPT-4o-mini、Claude 3 Haiku、Gemini Flash)的调用成本通常只有旗舰模型的1/10到1/50
50%Unverified旗舰模型的单次调用成本往往是轻量模型的10至50倍
50%UnverifiedGPT-4 Turbo的调用成本相比初代GPT-4降低了约80%
50%Unverified旗舰模型(如GPT-4o、Claude 3.5 Sonnet)与轻量模型(如GPT-4o-mini、Claude Haiku)在价格上可相差10-20倍,但在大量常规任务上性能差距并不显著
50%