前沿级别(frontier-grade)是AI行业用来描述当前最顶尖大模型能力层次的术语,通常指代GPT-4、Claude 3、Gemini Ultra等模型
Harvey 是法律 AI 赛道中融资规模最大的初创公司之一,基于 GPT-4 定制训练,主要面向大型律所提供合同分析、尽职调查和法律备忘录生成服务
Casetext 以判例检索起家,其 CoCounsel 产品将 GPT-4 引入法律研究工作流
Altman称他以为2023年做出GPT-4之后很快就会出现更大规模的颠覆,软件业务会立刻被重新洗牌,但结果并非如此
在纯CPU环境下,本地模型辅助编程的体验与云端服务(如GitHub Copilot、Claude、GPT-4)存在明显差距
部分大型语言模型已能在MATH、AIME等竞赛级题库中取得超过80%的正确率
GPT-4、Claude、Gemini等模型相继在MMLU上突破90%的准确率,导致该基准的区分度消失
对于一个3400字的任务prompt,GPT-4只用81个单词就完成了回复
该用户认为GPT-4无需特别调教就能理解用户对简洁性的需求
一位同时订阅Claude和GPT-4高级版(各200美元/月)的用户在Reddit上抱怨Claude回复过于冗长
还有 40 条时间轴事件
GPT-4的训练成本据估计超过1亿美元
90%已验证大语言模型的预训练过程需要数千块高端GPU并行运算数月,耗资通常在数千万到数亿美元之间
90%已验证MOE架构将模型内部划分为多个专家子网络,每次推理时由门控网络动态选择少数专家参与计算,实际激活参数量远小于总参数量
90%已验证训练一次GPT-4级别的模型需要数万块A100/H100 GPU协同工作数月
90%已验证GPT-4、Claude、Gemini等大语言模型的核心工作原理是基于Transformer架构的下一个token预测
90%已验证2024年发布的GPT-4o将图像生成能力直接整合进多模态大语言模型中
85%已验证GPT-4和Mixtral等主流大模型也采用了MoE架构
85%已验证GPT-4 级别模型的单次调用延迟可能在 1-30 秒之间浮动
80%已验证目前主流模型GPT-4、Claude、Gemini、通义千问均原生支持Function Calling能力
80%已验证ChatGPT Plus订阅价格为每月20美元
80%已验证2023年以来,随着GPT-4、Claude等大语言模型推理能力的飞跃,Agent从学术概念迅速走向工程实践
80%已验证AutoGPT于2023年3月发布,展示了GPT-4自主完成复杂任务的可能性
80%已验证Function Call是OpenAI在2023年6月随GPT-3.5/GPT-4 API更新引入的一项能力,允许开发者在API请求中定义函数的JSON Schema描述
80%已验证GPT-4的输入Token价格约为输出Token价格的1/3
80%已验证目前主流的大语言模型包括GPT-4、Claude、DeepSeek、通义千问等
80%已验证Cursor支持GPT-4、Claude等多模型调用能力
80%已验证GPT-4在2023年初的API调用成本约为每百万token 30美元
80%已验证业界估算GPT-4的训练成本超过1亿美元,涉及数万块A100 GPU、数月的持续运算和PB级别的训练数据
80%已验证GPT-4、Claude等大语言模型的代码生成能力源于训练数据中包含了GitHub上数以亿计的开源代码库
80%已验证Function Calling能力最早由OpenAI在2023年6月的GPT-3.5/4 API中正式引入
80%