待验证50% 置信基准精确时间
在同配置对比中,38K单请求吞吐从每秒69.38个Token提高到86.07个,约4K的8路总吞吐从每秒400.16提高到464.15
1
来源数
50%
置信度
长期有效
时效性
2026/9/15
首次发现
来源
涉及实体
相关事实
待验证200K token的上下文请求相比8K token请求,需要约25倍的KV-Cache显存71% 相似待验证LangSmith的Agent trace载荷持续增长:P50从6KB增长到37KB,P99从364KB增长到12MB,单个客户曾在一天内发送50TB的trace数据69% 相似待验证当上下文从4K token扩展到128K token时(32倍),理论计算量增长约1024倍67% 相似待验证顺序读取约14700MB/s的峰值速度主要体现在大文件连续读写场景(如4K视频素材拷贝),随机小文件性能提升相比上代没有同比例的飞跃67% 相似待验证Grok 4.5每秒输出速度80 token,上下文窗口高达50万token(约等于40万个英文单词)66% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/923189API
curl https://kongchang.com/api/v1/knowledge/claims/923189MCP
get_claim(id=923189)