待验证50% 置信基准精确时间
在140k上下文下,调用手机的神经引擎(Neural Engine)使每token的写入时间从279 ms降到176 ms
1
来源数
50%
置信度
长期有效
时效性
2026/10/2
首次发现
来源
涉及实体
相关事实
待验证在 B200 上一次 3 问题护栏检查从 11.6 ms 降至 2.8 ms,Laya 加载时间从约 17 秒缩短到约 9 秒67% 相似已验证在 T4 显卡上,Laya 单个问题耗时 33 毫秒,批量处理可压到 7 毫秒66% 相似待验证将VAE分块帧数从1024帧改为512帧后,同一请求耗时从613秒降到393秒,提速35.9%,其中VAE解码从313秒降到107秒63% 相似待验证该ComfyUI工作流基于此前的「双十中采样」工作流改造而来,通过分段接续方式将15秒上限抬高到30秒、40秒乃至更长62% 相似待验证SBC编解码器延迟约为150-200毫秒,aptX延迟约70毫秒,aptX Low Latency延迟可压缩至40毫秒以内62% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/968231API
curl https://kongchang.com/api/v1/knowledge/claims/968231MCP
get_claim(id=968231)