待验证50% 置信事实精确时间
视频生成模型如Sora的单次调用成本远高于文本模型
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/8/16
首次发现
有效期至:2026/11/14
来源
相关事实
待验证图像生成、视频合成等任务需要调用高性能GPU算力,其成本远高于纯文本生成74% 相似待验证Video generation API calls are typically priced much higher than image generation because video generation requires maintaining temporal consistency between frames, resulting in far higher computational costs.71% 相似待验证万象视频生成模型支持文本生成视频(Text-to-Video)和图像生成视频(Image-to-Video)两种生成模式70% 相似待验证在Codex平台中,生成视频比生成文字消耗的Token量要大得多,因为AI需要处理时间轴、动画参数、素材引用等多维度信息70% 相似待验证最新一代视频语言模型如 Gemini 1.5、InternVL2、LLaVA-Video 在海量视频-文本对上端到端预训练,推理成本比纯文本 LLM 高出一至两个数量级68% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/757305API
curl https://kongchang.com/api/v1/knowledge/claims/757305MCP
get_claim(id=757305)