Unverified50% confidenceFactExact time
视频生成模型如Sora的单次调用成本远高于文本模型
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
8/16/2026
First Seen
Valid until: 11/14/2026
Sources
Related Claims
Unverified图像生成、视频合成等任务需要调用高性能GPU算力,其成本远高于纯文本生成74% similarUnverifiedVideo generation API calls are typically priced much higher than image generation because video generation requires maintaining temporal consistency between frames, resulting in far higher computational costs.71% similarUnverified万象视频生成模型支持文本生成视频(Text-to-Video)和图像生成视频(Image-to-Video)两种生成模式70% similarUnverified在Codex平台中,生成视频比生成文字消耗的Token量要大得多,因为AI需要处理时间轴、动画参数、素材引用等多维度信息70% similarUnverified最新一代视频语言模型如 Gemini 1.5、InternVL2、LLaVA-Video 在海量视频-文本对上端到端预训练,推理成本比纯文本 LLM 高出一至两个数量级68% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/757305API
curl https://kongchang.com/api/v1/knowledge/claims/757305MCP
get_claim(id=757305)