视频生成AI模型,支持从参考图生成视频,通过异步API提供服务
国内AI创作平台竞争者包括字节跳动(即梦)、快手(可灵)、百度(文心一格)、阿里(通义万相)
快手的可灵(Kling)在国内率先实现了高质量长视频生成
当前AI视频生成领域的主流视频生成模型包括OpenAI的Sora、快手的可灵(Kling)、Google的Veo以及Runway Gen-3
OpenAI 的 Sora 和快手的可灵(Kling)等视频生成模型也采用了类似 DiT 的技术路线
AI视频工具如即梦、可灵、Runway的底层架构是扩散模型(Diffusion Model),通过逐步去噪的方式从随机噪声中生成视频帧
KLING 3.0已经发布,由快手旗下的可灵AI团队开发
可灵2.6具有口型同步能力,将角色台词写入提示词后,模型会自动生成带有口型匹配和情感语气的配音
AI漫剧制作的完整工作流包含五个环节:大语言模型生成剧本脚本、一站式AI平台多模型对比生图、ComfyUI图片高清放大、视频生成模型图生视频配音、剪映剪辑
可灵2.6同时支持首帧和尾帧设置,而Sora2 Pro只支持首帧
Lavalt是一站式AI平台,可以同时调用即梦4.5、即梦3.0、Flux、Midjourney等图片模型以及可灵2.6、Sora2.0、Veo3等视频模型在同一界面中切换使用
5 more timeline events