2025年6月,AI图像生成领域的王者Midjourney正式发布了其首款视频生成模型V1。这是Midjourney从静态图像向动态多媒体内容生产的重大转型,标志着它正式加入与OpenAI Sora、Runway Gen-4、Google Veo 3等巨头的AI视频竞赛。
V1核心功能:图像转视频的艺术延伸
V1是一款图像到视频的生成模型。用户可以上传Midjourney生成的图像或外部图片,V1会基于该图像生成四组5秒钟的视频片段。整个流程非常简洁:生成或上传图像后,点击"动画"按钮即可转换。
V1提供两种工作模式:自动运动合成会智能分析图像并添加适当动画效果;自定义模式允许用户通过文本描述精确控制场景中各元素的运动方式。运动强度也有两档可选:低运动模式适合环境场景和细腻动画(如眨眼、微风),高运动模式则带来更强的视觉冲击力。
生成效果与创作体验
从初期演示看,V1生成的视频延续了Midjourney一贯的超现实艺术风格。Perplexity AI设计师Phi Hoang在X上评价:"它超越了我所有的预期。"网友普遍反馈其在卡通动画风格上表现突出,画面背景变化时主人公动作依然连贯流畅,即使是凭空创造的怪物和科幻形象也运动自然。
视频时长方面,默认5秒的片段可延长4秒,最多延长4次,最长可制作21秒视频。生成速度也获得用户好评,普遍反映比其他视频模型更快。
定价策略:最低10美元/月
V1的定价具有明显竞争力。所有Midjourney订阅者均可体验,最低10美元/月的Basic套餐即可使用。60美元/月的Pro套餐和120美元/月的Mega套餐用户还能在"Relax"模式下享受无限次视频生成。视频生成成本为图像生成的8倍,按次消耗月度额度。
对比竞品:Runway标准计划15美元/月,OpenAI Sora起价20美元/月。Midjourney的定价策略显然更有利于吸引创作者入门。
局限与未来展望
V1目前不支持音频生成,配乐需要用户后期手动添加。视频也不支持编辑时间线、场景转换或片段间连续性控制。与已上市数月的Sora、Runway Gen-4相比,功能完善度仍有差距。
但Midjourney CEO David Holz明确表示,V1只是迈向"实时开放世界模拟"终极目标的第一步。后续还将推出3D渲染AI模型和实时AI模型,展现完整的多媒体生成技术布局。
适合人群与总结
V1适合Midjourney老用户、独立动画创作者和社交媒体内容生产者。如果你已经熟悉Midjourney的图像生成工作流,V1是无缝扩展视频创作的自然选择。对于专业视频制作团队,建议同时关注Sora和Runway Gen-4的功能演进。