中途视频生成模型公布 |迪士尼诉讼风险全貌与世界模式理念

AI图像生成服务Midjourney于2025年6月18日发布了首个AI视频生成模型“V1”。

该公司大约 2000 万用户可以通过网站和 Discord 将静态图像动画化为 5 秒剪辑,并且可以以 4 秒为增量最多延长四次,总共 21 秒。

视频生成功能包含在现有的订阅计划中,起价为每月 10 美元。每个视频作业的成本约为图像生成任务的八倍,但每秒的成本与生成单个静态图像的成本大致相同。

2025 年 6 月 11 日,即公告发布前一周左右,迪士尼和环球影业向美国加利福尼亚州中区地方法院起诉 Midjourney 侵犯版权。这份长达 100 多页的投诉指控该公司利用漫威、星球大战、辛普森一家、怪物史莱克等受版权保护的角色训练模型。

未来,该公司的目标是构建集静态图像生成、动画、3D空间导航和实时渲染于一体的世界模型。

从: “超出了我的所有期望”:在迪士尼和环球诉讼中,Midjourney 发布了首个人工智能视频模型

【编辑部评论】

Midjourney 视频生成功能的发布不仅仅是一个新功能。视频制作以前需要昂贵的专业软件和技术知识,现在任何人都可以以每月 10 美元的实惠价格进行制作。

要了解这种定价创新,将其与我们的竞争对手进行比较非常重要。 Google 的 Veo 3 起价为每月 249.99 美元,OpenAI 的 Sora 起价为每月 20 美元,Midjourney 的策略显然是为了“普及”。

接入方式的战略选择

当前的 V1 模型可以在网站和 Discord 上访问。这与 Midjourney 的传统图像模型类似,其设计重点是为现有用户提供便利。

视频的最大长度为 21 秒(初始 5 秒 + 4 秒 x 4 个扩展),虽然很短但很实用。这种限制应该被视为一种战略选择,而不是技术上的不成熟。

法律风险对整个行业的严重影响

迪士尼和环球影业于 2025 年 6 月 11 日提起诉讼可能成为整个人工智能行业的转折点。这场诉讼有可能从根本上改变人工智能公司的商业模式。

诉状称,Midjourney 没有为其受版权保护的角色训练数据的使用支付足够的补偿。如果目前的“免费使用学习数据”不再受到法律认可,人工智能开发成本将大幅上升,服务价格也会受到影响。

市场竞争加剧对消费者意味着什么

在社交媒体视频内容需求爆发式增长的推动下,AI视频生成市场持续快速增长。 Midjourney 的进入可能会迫使竞争对手进行价格竞争,从而为消费者提供更实惠、功能更强大的工具。

每家公司都在开发各具特色的服务,例如 Runway 的 Gen-4、Google 的 Veo 3、OpenAI 的 Sora,而且选择也越来越多样化。

技术创新将决定创意活动的未来

“世界模型”的概念是一项革命性的技术,超越了简单的视频生成。首席执行官 David Holz 的“实时开放世界模拟”愿景让我们看到了这样一个未来:用户只需输入“日落时分穿过摩洛哥的市场”,就会实时生成可探索的 3D 环境。

如果这项技术成为现实,即使是个人创作者也将能够创造好莱坞品质的视频体验,进一步使内容制作民主化。

企业使用需谨慎判断

将 Midjourney 用于商业用途的公司应仔细评估正在进行的版权侵权诉讼的风险。这是因为生成的内容可能面临版权侵权的风险。

另一方面,可以通过选择具有内置补偿功能的服务来降低这种风险,例如 OpenAI 的 Sora 和 Adob​​e Firefly Video。

从长远角度看技术的意义

中程视频功能发布是AI技术发展的重要里程碑

。当前的限制和法律挑战都是暂时的,技术的本质价值在于“创造力的释放”。

我们需要密切关注这项技术如何发展以及未来几年它将给社会带来哪些变化。尤其是版权法与AI技术的关系如何梳理,将是决定数字创作未来的重要因素。服务名称企业名价格(每月)视频长度音声生成解像度
主要特点中途V1中途$10〜最大21秒没有任何480p
图片生成视频,低价策略索拉开放人工智能$20〜最大20秒可以是1080p
从文本生成视频,补偿功能跑道 Gen-4跑道$12〜最大450秒可以是4K兼容
高品质视频,AI摄像头控制卢玛梦想机亮度好$9.99〜最大120秒可以是1080p
带音频的视频,重新设计皮卡实验室皮卡实验室$10〜最大210秒可以是1080p
独特的效果,灵活的编辑谷歌我看到3谷歌$249.99最大8分可以是4K
企业高品质,Google 集成Adobe 萤火虫视频土坯$9.99〜最大60秒可以是4K

Adobe集成,专业功能

【术语解释】
AI视频生成模型

AI技术可根据文本提示和静止图像自动生成视频。它使用深度学习来学习物理定律和运动模式,以创建逼真的图像。
世界模型

人工智能理解现实世界的物理规律和空间结构并生成和模拟用户可以实时探索的3D环境的技术概念。
迅速的

给AI生成工具的文本指令。具体描述您想要用自然语言生成的内容,例如“日落时分穿过摩洛哥的市场”。
GPU分数

表示 AI 视频生成中使用的计算资源量的单位。按使用量付费的系统,根据高性能GPU(图形处理单元)的使用时间进行收费。
版权侵权诉讼

未经许可使用或复制他人受版权保护的作品时产生的法律纠纷。 AI学习数据的利用也成为新的争论点。
多模态合成

集成、处理和生成文本、图像、视频、音频等多种不同媒体格式的人工智能技术。

[参考链接]中途
(外部)

提供AI图像和视频生成服务的独立研究实验室。它拥有大约2000万用户。OpenAI(索拉)
(外部)

一家以 ChatGPT 闻名的人工智能公司。我们提供视频生成 AI“Sora”,每月 20 美元起。跑道
(外部)

提供AI视频生成工具“Gen-4”。可以生成电影制作级别的高质量视频。亮度好
(外部)

皮卡实验室
(外部)

一种从文本和图像生成视频的人工智能工具。具有独特的“皮卡效应”功能。

[参考视频]

[参考文章]Midjourney推出首款AI视频生成模型V1
(外部)

TechCrunch 发布的 Midjourney V1 公告文章。解释了技术细节和未来愿景。迪士尼和环球影业针对中途的诉讼解释
(外部)

一篇详细的文章解释了迪士尼和环球公司提起的版权侵权诉讼。分析对行业的影响。Runway Gen-4 简介
(外部)

Runway最新AI视频生成模型“Gen-4”官宣文章。解释技术细节。

[编者后记]

看着Midjourney视频生成功能的发布和法律问题,我强烈感受到AI技术的进步与社会系统的差距。虽然我们正在进入一个任何人都可以每月花费 10 美元制作视频的时代,但版权的根本问题仍未得到解决。

您如何看待这项技术创新?我们应该欢迎它作为创意活动的民主化,还是应该警惕它对现有创作者权利的威胁?另外,当考虑其在公司中的使用时,您如何平衡法律风险和创新?

我们innovaTopia编辑部愿意与读者一起思考这项技术的可能性和挑战。我们很想听听您的意见和经验。