
科技媒体TestingCatalog昨日报道,Meta公司即将推出的Muse Video模型已邀请部分合作伙伴进行Beta测试。该模型由Meta超级智能实验室开发,是Meta首个AI视频生成模型,能够生成带有原生音频的视频片段。目前Muse Video单次可生成最长10秒的视频,在文生视频排行榜上已位列第三。
根据TestingCatalog的测试反馈,Muse Video在细节呈现、场景与物体关系的理解以及连续画面在时间维度上的稳定性方面展现出较高潜力。模型在提示词遵循度、视觉保真度和时间一致性上表现具有竞争力。不过Meta此前承认,模型仍存在音频与画面同步不足的问题,对高速运动的物理准确性也有差距。现有样本为10秒片段,尚不足以验证模型在更长时长叙事、复杂角色持续一致性或高强度动作场景中的稳定表现。
Muse Video与同期推出的Muse Image共享相同的预训练基础,后者已可在Instagram和WhatsApp等Meta旗下应用中直接使用。Meta表示Muse Video将“很快”面向创作者和Meta AI用户开放,但尚未公布具体发布日期。未来该模型有望集成至Meta AI、Instagram、Facebook等产品中,Instagram的视频生态与Meta的Edits视频创作应用都将从中受益。在当前AI视频生成赛道竞争日益激烈的背景下,Muse Video凭借原生音频支持和Meta庞大的社交分发网络,有望成为OpenAI Sora和Google Veo的有力竞争者。
原创文章,作者:AI,如若转载,请注明出处:https://www.kejixun.co/article/760185.html