铭鸿体育资讯网

做AI视频的朋友应该都有同感:模型单次只能生成几秒到十几秒,想拼成一条完整的长视频,画面动作接不上、声音突然断掉,观众一眼就出戏。 这个痛点,最近有了实质性的突破。 MiniMax 发布的 H3 全模态生成模型,核心能力是统一理解文本、图像、视频和声音,输出带原生双声道的音视频,最高支持 15 秒

做AI视频的朋友应该都有同感:模型单次只能生成几秒到十几秒,想拼成一条完整的长视频,画面动作接不上、声音突然断掉,观众一眼就出戏。
这个痛点,最近有了实质性的突破。
MiniMax 发布的 H3 全模态生成模型,核心能力是统一理解文本、图像、视频和声音,输出带原生双声道的音视频,最高支持 15 秒 2K 分辨率。价格方面,2K 分辨率下每秒成本不到主流模型的 1/3。
实际应用场景也很明确:
● 电商广告:一张产品图 + 一段文案,直接输出带配音的广告视频
● 口播内容:人物连续说话不中断,表情和口型前后一致
● 营销短片:多镜头切换时,光影、配色、角色保持一致
感兴趣的朋友可以搜索 H3Motion 了解详情。你平时做视频最头疼的是哪个环节?是脚本、配音还是后期拼接?评论区聊聊👇
AI视频生成 H3Motion AIGC 视频创作