📚 Wiki 知识库

美团开源 LongCat-Video-Avatar 1.5 音频驱动虚拟人模型

Joruno🕐 2026-05-25📦 1.6 KB 🟢 已读 𝕏 文章列表

美团开源了名为 LongCat-Video-Avatar 1.5 的音频驱动虚拟人模型。该模型支持唇形精准匹配、表情自然过渡、全身动作连贯及唱歌表演,综合能力据称超越 HeyGen、Kling Avatar 等商业模型。适用于需要高质量视频生成、本地部署及复杂场景开发的内容创作者、企业和 AI 研究者。