📚 Wiki 知识库

🏷️ 音频驱动

1 篇

美团开源 LongCat-Video-Avatar 1.5 音频驱动虚拟人模型

美团开源了名为 LongCat-Video-Avatar 1.5 的音频驱动虚拟人模型。该模型支持唇形精准匹配、表情自然过渡、全身动作连贯及唱歌表演,综合能力据称超越 HeyGen、Kling Avatar 等商业模型。适用于需要高质量视频生成、本地部署及复杂场景开发的内容创作者、企业和 AI 研究者。

技术AI ✍ Joruno🕐 2026-05-25