首页GitHub 项目库
剑的 AI 实验室 · 中文EN

视频、图片与声音

LongCat-Video

meituan-longcat/LongCat-Video

一句话看懂

一张图加一段声音,就能让真人、动漫角色或动物自然开口说话。

给一张人物图和一段声音,就能让真人、动漫角色或动物开口说话;同一仓库还支持文生视频、图生视频和长视频续写。

它能帮你完成什么

一张图加一段声音,就能让真人、动漫角色或动物自然开口说话。

给一张人物图和一段声音,就能让真人、动漫角色或动物开口说话;同一仓库还支持文生视频、图生视频和长视频续写。

  • LongCat-Video-Avatar 1.5 可用图片与音频生成说话视频,README 明确列出真人、动漫、动物和复杂现实场景等适用形象。
  • 同一仓库还提供文生视频、图生视频、视频续写和长视频生成路线,不只是一款口型同步工具。
  • Avatar 1.5 使用 Whisper-Large 改进口型同步,并提供蒸馏推理与单人、多人音频驱动示例。

它怎样帮上忙

从实际问题,看到对应能力。

用户遇到的问题

想让一张人物图开口说话,又不想每次都真人出镜。

LongCat-Video 的对应能力

给 LongCat-Video-Avatar 1.5 一张图片和一段声音,可生成音频驱动的人物视频;真人、动漫角色和动物都在官方适用范围内。

用户遇到的问题

普通口型工具只能做短片,后续还要换工具做文生视频或续写。

LongCat-Video 的对应能力

LongCat-Video 同一仓库还覆盖文生视频、图生视频、视频续写与长视频生成,可继续搭建完整的视频路线。

项目档案 × 真实实验

谁真正试过这个项目?

官方档案说明它声称能做什么;社区实验记录它在真实环境里做成了什么。

已连接 0 份实验
还没有人公开这项实验。

如果你已经试过它,请把过程、结果和踩坑经验留给后来的人。

成为第一个实验者