能帮你做什么

  • 图片转竖屏视频:将本地图片合成为 9:16 视频,设置展示时长,并添加背景音乐。
  • 突出图片中的文字:通过 OCR 识别文字,为关键词添加高亮、画圈或下划线动画。
  • 接入 AI 助手:提供本地 MCP 服务和 OpenClaw 工作流模板,便于编排素材解析、视频计划与渲染步骤。
  • 尝试链接转视频:实验性支持解析你有权使用的小红书内容,再将图片制作成视频。

如何开始

按照 GitHub 安装说明克隆项目并安装依赖。先使用项目自带的离线示例生成图片和视频,无需账号或小红书链接;跑通后,再换成自己的图片。

python examples/make_demo.py --output-dir output/demo
xhs-local-video output/demo/image_000.png output/demo/image_001.png --duration 2 --output-dir output

命令返回的 video_path 指向生成的视频。需要通过 AI 助手调用时,可参考仓库中的 MCP 客户端配置

使用前了解

需要 Python 3.10–3.12 和 FFmpeg;文字标注另需 Tesseract 及中文语言包,链接解析另需 Chromium。本地命令本身不调用模型,使用 AI 客户端时的模型费用由客户端配置决定。

目前为本地单人实验版,每次最多处理 20 张图片,视频总时长最多 240 秒。小红书链接解析可能因登录限制、验证码或页面变化而失败;项目不提供绕过访问限制的功能。请使用自己有权处理的图片和音乐。

项目采用 GPL-3.0 开源许可证。完整功能、安装步骤与最新状态见 GitHub 项目说明