cs-board
上传一段参考音频、粘贴中文文案,选个视觉模板,系统自动完成音色克隆、内容拆解、插画生成、手绘动画、字幕叠加和音画合成,最终导出成片。
Github地址
功能特性
能干啥
-
标准模式:知识讲解、故事口播、课程宣传这类,自动拆分镜、生成插画、画白板动画 -
自定义参考:固定 IP 或品牌视频,上传风格图和人物参考,让画风和角色贯穿全片 -
动态信息图:观点表达、商业分析,按真实旁白时间逐项展开内容,画面不会抢跑
具体能力
音色克隆走本地的 IndexTTS 服务,参考音频不出本机;12 套视觉模板,从极简白板、国风、手账到赛博霓虹;支持 1 张风格图 + 最多 5 个角色参考;能按真实语音时间轴生成动态信息图;中文重点词本地叠加,避开图片模型生成中文乱码的问题;字幕、笔身账号名、线条绘制量、每张图承载分镜数都能调;配音、分镜、图片、分段视频都有检查点,改渲染设置不用重新调模型;局域网内多台电脑能共用制作队列。
跑起来
环境要 Windows 10/11、Python 3.11+、Node.js 22.13+、FFmpeg 和 FFprobe 在 PATH 里,还得有个能访问的 IndexTTS 2.5 服务,以及 OpenLux 的 API Key。
项目根目录执行:
python scripts/prepare_env.py
.\.venv\Scripts\python.exe -m pip install -r webapp\requirements.txt
Push-Location web
npm ci
Pop-Location
然后 .\start-webapp.ps1 启动,自动打开 http://127.0.0.1:13000/,局域网设备也能访问。
首次打开右上角 API 设置,填 OpenLux API Key、选文本模型(默认 gpt-5)和图片模型(默认 gpt-image-2)、配 IndexTTS 地址。测试连上后,传 10-30 秒单人噪声少的参考音频,贴至少 10 字中文文案,选模式和模板就能开工。
所有配置、任务文件、成片存在 .webapp/ 目录下,API Key 和参考音频别往公开地方传。













![表情[nanguo]-寻找资源网](http://www.seekresource.com/wp-content/themes/zibll/img/smilies/nanguo.gif)
![表情[haobang]-寻找资源网](http://www.seekresource.com/wp-content/themes/zibll/img/smilies/haobang.gif)
![表情[shuai]-寻找资源网](http://www.seekresource.com/wp-content/themes/zibll/img/smilies/shuai.gif)
![表情[deyi]-寻找资源网](http://www.seekresource.com/wp-content/themes/zibll/img/smilies/deyi.gif)

![表情[chi]-寻找资源网](http://www.seekresource.com/wp-content/themes/zibll/img/smilies/chi.gif)



暂无评论内容