接受类似合作
解决什么
做短视频最累的不是创意,而是重复的体力活:写文案、录配音、配画面、导出,每期都从头来一遍。这套流水线把这些机械环节自动化——AI 出文案、自动配音、代码渲染画面,让人专注在选题和把关上,而不是被体力活淹没。
实际耗时
这是持续增加专题的创作流水线,未按单一交付项目记录总工时。
查看详细资料(3 项)
技术与AI
GLM / 智谱(文案生成)、edge-tts(中文配音合成)、Remotion(React 驱动的视频渲染)、headless Chrome(截图)、ffmpeg(音视频合成)、AI 辅助生成画面文案与字幕
踩过的坑
迭代中踩过几类坑并已修:生图服务曾静默退回占位图,后来增加文件类型和来源检查;字幕会溢出或缺少英文词间空格,后来统一排版规则;画面曾误印 URL 域名影响平台审核,后来调整来源展示;英文版曾残留中文硬编码,后来补齐语言分支检查。
公开范围
流水线代码在仓库内(ai_douyin_video_pipeline/);成品视频按各发布平台规则发布。本作品无独立公开访问站点,页面仅展示真实成片抽帧。

不是手动剪片子,而是把短视频做成一条能反复跑、能批量出片的流水线。

做短视频最累的不是创意,而是重复的体力活:写文案、录配音、配画面、导出,每期从头来一遍。这套流水线把这些机械环节自动化——AI 出文案、自动配音、代码渲染画面、再合成。

生活类比

像印刷厂:你给一份原稿(专题主题),流水线自动排版、配图、印刷、装订,出来一本成品。它不替你写内容,但把「写完到成片」中间的机械环节都包了。

对应:原稿=专题文案;排版印刷=渲染画面配音;成品=可发布的视频

这个比方在哪会塌:印刷厂印不出好内容:如果原稿(文案)本身空洞或有事实错误,流水线只会高效地做出一个空洞或错误的视频。

它防止的误解:防止把「自动化出片」理解成「自动出好内容」——创意与事实核查仍是人的责任。

它解决了什么

让「写完文案」到「能发的视频」之间的体力活自动化:文案生成、中文配音、带动画画面、字幕、合成,每期可重复跑,不用每次手动剪辑。

技术上是怎样的(给想了解的人)

  • GLM(智谱)生成专题文案;作者做事实核查(AI 会一本正经胡编)
  • edge-tts 合成中文配音;Remotion(React 驱动)渲染带动画画面
  • headless Chrome 截图 + ffmpeg 合成音视频
  • 字幕排版规则:英文词间加空格、最多两行、不溢出;画面不印 URL/域名(平台审核)
  • 每个专题 = 独立 demoData(数据)+ runtime(节奏)+ 复用 EditorialPromptSkills(杂志风组件),Root.tsx 注册即可渲染

真实成片画面

延伸:这三件作品(AI 工作站、开源雷达、短视频流水线)是同一套「把 AI 能力变成普通人能用的东西」的不同侧面。如果想从整体看,回到作品列表。

整理方式
编辑原创通俗解释
内容状态
已完成编辑复核
证据等级
作者真实实践

最后复核:2026-07-28

AI 领域更新很快,相关工具/价格/规则可能已变化,重要事实请以官方来源为准。