PROJECTS / 14 — DIGITAL HUMAN

BUILT · 2026-06

DIGITAL HUMAN

AI 数字人口播 · 文案到成片的数字人流水线

26 COMMITS

7 MODELS EVALUATED

4 PIPELINE STAGES

FastAPI SELF-BUILT

OVERVIEW ── 这是什么01

文案生成 → 语音合成 → 唇形同步 → 视频输出,端到端自动化。选型阶段横评了 GPT-SoVITS、SadTalker、Wav2Lip、LiveTalking 等七个开源方案并记录了复用度,最终走代码级自建:FastAPI 起服务、任务队列驱动,而不是套一个编排中台。

ARCHITECTURE ── 架构分层02

01服务

FastAPI + uvicorn · Pydantic v2 校验 · pydantic-settings 配置分离

02编排

任务队列驱动四段流水线 · services 层封装各模型调用 · httpx 异步请求

03模型

GPT-SoVITS 少样本声音克隆 · SadTalker / Wav2Lip 唇形同步 · LiveTalking 实时推流方案备选

04质量

pytest + pytest-asyncio + 覆盖率 · tests 目录随服务分层

05交付

deploy 部署脚本 · outputs / uploads 产物与素材分离

FEATURES ── 功能与取舍03

选型有据可查

七个开源项目逐个标注可复用模块与复用度,选型结论写进 README 而不是留在脑子里。

自建而非套壳

不用编排中台,FastAPI + 任务队列自己控流程,出问题能定位到具体环节。

实时与预生成双模式

同一套流水线支持离线批量出片与实时驱动两种跑法。

异步到底

httpx + pytest-asyncio,长耗时的合成与渲染不阻塞接口。

MILESTONES ── 里程碑04

2026-06-09

开源方案横评与流水线设计

2026-06-11

四段流水线跑通,FastAPI 服务与测试落地

RELATED LOGS ── 相关复盘05

01配音时长不可控——那就让画面跟着它走2026-07-0802Star 数,不是选型依据2026-06-0903同一个角色,跨 60 个镜头不能换脸2026-06-19