PROJECTS / 14 — DIGITAL HUMAN
BUILT · 2026-06
DIGITAL HUMAN
AI 数字人口播 · 文案到成片的数字人流水线
26 COMMITS
7 MODELS EVALUATED
4 PIPELINE STAGES
FastAPI SELF-BUILT
OVERVIEW ── 这是什么01
文案生成 → 语音合成 → 唇形同步 → 视频输出,端到端自动化。选型阶段横评了 GPT-SoVITS、SadTalker、Wav2Lip、LiveTalking 等七个开源方案并记录了复用度,最终走代码级自建:FastAPI 起服务、任务队列驱动,而不是套一个编排中台。
ARCHITECTURE ── 架构分层02
FastAPI + uvicorn · Pydantic v2 校验 · pydantic-settings 配置分离
任务队列驱动四段流水线 · services 层封装各模型调用 · httpx 异步请求
GPT-SoVITS 少样本声音克隆 · SadTalker / Wav2Lip 唇形同步 · LiveTalking 实时推流方案备选
pytest + pytest-asyncio + 覆盖率 · tests 目录随服务分层
deploy 部署脚本 · outputs / uploads 产物与素材分离
FEATURES ── 功能与取舍03
选型有据可查
七个开源项目逐个标注可复用模块与复用度,选型结论写进 README 而不是留在脑子里。
自建而非套壳
不用编排中台,FastAPI + 任务队列自己控流程,出问题能定位到具体环节。
实时与预生成双模式
同一套流水线支持离线批量出片与实时驱动两种跑法。
异步到底
httpx + pytest-asyncio,长耗时的合成与渲染不阻塞接口。
MILESTONES ── 里程碑04
开源方案横评与流水线设计
四段流水线跑通,FastAPI 服务与测试落地
RELATED LOGS ── 相关复盘05
01配音时长不可控——那就让画面跟着它走2026-07-0802Star 数,不是选型依据2026-06-0903同一个角色,跨 60 个镜头不能换脸2026-06-19