edgeTTS 是轻量级自托管语音合成服务,调用微软 Edge 在线朗读接口,提供 HTTP API 与 Web 工作台,支持流式传输、音色检索和 MP3 导出。长文本按段落、换行、句子智能切片,单次上限 2 万码点,并设有并发与限流保护。项目以单个 Fastify 进程托管前后端,用 Bearer Token 鉴权,官方提供 Docker 镜像,推荐配合反向代理部署。
南洋理工大学高材生孙燕姿回应“AI孙燕姿”现象,使用Sadtalker库和edge-tts实现音频转录和生成逼真的运动系数,展示超人智识水平。Sadtalker库提供面部运动细节,但增加了模型数量、推理成本和时间。
完成下面两步后,将自动完成登录并继续当前操作。