ARTICLE DETAIL

资讯详情

深耕网站视觉设计与运营推广的一线实战洞察。

edge-tts 零成本实战:3 步调用微软文本转语音,免费出带字幕的配音

edge-tts 零成本实战:3 步调用微软文本转语音,免费出带字幕的配音 edge-tts 零成本实战3 步调用微软文本转语音免费出带字幕的配音【免费下载链接】edge-ttsUse Microsoft Edges online text-to-speech service from Python WITHOUT needing Microsoft Edge or Windows or an API key项目地址: https://gitcode.com/GitHub_Trending/ed/edge-ttsedge-tts 是一个 Python 文本转语音工具直接调用微软 Edge 内置的在线 TTS 服务。它解决的问题很具体你想把文字批量变成自然度很高的 MP3 配音但不想装 Edge、不想上 Windows、更不想申请 API key 和按字计费。它到底替你省了什么事商用 TTS 接口按字符收费一个播客栏目跑下来每月成本从两位数起步。开源本地模型要 GPU、要配环境普通开发机上根本跑不动。微软那套在线合成质量确实好可入口被锁在 Edge 浏览器里程序想调用得逆向它的请求。edge-tts 做的事就是把这套请求逻辑用纯 Python 复现出来你传文本它还 MP3中间零人工。从零到跑通30 秒装好文本转语音先装它。装完跑一下版本号看到edge-tts加一个数字输出说明安装成功。最后一条命令生成第一条语音目录里出现 hello.mp3 且能播放就算跑通了。pip install edge-tts edge-tts --version edge-tts --text Hello, this is edge-tts --write-media hello.mp3不指定音色时默认用 en-US-EmmaMultilingualNeural一个英文女声。如果你只想用命令行、不想污染 Python 环境把 pip 换成 pipx 装法也一样。它能帮你做什么文本转语音的 3 个高频玩法列出全部音色换语言只改一个参数先跑--list-voices拉出全量音色清单按 Name 和 Gender 分好类几十个语种、上百个声线都在里面。挑中哪个把名字原样塞给--voice就行。edge-tts --list-voices edge-tts --voice zh-CN-XiaoxiaoNeural --text 今天是个好日子 --write-media chinese.mp3一句话调语速和音调语速、音量、音调三个参数都支持百分比或 Hz 的加减法。语速放慢三分之一、音量加两成、音调抬 10Hz一条命令全调完听感差距非常明显。edge-tts --rate-30% --volume20% --pitch10Hz --text 试试这个节奏 --write-media tuned.mp3边生成边出字幕在落盘音频的同时加一个--write-subtitles音频和 SRT 字幕一起产出。时间轴按句对齐剪辑软件里直接拖进去就能用。edge-tts --text 这是一条带字幕的语音 --write-media out.mp3 --write-subtitles out.srt两个真实场景给播客栏目批量做片头配音。把三集稿子排进列表循环里每个文本都走同一个音色跑完目录里就是一串按集编号的 MP3换栏目只改一个音色字符串。from edge_tts import Communicate scripts [第一集片头, 第二集片头, 第三集片头] for i, text in enumerate(scripts): Communicate(text, zh-CN-XiaoxiaoNeural).save_sync(fep_{i 1}.mp3)做课件旁白给剪辑同学留好配音口。语速上调 10% 让课堂节奏更紧mp3 落盘后直接放进课件时间线。from edge_tts import Communicate lesson 光合作用的原料是二氧化碳和水 Communicate(lesson, zh-CN-YunxiNeural, rate10%).save_sync(lesson_01.mp3)需要同步字幕时把这段换成 CLI 加--write-subtitles再跑一遍即可时间轴按句切好。进阶3 个值得调的参数参数名作用示例值--rate控制语速快慢-30%放慢--volume控制音量大小20%加大--pitch控制音调高低10Hz抬高其他参数跑edge-tts --help或翻 README 即可不用背。我踩过的坑负数参数报 unknown argument原因空格写法里 -30% 被 argparse 当成一个新的命令行开关。 解决负号参数一律用等号连接写成--rate-30%正数则随意。音色名差一个字母就 400原因--voice做的是精确匹配大小写和连字符都不能错。 解决从edge-tts --list-voices的输出里直接复制别手打。edge-playback 装了却没声音原因Windows 以外edge-playback 依赖 mpv 播放器没装它就静默失败。 解决先apt install mpv或brew install mpv再跑播放命令。底层怎么跑的它连的是微软 speech.platform.bing.com 的 WebSocket 接口请求头里带一个内置的客户端令牌模拟 Edge 浏览器读屏功能的请求。你传入的文本被包进一段 SSML 发过去服务把 MP3 按块流式回传同时附上每句话的起止时间戳字幕就是拿这个时间轴对出来的。上手前的最后提醒edge-tts 把微软的免费文本转语音服务压成了一条命令行和一个 Python 类装完即用按零付费。现在就可以去终端里pip install edge-tts把手头那段没人愿意念的稿子变成带字幕的 MP3。网络受限时记得加--proxy参数。相关链接项目说明README.mdPython 调用示例examples/核心模块源码src/edge_tts/命令行参数实现src/edge_tts/util.py播放器工具src/edge_playback/【免费下载链接】edge-ttsUse Microsoft Edges online text-to-speech service from Python WITHOUT needing Microsoft Edge or Windows or an API key项目地址: https://gitcode.com/GitHub_Trending/ed/edge-tts创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表