文字转语音
输入文本 → 选择语言和音色 → 点击生成,三步完成配音。支持语速、音调、音量参数调节,部分语音支持情感风格(如温柔、愤怒、悲伤)和角色扮演效果。HD 语音模型可自动识别文本情绪,实时调整语调。支持上传 TXT/DOCX 文件和 SRT 字幕文件配音,支持插入停顿和背景音乐。
English (United States) Text to Speech · 79 American English neural voices
美式英语配音,音色最多的地方就在这里:79 个美式英语神经网络音色,Ava Dragon HD Latest(女声)、Andrew Dragon HD Latest(男声)、Adam Dragon HD Latest(男声)等 79 个都在其中,还有多语言与 HD 系列可选,HD 音色带上下文理解,读长句不会越读越飘。粘贴文案选音色就能出 MP3,不用录音、不用装软件、不用注册。
适合做 YouTube 与 TikTok 英文口播、播客、英文有声书、产品介绍片和企业宣传。语速 0.5x-2x 可调,音调、音量、停顿时长独立控制,长英文稿一次能跑 10 万字。输出 MP3 无水印、无片头片尾宣传语音。
The largest American English voice set here: 79 neural voices, with Ava Dragon HD Latest / Andrew Dragon HD Latest / Adam Dragon HD Latest and 76 more among them, plus multilingual and HD models that keep the intonation steady across a long paragraph. Paste your script, pick a voice, download a watermark-free MP3 — no account, no software, no recording.
把下面这句英文粘进输入框,从 Ava Dragon HD Latest(女声)、Andrew Dragon HD Latest(男声)、Adam Dragon HD Latest(男声)等 79 个里挑一个试听,美音的连读和卷舌一听就分得出来:
Good morning, and thanks for tuning in — this is what American English sounds like on Fuym Voice.
推荐音色:Ava Dragon HD Latest(女声)/ Andrew Dragon HD Latest(男声)等
输入文本 → 选择语言和音色 → 点击生成,三步完成配音。支持语速、音调、音量参数调节,部分语音支持情感风格(如温柔、愤怒、悲伤)和角色扮演效果。HD 语音模型可自动识别文本情绪,实时调整语调。支持上传 TXT/DOCX 文件和 SRT 字幕文件配音,支持插入停顿和背景音乐。
按段落分配角色,每个角色配一个音色,系统自动切换生成完整对话音频。做英语广播剧、双人英语访谈、教学对话演练都合适。
每个任务支持最多 10 万字的大规模文本转换,系统采用异步批处理机制,不会实时返回音频。可一次提交多个任务,后台同步执行生成,提交后可关闭页面,稍后返回查看任务状态并下载已完成的音频。英语有声书、整套听力素材走这个入口最省事。
上传一段已有音频,把它换成系统里的目标音色,原来的语速、停顿和语气保留下来。已经录好的英语口播想换音色、或者想给同一段英语配多个版本,用这个不用重新录。
生成配音音频的同时输出对应字幕文件,可直接导入剪映、PR 等剪辑软件。英语视频想上英语字幕或做双语字幕,在这里一次拿到音频和 SRT。
独立的时间轴工具:调整偏移、合并相邻字幕、拆分超长字幕、SRT/ASS/VTT 互转。字幕和音频差半秒这类问题,在这里改比重新生成快。
上传 5-30 秒清晰人声样本(MP3/WAV),系统学习这段声音的特征后用它朗读你写的英语稿,免费单次 500 字(会员 1000 字)。品牌出镜人不想每次录音,或者想让固定声音贯穿一系列视频,可以用它。
用文字描述想要的音色(比如“成熟男声、语速偏慢、适合企业宣传”),系统据此生成专属音色;也能基于上传样本做克隆。系统自带音色都不满意时,这条路比找配音更省事。
en-US 语种下提供 Ava Dragon HD Latest(女声)、Andrew Dragon HD Latest(男声)、Adam Dragon HD Latest(男声)、Alloy Dragon HD Latest(男声)等,共 79 个神经网络音色,单次可转 5000 字符,长文本走批量生成、单任务上限 10 万字。下表是英语(美国)语音合成的参数口径,界面上的可选项与下表一致。
| 指标 | 数据 |
|---|---|
| 语言名称 | 英语 (美国) · English (United States) |
| 语言代码 | en-US |
| 可用音色 | Ava Dragon HD Latest(女声)、Andrew Dragon HD Latest(男声)、Adam Dragon HD Latest(男声)、Alloy Dragon HD Latest(男声)等,共 79 个神经网络音色;另有 45 个 Preview 音色 |
| 情感风格 | 18 个音色支持风格选择(如温柔、欢快、悲伤、新闻播报等) |
| 发音特点 | 美式英语发音,卷舌明显、连读自然,音色库覆盖 79 个 GA 音色,含 HD 与多语言系列 |
| 页面界面 | 中文界面,语言与音色名称按原语言写法显示 |
| 单次转换上限 | 5000 字符(含空格与标点,超出自动截断) |
| 批量生成上限 | 单任务最多 10 万字,异步批处理,可多任务并行 |
| 参数调节 | 语速 0.5x-2x、音调 ±50%、音量 0-100%、静音时长、目标时长 |
| 文件导入 | TXT / DOCX 文本导入,SRT 字幕按时间轴配音 |
| 导出格式 | MP3 / WAV,无水印、无片头片尾宣传语音 |
| 底层引擎 | 微软 Azure 认知服务文本转语音 API(神经网络语音) |
| 使用门槛 | 免登录即可使用,无需绑定手机号;当日可用额度在页面顶部实时显示 |
| 其他英语变体 | en-AU、en-CA、en-GB、en-HK、en-IE、en-IN、en-KE、en-NG、en-NZ、en-PH、en-SG、en-TZ、en-ZA,共 14 个 |
同一段文案换成其他地区口音,听感差别很明显。要换地区,在“语言”下拉里直接切,语音列表会同步刷新;也可以直接进对应的变体页:
American English is where the voice library is deepest. Fuym Voice (fuym.cn) ships 79 general-availability US English neural voices — Ava, Andrew, Adam, Aria and dozens more — plus HD models that understand context, so a long paragraph keeps its intonation from the first sentence to the last.
Paste up to 5,000 characters and download a watermark-free MP3, or adjust delivery from 0.5x to 2x, shift pitch by ±50%, change volume and insert pauses. Scripts longer than 5,000 characters go through Batch Generate, which takes up to 100,000 characters per task and runs in the background.
Good morning, and thanks for tuning in — this is what American English sounds like on Fuym Voice.
This section is written for English-speaking visitors. The interface is in Chinese, and the text box accepts English plus 140+ other languages.
| 对比维度 | 浮云梦配音(本站口径) | TTSMaker | Edge 大声朗读 | ElevenLabs |
|---|---|---|---|---|
| 使用门槛 | 免登录,网页即用 | 需注册(以官网为准) | 浏览器内置,仅限 Edge 内使用 | 面向开发者与海外用户(以官网为准) |
| 英语地区变体 | 14 个(en-US / en-AU / en-CA / en-GB 等) | 以官网为准 | 跟随系统语音包,以官网为准 | 以英语音色为主,以官网为准 |
| 字数与批量 | 单次 5000 字符;批量单任务 10 万字 | 以官网为准 | 无批量与附加功能 | 以官网为准 |
| 多人对话 | 内置,每个角色可配不同音色 | 多角色功能受限 | 不支持 | 以官网为准 |
| 语音克隆 | 上传 5-30 秒样本即可,免费单次 500 字(会员 1000 字) | 以官网为准 | 不支持 | 以官网为准 |
| 字幕工具 | 音频转 SRT + 时间轴校准 | 以官网为准 | 无 | 以官网为准 |
| 导出水印 | 无水印、无片头片尾宣传语音 | 以官网为准 | 无 | 以官网为准 |
| 界面语言 | 中文界面,语言名显示原语言写法 | 以官网为准 | 跟随浏览器语言 | 英文为主 |
竞品一列只做定性描述,具体功能、音色数量与限制以各家官网为准;这里的数值口径均可在上方参数表与站内语言列表中核对。
英语(美国)语音合成基于微软 Azure 认知服务文本转语音 API(Microsoft Azure Cognitive Services Text-to-Speech),Luna、Wayne 均为神经网络(Neural)音色,情感风格由所选风格参数控制。语音克隆与语音转换使用深度学习模型,与 TTS 引擎分开。整段音频在服务端生成,浏览器只负责播放与下载,本地不需要显卡算力。
en-US 语种下有 79 个 GA(正式可用)音色,加上预览状态的音色一共 124 个,是全站音色最多的语种。含 Ava、Andrew、Adam、Aria 等 HD 系列,以及带上下文理解的长句音色。
大。美音的卷舌(r 音)和连读更明显,英音更收敛、澳音元音更开。同一段产品视频用三种音色读,本地听众一耳朵就能听出地区,做哪个市场就选哪一套。
HD 系列(Dragon HD)对上下文更敏感,长段落里的重音和语调更稳,情绪转折更自然;普通音色速度更快、更省额度。短文案两者差距不大,五分钟以上的长音频建议用 HD。
单次 5000 字符(含空格标点),超出自动截断。整本有声书、整套课程稿用批量生成,单任务 10 万字,异步执行,提交后可以关掉页面。
够。多人对话功能可以给主持人和嘉宾分配不同音色,一次生成整段对白;字幕生成会同时给出 SRT,导入剪辑软件就能对轴。长文本走批量生成不用守着页面。
下载的是 MP3 或 WAV,无水印、无片头片尾宣传语音。商用场景的使用与授权细节以站内说明为准。
79 general-availability US English neural voices, 124 including preview models — the widest selection of any language on the site. It covers the Dragon HD series (Ava, Andrew, Adam, Aria and more) plus multilingual voices.
Yes. Paste up to 5,000 characters per request without signing in, or send longer scripts through batch mode at up to 100,000 characters per task. The MP3 downloads without a watermark.