文字转语音
输入文本 → 选择语言和音色 → 点击生成,三步完成配音。支持语速、音调、音量参数调节,部分语音支持情感风格(如温柔、愤怒、悲伤)和角色扮演效果。HD 语音模型可自动识别文本情绪,实时调整语调。支持上传 TXT/DOCX 文件和 SRT 字幕文件配音,支持插入停顿和背景音乐。
东北话文字转语音 · 晓北、云彪两个辽宁方言音色(Preview 预览状态)
东北话的喜感来自语调的起伏和那股冲劲,普通话音色读不出这个味道。这一页是 Xiaobei(女声)、Yunbiao(男声)两个东北话音色,一男一女,做东北风格短视频、直播切片、方言段子都能用。粘贴文字点生成,MP3 直接下载。
要说明的是:两个东北话音色目前都是微软的 Preview(预览)状态,可用但稳定性与情感表达不如正式音色。正式项目建议先试听定稿,或同时生成普通话版本备用。语速 0.5x-2x 可调,长稿走批量生成单任务 10 万字。
东北方言配音:晓北(女声)、云彪(男声)两个辽宁话音色按东北官话发音合成,得劲儿、咋整、嘎哈 这类口语直接读,单次最多 5000 字符,长稿走批量生成、单任务 10 万字。
把下面这句东北口语贴进输入框,用 Xiaobei(女声)、Yunbiao(男声)各试一遍,东北话的语调和普通话音色完全不同:
来,把这段字儿粘进去,挑个得劲儿的音色,点一下就成了。
推荐音色:Xiaobei(女声)/ Yunbiao(男声)
输入文本 → 选择语言和音色 → 点击生成,三步完成配音。支持语速、音调、音量参数调节,部分语音支持情感风格(如温柔、愤怒、悲伤)和角色扮演效果。HD 语音模型可自动识别文本情绪,实时调整语调。支持上传 TXT/DOCX 文件和 SRT 字幕文件配音,支持插入停顿和背景音乐。
按段落分配角色,每个角色配一个音色,系统自动切换生成完整对话音频。做辽宁话广播剧、双人辽宁话访谈、教学对话演练都合适。
每个任务支持最多 10 万字的大规模文本转换,系统采用异步批处理机制,不会实时返回音频。可一次提交多个任务,后台同步执行生成,提交后可关闭页面,稍后返回查看任务状态并下载已完成的音频。辽宁话有声书、整套听力素材走这个入口最省事。
上传一段已有音频,把它换成系统里的目标音色,原来的语速、停顿和语气保留下来。已经录好的辽宁话口播想换音色、或者想给同一段辽宁话配多个版本,用这个不用重新录。
生成配音音频的同时输出对应字幕文件,可直接导入剪映、PR 等剪辑软件。辽宁话视频想上辽宁话字幕或做双语字幕,在这里一次拿到音频和 SRT。
独立的时间轴工具:调整偏移、合并相邻字幕、拆分超长字幕、SRT/ASS/VTT 互转。字幕和音频差半秒这类问题,在这里改比重新生成快。
上传 5-30 秒清晰人声样本(MP3/WAV),系统学习这段声音的特征后用它朗读你写的辽宁话稿,免费单次 500 字(会员 1000 字)。品牌出镜人不想每次录音,或者想让固定声音贯穿一系列视频,可以用它。
用文字描述想要的音色(比如“成熟男声、语速偏慢、适合企业宣传”),系统据此生成专属音色;也能基于上传样本做克隆。系统自带音色都不满意时,这条路比找配音更省事。
zh-CN-liaoning 语种下提供 Xiaobei(女声)、Yunbiao(男声)神经网络音色,单次可转 5000 字符,长文本走批量生成、单任务上限 10 万字。下表是辽宁话(东北官话)语音合成的参数口径,界面上的可选项与下表一致。
| 指标 | 数据 |
|---|---|
| 语言名称 | 中文 (辽宁话) · Chinese (Northeastern Mandarin, Simplified) |
| 语言代码 | zh-CN-liaoning |
| 可用音色 | Xiaobei(女声)、Yunbiao(男声),共 2 个音色,当前均为 Preview(预览)状态 |
| 发音特点 | 东北官话发音,语调起伏大、语速偏快;2 个 Preview 音色(晓北女声、云彪男声) |
| 页面界面 | 中文界面,语言与音色名称按原语言写法显示 |
| 单次转换上限 | 5000 字符(含空格与标点,超出自动截断) |
| 批量生成上限 | 单任务最多 10 万字,异步批处理,可多任务并行 |
| 参数调节 | 语速 0.5x-2x、音调 ±50%、音量 0-100%、静音时长、目标时长 |
| 文件导入 | TXT / DOCX 文本导入,SRT 字幕按时间轴配音 |
| 导出格式 | MP3 / WAV,无水印、无片头片尾宣传语音 |
| 底层引擎 | 微软 Azure 认知服务文本转语音 API(神经网络语音) |
| 使用门槛 | 免登录即可使用,无需绑定手机号;当日可用额度在页面顶部实时显示 |
| 中文(其他方言与地区变体) | wuu-CN、yue-CN、zh-CN、zh-CN-guangxi、zh-CN-henan、zh-CN-shaanxi、zh-CN-shandong、zh-CN-sichuan、zh-HK、zh-TW,共 11 个 |
同一段文字换成别的方言,听感差别很明显。要换方言或地区写法,在“语言”下拉里直接切,语音列表会同步刷新;也可以直接进对应的页面:
东北官话的辨识度很高:语调起伏大、句尾常上扬、语速偏快,词汇也自成一套(得劲儿、咋整、嘎哈)。这个语种提供两个音色:晓北(女声)和 云彪(男声),目前均为 Preview 预览状态。
Preview 音色可以正常生成音频,但长文本的稳定性、情感切换不如正式音色。建议正式项目先试听几句,必要时用普通话(zh-CN)音色生成一版做对照。单次最多 5000 字符,长稿走批量生成。
来,把这段字儿粘进去,挑个得劲儿的音色,点一下就成了。
界面为中文界面,输入框可直接粘贴东北口语写法;其他方言与普通话请在“语言”下拉里切换。
| 对比维度 | 浮云梦配音(本站口径) | TTSMaker | Edge 大声朗读 | ElevenLabs |
|---|---|---|---|---|
| 使用门槛 | 免登录,网页即用 | 需注册(以官网为准) | 浏览器内置,仅限 Edge 内使用 | 面向开发者与海外用户(以官网为准) |
| 辽宁话地区变体 | 11 个(zh-CN-liaoning / wuu-CN / yue-CN / zh-CN 等) | 以官网为准 | 跟随系统语音包,以官网为准 | 以英语音色为主,以官网为准 |
| 字数与批量 | 单次 5000 字符;批量单任务 10 万字 | 以官网为准 | 无批量与附加功能 | 以官网为准 |
| 多人对话 | 内置,每个角色可配不同音色 | 多角色功能受限 | 不支持 | 以官网为准 |
| 语音克隆 | 上传 5-30 秒样本即可,免费单次 500 字(会员 1000 字) | 以官网为准 | 不支持 | 以官网为准 |
| 字幕工具 | 音频转 SRT + 时间轴校准 | 以官网为准 | 无 | 以官网为准 |
| 导出水印 | 无水印、无片头片尾宣传语音 | 以官网为准 | 无 | 以官网为准 |
| 界面语言 | 中文界面,语言名显示原语言写法 | 以官网为准 | 跟随浏览器语言 | 英文为主 |
竞品一列只做定性描述,具体功能、音色数量与限制以各家官网为准;这里的数值口径均可在上方参数表与站内语言列表中核对。
辽宁话(东北官话)语音合成基于微软 Azure 认知服务文本转语音 API(Microsoft Azure Cognitive Services Text-to-Speech),Luna、Wayne 均为神经网络(Neural)音色,情感风格由所选风格参数控制。语音克隆与语音转换使用深度学习模型,与 TTS 引擎分开。整段音频在服务端生成,浏览器只负责播放与下载,本地不需要显卡算力。
两个:晓北(女声)和云彪(男声),都是 Preview 预览状态。方言语种的音色数量普遍比普通话少,普通话(zh-CN)有 54 个正式音色。
能生成音频、能下载,日常短视频够用。但 Preview 属于灰度阶段,长文本可能出现语调波动或情感不连贯,正式商业项目建议先试听评估再定稿。
适合,正好一男一女两个音色。用多人对话功能给两个角色分别指定晓北和云彪,一次就能生成整段对白。
都是方言音色,但发音体系不同:东北话语调起伏大、语速快,河南话语调直、开口大,四川话调值差异更明显。做哪个地区的内容就选哪个语种页,别混用。
单次 5000 字符上限,超出自动截断;长稿用批量生成,单任务最多 10 万字,异步执行,提交后可关页面。
下载 MP3 无水印、无片头片尾宣传语音;商用场景的使用与授权细节以站内说明为准。
多用本地词:得劲儿、咋整、嘎哈、贼、整、唠。句尾加“儿”化音和语气词(呗、啊)会更像真人,但别堆太多,听感会假。
晓北女声适合带货口播和搞笑短剧;云彪男声适合解说、旁白和段子里的“讲事儿”角色。双人内容两个一起用效果最好。