文字转语音
输入文本 → 选择语言和音色 → 点击生成,三步完成配音。支持语速、音调、音量参数调节,部分语音支持情感风格(如温柔、愤怒、悲伤)和角色扮演效果。HD 语音模型可自动识别文本情绪,实时调整语调。支持上传 TXT/DOCX 文件和 SRT 字幕文件配音,支持插入停顿和背景音乐。
Texto a voz en español de España · 22 voces neuronales
卡斯蒂利亚西语配音,音色最全的是这一页:22 个正式可用的西班牙本土西语音色,Ximena Dragon HD Latest(女声)、Tristan Dragon HD Latest(男声)、Elvira(女声)等 22 个都在其中,涵盖女声、男声与 HD 系列。粘贴西语文本点生成,MP3 直接下载,不用录音、不用装软件、不用注册。
西班牙本土市场的广告旁白、电视与流媒体配音、企业培训、电话客服语音、有声内容都能用。语速 0.5x-2x、音调 ±50% 可调,长稿一次 10 万字走批量生成,输出无水印 MP3。
Español de España con 22 voces neuronales: Ximena Dragon HD Latest / Tristan Dragon HD Latest / Elvira and 19 more entre ellas. Pega tu texto, elige una voz y descarga un MP3 sin marca de agua. Sin cuenta, sin grabar, sin software.
把下面这句西语粘进输入框,用 Ximena Dragon HD Latest(女声)、Tristan Dragon HD Latest(男声)、Elvira(女声)等 22 个各试一遍,卡斯蒂利亚西语的 th 音(c/z)和拉美西语差别很明显:
Buenos días, gracias por acompañarnos. Empezamos con la explicación de hoy.
推荐音色:Ximena Dragon HD Latest(女声)/ Tristan Dragon HD Latest(男声)等
输入文本 → 选择语言和音色 → 点击生成,三步完成配音。支持语速、音调、音量参数调节,部分语音支持情感风格(如温柔、愤怒、悲伤)和角色扮演效果。HD 语音模型可自动识别文本情绪,实时调整语调。支持上传 TXT/DOCX 文件和 SRT 字幕文件配音,支持插入停顿和背景音乐。
按段落分配角色,每个角色配一个音色,系统自动切换生成完整对话音频。做西班牙语广播剧、双人西班牙语访谈、教学对话演练都合适。
每个任务支持最多 10 万字的大规模文本转换,系统采用异步批处理机制,不会实时返回音频。可一次提交多个任务,后台同步执行生成,提交后可关闭页面,稍后返回查看任务状态并下载已完成的音频。西班牙语有声书、整套听力素材走这个入口最省事。
上传一段已有音频,把它换成系统里的目标音色,原来的语速、停顿和语气保留下来。已经录好的西班牙语口播想换音色、或者想给同一段西班牙语配多个版本,用这个不用重新录。
生成配音音频的同时输出对应字幕文件,可直接导入剪映、PR 等剪辑软件。西班牙语视频想上西班牙语字幕或做双语字幕,在这里一次拿到音频和 SRT。
独立的时间轴工具:调整偏移、合并相邻字幕、拆分超长字幕、SRT/ASS/VTT 互转。字幕和音频差半秒这类问题,在这里改比重新生成快。
上传 5-30 秒清晰人声样本(MP3/WAV),系统学习这段声音的特征后用它朗读你写的西班牙语稿,免费单次 500 字(会员 1000 字)。品牌出镜人不想每次录音,或者想让固定声音贯穿一系列视频,可以用它。
用文字描述想要的音色(比如“成熟男声、语速偏慢、适合企业宣传”),系统据此生成专属音色;也能基于上传样本做克隆。系统自带音色都不满意时,这条路比找配音更省事。
es-ES 语种下提供 Ximena Dragon HD Latest(女声)、Tristan Dragon HD Latest(男声)、Elvira(女声)、Alvaro(男声)等,共 22 个神经网络音色,单次可转 5000 字符,长文本走批量生成、单任务上限 10 万字。下表是西班牙语(西班牙)语音合成的参数口径,界面上的可选项与下表一致。
| 指标 | 数据 |
|---|---|
| 语言名称 | 西班牙语 (西班牙) · Spanish (Spain) |
| 语言代码 | es-ES |
| 可用音色 | Ximena Dragon HD Latest(女声)、Tristan Dragon HD Latest(男声)、Elvira(女声)、Alvaro(男声)等,共 22 个神经网络音色;另有 2 个 Preview 音色 |
| 情感风格 | 1 个音色支持风格选择(如温柔、欢快、悲伤、新闻播报等) |
| 发音特点 | 卡斯蒂利亚西语(西班牙本土)发音,c/z 读 th 音、语调起伏明显;22 个 GA 音色 |
| 页面界面 | 中文界面,语言与音色名称按原语言写法显示 |
| 单次转换上限 | 5000 字符(含空格与标点,超出自动截断) |
| 批量生成上限 | 单任务最多 10 万字,异步批处理,可多任务并行 |
| 参数调节 | 语速 0.5x-2x、音调 ±50%、音量 0-100%、静音时长、目标时长 |
| 文件导入 | TXT / DOCX 文本导入,SRT 字幕按时间轴配音 |
| 导出格式 | MP3 / WAV,无水印、无片头片尾宣传语音 |
| 底层引擎 | 微软 Azure 认知服务文本转语音 API(神经网络语音) |
| 使用门槛 | 免登录即可使用,无需绑定手机号;当日可用额度在页面顶部实时显示 |
| 其他西班牙语变体 | es-AR、es-BO、es-CL、es-CO、es-CR、es-CU、es-DO、es-EC、es-GQ、es-GT、es-HN、es-MX、es-NI、es-PA、es-PE、es-PR、es-PY、es-SV、es-US、es-UY、es-VE,共 22 个 |
同一段文案换成其他地区口音,听感差别很明显。要换地区,在“语言”下拉里直接切,语音列表会同步刷新;也可以直接进对应的变体页:
El español de España se distingue rápido: la c y la z se pronuncian como th, el vosotros sigue vivo y la entonación sube más que en Latinoamérica. Aquí tienes 22 voces neuronales en castellano, entre ellas Ximena Dragon HD Latest / Tristan Dragon HD Latest / Elvira and 19 more.
Pega hasta 5.000 caracteres y descarga un MP3 sin marca de agua; ajusta la velocidad de 0,5x a 2x, el tono ±50%, el volumen y las pausas. Los guiones largos van por generación por lotes, con hasta 100.000 caracteres por tarea y ejecución en segundo plano.
Buenos días, gracias por acompañarnos. Empezamos con la explicación de hoy.
Esta sección está escrita para visitantes hispanohablantes. La interfaz está en chino; la caja de texto acepta español, chino y más de 140 idiomas.
| 对比维度 | 浮云梦配音(本站口径) | TTSMaker | Edge 大声朗读 | ElevenLabs |
|---|---|---|---|---|
| 使用门槛 | 免登录,网页即用 | 需注册(以官网为准) | 浏览器内置,仅限 Edge 内使用 | 面向开发者与海外用户(以官网为准) |
| 西班牙语地区变体 | 22 个(es-ES / es-AR / es-BO / es-CL 等) | 以官网为准 | 跟随系统语音包,以官网为准 | 以英语音色为主,以官网为准 |
| 字数与批量 | 单次 5000 字符;批量单任务 10 万字 | 以官网为准 | 无批量与附加功能 | 以官网为准 |
| 多人对话 | 内置,每个角色可配不同音色 | 多角色功能受限 | 不支持 | 以官网为准 |
| 语音克隆 | 上传 5-30 秒样本即可,免费单次 500 字(会员 1000 字) | 以官网为准 | 不支持 | 以官网为准 |
| 字幕工具 | 音频转 SRT + 时间轴校准 | 以官网为准 | 无 | 以官网为准 |
| 导出水印 | 无水印、无片头片尾宣传语音 | 以官网为准 | 无 | 以官网为准 |
| 界面语言 | 中文界面,语言名显示原语言写法 | 以官网为准 | 跟随浏览器语言 | 英文为主 |
竞品一列只做定性描述,具体功能、音色数量与限制以各家官网为准;这里的数值口径均可在上方参数表与站内语言列表中核对。
西班牙语(西班牙)语音合成基于微软 Azure 认知服务文本转语音 API(Microsoft Azure Cognitive Services Text-to-Speech),Luna、Wayne 均为神经网络(Neural)音色,情感风格由所选风格参数控制。语音克隆与语音转换使用深度学习模型,与 TTS 引擎分开。整段音频在服务端生成,浏览器只负责播放与下载,本地不需要显卡算力。
区别明显:西班牙本土把 c 和 z 读成 th 音(类似英语 think),拉美读成 s;另外西班牙用 vosotros,拉美用 ustedes。做西班牙市场的广告和客服语音要用 es-ES,用拉美音色会被听出是外来内容。
22 个正式可用音色,加上预览音色共 24 个,是西语各变体里最多的。含 Ximena、Tristan 的 Dragon HD 版本,以及 Elvira、Alvaro 等经典音色;拉美变体可以切到 es-MX、es-AR 等页面。
单次最多 5000 字符(含空格和标点),超出自动截断。长稿(有声书、整套课程)用批量生成,单任务最多 10 万字,异步执行,提交后可关页面。
可以。提示音建议 0.95x-1x 语速,句间用静音时长参数留 500ms-1s;多条提示可以一次性提交批量任务排队生成,不用一条条等。
会。ñ、á、é、í、ó、ú 直接粘贴就行,音色按西语规则读;重音符号漏写会把重音放错位置(比如 inglés 和 ingles),建议保留原文写法。
下载 MP3 或 WAV,无水印、无片头片尾宣传语音,可直接用于剪辑。商用场景的使用与授权细节以站内说明为准。
Sí. Las 22 voces de esta página usan la pronunciación castellana, con la c y la z como th y una entonación más marcada que las variantes latinoamericanas.
Sí. Hasta 5.000 caracteres por petición sin cuenta; para guiones más largos, el modo por lotes acepta hasta 100.000 caracteres por tarea y se ejecuta en segundo plano.