功能总览
这个软件把「配音一条龙」放在了一个界面里:写文案 → 选音色 → 调参数 → 配乐 → 导出成品。 下面按模块列清每一项能力,以及它在哪个端上可用。
网页版 / 微信 · 抖音 · 快手 · 支付宝小程序:文字转语音、语音转文字在线可用; 声音克隆仅提供功能说明与效果演示,购买 PC 版后可用完整克隆。
文字转语音
软件的主体功能。选音色、写文案、调参数、出成品。
322 个免费音色
含中文、方言、英日韩等,中文音色显示中文名并按语言分组,同语言的音色排在一起。
长文自动分段
按标点切成合适的段,逐段合成再接起来,避免长文本被模型截断。段与段之间的停顿时长可调。
发音参数可调
语速(−50 ~ +50)、音调、音量(±6 dB)三项独立调节。克隆模式下界面会显示实际生效的数值。
背景音乐
16 首原创免版税配乐,支持试听、截取片段、延迟进入、循环铺满、结尾淡出。
输出格式
mp3 / wav / 其他常见格式,可在音频工具里互相转换。
对白与批量
给做有声书、短剧、课程的人准备的两条批量通道。
对白模式
按「角色:台词」写剧本,中英文冒号都认;也支持「角色(提示):台词」和「【旁白】…」。没有角色标记的行自动归为旁白。
角色记忆
某个角色配过一次音色,下次写到同名角色会自动套用上次的选择。
说话人切换留白
角色交替处自动插入停顿,听感像真的对话,不是连读。
批量合成
一行一条文案,批量出音频。文件名按内容自动命名,重名自动加序号,不会互相覆盖。
AI 自动分角色
把剧本交给 AI 助手,它会读一遍内容并按情境给每个角色挑选合适的音色。
声音克隆(PC 版专属)
网页版与小程序版只提供介绍和效果演示,实际克隆需在 Windows 桌面版使用。
6~10 秒干音即可
不需要念完整篇、不需要训练。软件会自动从长音频里裁出最饱满的 6~10 秒,边界落在停顿中点,避免把字切一半。
自动转写参考文本
导入干音后自动识别出内容填进参考文本框,识别结果是简体中文,允许手动修正。
本地推理
克隆服务运行在你自己的电脑上,声音文件不出本机。适合保密单位和弱网、断网现场。
7 档语气预设
跟随干音 / 沉稳舒缓 / 明快轻快 / 郑重有力 / 温柔亲切 / 兴奋激动 / 低落平缓,在语速和音高上做确定性微调。
安全阀
选「跟随干音(不干预)」且音调归零时,服务端不做任何后处理,输出与原始合成逐比特一致。
语音转文字
把录音变成可编辑的文稿,支持字幕导出。
云端识别
支持 OpenAI Whisper 与 Azure 两条通道,需要自备密钥。
本地离线识别
随包内置识别模型,音频不出本机。仅桌面完整版提供。
导出多格式
一次导出 txt / srt 字幕 / md / json 四个文件,共用同一个文件名主体,不会互相拆散。
识别结果简体化
无论模型输出简体还是繁体,界面上一律转成简体中文。
AI 助手
需要你自己的大模型密钥,软件不额外收费。
生成文案
给一句需求(例如「30 秒新品带货口播」)直接生成配音文案,可选风格与目标字数。
润色文案
把写好的文案交给 AI 改一版,保持原意、调整语气。
配音导演
读剧本自动给每个角色挑音色,漏掉的角色用本地规则补上,不会漏配。
授权与额度
桌面端、网页端、小程序端同一套卡密,可以互相替换。
离线卡密
不联网也能验证,适合断网环境。
在线卡密
需要联网验证,可以绑定机器码,换机联系客服解绑。
多端额度
网页版与小程序版按字符数 / 分钟数计费,注册送体验额度,卡密兑换可提升额度。