clonetts安卓版软件是一款可以运行在安卓系统上的文字转语音的阅读引擎软件,本软件可以离线来使用语音,更好的去为你阅读书籍和长文本,轻松就能来听书。本软件支持音色克隆,可以轻松的来适用于小说、文章等长文本朗读,完全不需要网络连接就能来自由的管理。支持电池优化管理,多任务加锁,轻松的放置被系统清理,更好的来加载不同的语音模型。
配置
在开始一切操作前,为了防止手机在您听书息屏时中断朗读(被系统强杀后台),请务必在应用程序底部的 “帮助说明” 页面,参考卡片上的提示:
前往手机系统设置,将本应用的电池优化策略改为 “无限制” 或 “允许完全后台行为”。
在手机的多任务(最近任务)界面,下拉本应用的卡片或点击小锁图标,防止被一键清理掉(不同品牌操作方式略有不同,部分手机可能没有此功能)。
初次体验
首次启动:第一次打开 App 时,系统会在后台解压模型数据,请耐心等待几秒钟。
添加专属音色
在最下方的 “音色管理” 页面中,点击右上角的 “⋮ (更多选项)”,选择 “添加音色”。
提供参考声音:使用 录音室采音 进行高保真采音,或通过 外部选取 上传本地音频(时长要求 1~3 秒,单句清晰的无背景音人声)。
填写发音参考文本:一字不差地填写刚刚录制或上传声音里的纯文本。(文字必须完全匹配,否则发出的声音质量会极度不可视)。
算力精度 (num_steps):推荐保留默认的 2 步以获得最佳速度体验。如果您追求更高音质,可改为 4,但合成速度会相应变慢。最大值为 8,超过 8 不会有进一步的音质提升。
点击底部 保存并启用 即可。之后在"音色管理"列表点击该卡片即可激活它。
音色管理
选择与激活音色:点击音色卡片即可选中为当前默认音色。
自定义音色代号 (Alias):支持为音色设定专属的名称与唯一代号 (Alias)。该代号是开源阅读软件(如 Legado)通过 HTTP API 进行“分角色听书”精准调用的核心键值。
编辑属性:点击卡片右侧的 ⋮ 菜单可随时修改名字、代号及发音参考文本。系统会自动执行代号重名校验防护。
备份与迁移:支持通过 ⋮ 菜单进行音色的批量删除与 .zip 格式打包导出。导入时可智能选择“追加”或“覆盖”模式。
高级进阶:发音纠错与性能监控
在底部 “发音规则” 与 “高级设置” 栏中,您可以对合成体验进行底层的专业级干预:
添加发音正则替换:在 "发音规则" 界面,您可以针对特定的错误多音字添加文本或正则规则替换(例如遇到特定人名强制拼音纠错)。
高阶断句正则配置:这个选项决定了引擎切分小说长句时的停顿界限。配置紊乱时可点击“恢复系统默认”一键重置。
实时 RTF 监控瀑布台:在高级设置开启详细日志后,前端界面直通底层协程,您可直观捕捉并在页面底端查看每一句生成的 RTF(实时推理速率)和算力耗时,彻底终结盲盒合成!
接管朗读
模式 1:接管系统 TTS(兼容性最广) 在手机的"设置"中,搜索 "TTS 设置"(或文字转语音输出),将默认引擎改为 CloneTTS。随后在"开源阅读"等应用中点击"朗读"即可生效,支持无级调速体验。
模式 2:HTTP API 模式(适合高级用户) 切换到 "高级设置" 界面并打开首行的 "本地 HTTP API 服务"。将显示的接口地址填入外部阅读软件(如 Legado)的网络发音设置中即可。
支持两种请求方式:
GET 请求:http://127.0.0.1:8080/api/tts?text={{speakText}}&voice=音色名
POST 请求:支持 application/x-www-form-urlencoded 和 application/json 两种格式,可发送超长文本
voice 参数支持音色名称或音色代号 (Alias) 匹配。
1、支持多种不同的语言,可以满足你的收听需求。
2、不需要联网就能生成语音,内置系统特别的优化,轻松的来体验。
3、可以轻松接管系统tts语音系统,支持多种朗读的软件,满足你的听书需求。
1、可以自己管理音色,轻松的来批量管理自己的音色。
2、内置了多种不同的语音模型,可以让你的语言多种声线选择。
3、完全离线运行,可以让你轻松的去听书,满足你的需求。
1、修正特定字词发音
进入“发音规则”界面,点击右上角“⋮”选择“新添规则”,支持两种方式:纯文本替换:直接输入错误发音的字词及正确读音(如将“重”替换为“chóng”)。正则表达式替换:针对批量错误(如多音字),通过正则规则全局修正,提升效率。
2、批量处理多音字错音
在“高级设置”中打开“系统级纠错大词库”,手动导入第三方纠错词典(如system_dict.json),软件将自动应用强正则补充,解决大量多音字发音错误问题。
3、调整长句停顿与语调
通过“高阶断句正则配置”自定义逗号、句号的停顿时长,优化朗读节奏感。若配置混乱,可点击“恢复系统默认”一键重置。
4、精细优化音色自然度
在音色编辑弹窗中修改“推理步数(num_steps)”,调整算力精度以平衡发音自然度与生成速度,数值越高音色越细腻,但耗时略增。
5、验证与保存设置
修改后可通过内置朗读功能实时试听效果,确认无误后保存。所有规则与参数均持久化存储,避免丢失。
1、对接外部朗读失败怎么办
-接管系统TTS模式失效时,进入手机“TTS设置”,确认默认引擎已切换为CloneTTS,重启第三方阅读APP后生效
-HTTPAPI模式无效时,检查是否已开启本地HTTPAPI服务,确认接口地址输入无误,同时关闭手机防火墙,避免拦截本地网络请求
2、调用多音色时,无法按角色分配发音怎么办
-检查是否通过API接口传入正确的voice参数,确保发音人ID为正确的UUID格式
-在软件音色管理库中,确认已长按多选需要交替发音的音色,未选中会导致无法交替朗读
-重启第三方调用软件,重新建立与CloneTTS的连接,确保多音色调用指令正常传递
v0.4.0版本
修复了后台保存配置时可能因进程被杀导致参数丢失的问题。
修复了“追加合并”导入后,因读取旧缓存导致界面没有及时显示新音色的问题。
分发网络源配置给外部软件时,增加了哈希后缀机制,修复了向第三方软件批量导入时由于 ID 冲突导致只导入成功一个的问题。
8.8
500+人评价
请为应用评分: