将你喜爱的书籍转换为用你的声音朗读的有声书
即使你不在身边,也能给孩子留下讲故事的陪伴
为父母、有声书爱好者和无障碍倡导者打造。现已登陆 Android,iOS 和桌面版即将推出。
他们会一直记得的睡前故事
又要加班了?
录制一次故事,孩子每晚都能听到你的声音。
出差在外?
你的声音陪着他们,跨越时区也一样。
想留住奶奶的声音?
用一小段音频样本克隆任何声音。让你所爱的声音,永远留在他们喜欢的故事里。
Audior 安卓版:装进口袋的朗读工作室
录下自己的朗读,在波形上直接修正口误,并用本机 AI 完成可选的降噪清理和私密转写。Google Play 免费下载;音频始终留在你的手机里。
看看 Android 应用的实际表现
录音时实时提示
电平表会提示你声音过大或过小,让每一条录音都能用。
像录音棚一样剪辑
章节、多次录音、剪切和停顿检测都直接在波形上完成。任何一句话都能原位重录。
手机本地的神经网络降噪
Enhance 用经典音频处理来均衡响度、控制峰值;可选的神经网络降噪完全在本机运行,并提供 A/B 对比试听。
无需云端的文字稿
设备端语音转文字支持 25 种语言,帮你快速定位录音中的任意位置,完全离线。
家人的声音
让所爱的人读几句短句,就能留存他们的声音,用在讲给孩子的故事里。
可直接使用的有声书导出
导出带章节的 M4B 有声书,或把音频分享到任何地方,适配所有有声书播放器。
Audior 桌面版:把书页照片变成有声书
拍下你拥有的书的书页,让 AI 提取文字,再生成一整本用你的声音或克隆的家人声音朗读的有声书。正在为 Windows、macOS 和 Linux 开发。
以下内容介绍的是开发中的桌面应用。关注 GitHub 发布页,第一时间获知上线消息。
Audior 桌面版 · 即将推出
桌面应用一览
Audior 桌面版 · 即将推出
使用方法
拍下书页照片
用手机相机或任何扫描应用即可
AI 提取并整理文字
高级 OCR 可识别 29 种语言的文字
用你的声音生成有声书
自然的文字转语音,也能克隆任何声音
从书架到有声书,只要 15 分钟
| Step | Tool | Time |
|---|---|---|
| 扫描书页 | Google Drive 应用(批量扫描) | 5 分钟 |
| 把 PDF 导入 Audior | 拖放 | 10 秒 |
| 运行 OCR | 一键操作 | 2-3 分钟 |
| 快速编辑(可选) | 内置编辑器 | 2 分钟 |
| 生成音频 | 选择声音,点击生成 | 5 分钟 |
推荐的扫描应用(免费)
- Google Drive- 内置文档扫描,支持批量模式,自动增强画质
- Microsoft Lens- 边缘检测出色,可导出为 PDF
- Apple Notes- 原生应用,速度快,通过 iCloud 同步
实用技巧
- 用书架固定书本,拍摄角度更一致
- 自然光下效果最好
- Google Drive 批量模式:点相机,扫描,继续加页,最后保存为 PDF
Audior 桌面版 · 即将推出
选择适合你的方式,从完全免费到录音棚品质
每个步骤我们都支持多个 AI 提供商,可以按预算自由搭配。
在你自己的电脑上
完全免费,完全私密
- 文字提取:免费
- 音频生成:免费
- 声音克隆:免费
在云端
快速、便宜,任何电脑都能用
- 文字提取:每页几分之一美分
- 音频生成:一本 30 分钟的有声书约 $1
- 声音克隆:免费额度每月可做 1 到 5 本书
自由搭配
任意组合你想用的提供商
- 本地免费提取文字,搭配便宜的云端音频
- 云端提取文字,搭配免费的本地声音
- 日常用本地,特殊项目用云端克隆
你可以在自己的电脑上完全免费使用,也可以用实惠的云端 AI,或者把两者结合起来。我们把 Audior 做成每种组合都能跑通,各自的取舍也事先讲清楚,而不是藏着掖着。
Audior 桌面版 · 即将推出
简单公平的价格
桌面应用为一次性买断授权。Android 应用免费。
此定价将在桌面应用发布后生效。目前暂不开放购买。
免费试用
$0/ forever
- 1 个项目,最多 50 页
- 包含所有功能
- 无需账户
完整许可证
$4.90/ 一次性付款
- 项目数量不限
- 所有功能
- 优先支持
你的故事,始终属于你
- 所有 AI 都在你的设备上运行,不会上传到云端
- 你的 API 密钥永远不会离开你的电脑
- 无需账户,不做跟踪,也不收集数据
- 核心开源,你可以在 GitHub 上自行审查
下载 Audior
现已登陆 Android。适用于 Windows、macOS 和 Linux 的桌面版正在开发中。
版本说明 — vrecorder-v0.1.2(2026年8月15日)
## Audior Recorder 0.1.2 **Deployed to Play Store** (internal track) after manual approval.
常见问题
Android 应用
Android 应用免费吗?
免费。Google Play 上的 Audior 应用完全免费,无需账号,也没有广告。
我的音频会离开手机吗?
不会。录音、清理、母带处理和转写全部在你的设备上完成。除非你主动分享,录音始终留在你手中。
只用手机能做出真正的有声书吗?
可以。逐章录音,在波形上修正口误,跑一遍 Enhance,再导出带章节的 M4B 文件,任何有声书播放器都能播放。
转写支持哪些语言?
可选的设备端模型可自动识别 25 种欧洲语言(包括波兰语),并完全离线运行。文字稿用于辅助导航,并非逐字记录。
iPhone 版什么时候推出?
正在开发中。Windows、macOS 和 Linux 桌面版也在路上;关注我们的 GitHub 获取发布消息。
我的手机上运行的是什么 AI?
两个神经网络模型完全在本机运行:DPDFNet 负责可选的降噪清理,Parakeet-TDT(通过 sherpa-onnx)负责转写。响度和峰值控制使用经典音频处理,不是 AI。降噪和转写都不会上传任何内容。
桌面应用(即将推出)
如何扫描一本实体书?
用手机上任意一款文档扫描应用即可。我们推荐 Google Drive(Android/iOS),它有批量扫描模式;也可以用 Microsoft Lens,边缘检测很好。把每一页拍下来,然后导出为 PDF 就行。
把自己拥有的书做成有声书合法吗?
把你合法拥有的书做成有声书供自己使用,通常是允许的。但分发或出售这些有声书,一般需要版权持有人的许可。Audior 是为个人和家庭使用而设计的。
支持哪些语言?
搭配 Ollama 和 Qwen 2.5 VL 时,Audior 的 OCR 支持 29 种语言。文字转语音的语言支持则因提供商而异:ElevenLabs 支持 29 种语言,而 Chatterbox 等本地方案目前主要支持英语。
可以完全离线使用吗?
可以!用 Ollama 做本地 OCR,用 Chatterbox 或 Fish Speech 做本地文字转语音。首次设置完成后,所有处理都在你的电脑上进行,不需要联网。
支持哪些 AI 提供商?
OCR 方面:Gemini、Ollama(本地)、OpenRouter、OpenAI。TTS 方面:ElevenLabs、Chatterbox(本地)、Fish Speech(本地)、Resemble AI。你可以根据需要自由搭配。
一本 20 页的儿童书要花多长时间?
总共大约 10-15 分钟:用 Google Drive 扫描约 5 分钟,OCR 处理约 2-3 分钟,音频生成约 5 分钟。具体时间取决于你的硬件和所选的提供商。
本地文字转语音需要 GPU 吗?
运行 Chatterbox 和 Fish Speech 强烈建议使用至少 6 GB 显存的 GPU(例如 NVIDIA RTX 3060)。仅用 CPU 也能跑,但会慢很多。如果没有独立显卡,就用 ElevenLabs,它在云端运行,任何电脑都能用。
哪些 GPU 适合 Audior?
任何带 6 GB 以上显存、支持 CUDA 的 NVIDIA GPU 都可以。性价比之选:RTX 3060 12 GB、RTX 4060 8 GB。搭载 Apple Silicon 的 Mac(M1/M2/M3/M4)也可以,通过 MPS 加速。AMD GPU 目前还不支持本地 TTS。
用云端 TTS 做一整本有声书要多少钱?
这取决于提供商和书籍长度。一本典型的小说(约 40 万字符),按 ElevenLabs 标准费率大约 $48。像儿童书这样较短的书(1 万到 3 万字符)约 $1-4。本地 TTS(Chatterbox、Fish Speech)设置好之后完全免费。











