お気に入りの本をあなたの声で朗読したオーディオブックに
そばにいられない時でも、お子さんに物語の時間を贈りましょう
子育て中の方、オーディオブック好きの方、アクセシビリティを大切にする方のために。Androidで今すぐ利用でき、iOS版とデスクトップ版も準備中です。
一生忘れられない寝る前のお話
また残業ですか?
一度お話を録音すれば、お子さんは毎晩あなたの声を聞くことができます。
出張中ですか?
あなたの声はお子さんと一緒に旅をします。たとえ時差があっても届きます。
おばあちゃんの声を残したい?
短い音声サンプルからどんな声でもクローン。大切な人の声を、お気に入りの物語の中で生かし続けましょう。
Android版 Audior:ポケットに入るナレーションスタジオ
朗読を録音し、波形上でミスを修正。任意のノイズクリーンアップとプライベートな文字起こしには、デバイス上のAIを使えます。Google Playで無料。音声はスマホの中に残ります。
Androidアプリの実際の画面
ライブコーチング付き録音
レベルメーターが声の大きすぎ・小さすぎを知らせてくれるので、どのテイクも使えます。
スタジオ並みの編集
チャプター、テイク、カット、ポーズ検出を波形上で直接操作。どの文もその場で録り直せます。
スマホで動くニューラルノイズクリーンアップ
Enhanceはクラシックな音声処理で音量を均一にし、ピークを抑えます。任意のニューラルノイズクリーンアップは完全にデバイス上で動作し、A/Bプレビューも使えます。
クラウド不要の文字起こし
25言語対応のデバイス上音声認識で、録音の任意の箇所を完全オフラインで探せます。
家族の声
短い文をいくつか読むだけで大切な人の声を記録し、その人の物語のために残せます。
オーディオブック形式で書き出し
チャプター付きM4Bオーディオブックを書き出し、または音声をどこへでも共有。どのオーディオブックプレーヤーでも再生できます。
デスクトップ版 Audior:本の写真をオーディオブックに
お手持ちの本のページを撮影すると、AIがテキストを抽出し、あなたの声または複製した家族の声で朗読するオーディオブックを丸ごと生成します。Windows、macOS、Linux向けに開発中。
以下のセクションは開発中のデスクトップアプリについての説明です。リリースの瞬間を知るには GitHub のリリースをご覧ください。
デスクトップ版 Audior · 近日公開
デスクトップアプリの画面
デスクトップ版 Audior · 近日公開
使い方
本のページを撮影
スマートフォンのカメラまたはスキャンアプリを使用
AIがテキストを抽出・整形
高度なOCRが29言語のテキストを認識
あなたの声でオーディオブックを生成
自然な音声合成または任意の声をクローン
本棚からオーディオブックまで15分
| Step | Tool | Time |
|---|---|---|
| 本のページをスキャン | Google Driveアプリ(一括スキャン) | 5分 |
| PDFをAudiorにインポート | ドラッグ&ドロップ | 10秒 |
| OCRを実行 | ワンクリック | 2-3分 |
| クイック編集(オプション) | 内蔵エディタ | 2分 |
| 音声を生成 | 声を選択して生成をクリック | 5分 |
おすすめスキャンアプリ(無料)
- Google Drive- 内蔵ドキュメントスキャナー、一括モード、自動補正
- Microsoft Lens- 優れたエッジ検出、PDF出力
- Apple メモ- ネイティブ、高速、iCloud同期
プロのヒント
- ブックスタンドを使用して一定の角度を保つ
- 自然光が最適
- Google Driveの一括モード:カメラをタップ → スキャン → ページを追加し続ける → PDFとして保存
デスクトップ版 Audior · 近日公開
完全無料からスタジオ品質まで、あなたの道を選べます
各ステップで複数のAIプロバイダーをサポート。予算に合わせて組み合わせてください。
自分のデバイスで
完全無料、完全プライベート
- テキスト抽出:無料
- 音声生成:無料
- 声のクローン:無料
クラウドで
高速、安価、どのパソコンでも動作
- テキスト抽出:1ページあたり数分の1セント
- 音声生成:30分のオーディオブックで約1ドル
- 声のクローン:無料枠で月1〜5冊対応
組み合わせる
好きなプロバイダーを自由に組み合わせ
- 無料のローカルテキスト抽出 + 安価なクラウド音声
- クラウドテキスト抽出 + 無料のローカル音声
- 普段はローカル、特別なプロジェクトはクラウドクローン
自分のデバイスで完全無料にするも、手頃なクラウドAIを使うも、両方を組み合わせるも自由です。Audiorはどの組み合わせでも動作するように作られており、トレードオフを隠さず最初から明示します。
デスクトップ版 Audior · 近日公開
シンプルで公正な価格
デスクトップアプリは買い切りライセンス。Androidアプリは無料です。
この価格はデスクトップアプリのリリース時に適用されます。現時点では購入できません。
無料トライアル
$0/ forever
- 1プロジェクト、最大50ページ
- すべての機能を含む
- アカウント不要
フルライセンス
$4.90/ 一回払い
- プロジェクト数無制限
- すべての機能
- 優先サポート
あなたの物語はあなたのもの
- すべてのAIはあなたのデバイス上で動作するので、クラウドには何も送信されません
- APIキーはデバイスの外に出ることはありません
- アカウント不要、トラッキングなし、データ収集なし
- オープンソースコアなので、GitHubで自分で監査できます
Audiorをダウンロード
Android版は本日から利用可能。Windows・macOS・Linux向けデスクトップ版も準備中です。
リリースノート — vrecorder-v0.1.2(2026年8月15日)
## Audior Recorder 0.1.2 **Deployed to Play Store** (internal track) after manual approval.
よくある質問
Androidアプリ
Androidアプリは無料ですか?
はい。Google Play の Audior アプリは無料で、アカウント登録も広告もありません。
音声はスマホの外に送信されますか?
いいえ。録音、クリーンアップ、マスタリング、文字起こしはすべてデバイス上で実行されます。自分で共有しない限り、録音は手元に残ります。
スマホだけで本格的なオーディオブックを作れますか?
はい。チャプターごとに録音し、波形上でミスを修正、Enhanceを1回実行して、どのオーディオブックプレーヤーでも再生できるチャプター付きM4Bファイルを書き出せます。
文字起こしはどの言語に対応していますか?
オプションのデバイス上モデルはポーランド語を含む25のヨーロッパ言語を自動検出し、完全オフラインで動作します。文字起こしはナビゲーション用の補助であり、一字一句の記録ではありません。
iPhone版はいつ登場しますか?
現在開発中です。Windows、macOS、Linux向けのデスクトップアプリも準備中です。リリース情報は GitHub をご覧ください。
スマホではどんなAIが動きますか?
2つのニューラルモデルが完全にデバイス上で動作します。任意のノイズクリーンアップにはDPDFNet、文字起こしにはParakeet-TDT(sherpa-onnx経由)です。音量とピークの制御はクラシックな音声処理で、AIではありません。クリーンアップや文字起こしのために何もアップロードされません。
デスクトップアプリ(近日公開)
紙の本をスキャンするには?
スマートフォンのドキュメントスキャンアプリを使用してください。一括スキャンモードのあるGoogle Drive(Android/iOS)や、エッジ検出に優れたMicrosoft Lensをお勧めします。各ページを撮影し、PDFとしてエクスポートするだけです。
所有している本からオーディオブックを作成することは合法ですか?
合法的に所有している本から個人使用のためにオーディオブックを作成することは一般的に許可されています。ただし、これらのオーディオブックを配布または販売するには、通常、著作権者の許可が必要です。Audiorは個人および家庭での使用を目的として設計されています。
どの言語がサポートされていますか?
AudiorはOllamaとQwen 2.5 VLを使用する場合、29言語のOCRに対応しています。音声合成の言語サポートはプロバイダーによって異なります。ElevenLabsは29言語に対応し、Chatterboxなどのローカルオプションは現在英語を中心に対応しています。
完全にオフラインで使用できますか?
はい!ローカルOCRにはOllamaを、ローカル音声合成にはChatterboxまたはFish Speechを使用してください。初期設定後はインターネット接続なしですべての処理がデバイス上で行われます。
どのAIプロバイダーがサポートされていますか?
OCR:Gemini、Ollama(ローカル)、OpenRouter、OpenAI。TTS:ElevenLabs、Chatterbox(ローカル)、Fish Speech(ローカル)、Resemble AI。ニーズに応じて組み合わせることができます。
20ページの絵本はどのくらい時間がかかりますか?
合計約10〜15分:Google Driveでのスキャンに約5分、OCR処理に約2〜3分、音声生成に約5分。結果はハードウェアと選択したプロバイダーによって異なります。
ローカル音声合成にGPUは必要ですか?
ChatterboxやFish Speechには、VRAM 6 GB以上のGPU(例:NVIDIA RTX 3060)を強くお勧めします。CPUのみでも動作しますが、大幅に遅くなります。専用GPUがない場合は、ElevenLabsをご利用ください。クラウドで動作するため、どのパソコンでも使えます。
Audiorに適したGPUは?
VRAM 6 GB以上でCUDA対応のNVIDIA GPUであれば動作します。コスパの良い選択肢:RTX 3060 12 GB、RTX 4060 8 GB。Apple Silicon Mac(M1/M2/M3/M4)もMPSアクセラレーションで動作します。AMD GPUは現在ローカルTTSには対応していません。
クラウドTTSでオーディオブック1冊の費用は?
プロバイダーと本の長さによって異なります。一般的な小説(約40万文字)の場合、ElevenLabsの標準料金で約$48です。絵本など短い本(1万〜3万文字)は$1〜4程度です。ローカルTTS(Chatterbox、Fish Speech)はセットアップ後は完全無料です。











