
Wispr Flow
FREEMIUM音声をきれいなテキストに

Fish Audio
Fish Audioは、リアルなテキスト読み上げ、高速な声のクローン作成、正確な音声認識を提供するAI音声プラットフォームです。
Fish Audioとは
Fish Audioは、リアルなテキスト読み上げ、高速な声のクローン作成、正確な文字起こしのためのAI音声プラットフォームです。クリエイター、開発者、チームはこれを使って、テキストを自然な音声に変換したり、短い録音から声をクローンしたり、音声を読み取り可能なテキストに変換したりできます。
このプラットフォームは、自社のS2およびS2.1 Proモデルを搭載しており、数十言語にわたる数百万時間の音声でトレーニングされています。これにより、自然なペース、トーン、感情を備えた音声を生成でき、ささやき、笑い、ため息などの効果音のためのインラインタグもサポートしています。
テキスト読み上げに加えて、Fish Audioには、ボイスチェンジャー、効果音生成、音声分離ツール、音声翻訳、および長いプロジェクトに音声を組み合わせるためのStory Studioが含まれています。200万以上のコミュニティボイスのライブラリも検索可能で、すぐに使用できます。
Fish Audioは、日常使用のためのWebアプリ、アプリや音声エージェントを構築する開発者向けのAPI、研究や本番環境で自己ホスト可能なオープンソースモデルとして利用できます。
Fish Audioの機能
感情タグ付きのリアルなテキスト読み上げ
短いサンプルからの高速な声のクローン作成
200万以上の検索可能なボイスライブラリ
話者検出付きの音声認識
録音されたオーディオ用のボイスチェンジャー
効果音生成
ステムへの音声分離
音声翻訳と吹き替えのサポート
長いオーディオプロジェクト用のStory Studio
従量課金制の開発者向けAPI
Fish Audioの料金
Free
- 毎月8,000クレジット
- 最大7分の生成
- 1回の生成につき最大500文字
- 3つの公開ボイススロット
- 標準の生成速度
Plus
- 毎月250,000クレジット
- 最大200分の生成
- 1回の生成につき最大15,000文字
- 無制限の公開と10のプライベートボイススロット
- 1つのプロフェッショナルボイススロット
- 強化された声のクローン作成と商用利用
Pro
- 毎月2,000,000クレジット
- 最大1,620分の生成
- 3つのチームシートを含む
- 1回の生成につき最大30,000文字
- 無制限のボイススロット、5つのプロフェッショナルスロット
- Plusのすべて
Max
- 毎月25,000,000クレジット
- 最大6,250分の生成
- 10のチームシートを含む
- 15のプロフェッショナルボイススロット
- Proのすべて
Enterprise
- 従量課金制のボリューム価格
- 組織レベルのコントロール
- データ保持ゼロ
- オンプレミス展開
- SOC2コンプライアンス
- カスタムSSO(近日公開)
Fish Audioの使用例
Fish Audioについてのよくある質問
について、ユーザーの声を見る Fish Audio
0 レビュー
まだレビューがありません
最初のレビュアーになる Fish Audio







