
AssemblyAI
音声テキスト変換とVoice AI API
AssemblyAIは、開発者向けに高精度の音声テキスト変換、リアルタイム文字起こし、ボイスエージェントAPIを提供するVoice AIプラットフォームです。
AssemblyAIとは
AssemblyAIは、通話、会議、ポッドキャスト、ボイスエージェントからの音声を、シンプルな開発者向けAPIを使用して正確なテキストに変換するVoice AIプラットフォームです。録音済みの音声ファイルを処理したり、ライブの会話をリアルタイムでキャプチャしたりできる、録音済みおよびリアルタイムの文字起こしの両方を提供します。
主力のUniversal-3.5 Proモデルは、18言語で高い精度を実現し、複数の話者を処理し、医療用語や技術用語を理解します。単なる文字起こしに加えて、要約、感情分析、トピック抽出、翻訳などの理解機能をプラットフォームに追加します。
ボイスエージェントを構築するチーム向けに、AssemblyAIは音声テキスト変換、チューニング済み言語モデル、テキスト音声合成を1つのVoice Agent APIにまとめ、別々のツールを組み合わせる必要をなくします。
料金は従量課金制で、処理された音声1時間あたりに基づいて請求されます。大規模なチーム向けに、より高いボリュームや追加サポートを必要とする場合は、カスタムプランも利用できます。
AssemblyAIの機能
録音済みおよびリアルタイムの音声テキスト変換
短いクリップ用の単一呼び出しSync API
話者分離とラベル付け
最大99言語のサポート
要約、感情分析、トピック検出
翻訳とエンティティ検出
PII編集とコンテンツモデレーション
エンドツーエンドのVoice Agent API
医療用音声向け医療モード
PythonおよびJavaScript SDK
AssemblyAIの料金
Pre-recorded Speech-to-Text
- Universal-2モデル: 1時間あたり0.15ドルから
- Universal-3.5 Proモデル: 1時間あたり0.21ドルから
- 話者分離アドオン
- キータームプロンプティングと医療モードが利用可能
Realtime Speech-to-Text
- Universal-Streaming: 1時間あたり0.15ドルから
- Universal-3.5 Pro Realtime: 1時間あたり0.45ドルから
- 多言語ストリーミングサポート
- 低遅延のライブ文字起こし
Sync API
- 短い音声用の単一呼び出し文字起こし
- キータームプロンプティングを含む
- 会話コンテキストを含む
- 高速な応答時間
Voice Agent API
- 音声テキスト変換、LLM、TTSを含む
- 高度なターン検出と割り込み検出
- 録音と文字起こしを含む
- テレフォニーとSIPトランキングサポート
Enterprise
- カスタムレート制限と同時実行数
- ボリュームベースの割引
- Voice Agent顧客向けの専用サポート
- Voice Agent向けのカスタム音声
AssemblyAIについてのよくある質問
について、ユーザーの声を見る AssemblyAI
0 レビュー
まだレビューがありません
最初のレビュアーになる AssemblyAI








