
AssemblyAI
음성-텍스트 변환 및 Voice AI API
AssemblyAI는 개발자를 위한 정확한 음성-텍스트 변환, 실시간 전사, 음성 에이전트 API를 제공하는 Voice AI 플랫폼입니다.
AssemblyAI이란 무엇인가요?
AssemblyAI는 통화, 회의, 팟캐스트, 음성 에이전트의 음성을 간단한 개발자 API를 통해 정확한 텍스트로 변환하는 Voice AI 플랫폼입니다. 사전 녹음된 오디오 파일을 처리하거나 진행 중인 대화를 실시간으로 포착할 수 있도록 녹음 전사와 실시간 전사를 모두 제공합니다.
주력 모델인 Universal-3.5 Pro는 18개 언어에 걸쳐 높은 정확도를 제공하며, 여러 화자를 처리하고 의학 및 기술 용어를 이해합니다. 단순 전사를 넘어 요약, 감정, 주제, 번역과 같은 이해 기능도 제공합니다.
음성 에이전트를 구축하는 팀을 위해 AssemblyAI는 음성-텍스트 변환, 튜닝된 언어 모델, 텍스트-음성 변환을 하나의 Voice Agent API에 번들로 제공하여 별도의 도구를 연결할 필요를 없앱니다.
가격은 사용량 기반이며, 처리된 오디오 시간당 비용이 청구됩니다. 더 많은 볼륨이나 추가 지원이 필요한 대규모 팀을 위한 맞춤 플랜도 제공됩니다.
AssemblyAI의 기능
사전 녹음 및 실시간 음성-텍스트 변환
짧은 클립을 위한 단일 호출 Sync API
화자 분리 및 라벨링
최대 99개 언어 지원
요약, 감정, 주제 감지
번역 및 개체 감지
PII 편집 및 콘텐츠 중재
엔드투엔드 Voice Agent API
의료 오디오용 의료 모드
Python 및 JavaScript SDK
AssemblyAI 가격
Pre-recorded Speech-to-Text
- Universal-2 모델 시간당 $0.15부터
- Universal-3.5 Pro 모델 시간당 $0.21부터
- 화자 분리 추가 기능
- 키워드 프롬프트 및 의료 모드 사용 가능
Realtime Speech-to-Text
- Universal-Streaming 시간당 $0.15부터
- Universal-3.5 Pro Realtime 시간당 $0.45부터
- 다국어 스트리밍 지원
- 저지연 실시간 전사본
Sync API
- 짧은 오디오에 대한 단일 호출 전사본
- 키워드 프롬프트 포함
- 대화 컨텍스트 포함
- 빠른 응답 시간
Voice Agent API
- 음성-텍스트 변환, LLM, TTS 포함
- 고급 발화 및 중단 감지
- 녹음 및 전사본 포함
- 전화 및 SIP 트렁킹 지원
Enterprise
- 맞춤 요율 제한 및 동시성
- 볼륨 기반 할인
- Voice Agent 고객을 위한 전담 지원
- Voice Agent용 맞춤 음성
AssemblyAI에 대한 자주 묻는 질문
사용자들이 말하는 것을 확인하세요 AssemblyAI
0 리뷰
아직 리뷰가 없습니다
첫 번째 리뷰어가 되세요 AssemblyAI









