
AssemblyAI
API de reconnaissance vocale et Voice AI
AssemblyAI est une plateforme de Voice AI offrant des API de reconnaissance vocale précises, de transcription en temps réel et d'agents vocaux pour les développeurs.
Qu'est-ce que AssemblyAI ?
AssemblyAI est une plateforme de Voice AI qui transforme la parole provenant d'appels, de réunions, de podcasts et d'agents vocaux en texte précis grâce à des API simples pour développeurs. Elle propose à la fois la transcription de fichiers pré-enregistrés et la transcription en temps réel, vous permettant de traiter des fichiers audio sauvegardés ou de capturer des conversations en direct.
Son modèle phare Universal-3.5 Pro offre une grande précision dans 18 langues, gère plusieurs locuteurs et comprend les termes médicaux et techniques. Au-delà de la simple transcription, la plateforme ajoute des fonctionnalités de compréhension comme les résumés, l'analyse de sentiment, les sujets et la traduction.
Pour les équipes qui créent des agents vocaux, AssemblyAI regroupe la reconnaissance vocale, un modèle de langage ajusté et la synthèse vocale dans une seule API Voice Agent API, éliminant ainsi le besoin d'assembler des outils séparés.
La tarification est basée sur l'utilisation, facturée à l'heure d'audio traitée, avec des plans personnalisés disponibles pour les grandes équipes ayant besoin de volumes plus élevés ou d'un support supplémentaire.
Fonctionnalités de AssemblyAI
Reconnaissance vocale pré-enregistrée et en temps réel
API Sync API en un seul appel pour de courts extraits
Diarisation et identification des locuteurs
Prise en charge de jusqu'à 99 langues
Résumés, sentiments et détection de sujets
Traduction et détection d'entités
Rédaction des PII et modération de contenu
API Voice Agent API de bout en bout
Mode médical pour l'audio de santé
SDK Python et JavaScript
Tarification de AssemblyAI
Pre-recorded Speech-to-Text
- Modèle Universal-2 à partir de 0,15 $/heure
- Modèle Universal-3.5 Pro à partir de 0,21 $/heure
- Option de diarisation des locuteurs
- Invite de termes clés et mode médical disponibles
Realtime Speech-to-Text
- Universal-Streaming à partir de 0,15 $/heure
- Universal-3.5 Pro Realtime à partir de 0,45 $/heure
- Prise en charge du streaming multilingue
- Transcripts en direct à faible latence
Sync API
- Transcripts en un seul appel pour de courts extraits audio
- Invite de termes clés incluse
- Contexte de conversation inclus
- Temps de réponse rapides
Voice Agent API
- Reconnaissance vocale, LLM et TTS inclus
- Détection avancée des tours de parole et des interruptions
- Enregistrements et transcripts inclus
- Prise en charge de la téléphonie et du trunking SIP
Enterprise
- Limites de débit et concurrence personnalisées
- Remises basées sur le volume
- Support dédié pour les clients Voice Agent
- Voix personnalisées pour Voice Agent
Cas d'usage de AssemblyAI
FAQ sur AssemblyAI
Voir ce que les utilisateurs disent à propos de AssemblyAI
0 Avis
Pas encore d'avis
Soyez le premier à évaluer AssemblyAI









