
AssemblyAI
API chuyển giọng nói thành văn bản và Voice AI
AssemblyAI là nền tảng Voice AI cung cấp API chuyển giọng nói thành văn bản chính xác, phiên âm thời gian thực và agent giọng nói cho nhà phát triển.
AssemblyAI là gì?
AssemblyAI là nền tảng Voice AI giúp chuyển giọng nói từ cuộc gọi, cuộc họp, podcast và agent giọng nói thành văn bản chính xác thông qua các API dành cho nhà phát triển đơn giản. Nền tảng này cung cấp cả phiên âm tệp ghi âm sẵn và phiên âm thời gian thực, cho phép bạn xử lý các tệp âm thanh đã lưu hoặc nắm bắt cuộc trò chuyện trực tiếp khi chúng đang diễn ra.
Mô hình Universal-3.5 Pro chủ lực của AssemblyAI mang lại độ chính xác cao trên 18 ngôn ngữ, xử lý nhiều người nói và hiểu các thuật ngữ y tế và kỹ thuật. Ngoài phiên âm thông thường, nền tảng này còn bổ sung các tính năng hiểu ngữ nghĩa như tóm tắt, phân tích cảm xúc, chủ đề và dịch ngôn ngữ.
Đối với các nhóm xây dựng agent giọng nói, AssemblyAI gói gọn chuyển giọng nói thành văn bản, mô hình ngôn ngữ được tinh chỉnh và chuyển văn bản thành giọng nói vào trong một Voice Agent API duy nhất, giúp loại bỏ nhu cầu kết hợp các công cụ riêng lẻ.
Giá cả dựa trên mức sử dụng, tính phí theo giờ âm thanh được xử lý, với các gói tùy chỉnh dành cho các nhóm lớn hơn cần khối lượng cao hơn hoặc hỗ trợ bổ sung.
Tính năng của AssemblyAI
Chuyển giọng nói thành văn bản cho tệp ghi âm sẵn và thời gian thực
Sync API một lệnh gọi cho các đoạn clip ngắn
Phân biệt và gắn nhãn người nói
Hỗ trợ tối đa 99 ngôn ngữ
Tóm tắt, phân tích cảm xúc và phát hiện chủ đề
Dịch ngôn ngữ và phát hiện thực thể
Che giấu PII và kiểm duyệt nội dung
Voice Agent API trọn gói
Chế độ y tế cho âm thanh chăm sóc sức khỏe
SDK Python và JavaScript
Giá của AssemblyAI
Pre-recorded Speech-to-Text
- Mô hình Universal-2 từ $0.15/giờ
- Mô hình Universal-3.5 Pro từ $0.21/giờ
- Tiện ích phân biệt người nói
- Nhắc từ khóa và chế độ y tế có sẵn
Realtime Speech-to-Text
- Universal-Streaming từ $0.15/giờ
- Universal-3.5 Pro Realtime từ $0.45/giờ
- Hỗ trợ phát trực tuyến đa ngôn ngữ
- Phiên âm trực tiếp độ trễ thấp
Sync API
- Phiên âm trong một lệnh gọi cho âm thanh ngắn
- Bao gồm nhắc từ khóa
- Bao gồm ngữ cảnh hội thoại
- Thời gian phản hồi nhanh
Voice Agent API
- Bao gồm chuyển giọng nói thành văn bản, LLM và TTS
- Phát hiện lượt nói và ngắt lời nâng cao
- Bao gồm bản ghi âm và phiên âm
- Hỗ trợ điện thoại và kết nối SIP trunking
Enterprise
- Giới hạn tỷ lệ và số phiên đồng thời tùy chỉnh
- Giảm giá dựa trên khối lượng
- Hỗ trợ chuyên biệt cho khách hàng Voice Agent
- Giọng nói tùy chỉnh cho Voice Agent
Trường hợp sử dụng AssemblyAI
Câu hỏi thường gặp về AssemblyAI
Xem người dùng đang nói gì về AssemblyAI
0 Đánh giá
Chưa có đánh giá
Hãy là người đầu tiên đánh giá AssemblyAI








