Nhận diện người nói
Nhận dạng giọng nói ứng dụng AI phát hiện và gắn nhãn các người nói khác nhau, giúp phỏng vấn và cuộc họp dễ đọc, rõ ràng.
Tải lên bất kỳ tệp âm thanh hoặc video nào, dán liên kết YouTube, Vimeo hoặc Instagram, hoặc ghi âm trực tiếp từ micro của bạn. AI chuyển giọng nói thành văn bản với độ chính xác cao, tự động nhận diện người nói và dịch chỉ với một cú nhấp sang hơn 100 ngôn ngữ.
Chuyển giọng nói thành văn bản
Chuyển đổi âm thanh và video thành văn bản bằng AI với hơn 100 ngôn ngữ.
Mở không gian làm việc đầy đủ6 credit mỗi phút.

Điểm nổi bật
Nhận dạng giọng nói ứng dụng AI phát hiện và gắn nhãn các người nói khác nhau, giúp phỏng vấn và cuộc họp dễ đọc, rõ ràng.
Dán liên kết YouTube, Vimeo hoặc Instagram, hoặc lấy tệp từ Google Drive, Dropbox hoặc OneDrive — không cần tải xuống thủ công.
Bật tự động dịch để nhận bản ghi bằng ngôn ngữ đích cùng với văn bản ngôn ngữ nguồn.
Cách hoạt động
Tải lên tệp tới 2GB, dán URL phát trực tuyến, hoặc ghi âm trực tiếp trong trình duyệt.
Giọng nói được phân đoạn, gắn dấu thời gian và gắn nhãn theo người nói, với tùy chọn áp dụng dịch thuật.
Tải xuống dưới dạng SRT, VTT, TXT, PDF, DOCX hoặc CSV — có hoặc không có dấu thời gian.
Khả năng
Công việc thường gặp
Câu hỏi thường gặp
MP3, MP4, WAV, M4A, FLAC, OGG, WebM, MOV và AVI đều được hỗ trợ, tối đa 2GB mỗi tệp.
Có. Dán trực tiếp URL YouTube, Vimeo hoặc Instagram và công cụ sẽ lấy và chuyển đổi âm thanh mà không cần bước tải xuống thủ công.
Bản ghi được xuất dưới dạng SRT, VTT, TXT, PDF, DOCX hoặc CSV, có hoặc không có dấu thời gian. Bạn cũng có thể tự động dịch bản ghi sang hơn 100 ngôn ngữ trước khi xuất.
Có. Tự động nhận diện người nói gắn nhãn ai đang nói, hữu ích cho phỏng vấn, hội thảo và cuộc họp.
6 credit cho mỗi phút âm thanh. Chi phí credit được hiển thị trước khi bạn xác nhận công việc.