Modulate đã huy động 25 triệu USD (khoảng 33,9 tỷ won) để mở rộng nền tảng phân tích giọng nói bằng trí tuệ nhân tạo. Công ty cung cấp các tính năng phát hiện giọng nói deepfake, cuộc gọi gian lận và phân tích mức độ tuân thủ quy định của các tác nhân giọng nói.
Vòng gọi vốn do Future Ventures dẫn dắt, với sự tham gia của Hyperplane và Rockstar. TechCrunch đưa tin ngày 28 rằng Modulate đã huy động nguồn vốn mới cho nền tảng phân tích giọng nói dành cho doanh nghiệp.
Modulate hiện vận hành hơn 100 mô hình. Các mô hình này gồm nhóm trích xuất tín hiệu để xác định cảm xúc, cách nói, ngôn ngữ và khả năng giọng nói được tổng hợp, cùng nhóm phát hiện để phân tích ý định cuộc gọi, hành vi vi phạm quy định và dấu hiệu gian lận.
Công ty không phụ thuộc vào một mô hình lớn duy nhất mà sử dụng nhiều mô hình nhỏ, được gọi tùy theo nhu cầu. Modulate cho biết việc kết hợp các mô hình nhỏ giúp dễ dàng bổ sung hoặc thay thế từng tính năng phân tích, đồng thời không đòi hỏi phần cứng chuyên dụng hay nguồn lực tính toán quy mô lớn.
Carter Huffman (Carter Huffman), nhà sáng lập Modulate, nói: “Nhiều doanh nghiệp tập trung vào việc chuyển giọng nói thành văn bản, nhưng vẫn chưa đủ khả năng hiểu toàn bộ bối cảnh và những sắc thái quan trọng khi con người trò chuyện.” Điều này cho thấy chỉ chuyển nội dung giọng nói thành văn bản là chưa đủ để nắm bắt đầy đủ ý định và kết quả của cuộc gọi.
Công nghệ của Modulate được ứng dụng trong các trung tâm chăm sóc khách hàng và dịch vụ giọng nói doanh nghiệp. Hệ thống phân tích không chỉ đánh giá cảm xúc của người gọi mà còn xác định ý định thực tế, mức độ bất mãn và khả năng gian lận, đồng thời kiểm tra liệu tác nhân trí tuệ nhân tạo có phản hồi phù hợp với khách hàng hay không.
Công ty cũng cho biết công nghệ này được sử dụng để giám sát các cuộc tấn công mạng dựa trên giọng nói. Khi việc sao chép giọng nói trở nên dễ dàng hơn, khả năng xác minh lời nói của đối phương trong cuộc gọi có bình thường hay không ngày càng quan trọng với doanh nghiệp và các trung tâm chăm sóc khách hàng.
Huffman chỉ ra rằng không thể đánh giá mức độ thành công của cuộc gọi chỉ bằng phân tích cảm xúc. Khách hàng có thể nói chuyện lịch sự và không tỏ ra tức giận nhưng vẫn rất không hài lòng. Vì vậy, Modulate kết hợp tín hiệu giọng nói với bối cảnh hội thoại để cung cấp dữ liệu chi tiết cho doanh nghiệp.
Trong ngành AI giọng nói, đầu tư đang tiếp tục hướng vào các công nghệ xác định ý định và rủi ro của giọng nói, bên cạnh công nghệ tạo giọng nói tự nhiên. Việc startup AI giọng nói dành cho doanh nghiệp Ringg chuyển hướng kinh doanh mà TokenPost từng đưa tin cũng cho thấy công nghệ giọng nói đang mở rộng từ chức năng chuyển đổi đơn thuần sang các dịch vụ xử lý công việc doanh nghiệp.
Modulate được thành lập năm 2017 bởi Mike Pappas (Mike Pappas) và Huffman. Công ty ban đầu phát triển công nghệ biến đổi giọng nói cho người chơi game, sau đó mở rộng sang điều phối nội dung dựa trên giọng nói và phân tích giọng nói bằng trí tuệ nhân tạo.
TechCrunch đưa tin, dựa trên dữ liệu PitchBook, rằng Modulate đã huy động 41 triệu USD (khoảng 55,6 tỷ won) trước vòng gọi vốn lần này. Khi đó, công ty được định giá 170 triệu USD (khoảng 230,5 tỷ won).
Cơ sở khách hàng của Modulate gồm các trung tâm chăm sóc khách hàng và dịch vụ giọng nói dành cho doanh nghiệp. Tính năng phân tích của công ty hoạt động bên cạnh các dịch vụ giọng nói hiện có để đánh giá cuộc gọi, chất lượng phản hồi của tác nhân trí tuệ nhân tạo và mức độ tuân thủ quy định.
Hiện Modulate có 40-45 nhân viên. Công ty dự kiến tuyển thêm 10 người trong vài tháng tới để tăng cường năng lực phát triển mô hình.
Modulate cũng đang mở rộng khả năng triển khai tại chỗ và trên thiết bị nhằm bảo vệ quyền riêng tư.
Bình luận 0