Out of Set vừa ra mắt dịch vụ AI dựa trên nền tảng web, có thể tạo giọng nói chỉ trong 0,2 giây kể từ khi người dùng nhập văn bản cho đến khi nhận được phản hồi âm thanh đầu tiên.
Out of Set (Out of Set) cho biết vào ngày 12 rằng công ty đã công bố thương hiệu AI giọng nói mang tên Airy (Airy) và ra mắt dịch vụ tạo nội dung giọng nói bằng AI có tên Airy Studio (Airy Studio). Người dùng có thể tạo và tải giọng nói xuống mà không cần cài đặt hay thiết lập phức tạp, đồng thời có thể sử dụng miễn phí.
Airy Studio được tích hợp mô hình chuyển văn bản thành giọng nói (TTS) siêu nhẹ do chính Out of Set phát triển. Chỉ cần người dùng nhấn nút tạo, phản hồi giọng nói đầu tiên sẽ xuất hiện chỉ sau 0,2 giây. Hiện dịch vụ hỗ trợ 2 ngôn ngữ là tiếng Hàn và tiếng Anh, cùng 10 loại giọng nhân vật khác nhau.
TTS là công nghệ chuyển văn bản đầu vào thành giọng nói giống với giọng người thật. Công nghệ này thường được ứng dụng trong quá trình sản xuất nội dung âm thanh như sách nói, lồng tiếng video hay phát thanh thông báo.
Out of Set có kế hoạch mở rộng danh mục sản phẩm xoay quanh thương hiệu Airy, từ mô hình nền tảng giọng nói chạy trực tiếp trên thiết bị (on-device) đến các sản phẩm ứng dụng, cũng như API và SDK dành cho nhà phát triển. Trong đó, Airy Studio là dịch vụ được xây dựng để người dùng phổ thông có thể trực tiếp trải nghiệm tính năng tạo giọng nói.
Công ty cũng vừa được chọn tham gia TIPS (TIPS), chương trình hỗ trợ khởi nghiệp công nghệ do khu vực tư nhân dẫn dắt của Bộ Doanh nghiệp vừa và nhỏ và Khởi nghiệp Hàn Quốc. Trong 2 năm tới, công ty sẽ nhận tối đa 800 triệu won vốn nghiên cứu và phát triển (R&D) để đầu tư vào việc phát triển mô hình nền tảng AI nhận diện và tổng hợp giọng nói chạy trên thiết bị.
AI on-device là phương thức vận hành mô hình AI trực tiếp trên từng thiết bị như điện thoại thông minh, ô tô, robot, thay vì thông qua máy chủ đám mây. Cách làm này thường giúp giảm bớt việc truyền dữ liệu ra máy chủ bên ngoài, qua đó hỗ trợ xử lý tốt hơn các vấn đề về bảo mật thông tin cá nhân, độ trễ mạng và chi phí vận hành.
Out of Set đã nhận vốn đầu tư giai đoạn hạt giống (seed) từ The Ventures (The Ventures) vào tháng 5 vừa qua. Vào thời điểm đó, công ty cho biết sẽ phát triển mô hình AI chuyên biệt siêu nhẹ có thể vận hành ngay trên thiết bị mà không cần kết nối internet, đồng thời xác định nhận diện giọng nói và tổng hợp giọng nói là lĩnh vực kinh doanh đầu tiên.
Kim Hyung-joo (Kim Hyung-joo), CEO của Out of Set, cho biết: “Thông qua Airy Studio, chúng tôi muốn người dùng trực tiếp cảm nhận trải nghiệm giọng nói nhẹ và nhanh, phản hồi ngay lập tức chỉ trong 0,2 giây, đồng thời từng bước xây dựng hệ sinh thái AI giọng nói on-device mà cả nhà phát triển cũng có thể cùng khai thác.” Đây là định hướng triển khai tốc độ phản hồi nhanh trước tiên ở dịch vụ dành cho người dùng phổ thông, sau đó mở rộng sang các sản phẩm dành cho nhà phát triển.
Trên thị trường AI tạo giọng nói, không chỉ khả năng biểu cảm của mô hình mà tốc độ phản hồi và cách vận hành dịch vụ cũng được xem là yếu tố cạnh tranh quan trọng. Trước đó, tòa soạn từng đưa tin về việc startup AI tạo giọng nói Fish Audio huy động được khoản đầu tư giai đoạn hạt giống trị giá 52 triệu USD và trường hợp ByteDance ứng dụng mô hình AI xử lý đồng thời giọng nói, video và văn bản vào Doubao. Hiện chưa xác nhận được mối liên hệ trực tiếp giữa thông báo lần này với thị trường tiền mã hóa hay ngành công nghiệp blockchain.
Bình luận 0