Back to top
  • 공유 Chia sẻ
  • 인쇄 In
  • 글자크기 Cỡ chữ
URL đã được sao chép

Thử nghiệm của Tavus: 26/54 người tham gia nghĩ AI là người thật

Người tham gia cuộc gọi video nhìn vào màn hình máy tính xách tay / TokenPost.ai

Trong số 54 người tham gia một cuộc gọi video kéo dài một phút, 26 người cho rằng đối phương là người thật. Đây là kết quả thử nghiệm do Tavus công bố, không phản ánh tỷ lệ nhầm AI thành người trong các cuộc gọi video thông thường.

Ngày 1 tháng 10, Tavus ra mắt mô hình tương tác Griffin. Griffin-Lite, phiên bản dùng trong thử nghiệm, là mô hình xem trước dành cho nghiên cứu, có thể tiếp nhận âm thanh và hình ảnh theo thời gian thực, đồng thời tạo lời nói, biểu cảm, ánh mắt và cử chỉ. Decrypt đưa tin về thông báo và thử nghiệm của Tavus.

Tavus cho biết những người tham gia được hướng dẫn gọi video với một người khác trong một phút để trò chuyện về điều họ mong đợi trong năm nay. Sau cuộc gọi, công ty hỏi họ có nghĩ đối phương là người thật hay không. Trong 54 người, 26 người trả lời có; tỷ lệ Tavus đưa ra là 48%.

Tavus cho biết trong thử nghiệm với hệ thống trước đây, 1 trong 41 người tham gia (2,4%) nghĩ đối phương là người thật. Hệ thống cũ kết hợp ba mô hình đảm nhiệm việc tạo video, hội thoại và nhận thức. Số người tham gia ở hai thử nghiệm khác nhau, và thông tin công bố chưa cho biết đây có phải là thử nghiệm đối chứng trên cùng một nhóm hay không.

Tỷ lệ 48% đến từ thử nghiệm nội bộ của công ty, trong đó người tham gia trò chuyện về một chủ đề trong một phút mà không được báo trước rằng đối phương có thể là AI. Tavus chưa công bố tài liệu xác minh độc lập thiết kế và kết quả thử nghiệm.

Griffin-Lite được thiết kế để liên tục theo dõi âm thanh và hình ảnh trong lúc trò chuyện rồi tạo phản hồi, thay vì đợi đối phương nói xong mới trả lời. Tavus phân biệt cách tiếp cận này với quy trình lần lượt kết nối nhận dạng giọng nói, mô hình ngôn ngữ và các mô hình tạo âm thanh, video. Công ty nhấn mạnh khả năng xử lý mạch hội thoại và tín hiệu phi ngôn ngữ đồng thời với việc lắng nghe.

Trong bài đánh giá VideoFDB của NVIDIA, Griffin-Lite đạt 3,83/5 điểm ở hạng mục tạo nội dung. Điểm chuẩn của con người trong bảng công bố là 3,92; tổ hợp Gemini 2.5 và Anam đứng tiếp theo với 2,80 điểm. Ở hạng mục nhận thức, mô hình đạt 3,73 điểm, thấp hơn mức chuẩn 4,20 của con người.

VideoFDB đánh giá riêng khả năng nhận thức và tạo nội dung của AI dựa trên 237 đoạn hội thoại trích từ các cuộc gọi video thực tế cùng 11 loại tương tác phi ngôn ngữ. Điểm số được chấm bằng mô hình ngôn ngữ. Phép đo này khác với thử nghiệm của Tavus, vốn ghi nhận người tham gia có nghĩ đối phương là người thật hay không.

Tavus chưa cung cấp Griffin-Lite cho khách hàng phổ thông. Công ty cho biết đang cung cấp mô hình dưới dạng bản xem trước nghiên cứu cho một số người thử nghiệm đáng tin cậy, trong khi xây dựng các biện pháp an toàn, tính năng công khai việc sử dụng AI và hợp tác với các tổ chức an toàn liên quan.

<Bản quyền ⓒ TokenPost, nghiêm cấm sao chép và phân phối trái phép>

Phổ biến nhất

Các bài viết liên quan khác

Bình luận 0

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.

0/1000

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.
1