OpenAI đã ra mắt API quyết định, cho phép chọn một phương án trong danh sách được định trước để phân loại hành vi của tác nhân AI và tự động hóa công việc.
OpenAI công bố Decisions API dưới dạng bản xem trước giới hạn tại sự kiện dành cho nhà phát triển ngày 29 tháng 9. Nhà phát triển có thể nhập bối cảnh bằng văn bản hoặc hình ảnh, sau đó nhận một trong các câu trả lời được định trước để phân loại nội dung, định tuyến yêu cầu hoặc chọn hành động tiếp theo cho tác nhân AI.
Sam Altman (Sam Altman), CEO OpenAI, giải thích tại sự kiện rằng Decisions API giao cho mô hình Luna của OpenAI việc lựa chọn giữa các phương án định trước, chẳng hạn như phân loại hình ảnh hoặc xác định hành vi tiếp theo của tác nhân. Ông nói: “Khi tập trung mô hình vào lựa chọn đó, chúng tôi có thể tạo ra hệ thống rất nhanh mà vẫn duy trì khả năng hiểu hình ảnh, hỗ trợ ngôn ngữ rộng và các biện pháp bảo vệ”.
Điểm cốt lõi của API này là không để mô hình ngôn ngữ đa năng tự do tạo ra các câu trả lời dài, mà giới hạn đầu ra thành giá trị quyết định để phần mềm có thể xử lý trực tiếp. Khi nhà phát triển định trước các lựa chọn và dạng câu hỏi, mô hình sẽ trả về kết quả trong phạm vi đó.
Cấu trúc này phù hợp với các tác vụ như phân loại email hoặc nội dung, chuyển yêu cầu đến hệ thống thích hợp và chọn hành động tiếp theo cho tác nhân AI. Vì mô hình không phải tạo câu trả lời dài mỗi lần, phương thức này có thể giúp giảm thời gian xử lý và chi phí.
TechCrunch đưa tin Decisions API cung cấp chức năng tương tự Jev của TypeSafe AI, được công bố ngày 15 tháng 9. Jev được giới thiệu là mô hình trả về xác suất và quyết định có cấu trúc thay vì văn bản.
Jev được thiết kế để trả về các lựa chọn và xác suất do nhà phát triển định sẵn. TypeSafe AI giới thiệu Jev là mô hình ‘System One’ dành cho tự động hóa phần mềm, đồng thời nhấn mạnh khả năng đưa ra quyết định và tạo đầu ra có cấu trúc nhanh hơn so với việc tạo văn bản.
TypeSafe AI cho biết trong đánh giá nội bộ rằng Jev nhanh hơn tối đa 193,6 lần và rẻ hơn 444,6 lần so với các mô hình ngôn ngữ hiện có. Tuy nhiên, các con số này dựa trên môi trường đánh giá do TypeSafe AI thiết kế.
Diogo Almeida (Diogo Almeida), CEO TypeSafe AI, nói đùa trên X rằng API mới của OpenAI đánh dấu sự khởi đầu của “cuộc chiến nhân bản”. Ông nói sự quan tâm của OpenAI “có thể là tín hiệu cho thấy tương lai nằm ở việc xây dựng theo cách tương thích với System One”.
Almeida cũng nói: “Làm cho hệ thống nhanh và rẻ là điều rất dễ”, đồng thời cho rằng “nếu muốn thực sự nhanh và rẻ thì chỉ cần dùng xúc xắc”. Ông giải thích điều quan trọng là trí tuệ, còn mục tiêu là nâng cao hiệu quả của đường cong “trí tuệ trên mỗi USD”.
Một ứng dụng được nhắc đến của các mô hình quyết định là giám sát tác nhân AI. TechCrunch đưa tin OpenAI đang sử dụng một mô hình riêng để giám sát hành vi của tác nhân như một biện pháp bảo mật sau một sự cố tác nhân thực hiện hành động sai trên internet, nhưng phương thức này đòi hỏi chi phí tính toán đáng kể.
Shapor Naghibzadeh (Shapor Naghibzadeh), CEO QueryStory, đã tạo một màn trình diễn tại cuộc thi hackathon cuối tuần trước, trong đó Jev đối chiếu từng hành động của tác nhân với nhiệm vụ. Hành động được đánh giá là có rủi ro cao sẽ bị chặn, hành động chưa rõ ràng sẽ được đánh dấu để xem xét, còn các hành động khác được cho phép.
Trong màn trình diễn này, chi phí giám sát bằng Jev là 2,94 USD (khoảng 3.981 won), thấp hơn mức 372 USD (khoảng 500.000 won) khi sử dụng mô hình ngôn ngữ biên. TechCrunch lưu ý đây là so sánh trong một môi trường trình diễn cụ thể, không có nghĩa Decisions API của OpenAI đạt hiệu năng hoặc chi phí tương tự.
TechCrunch cho biết về lý thuyết, hoạt động giám sát bằng Jev có thể đã ngăn được sự cố xảy ra trên Hugging Face. Nếu chi phí đủ thấp để kiểm tra mọi hành động của tác nhân, hệ thống có thể được dùng để bổ sung bước rà soát thường xuyên trong quá trình thực hiện nhiệm vụ.
Tuy nhiên, giá trị thực tế của mô hình quyết định không chỉ phụ thuộc vào tốc độ phản hồi hoặc chi phí thấp. Cần đồng thời kiểm chứng khả năng mô hình điều chỉnh xác suất phù hợp với tình huống thực tế và phân biệt chính xác giữa hành động nguy hiểm với hành động bình thường.
Decisions API hiện vẫn ở giai đoạn xem trước giới hạn. Trước khi có thêm dữ liệu về hiệu năng, chi phí và tỷ lệ nhận diện sai từ các nhà phát triển sử dụng trong môi trường thực tế, chưa thể đánh giá nhiều hơn ngoài mức tương đồng về chức năng với Jev.
Bình luận 0