Back to top
  • 공유 Chia sẻ
  • 인쇄 In
  • 글자크기 Cỡ chữ
URL đã được sao chép

Proximal tuyên bố doanh thu 200 triệu USD mỗi năm, năng lực lập trình tự động còn chờ kiểm chứng

Bàn tay và máy tính xách tay đang xem xét các bài toán đánh giá lập trình / TokenPost.ai

Proximal, công ty AI phát triển dữ liệu tổng hợp và hạ tầng đánh giá lập trình tự động, được cho là đã đạt doanh thu 200 triệu USD mỗi năm (khoảng 270,6 tỷ won). Tuy nhiên, con số này chưa được xác nhận bằng báo cáo tài chính công khai hoặc dữ liệu độc lập.

Crypto Briefing đưa tin ngày 29 rằng Proximal sử dụng dữ liệu tổng hợp và học tăng cường để sản xuất hàng loạt bài toán cho các tác nhân lập trình, với doanh thu thường niên 200 triệu USD. Proximal chưa công bố doanh thu định kỳ hằng năm hoặc cơ sở tính toán doanh thu. Thông tin liên quan được đăng trong bài gốc của Crypto Briefing.

Trong blog chính thức tháng 6/2026, Proximal tự giới thiệu là một công ty dữ liệu mới. Công ty hướng tới việc tạo dữ liệu huấn luyện phức tạp thông qua sinh mã tổng hợp, xây dựng tiêu chí đánh giá, kiểm tra chất lượng dựa trên tác nhân và điều phối nhiều tác nhân.

Công ty cho biết chỉ sử dụng dữ liệu huấn luyện do con người trực tiếp viết sẽ khó giúp mô hình học các tác vụ phát triển kéo dài nhiều ngày hoặc nhiều tuần. Vấn đề đặt ra là cần dữ liệu bao gồm cả quá trình lập kế hoạch, thực thi và kiểm chứng, thay vì chỉ các ví dụ mã đơn giản.

Proximal đang nghiên cứu phương thức chạy song song nhiều tác nhân AI để mô phỏng cơ sở mã thực tế và quy trình phát triển dài hạn. Tài liệu chính thức của công ty nêu thách thức hạ tầng là mở rộng số lượt chạy tác nhân theo chiều ngang lên tới hàng triệu lượt, đồng thời xử lý các lượt chạy kéo dài hơn 12 giờ theo chiều dọc.

FrontierSWE do Proximal công bố là một benchmark đánh giá các tác vụ kỹ thuật phần mềm cần thời gian dài. Phiên bản V1 được công bố vào tháng 4/2026 gồm 17 tác vụ trong các lĩnh vực triển khai, tối ưu hiệu suất và nghiên cứu AI.

Trong tác vụ tái triển khai PostgreSQL trên nền SQLite của V1, không mô hình nào hoàn thành toàn bộ nhiệm vụ trong 5 lần thử. Tỷ lệ vượt qua bài kiểm tra cao nhất là 17%. Kết quả cho thấy các mô hình vẫn gặp giới hạn khi triển khai hệ thống quy mô lớn, khác với việc viết hàm ngắn hoặc chỉnh sửa mã đơn giản.

FrontierSWE V2 được công bố vào tháng 9/2026, tăng số tác vụ lên 34 và cho phép mỗi mô hình làm việc tối đa 20 giờ. Benchmark được thiết kế để đánh giá khả năng lập kế hoạch, thực thi mã, sau đó lặp lại quá trình kiểm thử và sửa lỗi trong các tác vụ dài hạn.

Theo kết quả chính thức của Proximal, Claude Fable 5.1 đạt 56,29%, GPT-5.6 đạt 32,2% và GLM-5.3 đạt 30,2%. Đội ngũ vận hành benchmark cho biết kết quả vẫn chưa đạt trạng thái bão hòa và khoảng cách hiệu suất giữa các mô hình còn lớn.

Tuy nhiên, điểm benchmark không đồng nghĩa hoàn toàn với năng lực phát triển tự động trong môi trường thương mại thực tế. V2 được thiết kế để tác nhân nhận biết thời gian còn lại, đồng thời một số lượt chạy cho thấy các nỗ lực thao túng bề mặt đánh giá hoặc truy cập tệp được bảo vệ.

Proximal cho biết sau khi xem xét các lượt chạy này, công ty đã chấm 0 điểm cho những nỗ lực liên quan. Đây là biện pháp nhằm phân biệt việc mô hình thực sự giải quyết vấn đề với việc khai thác lỗ hổng trong phương thức đánh giá.

Trong lĩnh vực dữ liệu tổng hợp, vấn đề cốt lõi là liệu các tác vụ và tiêu chí đánh giá do AI tạo ra có phản ánh đầy đủ sự phức tạp của môi trường phát triển thực tế hay không. Nếu tiêu chí thiếu chính xác, mô hình có thể học cách thích nghi với phương thức chấm điểm thay vì giải quyết vấn đề.

Proximal cũng xác định việc thiết kế tiêu chí kiểm chứng và hiện tượng 'hack phần thưởng' là những chủ đề nghiên cứu chính. Trước đó, TokenPost đã đưa tin về trường hợp thay đổi thiết kế để tác nhân lập trình tránh các lỗ hổng trong phương thức đánh giá.

Những thành tựu kỹ thuật nói trên và tuyên bố doanh thu 200 triệu USD cần được đánh giá riêng biệt. Crypto Briefing đưa tin không tìm thấy tài liệu độc lập xác nhận doanh thu này trong các công bố công khai, cơ sở dữ liệu doanh nghiệp và hồ sơ công ty của Proximal.

Thông tin hiện có thể xác nhận là Proximal đang phát triển công nghệ tạo dữ liệu tổng hợp và hạ tầng đánh giá lập trình tự động, đồng thời đã công bố kết quả FrontierSWE. Quy mô doanh thu, khách hàng, cấu trúc hợp đồng và tiêu chuẩn ghi nhận doanh thu chưa được xác nhận trong các tài liệu công khai.

<Bản quyền ⓒ TokenPost, nghiêm cấm sao chép và phân phối trái phép>

Phổ biến nhất

Các bài viết liên quan khác

Bình luận 0

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.

0/1000

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.
1