Back to top
  • 공유 Chia sẻ
  • 인쇄 In
  • 글자크기 Cỡ chữ
URL đã được sao chép

Google thử nghiệm nội bộ AI toán học 'Mathematica', lịch công bố chưa được xác nhận

Bàn tay của nhà nghiên cứu đang xem xét lời giải toán / TokenPost.ai

Google DeepMind được cho là đang thử nghiệm nội bộ mô hình trí tuệ nhân tạo 'Mathematica' chuyên giải các bài toán nâng cao, nhưng hiệu suất và lịch công bố chính thức của mô hình vẫn chưa được xác nhận.

Crypto Briefing đưa tin ngày 16 rằng Mathematica được phát triển dựa trên Deep Think, hệ thống AI suy luận của Google DeepMind, với mục tiêu giải các bài toán phức tạp. Một số thông tin cũng cho rằng mô hình này thuộc dòng Gemini 3.1 Pro.

Tuy nhiên, chưa có tài liệu chính thức nào cho thấy Google DeepMind xác nhận một mô hình nội bộ mang tên Mathematica. Không thể kết luận chắc chắn về việc thử nghiệm thực tế hay giai đoạn phát triển chỉ dựa trên tên mô hình và kết quả xuất hiện trong các bài đăng trực tuyến.

HuggingNews, đơn vị tổng hợp các bài đăng liên quan, cho biết Mathematica có thể là mô hình thử nghiệm hướng tới các bài đánh giá toán học khó như 'Millennium Bench'. Nội dung liên quan được đăng trên X, việc mô hình thực sự được thử nghiệm và các số liệu hiệu suất chưa được xác minh độc lập.

Dự án nghiên cứu toán học được Google DeepMind công bố chính thức gồm 'Aletheia'. Aletheia được giới thiệu là tác nhân nghiên cứu toán học dựa trên Gemini Deep Think, có khả năng xử lý các bài toán ở cấp độ nghiên cứu.

Aletheia được thiết kế để tạo lời giải, kiểm chứng rồi sửa lại khi phát hiện lỗi. Cấu trúc này không chỉ tạo ra đáp án mà còn kiểm tra tính hợp lệ của quá trình giải.

Tài liệu chính thức cho biết Aletheia được thiết kế để thừa nhận thất bại khi không thể giải quyết một bài toán. Đây là cách tiếp cận nhằm nâng cao khả năng kiểm chứng không chỉ đối với đáp án mà còn với quá trình giải toán.

Hiệu suất toán học của Deep Think cũng đã được thử nghiệm tại Olympic Toán học Quốc tế. Google DeepMind công bố phiên bản nâng cao của Gemini Deep Think năm 2025 đã giải hoàn hảo 5 trong 6 bài toán, đạt 35/42 điểm.

Bài làm được các quan chức Olympic Toán học Quốc tế chấm theo cùng tiêu chuẩn áp dụng cho bài làm của học sinh. Google DeepMind đánh giá kết quả này ở mức tương đương huy chương vàng.

Sau đó, Google DeepMind ra mắt AI for Math Initiative và cho biết sẽ thúc đẩy hợp tác nghiên cứu toán học với Imperial College London, Institute for Advanced Study, IHES, Simons Institute for the Theory of Computing thuộc UC Berkeley và Tata Institute of Fundamental Research.

Dự án này bao gồm Gemini Deep Think cùng hệ thống phát hiện thuật toán AlphaEvolve và hệ thống chứng minh hình thức AlphaProof. Chứng minh hình thức là phương pháp biểu diễn mệnh đề toán học trong một hệ thống logic để máy tính có thể kiểm chứng.

Diễn biến nghiên cứu trên cho thấy việc ứng dụng AI vào toán học đang mở rộng từ việc đưa ra đáp án sang kiểm chứng lời giải và sửa lỗi. Tuy nhiên, đây là mô tả về các hệ thống được Google DeepMind công bố chính thức, không phải bằng chứng chứng minh chức năng của Mathematica.

Chưa thể xác nhận các cụm từ như 'wait' hay 'oh my god' lan truyền trên mạng liên quan đến Mathematica có thực sự được tạo ra trong quá trình suy luận nội bộ của mô hình hay không. Cũng không thể 판단 ý thức hoặc cảm xúc của mô hình ngôn ngữ quy mô lớn chỉ từ một phần nội dung đầu ra.

Tổ chức nghiên cứu AI và cuộc cạnh tranh mô hình của Google DeepMind từng cho thấy vấn đề xác minh tương tự trong tin đồn về mô hình AI tự cải thiện đệ quy. Màn hình hoặc bài đăng trực tuyến có thể phản ánh xu hướng nghiên cứu, nhưng không thay thế xác nhận về việc phát hành chính thức và hiệu suất.

Theo các tài liệu chính thức hiện có, những AI liên quan đến toán học của Google DeepMind gồm Deep Think, Aletheia, AlphaProof và AlphaEvolve. Tên chính thức, giai đoạn phát triển, kết quả thử nghiệm và lịch công bố của Mathematica vẫn cần chờ thông báo bổ sung từ Google.

<Bản quyền ⓒ TokenPost, nghiêm cấm sao chép và phân phối trái phép>

Phổ biến nhất

Các bài viết liên quan khác

Bình luận 0

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.

0/1000

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.
1