Việc formal hóa Fermat cuối cùng được xác thực toàn diện bằng Lean do Claude tạo ra gần như tự động không chỉ là một tiêu đề nghiên cứu — đó là một bước ngoặt trong cách chúng ta xác minh kết quả do AI tạo ra. Thay vì dựa vào bằng chứng xã hội và nhiều tháng đánh giá thủ công, sản phẩm này có thể biên dịch được. Quá trình này được cho là đã trải dài hàng triệu dòng mã Lean, với các tác nhân chứng minh và tái sử dụng hàng chục nghìn định lý nhỏ. Sự thay đổi quan trọng nằm ở kiến trúc: AI không còn chỉ tạo ra các câu chuyện hay phác thảo; nó tạo ra toán học có thể kiểm tra bằng máy, có thể biên dịch lại, so sánh và mở rộng bởi người khác. Điều này đưa khám phá hỗ trợ AI gần hơn với kỹ thuật phần mềm, nơi tính đúng đắn được đảm bảo bởi hệ thống xây dựng thay vì tranh luận.
Việc tự động hóa formal hóa ở quy mô này cần các nguyên tắc phối hợp giữ cho nhiều tác nhân đồng bộ mà không mất trạng thái toàn cục. Một đồ thị có hướng không chu trình (DAG) của các định lý ưu tiên thứ tự chứng minh tiếp theo; việc tách biệt các phát biểu khỏi chứng minh giúp cải thiện việc xây dựng gia tăng; và các mô tả ngôn ngữ tự nhiên tăng khả năng tái sử dụng. Cùng nhau, các mẫu này giải quyết hai điểm nghẽn kinh niên trong các dự án toán học lớn: phân mảnh và thời gian biên dịch lại kéo dài. Kết quả gợi ý một quy trình có thể lặp lại: chọn một phát biểu chuẩn, mã hóa các phụ thuộc, huy động các tác nhân chuyên biệt, và liên tục xác thực bằng cách biên dịch các chứng minh từng phần. Nếu nhìn kỹ, đây giống như CI/CD cho toán học, với DAG định lý thay thế đồ thị phụ thuộc và bộ kiểm tra chứng minh hoạt động như bộ kiểm thử kín.
Đối với người thực hành, tác động là ngay lập tức. Xác thực chính thức không còn là một lý tưởng xa vời; nó là một bề mặt kiểm soát thực tế cho các tuyên bố quan trọng trong mật mã, thiết kế cơ chế, rủi ro và tính toán khoa học. Doanh nghiệp có thể thiết lập “cổng xác thực” trong quy trình nghiên cứu, yêu cầu các chứng minh có thể kiểm tra bằng máy hoặc các phép giảm có thể xác minh cho các kết quả cốt lõi. Nhà phát triển mô hình có thể đồng phát triển chứng minh cùng mã để các giả thuyết tự kiểm tra sớm, giảm thời gian lãng phí vào các ngõ cụt. Nhà đầu tư và lãnh đạo R&D có tín hiệu thẩm định rõ ràng hơn: đo bằng thành công biên dịch, phạm vi định lý và tái sử dụng thư viện — thay vì chỉ dựa vào các bài báo trắng. Các nút thắt giờ chuyển sang độ rộng thư viện, độ tin cậy phối hợp và thời gian con người dành cho việc hướng dẫn định nghĩa ở ranh giới.


