Nghiên cứuMô hình 🇷🇺 14.08.2026 21:02

Bác sĩ phẫu thuật thần kinh chứng minh giả thuyết làm khó các nhà toán học suốt 22 năm với một phiên chạy GPT-5.6 kéo dài 16 giờ

OpenAIOpenAI
Một bác sĩ phẫu thuật thần kinh, Tiến sĩ Shanmu Jin, đã chứng minh giả thuyết Crouzeix, một bài toán lâu đời trong phân tích ma trận, và được hỗ trợ bởi phiên chạy tự động 16 giờ của GPT-5.6 Sol của OpenAI. Chứng minh của ông đã được xác minh bởi nhiều nhà toán học, bao gồm cả tác giả của giả thuyết, và một chứng minh độc lập thứ hai xuất hiện vài ngày sau đó. Điều này đánh dấu một cột mốc: một đóng góp toán học lớn từ một người không chuyên kết hợp với mô hình AI.
Nhà toán học Alex Townsend đã nhờ ChatGPT chứng minh giả thuyết Crouzeix trong gần một năm, nhưng mô hình này luôn đưa ra những lời chứng sai hoặc không đầy đủ. Vào ngày 30 tháng 7 năm 2026, ChatGPT đã trả về một liên kết đến bản bản thảo chưa được bình duyệt (preprint) đăng tải ba ngày trước đó, tuyên bố đã tìm ra lời giải. Townsend và đồng nghiệp Anna Greenbaum đọc bản bản thảo này với thái độ hoài nghi và sớm nhận ra đó là công trình hợp lệ. Tác giả, Tiến sĩ Shanmu Jin, là một bác sĩ nội trú chuyên khoa thần kinh và nghiên cứu sinh sau tiến sĩ, không phải nhà toán học chuyên nghiệp. Ông trở nên quan tâm đến giả thuyết Crouzeix khi đang nghiên cứu về siêu âm xuyên sọ, và đã xây dựng chiến lược chứng minh trong một phiên làm việc tự động kéo dài 16 giờ với GPT-5.6 Sol trên ChatGPT Work, mà không có kết nối internet. Mô hình đã sử dụng một tập hợp các chiến lược đa dạng, các cuộc kiểm tra đối nghịch và phương pháp loại bỏ dựa trên phản ví dụ, theo hướng dẫn của Jin. Lời chứng này đã được kiểm tra độc lập bởi Townsend, Greenbaum và Michel Crouzeix, sau đó được củng cố bằng một lời chứng khác, khác biệt do các nhà toán học Emil Lorist và Felix Schwenninger thực hiện – những người cũng đã sử dụng ChatGPT 5.6 Pro. Trường hợp này nhấn mạnh sự thay đổi mô thức trong khám phá toán học và nảy sinh những câu hỏi về tính bền vững của quy trình bình duyệt ngang hàng (peer review).
Nguồn: Habr — хаб ИИ — bản gốc
Bài viết liên quan trước đây ↓
Tin mới