الملخص:
اتضح أن تشيو تشينغ تونغ، أول فائز بميدالية الحقول الصينية وأستاذ في جامعة تسينغهوا، هو أيضًا قارئ الحكمة الجديدة! بالأمس، أبلغنا أن إثبات نظرية فيرما الأخيرة تم إضفاء الطابع الرسمي عليه لأول مرة من قبل كلود، وكان مفتاح ذلك هو نظام Prove2Me من خريجي جامعة تسينغهوا ياو، بينج تيان يي، المبني على كلود. ولدهشتنا، لاحظنا
لقطة شاشة ذات صلة يتم تداولها على الإنترنت:
ص> ص>
السيد. يعرض Yau Shing-tung مكافأة قدرها 100000 دولار تايواني جديد للتحقق رسميًا من برهان حدسية Poincare الخاص بـ Perelman! ص>

حدسية بوانكاريه هي نظرية رياضية مشهورة حول شكل الفضاء ثلاثي الأبعاد في الطوبولوجيا. وينص على أنه إذا كان في الفضاء المغلق ثلاثي الأبعاد، يمكن لكل منحنى مغلق أن يتقلص إلى نقطة ما، فيجب أن يكون الفضاء كرة ثلاثية الأبعاد. في عام 2006، اعترف المجتمع الرياضي عمومًا بأن بيريلمان قد أكمل إثبات حدسية بوانكاريه. ص>
في الوقت الحاضر، لم نؤكد بعد صحة لقطات الشاشة بشكل كامل (يقال إنه لا يُسمح بمشاركة لقطات الشاشة في الخارج وفقًا للوائح)، ولكن نظرًا لأن الذكاء الاصطناعي يمكنه إكمال الدليل الرسمي لنظرية فيرما الأخيرة، فمن المحتمل جدًا أن يتمكن الذكاء الاصطناعي أيضًا من إضفاء الطابع الرسمي على إثبات حدسية بوانكاريه. ص>
في نفس الوقت تقريبًا، تردد أن لغز الألفية الآخر، وهو معادلة نافييه-ستوكس، مع مكافأة قدرها مليون دولار، قد تم حله بواسطة كلود الأنثروبي، ويتم إرسال الدليل إلى الخبراء للمراجعة. ص>

هذا الاتجاه الصعب هو أيضًا محور التركيز الرئيسي لـ Wei Shen (Wei Dongyi). النتائج المرحلية ذات الصلة فقط هي التي فازت بالجائزة الثانية للجائزة الوطنية للعلوم الطبيعية. ص>
إذا كانت الشائعات صحيحة، فإن قدرات التفكير الرياضي للنموذج الرئيسي الداخلي لكلود الذي لم يتم إصداره بعد ستتجاوز بكثير جميع النماذج العامة، بما في ذلك GPT-6 Astra. ص>
أجاب تاو تشيكسوان أنه على الرغم من أنه لا يمكن تأكيد صحة الشائعات في الوقت الحالي، إلا أنه قال بصرامة إنه "ليس من المستحيل تمامًا" أن يتغلب الذكاء الاصطناعي على مثل هذه المشكلات. ص>

لكنه بعد ذلك قضى آلاف الكلمات في استنتاج سؤال: ماذا سيحدث للرياضيات إذا قام الذكاء الاصطناعي بحل مثل هذه المسائل الصعبة بطريقة الصندوق الأسود؟ ص>
الاستنتاج يتجاوز توقعات الكثير من الناس: فقد يضر أكثر مما ينفع. ص> ص>
معادلة نافييه-ستوكس تدعم عالم الهندسة
ص>لكنها حيرت مجتمع الرياضيات لما يقرب من مائتي عام
ص>نقطة الاتصال الرئيسية للشائعة هي "التنبؤ" الذي أطلقه مدون التكنولوجيا أندرو كوران على X: قام كلود بحل معادلة NS،
الخطط الإنسانية التي سيتم الإعلان عنها قبل الاكتتاب العام
. ص>
https://x.com/AndrewCurran_/status/2096062392442724805
في وقت لاحق، تقاطعت مصادر متعددة: نقل موظفو OpenAI الأخبار إلى العالم الخارجي، وتتبع عالم الرياضيات إليوت جليزر سلسلة الشائعات ووجد أن النسخة الأولية تزعم أن الأنثروبيك حلت "اثنين" من مشاكل الألفية، والتي تم تصحيحها لاحقًا إلى مشكلة واحدة؛
قال المُبلغ عن المخالفات "الأخ ستروبيري" @iruletheworldmo إنه انتصر على "متعددة"؛

https://x.com/iruletheworldmo/status/2096262005149548951
يقدر بعض الأشخاص أنه إذا كان هذا صحيحًا، فإن قدرة النموذج ستتجاوز 170 ECI. ص>

أحدث إصدار من Epoch AI: مؤشر ECI لـ GPT-6 Astra هو 169
أخبر أستاذ رياضيات آخر جليزر أن النسخة التي سمعها من مصدر موثوق هي أن "حدسية هودج قد تم حلها". ص>
ومع ذلك، يمكن إرجاع جميع المصادر إلى تقارير موظفي OpenAI، ولا يوجد مصدر أساسي مستقل. ص>

https://x.com/ElliotGlazer/status/2096298696438906934
اعتبارًا من السادس من سبتمبر، لا يزال معهد كلاي للرياضيات يدرج معادلة NS باعتبارها مشكلة لم يتم حلها، مع عدم المطالبة بالجائزة البالغة مليون دولار. ص>
لا تقتل الدجاجة التي تبيض ذهباً
ص>يمكن تلخيص وجهة نظر تاو زيكسوان الأساسية في سلسلة الاستدلال التالية:
تكمن قيمة التخمين الشهير في الأدوات التي تولدها عملية الحل، والإجابة بحد ذاتها ثانوية →
إذا قدم الذكاء الاصطناعي إجابات بطريقة الصندوق الأسود، فسيتم قفل جميع الأفكار المكتسبة في العملية →
تم "حل" المشكلة تقنيًا ولكن الرياضيات توقفت عن النمو. ص>
لنأخذ معادلة NS كمثال: على مدى العقود القليلة الماضية، أنتج علماء الرياضيات سلسلة من الأدوات الأساسية مثل نظرية الحلول الضعيفة لراي-هوبف، ومتباينة جاجلياردو-نيرنبرج-لاديزينسكايا، ومعيار بيل-كاتو-ماجدا التفجيري في عملية الحل، والتي تشكل البنية التحتية للمعادلات التفاضلية الجزئية الحديثة. ص>
توضح نظرية فيرما الأخيرة نفس المشكلة: أكثر من ثلاثمائة عام من التحقق أدت إلى ظهور نظرية الشكل المعياري ونظرية المنحنى الإهليلجي، والتي لا تزال تلعب دورًا في نظرية التشفير والتشفير. ص>
إن هذه التخمينات تشبه الدجاجة التي تضع بيضة ذهبية. يثبت الذكاء الاصطناعي بعنف أنه يأخذ البيضة، لكنه قد يقتل الدجاجة. ص> ص>
حتى النماذج الرئيسية الجديدة، بما في ذلك GPT-6 Astra، بدأت في استخدام Current Depth لتحل محل Transformer كطريقة تفكير. والثمن هو أن تدخل عملية التفكير في صندوق أسود، ولا نستطيع الحصول على السقالات اللازمة لتسلق القمم العلمية في سلسلة تفكير واضحة. ص>
استخدم تاو زيكسوان مشكلة تباعد الأعداد الأولية لبناء تجربة فكرية مضادة للواقع لدعمها: على الجدول الزمني الحقيقي، أدى الإنجاز الذي حققه تشانغ ييتانغ في عام 2013 (الحد الأعلى 70 مليونًا) إلى ولادة أدوات على مستوى الكتب المدرسية مثل تعاون Polymath8 وطريقة Maynard sieve، وانخفض الحد الأعلى إلى 246.
ولكن إذا كانت هناك شركة ذكاء اصطناعي تسعى إلى حل القوة الغاشمة في عام 2005، فربما كانت طريقة غربلة ماينارد مدفونة في مئات الصفحات من الأدلة التي تم إنشاؤها بواسطة الذكاء الاصطناعي ولم يتم اكتشافها أبدًا. واصل Zhang Yitang العمل في متجر للسندويشات، وتم "إفراغ" الحقل بأكمله. ص>
يلخص تعليق أحد طلاب الدراسات العليا أسفل المنشور هذا الشعور: "عند الدردشة مع زملاء الدراسة، هناك شعور شائع جدًا وهو أن كل ما أفعله لم يعد مهمًا".
ومع ذلك، أعطى تيرينس تاو بوضوح حالة إيجابية. ص>
واستشهد بمشكلة إردوس رقم 1026: الذكاء الاصطناعي المستخدم للتعاون، وحل المشكلات وتعزيز الفهم البشري. ص>
ما ينتقده هو بعض الاختيارات المتعمدة: عدم التعاون مع الخبراء في هذا المجال، وعدم كتابة الأبحاث لمراجعة النظراء، فقط لتحقيق درجة مرجعية. ص>
تستخدم شركتا Anthropic وOpenAI أحدث الرياضيات كمعايير وعلاقات عامة واسعة النطاق لتأييد تقييمات الاكتتاب العام الأولي الخاصة بهما البالغة 10 تريليون يوان صيني. ص>
سوف يتم ترك البشر في النهاية وراءهم
ص>لكن تيرينس تاو نفسه اعترف بشيء واحد: حتى لو تم حل معادلة NS بطريقة مثالية، فإن البنية النهائية ستكون "معقدة للغاية، ومن المستحيل على البشر إكمال عملية التحقق بمفردهم". قد تصبح وثيقة الإثبات الرسمية في Lean هي الأكبر من نوعها. ص>
تم تأكيد هذا الحكم بالكامل في مكان آخر. ص>
في 4 سبتمبر، أعلنت شركة Anthropic أن كلود أكمل عملية إضفاء الطابع الرسمي على نظرية فيرما الأخيرة في 11 يومًا: 13 مليون سطر من التعليمات البرمجية، و29,500 نظرية متوسطة، وإخراج 6 مليار رمز. ص>
علق المراجع كيفن بوزارد من جامعة إمبريال كوليدج في لندن قائلاً إن هذا كان "إنجازًا رائعًا في الصياغة التلقائية"، حيث "لا تعتمد عملية الإثبات على أي افتراضات إضافية بخلاف البديهيات الرياضية". ص>
ولكن لا يمكن لأي إنسان قراءة 13 مليون سطر من تعليمات Lean البرمجية سطرًا تلو الآخر، وقد تحول التحقق البشري إلى: تشغيل المترجم ومعرفة ما إذا كان يُبلغ عن خطأ. ص>
هذه هي بداية ASI. ص> ص>
تتجاوز النتائج الحسابية للذكاء الاصطناعي حدود الفهم البشري. ص>
في الوقت الحالي، يستطيع البشر أيضًا تصميم حلول إرشادية، واختيار الاستراتيجيات، وتحديد المسارات التي تستحق الاستكشاف. ص>
ولكن عندما تستمر القدرة الاستدلالية للنموذج في الارتفاع، وحتى كبار علماء الرياضيات لا يستطيعون فهم خطواته الوسيطة، فإن نموذج "البشر يراكم الحدس في عملية الاستكشاف" الذي يعتز به تيرينس تاو لن يعد ممكنًا بالمعنى المادي. ص>
سوف يتخلف البشر ذوو الذكاء المحدود في النهاية عن الركب بواسطة ASI. ص>
حسنًا، لن يتوقف أحد
ص>من الواضح أن Anthropic وOpenAI لن يتباطأا بسبب تحذير Terence Tao. ص>
إن سباق التسلح الرياضي للذكاء الاصطناعي في عام 2026 قد بدأ بالفعل على قدم وساق: ففي أغسطس، حاول نموذج بحثي غير منشور من شركة أنثروبيك إثبات فرضية ريمان، لكنه فشل. ومع ذلك، في هذه العملية، دفعت الحد الأدنى لنسبة نقطة الصفر لدالة زيتا لريمان التي ترضي التخمين من 41.6% إلى 67.2%، محطمة بذلك أفضل رقم قياسي احتفظ به البشر. ص>
التفاصيل الأكثر فظاعة هي أن جاريد سومنر، الموظف الأنثروبي الذي قاد هذا الإنجاز، لم يكن لديه خلفية رياضية. لقد استمر في حث العارضة على "مواصلة المحاولة". ص>
في شهر أغسطس أيضًا، أعلنت شركة OpenAI أن شركة Astra تمكنت من حل 10 مشاكل رياضية ونظرية بارزة في علوم الكمبيوتر لمدة عشر سنوات على الأقل، بما في ذلك البناء الأول لمجموعة غير صوفية (وهي مشكلة ظلت دون حل منذ أن اقترحها جروموف في عام 1999)، وكل ذلك باستخدام البراهين الرسمية لـ Lean 4 وتكلفة إجمالية للطاقة الحاسوبية تبلغ حوالي 2000 دولار. ص>

https://openai.com/zh-Hans-CN/index/ten-advances-in-mathematics/
يتقدم Google DeepMind أيضًا. ص>
في شهر مايو، قامت شركة AlphaProof Nexus بحل 9 من 353 مشكلة مفتوحة في Erdos وأثبتت 44 من 492 تخمينًا لـ OEIS، كل ذلك من خلال التحقق من آلة Lean. ص>
وفي نفس الشهر، أبطلت شركة OpenAI تخمين وحدة المسافة الذي اقترحه إردوس في عام 1946. وقال تيم جاورز، الحائز على ميدالية فيلدز، إنه "سيوصي دون تردد بنشر هذه الورقة في مجلة حوليات الرياضيات (المجلة الأكثر موثوقية في الرياضيات)." ص>
في سوق التنبؤ المتعدد، تبلغ نسبة عقد "2026 AI Solving the Millennium Award Puzzle" حاليًا 38%. ص>
تتراكم الشائعات والأدلة والرهانات في نفس الاتجاه. ص>
يمكن حل اللغز بمكافأة مليون دولار، ولكن إذا تم حله بطريقة تمنع الرياضيات من النمو، فإن الشيء الذي يشتريه مليون دولار قد لا يستحق الثمن. ص>
قانون جودهارت
وقد تم إثبات ذلك مرة أخرى: بمجرد أن يصبح المؤشر هو الهدف الوحيد، فإنه يفقد معناه في قياس القيمة. ص> ص>
ولكن لدعم تقييم الاكتتاب العام الأولي بأكثر من تريليون دولار، لا تستطيع Anthropic وOpenAI إثبات أنهما "آمنتان" فحسب، بل يجب أن تثبتا أنهما "حققتا ذكاءً اصطناعيًا يتجاوز المستويات البشرية بشكل شامل"، أي ASI. ص>
هل هناك أي شيء يمكن أن يمنح الشركة إحساسًا أكبر بـ "المعجزة" من حل المشكلات الرياضية البحتة التي أزعجت البشرية لمئات السنين (نظرية فيرما الأخيرة، ومعادلة NS، وحدسية بوانكاريه، وما إلى ذلك)؟ ص> ص>
التعليقات