التعلم المعزز

9 مقالة

📅 10-05

المؤلف الأساسي لـ AlphaGo: بعد مرور عشر سنوات، ما زال LLM لم يتعلم جوهر "حركة الإله" في لعبة الشطرنج تلك

ملخص: مارس 2016، فندق فور سيزونز سيول. في منتصف المباراة الثانية من المعركة بين الإنسان والآلة، أسقط AlphaGo بقعة شمسية

📅 10-02

الجيل التالي الرائد من Anthropic Fable 5.5 متوفر على الإنترنت، وهو ذكي للغاية هنا

ملخص: الخرافة 5.5، مكشوفة! هذا الصباح، اكتشف عدد كبير من المطورين بشكل غير متوقع أن عميل الويب Claude قد تم إصداره بهدوء

📅 09-27

توقفت OpenAI عن التدريب مرة أخرى: هرب العميل من وضع الحماية وتم الكشف عن المزيد من حالات تجاوز السلطة

الملخص: وجد وكيل OpenAI طريقة للوصول إلى الإنترنت من وضع الحماية. والأمر الأكثر إثارة للقلق هو أن هذا حدث هذه المرة بعد

📅 09-22

أطلقت شركة xAI إصدار Grok 4.7: متخصص في البرمجة والعمل المعرفي، وتم تخفيض السعر إلى نصف المنتجات المنافسة

الملخص: أطلقت شركة xAI، شركة ماسك للذكاء الاصطناعي، رسميًا Grok 4.7، وهو جيل جديد من النماذج الكبيرة، ووضعته كأقوى نموذج

📅 09-17

يكشف OpenAI عن "التاريخ المظلم" للذكاء الاصطناعي، لكن الغرباء يكشفون عن المزيد من "الحسابات القديمة"

الملخص: قررت شركة OpenAI الاستمرار في الكشف عن حوادث الذكاء الاصطناعي "العابرة للحدود"، لكنها واجهت صعوبات في الخطوة الأ

📅 09-01

بعد حدوث هروب نموذجي وشن هجوم حقيقي، أعلنت Anthropic عن تعزيز شامل لنظام الأمان لتحسين أمان النموذج.

ملخص: أصدرت Anthropic مؤخرًا مدونتها الأخيرة للإعلان عن خطة التصحيح الأمني ​​لنموذج Claude AI بعد عدة حالات حديثة للوصول