اليوم، أعلنت شركة Alibaba Tongyi Qianwen عن إطلاق نموذج أصغر جديد ——Qwen3-4B-Instruct-2507 وQwen3-4B-Thinking-2507.في الوقت الحاضر، أصبح النموذج الجديد مفتوح المصدر رسميًا في Magic Community وHuggingFace. ووفقا للتقارير،في مجال عدم الاستدلال، يتفوق Qwen3-4B-Instruct-2507 بشكل شامل على GPT4.1-Nano مغلق المصدر.

في مجال التفكير، يمكن مقارنة Qwen3-4B-Thinking-2507 بـ Qwen3-30B-A3B (التفكير) متوسط ​​الحجم.

صرح المسؤولون أن الإصدار 2507 من طراز Qwen3-4B مناسب بشكل خاص لنشر الأجهزة الطرفية مثل الهواتف المحمولة.

وفيما يلي النقاط البارزة الأساسية للنموذج

Qwen3-4B-Instruct-2507

تم تحسين القدرات العامة بشكل كبير، متجاوزة النموذج التجاري صغير الحجم مغلق المصدر GPT-4.1-nano، ويقترب من أداء الطراز Qwen3-30B-A3B متوسط ​​الحجم (غير قابل للتفكير).

ويغطي النموذج الجديد المعرفة الطويلة بمزيد من اللغات، ويعزز توافق التفضيلات البشرية في المهام الذاتية والمفتوحة، ويمكن أن يقدم استجابات أكثر انسجاما مع احتياجات الناس.

يمتد الفهم السياقي إلى 256 كيلو بايت، ويمكن للنماذج الصغيرة أيضًا التعامل مع النصوص الطويلة.

Qwen3-4B-التفكير-2507

تم تعزيز القدرة على التفكير بشكل كبير، حيث وصل معدل AIME25 إلى 81.3. إن الأداء المنطقي لـ Qwen3-4B-Thinking-2507 يمكن مقارنته بالنموذج متوسط ​​المدى Qwen3-30B-Thinking.

خاصة في تقييم AIME25، الذي يركز على القدرة الرياضية، فقد سجل 81.3 نقطة بمعلمات 4B.

درجات الوكيل خارج المخططات، وجميع المراجعات ذات الصلة تتجاوز نموذج Qwen3-30B-Thinking الأكبر.

تدعم قدرة الفهم السياقي لـ 256 ألف رمز تحليل المستندات الأكثر تعقيدًا، وإنشاء محتوى طويل، والتفكير عبر الفقرات، والسيناريوهات الأخرى.