نموذج Google الجديد للذكاء الاصطناعي في البرمجة أصبح أفضل بكثير — وسعره النصف حتى يناير
يُحقق نموذج Gemini 3.7 Flash الجديد من Google تحسينات ضخمة في مهام البرمجة وسعره النصف حتى نهاية 2026، لكنه لا يزال يفشل في معظم المهام المعقدة متعددة الخطوات.
- 65.3%
- الدرجة في معيار DeepSWE لهندسة البرمجيات
- $0.75 / 1M tokens
- سعر الإدخال حتى 31 ديسمبر 2026
- 340 tokens/sec
- سرعة الإخراج — الأسرع بين 186 نموذجًا اختُبر
- 23 days
- الوقت بين Gemini 3.6 Flash و3.7 Flash
حققت Google للتو أحد أكبر القفزات في أداء الذكاء الاصطناعي للبرمجة من إصدار لآخر. في 13 أغسطس، أطلقت الشركة نموذج Gemini 3.7 Flash — نموذج حقق قفزة كبيرة في جميع اختبارات البرمجة مقارنةً بسلفه الذي صدر قبل 23 يومًا فقط. في معيار DeepSWE الذي يحاكي مهام هندسة البرمجيات الحقيقية، ارتفعت الدرجة من 49% إلى 65.3%. واختبار آخر، AutomationBench، تضاعف تقريبًا من 17% إلى 30.4%.
ما يجعل هذا الخبر مهمًا الآن لكل من يبني برمجيات هو السعر. حتى 31 ديسمبر 2026، تتقاضى Google 0.75 دولار لكل مليون توكن — والتوكن هي القطع النصية الصغيرة التي يقرأها النموذج ويكتبها، وتعادل تقريبًا ثلاثة أرباع كلمة. هذا نصف السعر المعتاد حتى يناير، حين يتضاعف السعر إلى 1.50 دولار. الأشهر الخمسة القادمة هي أفضل فرصة للبناء بهذا النموذج وقياس مدى فائدته الحقيقية.
ثمة حد مهم ينبغي معرفته. حتى عند هذا المستوى المحسّن، لا يزال Gemini 3.7 Flash يفشل في معظم المهام المعقدة متعددة الخطوات — تلك التي تطلب فيها من وكيل ذكاء اصطناعي إدارة مشروع كامل من البداية إلى النهاية. تضاعف AutomationBench تقريبًا، وهذا يبدو كبيرًا، لكن سبعة من كل عشرة محاولات معقدة لا تزال تفشل. وحتى الآن، لا يستطيع المستخدمون في أوروبا الوصول إلى النسخة الاستهلاكية.
من الناحية العملية، يُعدّ Gemini 3.7 Flash أداة قوية للمهام البرمجية الفردية: كتابة دالة، ومراجعة طلب سحب، وتوليد الاختبارات، وشرح كود غير مألوف. الوقت المناسب للاختبار هو الآن، ريثما يظل سعر الإطلاق ساريًا. جرّبه على عملك الحقيقي — الفجوة بين أدوات الذكاء الاصطناعي تتغير كل بضعة أسابيع، والاختبار الشخصي يخبرك أكثر من أي قائمة تصنيف.