أصدرت Google DeepMind اليوم ثلاثة نماذج جديدة خاصة بالذكاء الاصطناعي تقول إنها من بين أكثر نماذجها فعالية من حيث الرمز المميز حتى الآن: Gemini 3.6 Flash، وGemini 3.5 Flash-Lite، وGemini 3.5 Flash Cyber.
تهدف النماذج إلى جعل عملاء الذكاء الاصطناعي أسرع وأكثر ذكاءً وأرخص على نطاق واسع. تقوم Google بتسعير Gemini 3.6 Flash بسعر 1.50 دولارًا أمريكيًا لكل مليون رمز إدخال و7.50 دولارًا أمريكيًا لكل مليون رمز إخراج من خلال واجهة برمجة التطبيقات (API)، بينما تبلغ تكلفة Gemini 3.5 Flash-Lite 0.30 دولارًا أمريكيًا / 2.50 دولارًا أمريكيًا لكل مليون رمز مميز داخل/خارج.
قارن ذلك بـ 1.50 دولارًا أمريكيًا/9.00 دولارًا أمريكيًا لكل مليون رمز مميز لـ Gemini 3.5 Flash، و2 دولار أمريكي/12 دولارًا أمريكيًا لـ Gemini 3.1 Pro Preview، وستكون التوفيرات كبيرة. ومع ذلك، فإن الجيل السابق من Google Gemini 3.1 Flash-Lite لا يزال ملكًا لعملاق البحث "الأكثر فعالية من حيث التكلفة" النموذج بسعر 0.25 دولارًا أمريكيًا/1.50 دولارًا أمريكيًا لكل مليون رمز مميز. ومع ذلك، فهو يظل أبطأ مرتين من Gemini 3.5 Flash-Lite الجديد والأكثر تكلفة، مما يمنح الشركات التي تقدر السرعة أكثر "انفجار" مقابل أموالهم.
مخطط مقارنة أسعار VB Frontier AI Model API (القائمة المختصرة لأواخر يوليو 2026)
|
نموذج |
الإدخال (دولار/1 مليون) |
الناتج (دولار/1 مليون) |
الإجمالي (مليون دولار/مليون) |
مصدر |
|
فلاش ميمو V2.5 |
0.10 دولار |
0.30 دولار |
0.40 دولار |
XIAOMI |
|
Deepseek-v4-flash |
0.14 دولار |
0.28 دولار |
0.42 دولار |
ديب سيك |
|
Deepseek-v4-pro |
0.435 دولار |
0.87 دولار |
1.305 دولار |
ديب سيك |
|
ميني ماكس-M3 |
0.30 دولار |
1.20 دولار |
1.50 دولار |
ميني ماكس |
|
LongCat-2.0 — عرض ترويجي لفترة محدودة |
0.30 دولار |
1.20 دولار |
1.50 دولار |
قطة طويلة |
|
الجوزاء 3.1 فلاش لايت |
0.25 دولار |
1.50 دولار |
1.75 دولار |
جوجل |
|
Qwen3.7-بلس |
0.40 دولار |
1.60 دولار |
2.00 دولار |
علي بابا كلاود |
|
ميمو-V2.5 |
0.40 دولار |
2.00 دولار |
2.40 دولار |
XIAOMI |
|
الجوزاء 3.5 فلاش لايت |
0.30 دولار |
2.50 دولار |
2.80 دولار |
جوجل |
|
LongCat-2.0 – قياسي |
0.75 دولار |
2.95 دولار |
3.70 دولار |
قطة طويلة |
|
MiMo-V2.5 Pro (أقل من 256 كيلو) |
1.00 دولار |
3.00 دولار |
4.00 دولار |
XIAOMI |
|
جي إل إم-5.2 |
1.40 دولار |
4.40 دولار |
5.80 دولار |
Z.ai |
|
جي بي تي-5.6 لونا |
1.00 دولار |
6.00 دولار |
7.00 دولار |
OpenAI |
|
جروك 4.5 |
2.00 دولار |
6.00 دولار |
8.00 دولار |
xAI |
|
MiMo-V2.5 Pro (>256 كيلو) |
2.00 دولار |
6.00 دولار |
8.00 دولار |
XIAOMI |
|
الجوزاء 3.6 فلاش |
1.50 دولار |
7.50 دولار |
9.00 دولار |
جوجل |
|
Qwen3.7-ماكس |
2.50 دولار |
7.50 دولار |
10.00 دولار |
علي بابا كلاود |
|
الجوزاء 3.5 فلاش |
1.50 دولار |
9.00 دولار |
10.50 دولار |
جوجل |
|
معاينة الجوزاء 3.1 Pro (200K200K) |
2.00 دولار |
12.00 دولارًا |
14.00 دولارًا |
جوجل |
|
جي بي تي-5.6 تيرا |
2.50 دولار |
15.00 دولارًا |
17.50 دولارًا |
OpenAI |
|
جي بي تي-5.4 |
2.50 دولار |
15.00 دولارًا |
17.50 دولارًا |
OpenAI |
|
كيمي ك3 |
3.00 دولار |
15.00 دولارًا |
18.00 دولارًا |
Moonshot AI |
|
معاينة الجوزاء 3.1 Pro (> 200 ألف) |
4.00 دولار |
18.00 دولارًا |
22.00 دولارًا |
جوجل |
|
كلود أوبوس 4.8 |
5.00 دولار |
25.00 دولارًا |
30.00 دولارًا |
أنثروبي |
|
جي بي تي-5.5 |
5.00 دولار |
30.00 دولارًا |
35.00 دولارًا |
OpenAI |
|
GPT-5.5 فوري (أحدث الدردشة) |
5.00 دولار |
30.00 دولارًا |
35.00 دولارًا |
OpenAI |
|
ساكانا فوجو الترا (272K272K) |
5.00 دولار |
30.00 دولارًا |
35.00 دولارًا |
سكنا آي |
|
جي بي تي-5.6 سول |
5.00 دولار |
30.00 دولارًا |
35.00 دولارًا |
OpenAI |
|
أسطورة كلود 5 / كلود ميثوس 5 |
10.00 دولار |
50.00 دولارًا |
60.00 دولارًا |
أنثروبي |
لم يتم تحديد سعر حتى الآن لنموذج Gemini 3.5 Flash Cyber المتخصص، والذي، كما يوحي اسمه، مصمم للباحثين في مجال الأمن السيبراني وفريق العمل الأحمر لتصحيح الأخطاء.
في حين أن الأسعار هي من بين الحد المتوسط والمنخفض لجميع نماذج الذكاء الاصطناعي الرئيسية على مستوى العالم، فإن حقيقة أن Google صممتها لاستخدام عدد أقل من الرموز المميزة بشكل عام يجب أيضًا أن تؤدي إلى خفض تكاليف المؤسسات بما يتجاوز ما يظهره سعر الملصق (نظرًا لأنك ستدفع مقابل عدد أقل من الرموز المميزة بأي حال من الأحوال).
يتوفر Gemini 3.6 Flash وGemini 3.5 Flash-Lite على الفور من خلال Gemini API في Google AI Studio وAndroid Studio، وكذلك داخل تطبيق Gemini للمستهلك وبحث Google. وفقًا لمنشور منفصل على مدونة Google، سيكون Gemini 3.5 Flash Cyber متاحًا "متاح حصريًا للحكومات والشركاء الموثوقين عبر CodeMender قريبًا" — CodeMender هو وكيل إصلاح أخطاء كود الذكاء الاصطناعي المملوك لشركة Google والذي تم إصداره العام الماضي.
كما هو الحال مع نماذج جيميني السابقة، فإن هذه كلها مملوكة ومملوكة "مصدر مغلق," وبالتالي، لا يمكن الحصول عليها إلا من خلال واجهة برمجة التطبيقات الرسمية لشركة Google وتلك الخاصة بشركائها، على عكس ترخيص مفتوح المصدر مثل MIT أو Apache 2.0.
أحد الإغفالات الواضحة التي لاحظها المطورون على X ووسائل التواصل الاجتماعي: أين سيتم إصدار نموذج Gemini 3.5 Pro الرائد الأكبر والأقوى والذي ألمح إليه Google سابقًا هذا الصيف؟ بعد كل شيء، Gemini 3.1 Pro، الرائد السابق، ظهر لأول مرة في فبراير 2026، ومنذ ذلك الحين أصدر المنافسان OpenAI و Anthropic عدة أجيال أخرى من التحديثات الرئيسية أقوى بكثير من تحديثات Google.
رد لوغان كيلباتريك، الموظف الفني في Google، على أحد هذه الاستفسارات على X، فكتب: "يتم اختبار Gemini 3.5 Pro حاليًا مع الشركاء ونخطط لإتاحته على نطاق واسع بمجرد أن يصبح جاهزًا."
يشير إصدار Google إلى أن المستقبل القريب للذكاء الاصطناعي يكمن في القدرات الوكيلة، وهي الأنظمة التي تعمل بشكل مستقل على مدى فترات طويلة.
إذا كانت نماذج اللغات الكبيرة المبكرة تشبه قطارات الشحن الضخمة المتعطشة للوقود والقادرة على نقل حمولات مذهلة بتكلفة هائلة، فإن سلسلة فلاش الجديدة تمثل أسطولًا من شاحنات التوصيل الهجينة الذكية وذات الكفاءة العالية.
مكاسب الكفاءة تتراوح من 17% إلى 65% خفضت الرموز لتحقيق نتائج قوية على معايير الطرف الثالث
تحت الغطاء، يحقق Gemini 3.6 Flash مكاسب كبيرة في الكفاءة. يقلل النموذج من استخدام رمز الإخراج بنسبة 17% مقارنة بسابقه، Gemini 3.5 Flash، وفقًا لمؤشر التحليل الاصطناعي الذي تحتفظ به مجموعة قياس الذكاء الاصطناعي المستقلة التابعة لجهة خارجية والتي تحمل الاسم نفسه.
في معايير هندسة البرمجيات المحددة طويلة المدى مثل DeepSWE، والتي تقيس مدى نجاح الوكلاء في إكمال المهام الهندسية متعددة الخطوات من الصفر، تصل نسبة التوفير في الرمز المميز إلى 65%.
ويعني هذا التخفيض أن النموذج يتطلب عددًا أقل من خطوات الاستدلال واستدعاءات الأدوات لإكمال نفس سير العمل متعدد الخطوات بالضبط. فكر في الكفاءة الرمزية مثل الاقتصاد في استهلاك الوقود في السيارة.
عندما يتخذ نموذج الذكاء الاصطناعي مسارًا معقدًا لحل مشكلة ما، فإنه يستهلك المزيد من الوقود الحسابي، مما يؤدي إلى رفع التكلفة النهائية للمطور. ومن خلال تبسيط منطقه الداخلي، يصل Gemini 3.6 Flash إلى الإجابة الصحيحة بشكل أسرع وأرخص.
في حين أن مواد جوجل لم تحدد التغييرات المعمارية أو الخوارزمية الدقيقة المستخدمة لتحقيق كفاءة الرمز المميز هذه، إلا أنها أشارت إلى أن النموذج "يأخذ عددًا أقل من خطوات التفكير واستدعاءات الأدوات لإنجاز مهام سير العمل متعددة الخطوات" والمعارض خفضت "الإسهاب."
تكشف بطاقات النموذج الرسمية التي أصدرتها Google أن كلا من Gemini 3.6 Flash وGemini 3.5 Flash-Lite يتميزان بنافذة سياق إدخال تحتوي على مليون رمز إلى جانب حد أقصى للمخرجات يبلغ 64000 رمز، مع مشاركة كلا النموذجين في تاريخ قطع المعرفة وهو مارس 2026.
أداء معياري محترم بتكلفة منخفضة
وتمتد التحسينات التكنولوجية إلى القدرات الملموسة. حقق Gemini 3.6 Flash نسبة 49% في اختبار DeepSWE، وهي زيادة ملحوظة عن نسبة 37% التي حققها الإصدار 3.5.
كما أنه يدفع أداء هندسة التعلم الآلي إلى أعلى، حيث سجل 63.9% على MLE-Bench مقارنة بـ 49.7% سابقًا. علاوة على ذلك، تدمج Google استخدام الكمبيوتر كأداة مدمجة من جانب العميل عبر Gemini API وGemini Enterprise، مما يعكس نتيجة معتمدة من OSWorld بنسبة 83.0%، ارتفاعًا من 78.4%.
يتعامل النموذج أيضًا مع العمل المعرفي بكفاءة أكبر، ويتفوق على سابقه في معايير مثل الناتج المحلي الإجمالي (GDVal-AA v2) بالانتقال من درجة 1349 إلى 1421.
ولضمان السلامة وسط ترقيات القدرات هذه، تنشر Google وسائل حماية محسنة للسلامة الحدودية. تعمل وسائل الحماية هذه على تقوية النموذج ضد عمليات كسر الحماية وتخفيف المخاطر في المجالات الكيميائية والبيولوجية والإشعاعية والنووية، بالإضافة إلى إساءة استخدام الجرائم السيبرانية.
يقوم الفريق الهندسي بتدريب النموذج لتقليل حالات رفض الاستخدامات المفيدة، وتحقيق التوازن الضروري بين الأمان الصارم والمنفعة العملية.
منماذج لحالات استخدام الترميز والوكلاء والأمن السيبراني منخفضة التكلفة – على التوالي
قسمت Google عروضها الجديدة إلى ثلاثة منتجات متميزة مصممة لتلبية الاحتياجات التشغيلية المختلفة.
يعمل Gemini 3.6 Flash بمثابة العمود الفقري للخدمة الشاقة للثلاثي. فهو يتعامل مع الترميز المعقد والعمل المعرفي المعقد والمعالجة متعددة الوسائط بدقة محسنة. يستخدمه عملاء المؤسسات في المهام الصعبة مثل تحليل المستندات المعقدة، والمخططات المعقدة، وتحليل البيانات، وصياغة التقارير الطويلة. ينفذ النموذج عمليات ترحيل معقدة للتعليمات البرمجية باستخدام أطر عمل تزامن متعددة الوكلاء مع زمن وصول أقل وجودة أعلى من التكرارات السابقة. علاوة على ذلك، يساعد فلاش 3.6 في تطوير أدوات استخراج نسيج الصور الفوتوغرافية لسير العمل ثلاثي الأبعاد باستخدام واجهات قماشية.
يستهدف Gemini 3.5 Flash-Lite البيئات التي تكون فيها الإنتاجية العالية والحد الأدنى من زمن الوصول المطلق غير قابلين للتفاوض. تصنفه Google على أنه أسرع طراز في سلسلة 3.5.
وفقًا لقياس التحليل الاصطناعي، يعالج النموذج 350 رمزًا مميزًا للإخراج في الثانية، مما يجعله فعالاً للغاية للبحث الوكيل وأحمال عمل معالجة المستندات الضخمة. يشير التحليل الاصطناعي إلى أن هذا أسرع بمرتين تقريبًا من طراز الجيل السابق Gemini 3.1 Flash-Lite.
يمكن للمطورين تكوين 3.5 Flash-Lite لإعطاء الأولوية للتنفيذ منخفض زمن الوصول للمهام كبيرة الحجم باستخدام الحد الأدنى من مستويات التفكير، أو إشراك مستويات تفكير أعلى لمعالجة أعباء عمل الوكيل الفرعي المعقدة متعددة الخطوات.
على الرغم من تصنيفه الخفيف، فإنه يتفوق على Gemini 3 Flash القياسي في العديد من التقييمات الرئيسية للوكلاء والتشفير، بما في ذلك SWE-Bench Pro، حيث سجل 54.2% مقارنة بـ 49.6%، وOSWorld-Verified، حيث سجل 74.0% مقابل 65.1%.
يستخرج النموذج ميزات المنتج من مجموعات البيانات الضخمة، ويولد مفاهيم تصميم الويب التفاعلية، ويقيس ترجمة الإيصالات بسلاسة.
المنتج الثالث، Gemini 3.5 Flash Cyber، يمثل عملية نشر متخصصة للغاية. قامت Google بضبط هذا النموذج خصيصًا للعثور على ثغرات الأمن السيبراني وإصلاحها. إنه يتكامل مباشرة مع وكيل CodeMender من Google.
من الناحية العملية، يعمل العديد من وكلاء Flash Cyber 3.5 بشكل متزامن لإنتاج تقرير واحد وشامل عن نقاط الضعف، مما يحقق أداءً تنافسيًا على الحدود وفقًا لمعيار CyberGym.
لم تحدد Google تكلفة رقمية دقيقة لـ 3.5 Flash Cyber، مشيرًا فقط إلى أنه تم ضبطه بدقة "بسعر أقل لكل رمز مميز من النماذج الأكبر.
ترخيص تجاري فقط
يحمل إطار الترخيص لنماذج Gemini الجديدة آثارًا عميقة على المطورين ومستخدمي المؤسسات. تنشر Google الإصدارين Gemini 3.6 Flash و3.5 Flash-Lite ضمن نموذج تجاري خاص بواجهة برمجة التطبيقات (API). على عكس البرامج مفتوحة المصدر التي تحكمها تراخيص مثل ترخيص MIT أو ترخيص GNU العام، لا يتمكن المطورون من الوصول إلى أوزان النماذج الأساسية أو بيانات التدريب أو كود المصدر.
يمنح ترخيص MIT أو GPL المستخدمين حرية تنزيل قاعدة التعليمات البرمجية، وتعديل البنية الداخلية، واستضافة النشر ذاتيًا، وتوزيع البنية التحتية للبرنامج بشكل مستقل. في المقابل، فإن نهج Google API يعني أن المطورين يؤجرون بشكل أساسي الوصول إلى المعلومات على أساس مقنن صارم. تنتقل كل استجابة سريعة ومولدة عبر خوادم Google المُدارة، مما يؤدي إلى تكبد تكلفة بناءً على هيكل التسعير الصارم الذي يبلغ 1.50 دولارًا أمريكيًا لكل مليون رمز إدخال لـ 3.6 Flash.
هذا الربط التجاري يقيد مرونة النشر. لا تستطيع المؤسسات نشر النماذج بالكامل على أجهزتها المحلية الآمنة دون إبرام اتفاقيات مؤسسية متخصصة وعالية المستوى مع Google Cloud. يظل المطورون ملتزمين بسياسات الاستخدام المقبولة من Google، وحدود الأسعار التعسفية، ومتطلبات الشبكة، مما يؤدي إلى إنشاء اعتماد دائم على وقت تشغيل البنية التحتية لـ Google وشروط الخدمة.
أثبت ترخيص Gemini 3.5 Flash Cyber أنه أكثر تقييدًا. اعترافًا بطبيعة الاستخدام المزدوج للذكاء الاصطناعي في مجال الأمن السيبراني – والذي يمكن للمهاجمين تسليحه بنفس السهولة التي يمكن للمدافعين استخدامها لتصحيح الأنظمة – تعمل Google حاليًا على جعل النموذج متاحًا فقط خلف برنامج تجريبي محدود الوصول، على غرار الاتجاه الذي بدأه نموذج Anthropic’s Mythos مع برنامج Project Glasswing، واستمرت بواسطة OpenAI مع طرحها المتدرج لـ GPT-5.6.
وفي هذه الحالة، ستوفر Google الإصدار 3.5 Flash Cyber حصريًا للحكومات والشركاء الموثوقين. تمنع عملية الحراسة الصارمة هذه الوصول المفتوح، مما يعطي الأولوية للأمن النظامي على ابتكارات المطورين واسعة النطاق.
نتطلع إلى الأمام
يستمر Google DeepMind في التكرار بسرعة، لكن الفجوة في خط إنتاجه تظل واضحة. بينما تتفوق سلسلة فلاش في السرعة والاقتصاد،
تنتظر الصناعة بفارغ الصبر نشر Gemini 3.5 Pro لقياس قدرات Google المطلقة.
وفي الوقت نفسه، تؤكد الشركة أن التدريب المسبق للعبة Gemini 4 قد بدأ بالفعل.
وإلى أن يتم إطلاق الإصدار الرئيسي التالي، يجب على المطورين تحسين أنظمتهم باستخدام بنية Flash عالية الكفاءة، ولكنها مقيدة بشكل مقصود.
