العودة إلى جميع المقالات
مقال

نماذج ذكاء اصطناعي تستحق المتابعة في أغسطس 2026: ما الجديد ولمن تناسب؟

الكاتب:

أبرز تحديثات أغسطس للعمل اليومي والبرمجة والصور والفيديو والتفريغ والاستخدام المحلي، مع تواريخ الإصدار وطرق الوصول وأسباب التجربة.

صندوق أدوات مفتوح ومقسم يحتوي على مستند وصورة وشريط فيلم وميكروفون

إذا كان لديك مساعد ذكاء اصطناعي ينجز معظم عملك، فلا يستحق نموذج جديد انتباهك بلا سبب. قدم أغسطس أسبابًا عدة: تحديثات للمحادثة اليومية، وخيارات أكثر داخل أدوات البرمجة، وتحكم أكبر في تعديل الصور والفيديو، وطريقة أخرى لتشغيل مساعد على جهازك.

تبدأ قائمتنا لأغسطس بالمهمة التي تريد تحسينها. يهم تحديث GPT-5.6 مستخدمي ChatGPT الحاليين مباشرةً. ويستحق Gemini 3.7 Flash وDeepSeek-V4-Pro نظر المطورين. أما المبدعون فلديهم أمور ملموسة يختبرونها في Imagine Image 2.0 وضوابط الفيديو الجديدة في FLUX 3 Video وGemini Omni 1.1 Flash.

يغطي العدد الأول من AI Model Monthly إصدارات وتغييرات توفر مهمة بين 1 و31 أغسطس 2026، جرى التحقق منها بمصادر عامة في 8 سبتمبر. إنه اختيار تحريري للتغييرات الموثقة، لا بطولة عملية. تصف طرق الوصول أدناه ما أُعلن؛ وقد تختلف الحسابات والمناطق والخطط الحالية.

اختر القسم الذي يناسب عملك

مهمتكابدأ بـسبب استحقاقه النظر
الكتابة اليومية وتنظيم المعلوماتتحديث أغسطس لـ GPT-5.6 Sol / Lunaربما تغيرت تجربة محادثتك الحالية
البرمجة والعمل متعدد الخطواتGemini 3.7 Flash؛ DeepSeek-V4-Proإصدارات وخيارات تكامل جديدة
تعديل صور ترويجيةImagine Image 2.0تحديد المناطق والتحرير القائم على المراجع
إنشاء فيديو قصيرFLUX 3 Video؛ Gemini Omni 1.1 Flashإطارات رئيسية وتمديد وضوابط معاينة
تحويل الكلام إلى نصGemini 3.5 Transcribeمساران منفصلان للمباشر والصوت المسجل
تشغيل مساعد محليًاMuse Glimmerأوزان مفتوحة مع إرشادات فعلية للأجهزة المحلية

تقدم الأقسام التالية دليل الإصدار والحدود وراء هذه الخيارات. ويضيف Grok 4.6 وMuse Spark 1.2 وGLM-5.3-Flash وQwen3.8-Flash-Next خيارات لمن يبني بالنماذج.

المحادثة اليومية: ربما يؤثر تحديث GPT-5.6 فيك بالفعل

تصف بطاقة نظام OpenAI في 6 أغسطس إصداري GPT-5.6 Sol وLuna المحدثين لـ ChatGPT. وتعلن خيارًا افتراضيًا جديدًا لمستخدمي Free وGo، ووصولًا محدثًا إلى Sol مع شريط للجهد لمستخدمي Plus وPro. عند الإصدار، احتفظ Codex وChatGPT Work بإصدارات يوليو.

يهم هذا الفرق حين تسمع أن «GPT-5.6 تحسن». يجب كتابة المنتج وإصدار النشر إلى جانب اسم النموذج. لا تصف نتيجة من ChatGPT تلقائيًا الإصدار الذي استخدمه شخص في أداة برمجة.

هذا سبب للمستخدم اليومي لإعادة تجربة مهمة عالجها مساعده سابقًا بصورة ضعيفة قبل شراء اشتراك آخر. تخيل فعالية صغيرة لها وصف وحد أقصى للحضور وتاريخ مؤكد. اطلب دعوة قصيرة، ثم افحص بقاء التاريخ والسعة. الدعوة الأكثر سلاسة التي تغير أحدهما عمل إضافي، مهما كان اسم النموذج.

البرمجة: وسّع أغسطس مجموعة المقارنة المفيدة

تستهدف إصدارات البرمجة بصورة متزايدة الوكلاء، أي برامج تتيح للنموذج فحص الملفات واستخدام الأدوات والعمل عبر خطوات. والسؤال العملي هو هل يستطيع النموذج والأداة معًا إنهاء التغيير بتصحيح أقل.

Gemini 3.7 Flash: خيار جديد للعمل المتكرر

قدمت Google نموذج Gemini 3.7 Flash في 13 أغسطس، مع التركيز على البرمجة وسير الوكلاء. يسرد الإعلان وصول المطورين عبر Gemini API وGoogle AI Studio إلى جانب تكاملات أخرى. وحُدد الوصول الفردي عبر Gemini Spark لمشتركي Pro وUltra في الدول المدعومة.

كان عرض الإطلاق $0.75 لكل مليون رمز إدخال و$3.75 لكل مليون رمز إخراج حتى نهاية 2026. الرموز وحدات قياس معالجة النص. هذه أسعار API، لا سعر اشتراك محادثة أو تكلفة إنهاء مهمة كاملة.

سنضعه في قائمة لمهام المستندات أو البرمجة المتكررة التي تهم فيها التكلفة والتصحيحات. أعطه في مثال الفعالية خطأً صغيرًا في نموذج التسجيل يسمح بحجز واحد فوق السعة. تحقق من الحد الدقيق ورسالة الخطأ. وسجّل إعادة المحاولة ووقت المراجعة مع رسوم الاستخدام؛ لا يفيد السعر المنخفض إذا أخفق التغيير مرارًا.

DeepSeek-V4-Pro: تحديث خلف اسم مألوف

يسجل سجل تغييرات DeepSeek في 13 أغسطس الإصدار العام لـ V4-Pro عبر التطبيق والموقع وAPI. وواصل المطورون استخدام اسم النموذج نفسه deepseek-v4-pro. كما وثق التحديث توافق Responses API وضبط جهد التفكير.

هذا سبب جيد لمستخدم DeepSeek الحالي لإعادة تشغيل مهمة محفوظة. ثبات اسم API لا يعني ثبات السلوك. احتفظ بتاريخ الاختبار والإعدادات مع النتيجة حتى تظل مقارنة لاحقة مفهومة.

يسجل السجل نفسه V4-Flash-Vision-Exp في 21 أغسطس، وهو نموذج API تجريبي للفهم البصري. عامله خيارًا مستقلًا لقراءة لقطات الشاشة والمدخلات البصرية. ليس مولد صور، وتجريبيته تجعله مرشحًا للتقييم قبل الاعتماد عليه.

Grok 4.6 وMuse Spark 1.2: انظر داخل أداة البرمجة

أُطلق Grok 4.6 في 12 أغسطس، مع وصول عبر Grok Build وCursor وAPI. إذا توفر في أداة تستخدمها، يقدم مقارنة إضافية ملائمة لتغيير متعدد الملفات. تركيز المزود على العمل الطويل سبب لاختباره، لا دليلًا على إتمامه مهام مستودعك بموثوقية أعلى.

جمع إصدار Meta في 5 أغسطس بين Muse Spark 1.2، أي النموذج، وMuse Code beta، أي وكيل برمجة للطرفية. افصل الاسمين: الوكلاء الخلفيون الدائمون وسلوك الاستئناف في الأداة جزء من نظام تنفيذها، وليسا ميزتين تحصل عليهما تلقائيًا باستدعاء النموذج في مكان آخر.

قارن إعداد برمجة كاملًا بآخر كامل، أو ثبّت بيئة الأداة عند مقارنة النماذج. وإلا بدا اختلاف الأدوات أو الأذونات أو إعادة المحاولة كأنه اختلاف في ذكاء النموذج.

الصور: يجعل Imagine Image 2.0 التحرير هو السؤال المفيد

وصل Imagine Image 2.0 في 7 أغسطس كوضع Quality Mode الجديد في منتجات Grok للويب والهاتف، مع وصول API باسم grok-imagine-image-2.0. يصف الإعلان تحرير منطقة مختارة وإزالة الخلفية والتحرير بعدة صور مرجعية.

يجعله ذلك جديرًا بالنظر للأصول الترويجية التي تحتاج إلى مراجعتها. جرّب على صورة مصرح بها لمكان الفعالية تغيير لون لافتة مع الحفاظ على القاعة والأثاث والإشارات. افحص المساحات التي لم تتغير بقدر المعدلة. لا يغني وعد المزود بالتحرير الدقيق عن الفحص.

إذا احتاجت الصورة النهائية إلى تفاصيل فعالية دقيقة، فافحص كل تاريخ واسم وسطر. ويمكنك أيضًا توليد الصورة وإضافة الصياغة المعتمدة في أداة تخطيط. لا تبرر ادعاءات الطباعة التوقف عن التدقيق.

الفيديو: اضبط اللقطة قبل الحكم على الإبهار

تكتسب تطورات أغسطس التالية أهمية حين تكون لديك لقطة بعينها، لا طلب مفتوح لمقطع جذاب.

FLUX 3 Video: أصبح التوليد متاحًا لمستخدمي API

أتاحت Black Forest Labs توليد FLUX 3 Video عمومًا في 4 أغسطس عبر API وشركاء مختارين. وصف العرض الأول مقاطع حتى 20 ثانية بصوت أصلي وإطارات رئيسية وتمديد فيديو ووضع مسودة. ويميز الإعلان إخراج HD عن Full HD الناتج من رفع الدقة.

تتمثل الجاذبية العملية في تحديد أجزاء أكثر من التسلسل. ابدأ في إعلان فعالية بصورة المكان المعتمدة واطلب حركة كاميرا هادئة واحدة. احكم على بقاء القاعة واضحة ووصول الحركة إلى نهايتها المطلوبة. تفشل حركة مبهرة إذا اخترعت بابًا.

Gemini Omni 1.1 Flash: طرق أكثر لمراجعة التسلسل

يضيف إصدار Google للمطورين في 27 أغسطس تمديد المشهد والتحكم في الإطارين الأول والأخير ومعاينات أقل دقة ورفعًا إلى 4K عبر Gemini API في Google AI Studio.

سننظر فيه عندما تهم الصورتان الأولى والأخيرة، أو يحتاج مقطع صالح إلى تمديد. ومن المفيد مقارنته بـ FLUX في حفاظ كل نظام على العنصر عبر الانتقال المطلوب. حدّد الصوت والمدة وإعدادات الإخراج. لا يجعل رفع نتيجة إلى 4K التوليد أصليًا بدقة 4K، وتمديد تسلسل غير توليد كامل المدة دفعةً واحدة.

التفريغ: يفصل Gemini 3.5 Transcribe الكلام المباشر عن التسجيلات

أعلنت Google عن Gemini 3.5 Transcribe في 26 أغسطس. يقدم مسار بث مباشر ومسار صوت مسجل مسبقًا، مع دعم الأخير لإسناد المتحدث وطوابع زمنية لكل كلمة. ويصف الإصدار مصطلحات مخصصة وتنظيف التردد والتصحيح الذاتي.

يفيد ذلك في تحويل الملاحظات المنطوقة إلى وثيقة عمل سهلة القراءة، لكنه يطرح سؤالًا: هل تريد ما قيل، أم المعنى المقصود بعد التنظيف؟

تخيل أنك تملي للفعالية: «احجزها الثلاثاء، عفوًا، الأربعاء». ينبغي لملاحظة تخطيط مصقولة أن تعكس التصحيح، بينما يحتفظ السجل الحرفي بالكلام الأصلي. قرر قبل المقارنة. افحص الأسماء والتواريخ والتصحيحات مقابل التسجيل بدل الحكم على سهولة قراءة النص وحدها.

يصف الإصدار إسنادًا حتى ثلاثة متحدثين، والمجموعات الأكبر تجريبية. يهم الحد من يفرغ نقاشًا جماعيًا أكثر من ادعاء عام عن الجودة.

النماذج المحلية والمفتوحة: افحص ما يمكنك تشغيله فعلًا

Muse Glimmer: أوضح قصة للاستخدام المحلي في القائمة

أصدرت Meta نموذج Muse Glimmer في 10 أغسطس، واصفةً نموذجًا من 30 مليار معامل بأوزان Apache 2.0 لسير وكلاء محلي. تشرح الأجهزة التكميم، أي ضغط التمثيل العددي للنموذج، وتكوينات ضمن ذاكرة 24 أو 32 GB.

يستحق الاهتمام إذا كان تشغيل النموذج على جهازك مطلبًا. ابدأ بتنزيلاته وإرشادات النشر في الإعلان. وافحص احتياج الذاكرة كاملًا، بما فيه ذاكرة العمل، بدل افتراض أن حجم التنزيل كل ما تحتاج إليه.

قد يكون النموذج المحلي مكوّنًا في مساعد محلي. لا يزال عليك فحص التطبيق المحيط والأدوات المتصلة قبل افتراض بقاء كل عملية على الجهاز.

GLM وQwen: خياران مفيدان للمطورين لسببين مختلفين

تؤكد ملاحظة إصدار Cloudflare في 26 أغسطس توفر GLM-5.3-Flash على Workers AI بمدخلات متعددة الوسائط، مع اشتراط خطة Workers مدفوعة أو أرصدة AI Gateway مسبقة الدفع. يقدم ذلك خيار نشر آخر للفرق الموجودة على المنصة. ولا يقول اسم «Flash» شيئًا عن ملاءمة النموذج لحاسوبك المحمول.

أما Qwen3.8-Flash-Next فهو عنصر لمتابعة المعمارية. يصف إعلان أغسطس وبحث المعمارية إصدارًا مبكرًا يتيح للمجتمع تقييم تغييرات قبل Qwen4. يستحق المتابعة لمن يقدم النماذج أو يكيّفها، لكنه ليس إطلاق Qwen4 أو سببًا واضحًا لمستخدم محادثة يومي كي ينتقل.

جرّب نموذجًا واحدًا مقابل مطلب حقيقي واحد

لا تحتاج إلى اعتماد القائمة كلها. خذ مهمة تكررها، وثبّت مدخلها، وقارن إعدادك الحالي بمرشح واحد مناسب. اكتب ما يجعل الناتج غير مقبول قبل تشغيل أي منهما.

قد يكون ذلك في مواد الفعالية تاريخًا لا يتغير، أو حد حجز لا يمكن تجاوزه، أو قاعة تظل واضحة، أو نصًا يتعامل مع تصحيح كما ينبغي. سجّل النموذج والمنتج والتاريخ والإعدادات والأخطاء ووقت التصحيح والتكلفة الفعلية. احتفظ بما يساعدك على إنهاء العمل بإصلاح أقل.

المراجع