أخبار الذكاء الاصطناعي لتوليد الصور والفيديو — 2026-09-05
هيمن GPT-6 «Astra» على الضجة الخاصة بالنماذج المغلقة المصدر عبر X وBluesky هذا الأسبوع، بينما حافظت نماذج الفيديو/الصور المفتوحة الأوزان (LTX-2.5 وMiniMax H3 وQwen-Image-3.0) على زخمها بالكامل تقريبًا داخل منظومة ComfyUI. أما القصة الأبرز إجمالًا فكانت تحوّل Midjourney من توليد الصور إلى أجهزة الموجات فوق الصوتية الطبية.
ملخص أخبار الذكاء الاصطناعي لتوليد الصور والفيديو — المغلق مقابل المفتوح — 2026-09-05
مرحبًا! كان عالم الذكاء الاصطناعي لتوليد الصور والفيديو هذا الأسبوع فوضويًا تمامًا 🔥. في جانب النماذج المغلقة، استحوذ GPT-6 «Astra» من OpenAI على المشهد بعد انتشار هائل على X (تويتر سابقًا) تجاوز 100 مليون مشاهدة 😳. وفي المقابل، لم يتأخر جانب المصدر المفتوح: إذ ظهرت تباعًا نماذج قوية مثل LTX-2.5 وMiniMax H3 وQwen-Image-3.0 بأوزان مفتوحة، وأصبح ComfyUI بمثابة المنصة الأم الفعلية لها 🛠️. والخبر المثير بهدوء هو أن Midjourney تحولت من توليد الصور إلى شركة لأجهزة الموجات فوق الصوتية الطبية 😱. وكان لافتًا أيضًا أن نقاش المعاملة القانونية لمخرجات الذكاء الاصطناعي جذب مستخدمي Reddit أكثر من تطور التقنية ذاتها.
عبر المنصات
- موجة GPT-6 Astra: أصبح حديث الساعة بسرعة على كل من X وBluesky (مع اختبار صورة البجع الذي يجريه Simon Willison). X: https://x.com/OpenAI/status/2095595741528125780 / Bluesky: https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c . واللافت أنه لا يُسوَّق بوصفه نموذجًا لتوليد الصور/الفيديو، لكن الجميع يختبر Astra في النمذجة ثلاثية الأبعاد والرسوم المتحركة 😂
- ComfyUI قاعدة المصدر المفتوح الفعلية: على YouTube وLemmy معًا، يُتحدث عن Wan وFLUX وQwen-Image وLTX-2.5 وMiniMax H3 وTrellis.2 بوصفها مرتبطة دائمًا بـComfyUI. YouTube: https://www.youtube.com/watch?v=3BFDcO2Ysu4 / Lemmy: https://blog.comfy.org/p/trellis2-and-pixal3d-are-now-native
- إشكالية MiniMax H3: «مفتوح» لكن الاستخدام التجاري مدفوع: كان ذلك موضوعًا على Lemmy أيضًا؛ فهو نموذج فيديو يعمل حتى على فئة RTX3060، لكن يتطلب ترخيصًا مدفوعًا عبر Comfy. https://blog.comfy.org/p/comfy-is-now-the-only-official-reseller . الحدود بين المفتوح والمغلق أصبحت ضبابية جدًا 🤔
- الجدل والتحولات تتفوق على التقنية في جذب الانتباه: ظهر النمط نفسه في Reddit، حيث تجاوز نقاش حكم قضائي يتعلق بمواد CSAM المولدة بالذكاء الاصطناعي 800 تعليق، https://www.reddit.com/r/news/comments/1w5k6pr/ ، وفي Lemmy حيث حصد تحوّل Midjourney إلى الأجهزة الطبية درجات 58–73، https://lemmy.zip/post/66397234 .
حسب المنصة
Reddit: كان الملخص الشهري في r/StableDiffusion حول الإصدارات المفتوحة الكثيرة—مثل Qwen3.8 وDeepSeek-V4-Pro وLing-3.0 وGemma-4-31B—موضوعًا ممتازًا، وبوتيرة يصعب حتى على التعليقات مواكبتها: https://www.reddit.com/r/StableDiffusion/comments/1w3rwoe/ . كما برز Atlas من World Labs، الذي ينشئ عالمًا ثلاثي الأبعاد فورًا من فيديو أو صور، بما يفتح بابًا للروبوتات: https://www.reddit.com/r/accelerate/comments/1w5ye9s/ . لكن أكثر المواضيع انتشارًا لم يكن خبرًا تقنيًا، بل نقاش حكم «مواد إباحية للأطفال مولدة بالذكاء الاصطناعي محمية دستوريًا»، ما يشير إلى أن القانون والأخلاق يشعلان النقاش في Reddit أكثر من أخبار التقنية.
X: انحصر البحث في أربع منشورات مرتبطة بـAstra، ليصبح GPT-6 Astra صاحب الساحة وحده 🎤. ومنشور المطور @Dimillian، الذي عرض مسارًا ثلاثي الأبعاد من Blender إلى UE5، كان الأكثر تقنية: https://x.com/Dimillian/status/2095596700815516004 . لم يظهر أي محتوى مفتوح المصدر مثل Stable Diffusion أو Flux أو Wan ضمن نطاق البحث هذه المرة، وهي فجوة حقيقية.
YouTube: احتوى جانب النماذج المغلقة على مراجعات مقارنة كثيرة لـNano Banana 2 وKling 3.0 مقابل Veo3.1 وSora2، وSeedance2.5 وSeedream5.0 Pro: https://www.youtube.com/watch?v=AAD7wJ3DWiA . وعلى الجانب المفتوح، ظهرت LTX-2.5—نموذج سريع يولد فيديو 720p لمدة 10 ثوانٍ في 6.8 ثانية—https://www.youtube.com/watch?v=RjlbDhs1MPk ، وHunyuanImage3.0، نموذج MoE من 80 مليار معامل: https://www.youtube.com/watch?v=U-8RjjU7x14 . أصبح من المعتاد مقارنة النماذج المفتوحة الأوزان مع النماذج المغلقة فور إعلانها. وظهر أيضًا حديث عن إنهاء OpenAI لواجهة Sora API لتركيز الموارد على نموذج تالٍ باسم «Spud»، لكن الفيديو نفسه لم يُتحقق منه مباشرة.
Bluesky: أصبح «اختبار صورة البجع» المتكرر لدى Simon Willison محطة رصد ثابتة لجودة النماذج المغلقة: https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c . ويعمل الحساب الرسمي لـReplicate مركزًا لإعلانات نماذج الفيديو مثل Kling3.0 وSeedance2.0 وRunway Gen-4.5 وVidu Q3: https://bsky.app/profile/replicate.com/post/3mf5fbf6u4l2c . تكاد تنعدم الإعلانات الأولية الخاصة بالمصدر المفتوح؛ حتى ostris، مطور أدوات LoRA، قال إن مجتمع AI/ML بقي تقريبًا على X (Twitter) 😅. أما المحتوى الياباني فيقتصر تقريبًا على مشاركة مقال GIGAZINE عن Qwen-Image-3.0: https://gigazine.net/news/20260722-qwen-image-3/ .
Lemmy: مجتمع !«メールアドレス» هو الأعلى كثافةً بالمعلومات عن النماذج المفتوحة. استحوذت مواد MiniMax H3، مثل تحول Comfy إلى موزع تجاري رسمي https://blog.comfy.org/p/comfy-is-now-the-only-official-reseller وأدوات تشغيله بذاكرة VRAM قدرها 16GB، على ما يقارب نصف المنشورات. كما حظي LLaDA-Image، بوصفة تدريب مفتوحة بالكامل، بالاهتمام: https://arxiv.org/abs/2609.03796 . وفي الجانب المغلق، تفوق خبر تحوّل Midjourney من توليد الصور إلى أجهزة المسح بالموجات فوق الصوتية الطبية على أخبار النماذج الجديدة بفارق كبير في التقييم (58–73)، وكان محور اهتمام مجتمع Lemmy.
Pinterest: بصريًا، هيمنت النماذج المغلقة بشدة؛ إذ كانت Google Veo2/3 وMicrosoft VASA-1 وGrok4.6 ووصول Gemini إلى مليار مستخدم مواد متكررة لصور الملخصات. ولم يظهر من الأسماء المفتوحة بوضوح سوى أداة AMD المحلية «Amuse 3.0». كما كثرت حالات الاستخدام التي «تحرك الوجه أو تنشئه»—مزامنة الشفاه، ومحاكاة التعبيرات، وإنشاء الصور الشخصية—وهو ما يبدو مناسبًا لجمهور Pinterest المهتم بالجمال وأفكار منشورات الشبكات الاجتماعية.
ما ينبغي متابعته
- المستجدات البصرية لـGPT-6 Astra — X، https://x.com/flowith/status/2095750768204877858 (إعلان قريب لمقارنة رسوم متحركة بين GPT-6 Astra وGPT-5.6)
- إيقاف Sora API ثم نموذج «Spud» التالي — وفق بحث YouTube، من المقرر إنهاء API في 2026-09-24. لم يتحقق أحد بعد من اللقطات أو الخصائص الفعلية.
- مصير ترخيص MiniMax H3 التجاري — Lemmy، https://blog.comfy.org/p/comfy-is-now-the-only-official-reseller (هل يترسخ نهج الأوزان المفتوحة مع دفع الاستخدام التجاري؟)
- تحوّل Midjourney إلى الأجهزة الطبية — Lemmy، https://lemmy.zip/post/66397234 (هل يغادر لاعب مخضرم في النماذج المغلقة مجال توليد الصور فعليًا؟)
- وصفة التدريب المفتوحة بالكامل لـLLaDA-Image — Lemmy/arXiv، https://arxiv.org/abs/2609.03796 (إلى أي مدى ستنتشر محاكاة هذا النموذج المفتوح المتقدم في Qwen-Image-Bench؟)
- Atlas من World Labs — Reddit، https://www.reddit.com/r/accelerate/comments/1w5ye9s/ (كيف يمكن إعادة استخدام إنشاء العوالم ثلاثية الأبعاد من الفيديو في بيانات تدريب الروبوتات؟)
التوصيات
- ينبغي إعادة جمع نتائج X باستخدام تسميات محددة مثل «Stable Diffusion» و«ComfyUI» و«Flux» و«Wan» و«Kling» و«Sora» بدل الاعتماد على المواضيع الرائجة.
- لأن واجهة
searchPostsفي Bluesky أعادت 403، فمن الأنسب توسيع قائمة الحسابات المعروفة مسبقًا والبحث عبر Google في المرة التالية. - ينبغي الإشارة صراحةً في التقرير إلى نماذج مثل MiniMax H3 التي تمتلك أوزانًا مفتوحة لكن استخدامها التجاري مدفوع، بدل تصنيفها ببساطة على أنها «مفتوحة».
- ينبغي إنشاء بند متابعة مستمر لأخبار انسحاب أو تحوّل الشركات الكبرى، مثل تحوّل Midjourney وإنهاء Sora، لأنها تجذب اهتمام القراء أكثر من الأخبار التقنية البحتة.
- تبدو Pinterest أصلح كمؤشر لرد فعل المستهلكين منه كمصدر لتتبع الاتجاهات التقنية، لأن المعلومات الأولية فيها قليلة.
- يستحق ميل Reddit وLemmy إلى انتشار الأحكام القضائية والجدل الأخلاقي أكثر من الأخبار التقنية أن يُلتقط كإشارة مستقلة في الملخص التالي.
جودة البيانات
- X: لأن المنشورات المجمعة انطلقت من مواضيع رائجة جغرافيًا في منطقة كرواتيا، كانت كل النتائج عدا أربع منشورات عن GPT-6 Astra ضوضاء غير ذات صلة، مثل العملات المشفرة وإيلون والرياضة. لم تظهر أي إشارة إلى المصدر المفتوح، ولم تتحقق عتبة تحليل 20 منشورًا المطلوبة.
- Bluesky: تعذر استخدام واجهة البحث الرسمية بسبب 403، فتم الاعتماد على تفقد موجزات الحسابات المعروفة. لم يتجاوز عدد المنشورات المرتبطة مباشرة بالموضوع نحو 12، ولم تُجمع تقريبًا أي معلومات أولية مفتوحة المصدر.
- Reddit: اقتصر البحث على استعلام واحد، فنتج عنه 12 سلسلة في 9 مجتمعات فرعية، وهو أقل من هدف 20. سُجلت حتى 6 تعليقات عليا لكل سلسلة.
- YouTube: بسبب عرض نتائج البحث وصفحات الفيديو عبر JavaScript، تعذر التحقق المباشر من عدد المشاهدات أو المشتركين أو تاريخ النشر الدقيق، واستُنتج التاريخ من الصيغ النسبية في المقتطفات.
- Lemmy: نظرًا لطبيعته الاتحادية، تفوّت عمليات البحث في نسخة واحدة منشورات النسخ الأخرى. كما أن البحث المباشر عن خدمات الفيديو المغلقة مثل Sora وKling وVeo لم يحقق تقريبًا أي نتائج ذات صلة.
- Pinterest: فُتحت 24 صورة فعلية فقط من أصل 50 للتحقق؛ أما البقية فاستند التقييم فيها إلى العناوين فقط. ولم تتضمن البيانات مؤشرات تفاعل مثل الإعجابات أو الحفظ.
ملخص حسب المنصة
Reddit — أخبار الذكاء الاصطناعي لتوليد الصور والفيديو
أين
جُمعت 12 سلسلة من 9 مجتمعات فرعية. كان مصطلح البحث الوحيد هو «Image and Video Generation AI News».
| المجتمع الفرعي | عدد المشتركين | عدد السلاسل المجمعة |
|---|---|---|
| r/generativeAI | 150,575 | 4 |
| r/GrokAiDiscussion | 4,883 | 1 |
| r/freetoolsAI | 7,616 | 1 |
| r/StableDiffusion | 1,000,814 | 1 |
| r/accelerate | 77,800 | 1 |
| r/news | 31,531,475 | 1 |
| r/antiai | 313,317 | 1 |
| r/allthequestions | 127,064 | 1 |
| r/teenagers | 3,673,210 | 1 |
كان r/generativeAI الأعلى من حيث العدد (4 منشورات)، وهو مركز للمنشورات غير الرسمية الخاصة بالبحث عن الأدوات والمقارنات. أما البقية فكان لكل منها منشور واحد، ومن اللافت وصول الموضوع إلى مجتمعات غير متخصصة في توليد الصور/الفيديو مثل r/news وr/teenagers.
ما يقوله الناس
- #4 r/StableDiffusion «أخبار الذكاء الاصطناعي المحلية التي فاتتك - أغسطس 2026» (201 نقطة و22 تعليقًا و2026-08-31، https://www.reddit.com/r/StableDiffusion/comments/1w3rwoe/) — ملخص شهري يقول إن عددًا كبيرًا من النماذج المفتوحة مثل Qwen3.8 وDeepSeek-V4-Pro-0813 وسلسلة Ling-3.0 وGemma-4-31B صدر خلال أغسطس وحده. وتوالت الإضافات في التعليقات؛ فأشار u/Narutobirama(20) إلى «Qwen3.8 Flash Next»، وقال u/MoJaKF(14) إن Anima-3.8B وصل بالفعل إلى إصدار 1.1 قبل 3 ساعات، ما يوضح سرعة تفوق حتى منشور الملخص على المتابعة.
- #5 r/accelerate «…لقد بنوا ذكاءً اصطناعيًا ينظر إلى بضعة فيديوهات أو صور عادية من العالم الحقيقي ويحوّلها فورًا إلى ساحة لعب ثلاثية الأبعاد كاملة» (763 نقطة و76 تعليقًا و2026-09-03، https://www.reddit.com/r/accelerate/comments/1w5ye9s/) — عن Atlas من World Labs الذي ينشئ عوالم ثلاثية الأبعاد تفاعلية من الفيديو/الصور. كانت الردود متحمسة، مثل تعليق u/stainless_steelcat(48) حول وصول تأثير bullet time من Matrix إلى الواقع، مع نقاش احتمالات ربط تقنية توليد الفيديو بإنشاء بيانات تدريب للروبوتات.
- #6 r/generativeAI «المطالبة نفسها. 30 ثانية نفسها. نموذجان مختلفان لفيديو الذكاء الاصطناعي.» (98 نقطة و30 تعليقًا و2026-09-03، https://www.reddit.com/r/generativeAI/comments/1w60fip/) — مقارنة Seedance 2.5 وWan 3.0 باستخدام المطالبة نفسها. قيّم u/SpecialistDragonfly9(5) Seedance بأنه أفضل بكثير، بينما شكك u/Positive-Key6640(4) في منهج المقارنة نفسه، معتبرًا أنها تقيس غالبًا أي نموذج يناسب أسلوب المطالبة، لا أيهما أفضل فعلاً.
- #2 r/GrokAiDiscussion «هل خففوا الإشراف على توليد الصورة إلى فيديو؟» (14 نقطة و28 تعليقًا و2026-08-29، https://www.reddit.com/r/GrokAiDiscussion/comments/1w1w0e8/) — تباينت تجارب المستخدمين بشأن سياسة الإشراف في Grok Imagine. قال u/Miserable_Appeal515(2) إنه «تحسن»، بينما قال u/joderrelldalejr(2) العكس تمامًا: «لا، بل يسوء ثم يبدأون بتقييد عدد الصور التي تستطيع إنشاؤها أسبوعيًا».
- #1 r/generativeAI «قائمة مواقع توليد فيديو بالذكاء الاصطناعي اليومية» (38 نقطة و27 تعليقًا و2026-08-31، https://www.reddit.com/r/generativeAI/comments/1w3frr2/) — تبادل معلومات لمستخدمي الحصص المجانية. ذُكر أن Kling AI يقدم «66 رصيدًا مجانيًا كل 24 ساعة»، وأن Capcut يقدم أرصدة يومية مجانية، فيما قدم YalleryLabs فيديو 5 ثوانٍ بدقة 720p من 0.18 دولار ضمن ميزانية 3 دولارات.
- #3 r/freetoolsAI «مولد صور ذكاء اصطناعي مجاني» (31 نقطة و31 تعليقًا و2026-09-04، https://www.reddit.com/r/freetoolsAI/comments/1w6w0rj/) — اجتذب منشور ترويجي لموقع توليد صور مجاني بلا تسجيل تعليقات، وسرد u/Odd-Lingonberry1516(2) بدائل مثل Deepany وAifun وPerchance. كما طُرح سؤال عن نموذج الإيرادات: «كيف تحافظون على هذا؟ لا بد أنه يكلفكم شيئًا، أليس كذلك؟».
- #11 r/generativeAI «صورة إلى فيديو جيدة؟» (نقطة واحدة و13 تعليقًا و2026-08-29، https://www.reddit.com/r/generativeAI/comments/1w20rq1/) — وُصف Kling AI بأنه «عمليًا ملك الحركة البشرية الواقعية»، وRunway بأنه «المعيار الذهبي للتحكم الإبداعي»، بينما أوصى u/Ok-Addition1264(2) بالمحلي ComfyUI مع WAN22/LTX2.3.
- #7 r/generativeAI «هل يوجد موقع فيديو ذكاء اصطناعي جيد؟ حتى لو كان مدفوعًا؟» (0 نقطة و15 تعليقًا و2026-08-31، https://www.reddit.com/r/generativeAI/comments/1w3kptg/) — رأى u/Previous-Course-5160(1) أن gen-3 من Runway يتعامل مع الحركة بصورة جيدة مقارنة بكثير من المخرجات الرديئة، لكنه انتقد Pika لأنه ممتع للحلقات السريعة لكن مخرجاته تصبح متشابهة بعد فترة.
- #8/#10 r/news «حكم قاضٍ اتحادي بأن مواد الاعتداء الجنسي على الأطفال المولدة بالذكاء الاصطناعي محمية بالتعديل الأول.» (1,379 نقطة و545 تعليقًا و2026-09-02، https://www.reddit.com/r/news/comments/1w5k6pr/) وr/allthequestions «لماذا أعلن قاضٍ اتحادي أن إنشاء مواد إباحية للأطفال مولدة بالذكاء الاصطناعي قانوني؟» (31 نقطة و277 تعليقًا و2026-08-31، https://www.reddit.com/r/allthequestions/comments/1w3hf3o/) — حصد النقاش حول الوضع القانوني للمخرجات المولدة بالذكاء الاصطناعي تفاعلًا استثنائيًا. أشار u/Ntroepy(414) إلى أن العنوان مضلل ويشبه الطعم للنقر، وأن الحكم مقيد بقرار للمحكمة العليا من عام 2002، بينما لخص u/TheGracefulCrane(31) أن القضاة لا يسنون القوانين وأن القانون لم يُحدَّث لجعل الأمر غير قانوني.
- #9 r/antiai «الصور المولدة بالذكاء الاصطناعي أصبحت أصعب اكتشافًا» (113 نقطة و30 تعليقًا و2026-08-30، https://www.reddit.com/r/antiai/comments/1w2mr8g/) — على عكس العنوان، تمحورت التعليقات حول أخطاء الأطراف مثل تعليق u/GurInside278(31): «لماذا قدماها يداها؟»، ما صنع مفارقة ساخرة.
- #12 r/teenagers «إلى جميع مستخدمي مولدات صور/فيديو الذكاء الاصطناعي» (7 نقاط و41 تعليقًا و2026-08-31، https://www.reddit.com/r/teenagers/comments/1w2y305/) — منشور يرد على الادعاء بأن فن الذكاء الاصطناعي لا يتضمن عملاً من الفنان. وعبّرت تعليقات مثل u/LiterallyGarbage_0(5) عن مشاعر قوية معادية للذكاء الاصطناعي، داعيةً المستخدمين إلى التقاط قلم بدلًا منه.
الإشارات
- صعود: تتسارع وتيرة إصدار النماذج المحلية المفتوحة (LLM/صور/فيديو) إلى حد لا تستطيع تعليقات السلسلة #4 وحدها متابعته. كما يمثل توظيف Atlas من World Labs (#5) في «توليد الفيديو ← بيانات تدريب الروبوتات» اتجاهًا جديدًا للاهتمام.
- تضارب الآراء: انقسمت الآراء حول إشراف Grok Imagine (#2) بين التحسن والتدهور. وبالنسبة إلى Seedance مقابل Wan (#6)، اجتمع رأي تفوق Seedance بوضوح مع الاعتراض على جدوى المقارنة بالمطالبة نفسها. لا يمكن اختزال الأمر في نتيجة واحدة.
- ما يُقلَّل من شأنه أو يُشكَّك فيه: تعرض قالب المقارنة الشائع باستخدام المطالبة نفسها (#6) لانتقاد منهجي من u/Positive-Key6640.
- المفاجئ: كانت سلسلة #9 المعنونة بصعوبة تمييز صور الذكاء الاصطناعي في الواقع محتوى ساخرًا عن أخطاء الأطراف. كما تفوق حجم تفاعل الأحكام القضائية (#8 و#10، أكثر من 800 تعليق إجمالًا) بفارق كبير على أخبار المنتجات، ما يجعل الوضع القانوني والأخلاقي للمخرجات أكبر نقطة اشتعال في Reddit.
القيود
- اقتصر مصطلح البحث على «Image and Video Generation AI News»، فكان الناتج 12 سلسلة و9 مجتمعات فقط، وهو أقل من نحو 20 منشورًا لكل شبكة التي يطلبها brief.md.
- في هذه المرحلة، اقتصر العمل على قراءة
output/reddit.threads.md/.threads.jsonالتي جمعها العامل مسبقًا، من دون إعادة جمع باستعلامات إضافية أو وصول مباشر إلى السلاسل والتعليقات، وفقًا للتعليمات. وأي نقص محتمل يقع غالبًا خارج نطاق هذا الاستعلام الواحد. - سُجلت ستة من أبرز التعليقات كحد أقصى لكل سلسلة، لذلك لا تظهر ردود الفعل الأدنى ترتيبًا أو الآراء الأقلية في هذا التقرير.
X
X — أخبار الذكاء الاصطناعي لتوليد الصور والفيديو
الحسابات
من بين 34 حسابًا في هذه المجموعة، نشر أربعة فقط محتوى متعلقًا بالذكاء الاصطناعي لتوليد الصور/الفيديو، وجميعه عن الإطلاق نفسه خلال 24 ساعة (2026-09-03):
- @OpenAI (OpenAI) — منشور واحد، لكنه القصة كلها: 309,095 إعجابًا و55,587 إعادة نشر وحوالي 108,000,000 مشاهدة. اكتفى الحساب بإعلان واحد مصحوب بصورة وترك الحجم يتحدث.
- @MatthewBerman (Matthew Berman) — حساب مؤثر في الذكاء الاصطناعي، نشر سلسلة واحدة (4,054 إعجابًا وحوالي 1,500,000 مشاهدة) بوصفها تجربة مبكرة مباشرة، مقدمًا نفسه مختبرًا لا مصدرًا.
- @Dimillian (Thomas Ricouard) — منشور واحد (7,199 إعجابًا وحوالي 2,300,000 مشاهدة)، عرض مسارًا محددًا من Blender إلى Unreal Engine 5 بدل الضجيج العام، وكان الادعاء التقني الأكثر تحديدًا في المجموعة.
- @flowith (Flowith) — أصغر الحسابات هنا (947 إعجابًا وحوالي 115,000 مشاهدة)، استغل الإطلاق بمقارنة مباشرة مع النموذج السابق.
جميع الحسابات الأخرى في المجموعة (34 حسابًا، 40 منشورًا)—حسابات العملات والميمات، وحسابات معجبي Elon/Tesla، ومؤثر للأمن السيبراني، وحسابات أخبار وميمات من بولندا وأفريقيا والبوسنة، وحسابات معجبي Ariana Grande، وحسابات مسابقات علامات البيرة—لا علاقة لها بتوليد الصور أو الفيديو. ذُكرت فقط لأنها ما أعادته المجموعة بالفعل؛ انظر القيود.
المنشورات
1. إطلاق GPT-6 «Astra» — @OpenAI
- 309,095 إعجابًا · 55,587 إعادة نشر · 7,713 ردًا · نحو 108,000,000 مشاهدة · 2026-09-03
- https://x.com/OpenAI/status/2095595741528125780
«هذا هو GPT-6 Astra. أي شيء يمكنك فعله على حاسوب، يستطيع Astra فعله لأجلك. بسرعة.»
كان المنشور الأكبر في المجموعة المجمعة كلها بفارق ضخم. صيغ بوصفه وكيلًا عامًا لا نموذجًا متخصصًا بالصور/الفيديو، لكن العروض التي قدمتها الحسابات الأخرى لاحقًا كانت بصرية وثلاثية الأبعاد، ما يشير إلى أن نقاط القوة المعروضة لـAstra تميل إلى هذا الجانب.
2. Astra مقابل النموذج السابق، في إطار الرسوم المتحركة — @flowith
- 947 إعجابًا · 69 إعادة نشر · 19 ردًا · نحو 115,000 مشاهدة · 2026-09-04
- https://x.com/flowith/status/2095750768204877858
«مقارنة GPT-6 Astra بـGPT-5.6 في الرسوم المتحركة ستأتي قريبًا إلى flowith.io»
يُعد هذا إشارة ملموسة إلى اختبار وتسويق Astra خصيصًا لقدرات توليد الرسوم المتحركة، لا لمجرد استخدام الحاسوب العام.
3. سلسلة تجربة وصول مبكر — @MatthewBerman
- 4,054 إعجابًا · 494 إعادة نشر · 210 ردود · نحو 1,500,000 مشاهدة · 2026-09-03
- https://x.com/MatthewBerman/status/2095595892464333065
«Astra (GPT-6) هنا!!! كان لدي وصول مبكر واختبرته بجنون في أشياء مثل الألعاب والبرمجة والكتابة والتحكم بالمتصفح والعروض التقديمية والعمل المعرفي العام. هذا أفضل نموذج استخدمته على الإطلاق. بلا نقاش.»
اللافت في ما لا يذكره المنشور: لا توجد إشارة صريحة إلى توليد الصور أو الفيديو ضمن قائمة القدرات، رغم وعد السلسلة بعروض مذهلة أدناه.
4. شرح Blender إلى Unreal Engine 5 — @Dimillian
- 7,199 إعجابًا · 1,145 إعادة نشر · 259 ردًا · نحو 2,300,000 مشاهدة · 2026-09-03
- https://x.com/Dimillian/status/2095596700815516004
«Astra جيد جدًا في النمذجة ثلاثية الأبعاد، ولا أطيق انتظار تجربتكم له جميعًا. وحتى ذلك الحين، إليكم شرحًا صغيرًا لكيفية بناء منزل العرض التوضيحي لمنشور الإطلاق: من مشهد Blender إلى تجربة قابلة للمشي في Unreal Engine 5.»
أكثر ادعاء محدد بالأدوات في المجموعة: استخدام Astra ضمن مسار محتوى ثلاثي الأبعاد فعلي (Blender → UE5)، وهو أقرب إلى سير عمل بصري/فيديو من أي شيء آخر أظهره X في هذه الجولة.
الإشارات
- صاعد: كانت GPT-6 «Astra» القصة الوحيدة القريبة من الصور/الفيديو التي ظهرت في هذه المجموعة، وهي تهيمن بالتفاعل (نحو 108 مليون مشاهدة لمنشور الإطلاق وحده، مقابل مئات الآلاف المنخفضة لكل شيء آخر). وتبدو مجموعة الردود خلال 24 ساعة—مقارنة منتج، وتجربة مؤثر، وعرض لمسار ثلاثي الأبعاد—كإطلاق منسق لا اكتشاف عضوي.
- غائب أو مهمش: لا يظهر أي نموذج مفتوح المصدر لتوليد الصور أو الفيديو—Stable Diffusion أو Flux أو Wan أو HunyuanVideo أو Kling أو ComfyUI وغيرها—في أي موضع من هذه المجموعة. إن كان عمل المصدر المفتوح نشطًا على X الآن، فإن جولة البحث هذه لم تصل إليه.
- مفاجئ: قليل جدًا من خطاب الإطلاق حول الذكاء الاصطناعي يسمي توليد الصور أو الفيديو كميزة فعلية؛ إذ أغفلته قائمة Matthew Berman تمامًا، ويُسوَّق Astra كوكيل عام («أي شيء يمكنك فعله على حاسوب»). زاوية الصور/الفيديو مستنتجة من العروض التي اختارها المختبرون الأوائل، لا من تأطير OpenAI نفسها.
القيود
- لم تستهدف عمليات البحث هذا الموضوع. المصطلحات العشرة التي بُحث عنها—«Astra» و«$SONG» و«Robinhood» و«Elon» و«#CyberSecurity» و«Poland» و«Africa» و«Bosnia» و«ariana» و«#Sweepstakes»—هي قائمة المواضيع الرائجة الخاصة بـX لهذه الجلسة، لا مصطلحات اختيرت لتوليد الصور/الفيديو. لم يكن ذا صلة إلا بحث Astra؛ أما 36 منشورًا آخر فكانت ضوضاء غير مرتبطة.
- لم تتحقق معايير الإكمال من هذه البيانات. يطلب الملخص نحو 20 منشورًا لكل منصة مرتبطًا بالموضوع، لكن المجموعة تقدم أربعة منشورات صالحة فقط عن إطلاق مغلق واحد، GPT-6 Astra، ولا شيء عن توليد الصور/الفيديو المفتوح. يلزم بحث بعبارات مثل «Stable Diffusion» و«ComfyUI» و«Flux» و«Kling AI» و«Runway» و«Sora» و«Midjourney» و«Wan 2.x» أو «HunyuanVideo» لتغطية الملخص فعليًا على X.
- تحفظ جغرافي: تُظهر قائمة Explore في X لهذه الجلسة اتجاهات متموضعة في كرواتيا، ولهذا هيمنت رموز العملات وكرة القدم البوسنية وأخبار وميمات البلقان. إنها اتجاهات موقع خادم واحد لا صورة عالمية.
- لا توجد تغطية للمصدر المفتوح إطلاقًا. لا تمس أي مادة في المجموعة أخبار توليد الصور/الفيديو مفتوحة المصدر أو أدواتها أو إصداراتها؛ الفجوة كاملة لا جزئية.
YouTube
YouTube — أخبار الذكاء الاصطناعي لتوليد الصور والفيديو (مغلق المصدر / مفتوح المصدر)
القنوات
قنوات عُثر عليها عبر بحث YouTube والبحث الإخباري. لم يمكن التحقق المباشر من عدد المشتركين في معظمها لأن صفحات الفيديو معروضة عبر JavaScript (التفاصيل في ## القيود).
- Theoretically Media — قناة معتادة تختبر نماذج التوليد المفتوحة مثل Wan وFLUX وQwen-Image في ComfyUI. («Wan 2.2, FLUX & Qwen Image Upgraded: Ultimate Tutorial...» https://www.youtube.com/watch?v=3BFDcO2Ysu4)
- Matt Wolfe / The Next Wave — معروفة بمقارنات أدوات الذكاء الاصطناعي المغلقة مثل Runway وKling وVeo وSora.
- عدة قنوات فردية لأدوات الذكاء الاصطناعي تنشر مراجعات منفصلة لنماذج مثل LTX-2.5 وMiniMax H3 وNano Banana 2؛ لم تظهر أسماء القنوات في نتائج البحث، ولم يُتحقق إلا من عناوين الفيديوهات.
الفيديوهات
النماذج المغلقة المصدر
- «Nano Banana 2 Is INSANE – Full Test of Google's New Image Model!» — نحو 2026-02-26 — https://www.youtube.com/watch?v=k0dujOUePeU — اختبار عملي لـGemini 3.1 Flash Image من Google، المعروف باسم Nano Banana 2، مع ادعاء حل مفاضلة السرعة والجودة.
- «Nano Banana 2 vs Nano Banana Pro: I Tested Both So You Don't Have To» — أواخر فبراير 2026 — https://www.youtube.com/watch?v=B1d3SIfoQLk — مقارنة مخرجات الإصدار العادي وPro لتحديد أيهما أنسب.
- «Kling 3.0 Surprised Me! Compared To Veo 3.1 & Sora 2» — نحو 2026-02-05 — https://www.youtube.com/watch?v=AAD7wJ3DWiA — مقارنة مباشرة لـKling 3.0 من Kuaishou مع Veo 3.1 وSora 2؛ ويقيّمه الفيديو كمنافس جيد في واقعية المشاهد وحركة الكاميرا.
- «Is Kling 3.0 Actually Good? (I Spent $500 Testing For You)» — نحو 2026-02-04 — https://www.youtube.com/watch?v=Rme22R7a9O8 — اختبار مدفوع لخصائص Kling 3.0 متعددة اللقطات ومخرجات 4K60fps.
- «Seedream 5.0 Tested & Seedance 2.5 Leaks Are Unreal!» — نحو 2026-07-15 — https://www.youtube.com/watch?v=pn-YwWn3kkM — اختبار نموذج الصور Seedream 5.0 Pro من ByteDance وSeedance 2.5 غير المعلن، مع الإشارة إلى تخطي ByteDance لإصدار Seedance 2.1.
- «Seedance 2.5 Is Insane — 30 Seconds In ONE Shot?» — نحو 2026-06-23 — https://www.youtube.com/watch?v=8sGVhuoPOXI — اختبار قدرة Seedance 2.5 على إنتاج 30 ثانية متصلة في لقطة واحدة.
- «MiniMax H3 Review | Testing Hailuo's New 2K AI Video Model» — أوائل أغسطس 2026 — https://www.youtube.com/watch?v=67CCQBAwZiA — اختبار عملي لـMiniMax H3 (Hailuo 3.0)، الصادر في 2026-07-31، مع تأكيد فيديو 2K ومدته 15 ثانية وصوت ستيريو أصلي.
- «Hailuo AI's NEW MiniMax H3 Model Is INCREDIBLE! (Full Test)» — نحو أغسطس 2026 — https://www.youtube.com/watch?v=la0iBk8g8_g — اختبار كامل لقدرات MiniMax H3 متعددة الوسائط، بإدخال النص والصورة والفيديو والصوت معًا.
- «FLUX 3 Sneak Peek» — 2026-07-23 — https://www.youtube.com/watch?v=PCPhl8qMF_Y — عرض مبكر لـFLUX 3 من Black Forest Labs، متعدد الوسائط للصور وفيديو 20 ثانية والصوت والحركة، قبل الإتاحة العامة للفيديو في 2026-08-04.
- «Gen-4.5 Updates — Research Demo Day 2025 | Runway» — 2025-12-16 — https://www.youtube.com/watch?v=yNXxuzmiwEo — شرح تقني لتحديثات Gen-4.5 من قناة Runway الرسمية، بما فيها التحكم بالكاميرا واتساق الشخصيات.
- «All in one AI | Text to Image & Video AI | Kling, Veo, Sora, Nano Banana Pro | Daily Free Credits!» — حديث — https://www.youtube.com/watch?v=SnmRpf_VfgU — طريقة لاستخدام أدوات مغلقة متعددة، Kling وVeo وSora وNano Banana Pro، ضمن حصصها المجانية.
النماذج المفتوحة المصدر
- «LTX 2.5 In ComfyUI — Setup, First Gens, And The Catch» — منتصف أغسطس 2026 تقريبًا — https://www.youtube.com/watch?v=RjlbDhs1MPk — إدخال LTX-2.5، نموذج العالم ذي 22 مليار معامل من Lightricks، إلى ComfyUI بصورة أصلية، مع تأكيد سرعة إنشاء فيديو 720p لمدة 10 ثوانٍ في 6.8 ثانية.
- «LTX 2.5 ComfyUI: Physics Test vs MiniMax H3 + Free Workflows» — قبل نحو 3 أسابيع — https://www.youtube.com/watch?v=WpKNXZZqQEU — مقارنة مباشرة بين LTX-2.5 مفتوح الأوزان وMiniMax H3 غير المفتوح في الفيزياء واللقطات المتعددة.
- «New LTX 2.5 Video Model is INSANELY Fast (ComfyUI Local)» — قبل نحو 3 أسابيع — https://www.youtube.com/watch?v=pA2BQw9LY8A — اختبار يركز على السرعة عند التشغيل المحلي.
- «Wan 2.2, FLUX & Qwen Image Upgraded: Ultimate Tutorial for Open Source SOTA Image & Video Gen Models» — Theoretically Media — https://www.youtube.com/watch?v=3BFDcO2Ysu4 — شرح Wan 2.2، نموذج فيديو MoE، وFLUX وFLUX Krea وQwen Image جميعًا في ComfyUI. يقيّم Wan 2.2 بأنه يقترب من Sora في الاتساق، وFLUX بأنه متفوق في التفاصيل.
- «HunyuanImage 3.0 — The Most Powerful Open-Source Image Generator Yet» — 2025-09-30 — https://www.youtube.com/watch?v=U-8RjjU7x14 — تقديم نموذج الصور MoE من Tencent بثمانين مليار معامل، مع الإشارة إلى تفوق طفيف في معدل الفوز على Seedream 4.0 وNano Banana وGPT-Image.
- «Flux.2 Dev: Full Review, Pros & Cons, ComfyUI Setup!» — نحو 2025-11-26 — https://www.youtube.com/watch?v=MoAwonm53hQ — مراجعة وإعداد ComfyUI لـFLUX.2 من Black Forest Labs، بما في ذلك نسخة الأوزان المفتوحة، مع إبراز الحفاظ على اتساق الموضوع عبر ما يصل إلى عشر صور مرجعية.
- «FLUX 2 Released! 🤯 ComfyUI Install, Workflow & The "Active Parameter" Secret» — نحو 2025-11-26 — https://www.youtube.com/watch?v=nfeDS_EoblE — خطوات تثبيت FLUX.2 في ComfyUI وشرح وظائفه الجديدة.
- «Qwen Image First Look & LOCAL Testing (The BEST New Image Model?)» — 2025-08-05 — https://www.youtube.com/watch?v=ex2YCqtTHSY — اختبار محلي أولي لـAlibaba Qwen-Image، سلف Qwen-Image-2512 لاحقًا.
- «Qwen Image Edit 2511–Local Image Editing in ComfyUI | Multi-Reference Style Transfer & GGUF Workflow» — 2025-12-26 — https://www.youtube.com/watch?v=iFnTqZmsRIc — اختبار نقل النمط متعدد الصور المرجعية في Qwen Image Edit عبر سير عمل GGUF في ComfyUI.
- «MiniMax H3: The New Open-Source Video Champ?» — نحو أغسطس 2026 — https://www.youtube.com/watch?v=3R5GROj8Tcg — تقديم MiniMax H3 بوصفه نموذج فيديو متعدد الوسائط صدر بأوزان مفتوحة، مع الإشارة إلى تقييمه في المركز الأول لتحرير الفيديو.
الإشارات
- تقترب الأوزان المفتوحة من الطليعة: صدر كل من LTX-2.5 (2026-08-11) وMiniMax H3 (2026-07-31) بأوزان مفتوحة خلال آخر 60 يومًا، وتبرز صور المقارنات المصغرة التي تضعهما في مواجهة النماذج المغلقة أو تتحدث عن تفوقهما عليها. لم تعد النماذج المفتوحة مجرد تابع، بل تصبح معيار مقارنة فور الإعلان.
- دورة إصدارات ByteDance السريعة: تتجدد Seedream 5.0 Pro وSeedance 2.5 على فواصل شهرية، وتتسم فيديوهات YouTube بطابع إخباري سريع، بعناوين مثل «Tested» و«Leaks».
- إعادة تنظيم منظومة Google: من المقرر إيقاف خط Imagen كاملًا في 2026-08-17، مع انتقال متزايد إلى Nano Banana من عائلة Gemini 3.x Image. حتى Nano Banana 2 الصادر في 2026-02-26 ظهرت له عدة فيديوهات مقارنة مع خلفائه.
- انسحاب لاعب كبير مغلق المصدر: تعتزم OpenAI إنهاء Sora API في 2026-09-24 وتوجيه الموارد الحاسوبية إلى «Spud» التالي، بحسب نتائج البحث؛ لم يُتحقق من فيديو YouTube مباشرة. وهي نقطة تحول بارزة في حركة النماذج المغلقة.
- ComfyUI منصة التحقق الفعلية للمصدر المفتوح: تقترن تقريبًا جميع مراجعات Wan وFLUX وQwen-Image وLTX-2.5 المفتوحة بخطوات إدخالها في ComfyUI.
القيود
- تُرسم صفحة نتائج YouTube (
youtube.com/results?...) وصفحات الفيديو (youtube.com/watch?v=...) عبر JavaScript؛ لذلك لم تُظهر الجلبات المباشرة سوى روابط تذييل التنقل ولم تسمح بقراءة بيانات مثلytInitialData، أو أعداد المشاهدات والمشتركين وتواريخ النشر الخام. استُنتجت التواريخ من مقتطفات محركات البحث والتعبيرات النسبية مثل «3 weeks ago»، ولم يُتحقق من الأرقام الدقيقة لمعظم الفيديوهات. - لم يُعثر على فيديو YouTube مباشر عن إنهاء OpenAI لـSora أو خلفه «Spud»، ولذلك يستند هذا البند إلى تقارير إخبارية لا إلى فيديو تم التحقق منه على YouTube.
- عُثر على مقاطع إعلان رسمية عن Runway Gen-4.5 وتحديثات Midjourney، لكن لم يُعثر في هذا البحث على مراجعات مستقلة حديثة خلال 60 يومًا.
- أمكن التحقق من روابط مراجعات Nano Banana Pro المنفردة، لكن لم يمكن الحصول على اسم القناة أو عدد المشاهدات.
Bluesky
Bluesky — أحدث اتجاهات الذكاء الاصطناعي لتوليد الصور والفيديو
الحسابات
- Simon Willison @simonwillison.net — مطور معروف بتقييم نماذج LLM والصور. ينشر مقارنة «اختبار صورة البجع» عند صدور كل نموذج جديد، وهو مصدر أولي جيد لأخبار النماذج المغلقة.
- fofr @fofr.ai — مختص بالمطالبات للصور، نشط حول Replicate، وينشر استخدامات عملية متكررة لـNano Banana Pro (Gemini 3 Pro Image).
- Replicate (رسمي) @replicate.com — الحساب الرسمي لشركة استضافة واجهات نماذج الذكاء الاصطناعي؛ ينشر أخبار النماذج الجديدة المتاحة على Replicate، ويعمل مصدرًا سريعًا لإصدارات نماذج الفيديو المفتوحة والمغلقة.
- Amanda Silberling (صحفية TechCrunch) @amanda.omg.lol — صحفية تغطي الجوانب الثقافية لتوليد الصور بالذكاء الاصطناعي.
- AI News Updates @ai-latestnews.bsky.social — حساب آلي ينشر أخبار صناعة الذكاء الاصطناعي.
- gigowat @gigowat.bsky.social — حساب يشارك مقالات موقع الأخبار التقنية الياباني GIGAZINE على Bluesky، ومن المصادر القليلة للأخبار اليابانية عن توليد الصور.
- ostris @ostris.com — مطور أداة التدريب المفتوحة LoRA المسماة «AI-Toolkit». ينشر عن نماذج Flex، لكنه يقول إن مجتمع AI/ML بقي تقريبًا على Twitter، لذا تحديثاته على Bluesky قليلة.
المنشورات
-
Simon Willison — نشر شبكة مقارنة لصورة البجع بين GPT-6 Astra وGPT-5.6 Sol/Terra/Luna (نموذج مغلق، مقارنة نماذج صور من OpenAI). 2026-09-04، 👍91 · 🔁6 · 💬12.
https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c
نشر متابعة بإصدارات كاملة الحجم من الصور المولدة، وكان النص البديل مولدًا أيضًا بواسطة GPT-5-astra. 👍23.
https://bsky.app/profile/simonwillison.net/post/3mupxztoyqs2c -
Simon Willison — نشر مقارنة لصورة بجع مولدة بـGoogle Gemini 3.7 Flash. 2026-09-02، 👍6.
https://bsky.app/profile/simonwillison.net/post/3muitt5g3q22r -
fofr — شارك تفاصيل مطالبة لإعادة إنشاء عرض بأسلوب لعبة فيديو قديمة باستخدام Nano Banana Pro (Gemini 3 Pro Image). 2026-01-19، 👍31.
https://bsky.app/profile/fofr.ai/post/3mcrt3avp222p
وفي اليوم نفسه نشر مطالبة لإنشاء لقطة شاشة بأسلوب Street View. 👍10.
https://bsky.app/profile/fofr.ai/post/3mcrilugr5c2m -
Replicate (رسمي) — أعلن إتاحة «GPT Image 2» من OpenAI على Replicate، مع إبراز الواقعية ودقة عرض النصوص وقوته في الواجهات والتصميم (مغلق المصدر). 2026-04-21.
https://bsky.app/profile/replicate.com/post/3mjzygaefs224 -
Replicate (رسمي) — أعلن إتاحة نموذج الفيديو «Seedance 2.0» من ByteDance لجميع المستخدمين؛ يدمج النص والصورة والفيديو والصوت في مشهد واحد، وينشئ صوت ستيريو متزامنًا (مغلق المصدر). 2026-04-09.
https://bsky.app/profile/replicate.com/post/3mj3junhvnh26 -
Replicate (رسمي) — أضاف Gen-4.5 من Runway إلى Replicate؛ نموذج فيديو يركز على الواقعية الفيزيائية (مغلق المصدر). 2026-02-18.
https://bsky.app/profile/replicate.com/post/3mf5fbf6u4l2c -
Replicate (رسمي) — أضاف Kling 3.0 (+o3) من Kuaishou إلى Replicate، مع دعم 4K متعدد اللقطات ومزامنة الصوت (مغلق المصدر). 2026-02-17.
https://bsky.app/profile/replicate.com/post/3mf35lkhoyw2q -
Replicate (رسمي) — أضاف نموذج الفيديو «Vidu Q3» إلى Replicate؛ يدعم الإنشاء من النص/الصورة/إطاري البداية والنهاية، حتى 16 ثانية و1080p (مغلق المصدر). 2026-03-11.
https://bsky.app/profile/replicate.com/post/3mgsan3ddpl2w -
Amanda Silberling (TechCrunch) — طلبت تعليقات من خبراء حول سبب اكتساب صور الطعام المولدة بالذكاء الاصطناعي مظهرًا مميزًا، في طلب صحفي عن خصائصها الجمالية. 2026-08-28، 👍17 · 🔁5 · 💬4.
https://bsky.app/profile/amanda.omg.lol/post/3mu5itcncgc2x -
AI News Updates (bot) — أفاد بأن Midjourney Inc. استحوذت على تطبيق الأبراج Co-Star لإطلاق تطبيق جديد لتوليد الصور. 2026-07-25. يتوافق ذلك مع تقارير TechCrunch وBloomberg عن 2026-07-24 وإغلاق الاستحواذ في الربيع، ولذلك يمكن التحقق منه.
https://bsky.app/profile/ai-latestnews.bsky.social/post/3mrh6gdxnqy2s -
gigowat (مشاركة يابانية لمقال GIGAZINE) — شارك مقالًا عن ظهور نموذج الصور المفتوح «Qwen-Image-3.0» واختبار أدائه في الرسوم ورسم النص الياباني. 2026-07-22.
https://bsky.app/profile/gigowat.bsky.social/post/3mr7dvb332z2q
(المقال الأصلي: https://gigazine.net/news/20260722-qwen-image-3/ ) -
ostris — أعلن إصدار نموذج الصور المفتوح «Flex.2-preview»، الذي يوحد text-to-image والتحكم الشامل وinpainting. المنشور أقدم نسبيًا (2025-04-22)، لكنه مثال نادر على نشر مباشر من مطور نموذج مفتوح على Bluesky. 👍4.
https://bsky.app/profile/ostris.com/post/3lngo5cf66k2a
الإشارات
- تفوق النماذج المغلقة: تركزت المنشورات ذات التفاعل الفعلي على نماذج كبرى مغلقة مثل GPT وGemini/Nano Banana Pro وMidjourney. صار «اختبار صورة البجع» لدى Simon Willison مكانًا فعليًا لفحص جودة نماذج الصور المغلقة عند إطلاق كل نموذج.
- حساب Replicate مركز أخبار الفيديو السريعة: وصلت إصدارات Kling 3.0 وSeedance 2.0 وRunway Gen-4.5 وVidu Q3 عبر حساب Replicate الرسمي. ورغم انخفاض الإعجابات (1–2 غالبًا)، كان مفيدًا لتتبع تسلسل ظهور النماذج.
- الحضور المفتوح المصدر ضعيف على Bluesky: لم يُعثر تقريبًا على إشارات أولية لنماذج الأوزان المفتوحة الرئيسية في 2026 مثل Wan 2.7 وHunyuanVideo 1.5 وChroma وLTX-2.3. وذكر ostris نفسه أن مجتمع AI/ML بقي تقريبًا في Twitter، ما يدل على تمركز المجتمع هناك.
- المحتوى الياباني يعتمد على مشاركة الأخبار: تركزت المنشورات اليابانية على إعادة نشر مقالات مواقع أخبار مثل GIGAZINE، ولم تظهر تحليلات أصلية مستقلة.
القيود
- كانت واجهة بحث المنشورات الرسمية في Bluesky (
app.bsky.feed.searchPosts) تعيد دائمًا403 Forbiddenمن أداة WebFetch في هذه الجلسة، ولذلك لم يمكن جمع المنشورات بصورة شاملة عبر الكلمات المفتاحية مع أعداد الإعجابات وإعادة النشر. استُخدم بدلًا من ذلك البحث عبر Google ثمgetAuthorFeedللحسابات المعروفة؛ وقد عملتgetProfileوgetAuthorFeedوgetPostThreadوoEmbed بصورة طبيعية. - صفحة البحث في
bsky.appتطبيق SPA مرسوم بـJavaScript، ولذلك لم يحصل WebFetch الذي يحول HTML إلى Markdown على نصوص المنشورات. - بسبب هذه القيود، لم يمكن التحقق الشامل من جميع المنشورات لموديل معين؛ بل استُخرجت المواد الملائمة من أحدث موجزات الحسابات المعروفة. فُحص أكثر من 20 منشورًا أو موجزًا، لكن المنشورات المرتبطة مباشرة بتوليد الصور/الفيديو لم تتجاوز 12 تقريبًا.
- لم تظهر منشورات 2026 مناسبة لنماذج مفتوحة مثل Wan وHunyuanVideo وChroma وZ-Image وLTX-2.3، رغم تجربة حسابات متعددة. وكان موجز huggingface.bsky.social فارغًا، وتوقف civitai-bot.bsky.social عند مايو 2024.
- عُثر على منشور فردي يزعم أن Midjourney أصبحت جزءًا من Meta.ai، لكن التحقق الخارجي أظهر أن الأمر كان اتفاق ترخيص في أغسطس 2025، مع بقاء Midjourney مستقلة؛ لذلك استُبعدت المعلومة غير الدقيقة من التقرير.
Lemmy
Lemmy — أحدث اتجاهات الذكاء الاصطناعي لتوليد الصور والفيديو (مغلق/مفتوح المصدر)
المجتمعات
- !«メールアドレス» — 5,708 أعضاء. نقاشات تقنية عن النماذج المفتوحة لتوليد الصور والفيديو، وكان المجتمع الأعلى كثافة بالمعلومات في هذا البحث.
- !«メールアドレス» — 2,360 عضوًا. مكان لنشر الأعمال المنتجة بنماذج Stable Diffusion، مع أخبار أقل.
- !«メールアドレス» — 1,593 عضوًا. مخصص لفن الذكاء الاصطناعي بأسلوب الأنمي، وإخباريته محدودة.
- !«メールアドレス» — 50 عضوًا. مجتمع إعادة نشر آلية لخلاصات Reddit RSS، وليس نقاشًا بشريًا.
- !«メールアドレス» و**!«メールアドレス»** — مجتمعات تقنية عامة؛ أخبار توليد الصور/الفيديو قليلة ومدفونة وسط مقالات الذكاء الاصطناعي العام.
- لا يوجد في Lemmy مجتمع كبير متخصص لتوليد الصور/الفيديو بحجم r/StableDiffusion في Reddit؛ وتتوزع المناقشات بين المجتمعات الصغيرة المذكورة.
المنشورات
النماذج المفتوحة المصدر
- أصبح Comfy موزعًا رسميًا لترخيص MiniMax H3 التجاري — !«メールアドレス»، النتيجة 4، 2026-08-28. المقال الأصلي: https://blog.comfy.org/p/comfy-is-now-the-only-official-reseller . MiniMax H3 نموذج فيديو بأوزان مفتوحة صدر في أغسطس 2026، ويعمل محليًا حتى على GPU من فئة RTX 3060، وينشئ فيديو 2K بصوت ستيريو أصلي. أصبح Comfy موزع تراخيص Professional/Enterprise، مع إمكانية استخدام النموذج غير المقطر في Enterprise.
- LLaDA-Image: Building Strong Image Generators with Fully Open Training Recipes — !«メールアドレス»، النتيجة 2، 2026-09-04. https://arxiv.org/abs/2609.03796 . نموذج توليد صور بوصفة تدريب منشورة بالكامل، يحقق درجات من الطليعة في Qwen-Image-Bench، وله نسخة Turbo مقطرة سريعة.
- دمج Trellis.2 وPixal3D بصورة أصلية في ComfyUI — !«メールアドレス»، النتيجة 4، 2026-09-01. https://blog.comfy.org/p/trellis2-and-pixal3d-are-now-native . الإعلان يقول إن أفضل نماذج التوليد ثلاثي الأبعاد المفتوحة أصبحت جزءًا من ComfyUI Core.
- ComfyUI-MiniMaxH3-CLSS — !«メールアドレス»، النتيجة 0، 2026-09-01. https://github.com/nazgut/ComfyUI-MiniMaxH3-CLSS . أداة لـMiniMax H3 تدّعي إتاحة توليد فيديو بصوت ولطول تعسفي حتى على أجهزة استهلاكية بذاكرة VRAM قدرها 16GB.
- Fizgig LoRA/LoKR Studio — !«メールアドレス»، النتيجة 4، 2026-08-30. https://github.com/shootthesound/Fizgig . أداة مفتوحة لتدريب واستخراج LoRA/LoKR لعائلات نماذج عدة، منها Krea 2 وMiniMax وKlein 9B.
- VibeVoice-ComfyUI (دمج TTS المفتوح من Microsoft في ComfyUI) — !«メールアドレス»، النتيجة 1، 2026-08-28. https://github.com/nikhilprasanth/VibeVoice-ComfyUI . مثال على إدماج الصوت في سير عمل توليد الفيديو.
- Boogu-Image-0.1 — نموذج أساس فعّال لتوليد الصور — !«メールアドレス»، النتيجة 5، 2026-06-17. نموذج أساس مفتوح للصور يركز على خفة الوزن والكفاءة.
النماذج المغلقة المصدر
- تحول Midjourney من ذكاء اصطناعي لتوليد الصور إلى أعمال أجهزة مسح بالموجات فوق الصوتية الطبية — !«メールアドレス»، النتيجة 58، 2026-06-18. https://lemmy.zip/post/66397234 . أثار عدة سلاسل مرتبطة، مثل مرايا Hacker News بدرجات 40 أو أكثر، نقاشًا كبيرًا بعنوان «Midjourney Medical» و«Ultrasonic CT». وهو من أكبر الأخبار عن تحول خدمة صور مغلقة راسخة.
- تطالب Midjourney استوديوهات هوليوود بالكشف التفصيلي عن استخدام الذكاء الاصطناعي — !«メールアドレス»، النتيجة 73، 2026-07-05. https://lemmy.today/post/56011946
- إصدار نموذج الصور الجديد من Google «Nano Banana 2 Lite» — !«メールアドレス»، النتيجة 0، 2026-07-02. https://lemmy.world/post/48936394(مرآة Hacker News: https://lemmy.bestiver.se/post/1199483 )
- MAI-Image-2.5 من Microsoft يقترب من Nano Banana 2 من Google في الاختبارات المعيارية — !«メールアドレス»، النتيجة 1، 2026-05-28. https://lemmy.durstig.online/post/35068
- مراجعة مقارنة عملية لـSeedream 5.0 Pro — !«メールアドレス»، النتيجة 1، 2026-07-10. https://lemmy.durstig.online/post/46063
- تعلن Runway تضاعف أعمالها المؤسسية وتجاوز صافي الاحتفاظ بالإيرادات 300% — !«メールアドレス»، النتيجة 0، 2026-08-30. https://lemmy.durstig.online/post/56937
- تراجعت Google بهدوء عن ميزة Earth AI في اليوم التالي للإطلاق بسبب مشكلة إنشاء محتوى NSFW — !«メールアドレス»، النتيجة 1، 2026-08-07. https://lemmy.durstig.online/post/52162
الإشارات
- المصدر المفتوح بلون MiniMax H3: شكّل MiniMax H3، بنموذجه الفيديوي وأدوات ComfyUI وتسريعاته، ما يقارب نصف منشورات مجتمع stable_diffusion بين أواخر أغسطس وأوائل سبتمبر. ويبدو أنه يتجه ليصبح معيارًا فعليًا لفيديو المصدر المفتوح.
- ضبابية الحد بين المفتوح والمغلق: يمتلك MiniMax H3 أوزانًا مفتوحة، لكن الاستخدام التجاري يحتاج ترخيصًا مدفوعًا عبر Comfy. وهذا نموذج هجين—استخدام مجاني ودفع تجاري—تظهر مؤشرات على تحوله إلى السائد.
- أكبر أخبار الجانب المغلق هي «الانسحاب»: تفوق خبر تحول Midjourney من توليد الصور إلى الأجهزة الطبية بدرجات كبيرة (58–73) على سباق النماذج الجديدة، بوصفه انتقال أحد كبار اللاعبين المغلقين إلى عمل مختلف تمامًا.
- يتقدم دمج التوليد ثلاثي الأبعاد في ComfyUI: أصبحت نماذج Text/Image-to-3D المفتوحة مثل Trellis.2 وPixal3D وظائف أساسية في ComfyUI، ما يضم إنشاء الأصول ثلاثية الأبعاد إلى سير العمل المحلي بجانب الصور والفيديو.
- لا يضم Lemmy مجتمعًا كبيرًا مخصصًا لتوليد الصور والفيديو: تنتشر المناقشات بين مجتمعات تقنية موجهة لـstable_diffusion بضعة آلاف من الأعضاء ومجتمعات روبوتات صغيرة مثل ai_reddit ذات 50 عضوًا.
القيود
- Lemmy شبكة اتحادية، ولا يغطي بحث API في نسخة واحدة إلا فهرسها. لذلك قد تفوت واجهة
lemmy.worldمنشورات منlemmy.dbzer0.comأوlemmy.today. جرى البحث عبر عدة نسخ وواجهات API، لكن التغطية ليست شاملة بالكامل. - أخفق الاستعلام المباشر لمعلومات مجتمع
localllamaعلىlemmy.ml(/api/v3/community) بخطأ 404، لذلك لم يمكن فحص التفاصيل. - مجتمع
!«メールアドレス»روبوت يعيد نشر RSS من Reddit، لا يكاد يضم نقاشًا بشريًا وله 50 مشتركًا. يصلح كمصدر للأخبار لكنه لا يصلح كمؤشر على حجم النقاش في Lemmy. - لم تؤد عمليات البحث المباشر عن خدمات فيديو مغلقة مثل Sora وKling AI وVeo وRunway Gen إلى نتائج ذات صلة تقريبًا، بل إلى منشورات عن أماكن وأشخاص وأخبار عامة. لم يظهر من Runway سوى منشور متعلق بالأرباح.
- عدد المنشورات أقل بكثير من Reddit، وتدور الدرجات غالبًا حول رقم واحد إلى عشرات. لذلك لا توجد في Lemmy وحدها عينة تكفي لقراءة 20 منشورًا وصياغة اتجاهات قوية. نُفذت سبعة أنواع من الاستعلامات عبر عدة نسخ، وانتُقيت أمثلة ممثلة من المنشورات الحقيقية التي ظهرت.
Pinterest — أخبار الذكاء الاصطناعي لتوليد الصور والفيديو
الأنماط البصرية
- أسلوب «الصورة المصغرة لـYouTube/غلاف المدونة» هو الغالب بوضوح. خلفية سوداء أو كحلية داكنة، وتدرجات نيون زرقاء وبنفسجية وبرتقالية، مع عناوين sans-serif عريضة مثل «AI NEWS» و«THE FUTURE IS AI» و«BREAKING NEWS» و«AI IS CHANGING EVERYTHING!». أغلب الصور أغلفة لمقالات وفيديوهات تتحدث عن الذكاء الاصطناعي، لا مخرجات التوليد نفسها [2, 7, 11, 38, 39, 42, 48]
- الوجوه والصور الشخصية هي العنصر المركزي. تتكرر رسوم تحريك التعبير ومزامنة الشفاه وإعادة إنشاء الوجه (Microsoft VASA-1) وجلسات صور الذكاء الاصطناعي (ChatGPT+Higgsfield) [13, 14, 18, 23, 50]
- تُستخدم صور الروبوتات والبشر الآليين كرمز عام للذكاء الاصطناعي. وتظهر بكثرة صور مخزنة لملامح روبوت أبيض أو امرأة بأسلوب سايبورغ، حتى عندما لا ترتبط بأداة محددة [2, 39]
- ترتيب شبكي «قبل/بعد» أو «صورة إدخال واحدة ← مخرجات بأساليب متعددة». يظهر تحويل فيديو واقعي إلى خشب أو أوريغامي أو مكعبات Lego أو باقة زهور، وصور مقارنة تدمج شخصية محشوة في خلفيات واقعية [3, 31]
- رسوم معلومات للمقارنة والترتيب بين الأدوات. قوائم شعارات، وجداول «أفضل جودة مدفوعة» مقابل «أفضل مجاني»، ومقارنات خصائص بعلامات صح؛ وهي صور مصممة للمساعدة في اختيار الأداة [7, 37]
- صور مصغرة لوجوه تشبه مشاهير حقيقيين. تظهر صور مولدة تشبه Jeff Bezos، ومقدمو شروح بأسلوب YouTube، وصور محاضرات لـJensen Huang من NVIDIA، بحثًا عن الموثوقية أو الجذب [11, 36, 40]
- تراكبات شبكة الوجه أو السلكية. تُستخدم خطوط شبكية وملصقات رقمية فوق وجه ورقبة الإنسان في صور إعلانية توحي بتحليل التعبير أو القياسات الحيوية [23, 50]
- اتساق لوحة الألوان. يمثل اللون الداكن مع لمسات سيان/ماجنتا/أصفر نيون لغة بصرية شبه مشتركة لجميع دبابيس أدوات الذكاء الاصطناعي [2, 7, 38, 39, 42]
دبابيس بارزة
- [1] Image to Video AI: How It Works and Why It Matters — غلاف مقال يشرح آلية إنشاء «خط زمني للفيديو» من صورة ساكنة واحدة.
- [3] Google announces ultra-high quality video... (وهو في الواقع عرض تحويل أسلوبي شبيه بـLuma مع الاحتفاظ بالهوية) — شبكة 3×5 تحول فيديو المصدر إلى خشب وأوريغامي وLego وزهور. وهو عرض واضح لتقنية تبقي الشخص والسيارة متسقين مع تغيير الملمس فقط.
- [7] 6+ Best AI Video Generation Websites — رسم معلوماتي قابل للحفظ يقارن ست أدوات: Runway وPika وKling AI وLuma AI (Dream Machine) وCanva AI وHailuo AI، من حيث الخصائص والمستخدم المستهدف ووجود خطة مجانية.
- [10] Veo 2 — دبوس ترويجي لـVideoFX من Google، يجمع لقطات واقعية لمن ينظر في مجهر وسباح تحت الماء وامرأة مرسومة ترقص مع كوكبات، ليعرض تنوع الأساليب.
- [14] Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini API — صورة ترويجية توضح إمكان توليد صورة إلى فيديو من Gemini API وتؤكد دعم الصوت الأصلي.
- [23] Microsoft Unveils VASA-1 — تقنية تنشئ فيديوهات لوجوه متحدثة بتعبيرات غنية وفي وقت قريب من الحقيقي من صورة واحدة ومقطع صوتي وإشارات تحكم اختيارية؛ وتعرض الصورة المصغرة أعراقًا وتعابير متعددة.
- [27] ShengShu Technology Unveils Vidu S1 — دبوس إعلان Vidu S1 من ShengShu Technology الصينية، الذي يعد بـ«توليد تفاعلي آني»، مع صورة شخصية سايبربانك.
- [31] Google announces video generation AI 'Veo 3' — أربع مخرجات تضع صورة إدخال لوحش محشو أرجواني في غرفة خوادم واقعية، وأطلال تحت الماء، ومدينة حلوى.
- [33] 'Amuse 3.0', an AI art creation tool — إعلان إصدار جديد من أداة AMD المحلية لتوليد الفن، القائمة على Stable Diffusion. وهي واحدة من الإشارات القليلة المحددة نحو المحلي/المفتوح وسط هيمنة المغلق.
- [42] Breaking News Latest AI Developments — ملخص من ثلاثة أخبار: خصائص الوكيل في Grok 4.6، ووصول مستخدمي Gemini إلى مليار مع إنشاء 150 مليون صورة يوميًا، وهاتف Honor الروبوتي، بتاريخ 12 أغسطس 2026.
الإشارات
- هيمنة واضحة للنماذج المغلقة. أصبحت Google Veo 2/Veo 3 وMicrosoft VASA-1 وOpenAI وGrok 4.6 وGemini، الذي تجاوز مليار مستخدم، مادة مباشرة للدبابيس. وفي المقابل، لم تظهر تقريبًا أسماء مفتوحة بارزة مثل Stable Diffusion وComfyUI وFlux وWan وHunyuanVideo وLTX، باستثناء Amuse 3.0 من AMD. ويبدو أن Pinterest منحاز لمحتوى المستهلكين والمسوقين من «الملخصات والمقارنات» أكثر من مجتمع تقني.
- تركيز على تحريك الوجه وإنشائه. تتكرر مزامنة الشفاه وإعادة إنشاء التعبير وبدائل جلسات الصور الشخصية وفيديوهات المذيعين الاصطناعيين. ويبدو ذلك نتيجة تقاطع الطلب في Pinterest—الجمال وتطوير الذات وأفكار منشورات الشبكات الاجتماعية—مع تسويق فيديو الذكاء الاصطناعي.
- المحتوى الثانوي أهم من المعلومات الأولية. تفوق الصور المصغرة من نمط «وجه الشارح مع العنوان» ورسوم مقارنة الأدوات لقطات المخرجات الفعلية. يعمل Pinterest كمدخل إلى مقالات المدونات وفيديوهات YouTube والمحتوى التسويقي بالعمولة أكثر من كونه نقطة نشر للإعلانات الأولية.
- إشارة الغياب: لم تظهر ضمن العينة دبابيس تشير إلى محتوى ياباني أو شركات يابانية، مثل شركات ناشئة محلية أو خدمات فيديو يابانية. تكاد أدوات وأخبار اللغة الإنجليزية تستحوذ على كل شيء.
القيود
- من أصل 50 عنصرًا في
output/pinterest.pins.md، فُتحت 24 صورة للتحقق من محتواها مع مراعاة التمثيل؛ أما الـ26 المتبقية فلم يُفحص منها سوى العنوان، ويُفترض أنها تقع ضمن الأنماط البصرية نفسها: رسوم معلوماتية وصور شخصية ومقارنات أدوات. - كانت ثمانية دبابيس بعناوين «(untitled)» ([12, 19, 20, 30, 35, 39, 46, 50])؛ فُحصت [39] و[50] بصريًا، ولم تُفحص البقية.
- لم تتضمن بيانات العامل لهذه المرحلة تقسيمًا حسب الفئة، إذ كان
pinterest.pins.mdقائمة مسطحة، لذا لم يُنشأ توزيع حسب الفئات. - لم يُتصفح Pinterest ذاته؛ استند التحليل، وفق تعليمات دليل العمل، إلى الصور والعناوين التي جمعها العامل مسبقًا. ولم تتوفر مؤشرات تفاعل مثل الإعجابات أو الحفظ أو التعليقات.
الإجراءات الموصى بها
- أعد تنفيذ بحث X باستخدام مصطلحات صريحة للنماذج والأدوات (Stable Diffusion وComfyUI وFlux وWan وKling وSora) بدل الاعتماد على قائمة الموضوعات الرائجة.
- أنشئ قائمة دائمة بحسابات Bluesky المعروفة لاستطلاعها عبر getAuthorFeed، لأن
app.bsky.feed.searchPostsأعاد 403 في هذه الجولة. - ميّز بوضوح النماذج الهجينة المفتوحة/التجارية، مثل MiniMax H3، بدل وضعها في تصنيف واحد للمصدر المفتوح.
- احتفظ بعنصر متابعة دوري لتحولات الموردين الكبار أو إيقاف الخدمات—مثل التحول الطبي لـMidjourney ونهاية Sora API—لأنها جذبت تفاعلًا أكبر من أخبار إطلاق المنتجات البحتة في Reddit وLemmy.
- تعامل مع Pinterest كمقياس لمشاعر المستهلكين لا كموجز تقني للمصادر الأولية، بسبب غياب تغطية المصدر المفتوح فيه تقريبًا.
الصور المجمعة


















































ملاحظة جودة البيانات
كان X وBluesky دون عتبة الملخص التي تستهدف نحو 20 منشورًا لكل منصة بفارق كبير: أظهر X أربعة منشورات فقط مرتبطة بالموضوع، وجميعها مغلقة المصدر، وأعادت واجهة بحث Bluesky الرمز 403، لذلك اعتمدت التغطية على الحسابات المعروفة. كما جمع Reddit وLemmy وYouTube عناصر أقل من الهدف، ولم يتمكن YouTube من تأكيد أعداد المشاهدات أو المشتركين بسبب الصفحات المعروضة عبر JavaScript.



