أخبار الذكاء الاصطناعي لتوليد الصور والفيديو — 2026-09-08
على جانب المصادر المغلقة، برز بشكل مستقل على Reddit وX وBluesky نوع جديد يتمثل في «وكيل LLM (GPT-6 Astra) الذي يشغّل أدوات GUI وBlender لصنع صور ومقاطع ثلاثية الأبعاد، بدل نماذج الانتشار». في المقابل، تركزت تحركات المصادر المفتوحة في مجتمع ComfyUI على Lemmy وقنوات المراجعة على YouTube، ولم تُرصد تقريبًا على Bluesky وPinterest وReddit وX.
أخبار الذكاء الاصطناعي لتوليد الصور والفيديو — 2026-09-08
أبرز ما في هذا الاستطلاع العابر للمنصات الست هو أن نوعًا جديدًا على جانب المصادر المغلقة—حيث «ينشئ وكيل LLM (GPT-6 Astra) صورًا ومقاطع ثلاثية الأبعاد عبر تشغيل أدوات GUI وBlender مباشرة، بدل نماذج الانتشار»—أصبح موضوعًا للنقاش بصورة مستقلة على ثلاث منصات. أما جانب المصادر المفتوحة فكان أقل حضورًا إجمالًا، لكنه نشط على مستوى مجتمع المطورين: فقد أُطلق تباعًا في أسبوع واحد ما بين خمس وست عقد ComfyUI لتسريع نماذج الفيديو من فئة MiniMax H3 داخل مجتمع !stable_diffusion على Lemmy، بينما تواصل على YouTube اختبار المنافسة على الصدارة بين Flux.2/Flux 2 Klein وQwen-Image. وانحازت Pinterest، وكذلك غالبية منشورات Reddit وX، إلى أسماء المنتجات المغلقة المصدر مثل Midjourney وSora وVeo وRunway وKling وNano Banana وSeedream، فيما لم تظهر أسماء مميزة للمصادر المفتوحة تقريبًا. وبرزت كذلك، عبر Reddit وPinterest، موضوعات الأثر الاجتماعي—مثل الجدل حول ما إذا كان المحتوى مولدًا بالذكاء الاصطناعي، أو حلول وكلاء الذكاء الاصطناعي محل أدوار البشر وأعمالهم—أكثر من الاتجاهات التقنية نفسها.
عبر المنصات
- أصبح التوليد البصري القائم على الوكلاء في GPT-6 Astra موضوعًا مستقلًا على ثلاث منصات: نوقشت واقعة تشغيل Astra لـBlender وإنتاجه لعرض مرئي على Reddit (r/DefendingAIArt) وBluesky (@simonwillison.net) كلٌّ على حدة، فيما ولّد عرض إنشاء مدينة ثلاثية الأبعاد بواسطة Astra سلسلة من التقليد على X (@synabreu، @GulatiYajat). ولم يكن الموضوع «تطور نماذج الانتشار»، بل زاوية جديدة مفادها أن «وكلاء LLM يستولون على الأدوات القائمة لصنع الرسوم والمشاهد ثلاثية الأبعاد»؛ وكان هذا أكبر موضوع عابر للمنصات في هذا الاستطلاع.
- لا يزال تقييم مشكلة اتساق الشخصيات والمشاهد في توليد الفيديو منقسمًا من دون حل واضح: على Reddit (r/generativeAI، r/aivideomaking) وX معًا، نُشرت في الفترة نفسها آراء مؤيدة ومعارضة للنقطة ذاتها، بين @atlas_remake الذي يشيد بـSeedance 2.5 و@Aiden_Tech_Ai الذي يشير إلى انهيار النتائج في المشاهد المعقدة.
- يختلف حضور المصادر المفتوحة جذريًا بحسب المنصة: مجتمع
!stable_diffusionعلى Lemmy نشط إلى درجة إطلاق عقد ComfyUI لنماذج MiniMax H3، مثل ComfyUI-Ref2VA-VSA، بصورة متزامنة تقريبًا، كما ينشر YouTube باستمرار فيديوهات مقارنة واختبار لـQwen-Image وFLUX وWan 2.2. في المقابل، لم يُعثر تقريبًا على منشورات تتضمن أسماء نماذج مفتوحة محددة—مثل الإصدارات الجديدة من Stable Diffusion أو FLUX أو Wan أو HunyuanVideo—على Bluesky أو Pinterest أو Reddit أو X. ويظل من نقاط الضعف البنيوية التي أشارت إليها أقسام Limits في منصات عدة: هل المصادر المفتوحة ليست موضع حديث فعلًا، أم أن انحياز كلمات البحث إلى المصادر المغلقة جعلها تفلت من الرصد؟ - يتوازى الجدل حول الأصالة والأثر الاجتماعي مع الاتجاهات التقنية: رُصدت مستقلًا عبر منصات متعددة منشورات تتنازع حول ما إذا كان المحتوى حقيقيًا أم مولدًا، مثل r/isthisAI على Reddit، ومقاطع Thor لدى r/pj_explained مقابل r/NewRockstars، وخدمة aimod.social على Bluesky لوضع علامات تلقائية على الصور المشتبه بأنها مولدة بالذكاء الاصطناعي، وفيديو مزيف لانتخابات حاكم نيويورك على Bluesky/404media، وصور مصغرة بختم «FAKE» على Pinterest. أي أن التركيز على «التمييز والشك» برز إلى جانب التركيز على «الإنتاج».
حسب المنصة
Reddit: من بين 12 سلسلة نقاش، كان التفاعل في المجتمعات المعنية بالجدل حول الذكاء الاصطناعي وتحديد الأصالة—مثل r/antiai وr/aiwars وr/DefendingAIArt وr/isthisAI وr/pj_explained وr/NewRockstars—أعلى منه في المجتمعات المتخصصة بالصور والفيديو التوليديين، مثل r/generativeAI وr/aivideomaking وr/GoogleFlow وr/freetoolsAI. وبسبب استخدام عبارة بحث واحدة فقط، تعذر تقريبًا إجراء مقارنة بين المغلق والمفتوح المصدر.
X: تركزت المحادثة على إعلان NVIDIA عن Sol-H3، وهو استدلال فيديو أسرع من التشغيل بالزمن الحقيقي، وإعادة إنتاجه محليًا من مستخدمين أفراد، وسلسلة تقليد لإنشاء مدن ثلاثية الأبعاد باستخدام GPT-6 Astra. ومن أصل 40 منشورًا، كان عدد محدود فقط ذا صلة مباشرة بتوليد الصور أو الفيديو، فيما اختلطت منشورات كثيرة خارجة عن الموضوع بسبب إدراج اتجاهات محلية من Explore حول كرواتيا.
YouTube: لم يتسنَّ الحصول على أعداد المشاهدات أو المشتركين بسبب العرض المعتمد على JavaScript، لكن أمكن تأكيد وجود قنوات مقارنة وشرح تغطي كلاً من المصادر المغلقة—Midjourney V8.2 وGrok Imagine وGoogle Gemini «Omni»—والمصادر المفتوحة—Qwen-Image-2.0 وFLUX وWan 2.2. ولذلك كان YouTube أسهل مصدر للمقارنة بين المغلق والمفتوح بين المنصات الست.
Bluesky: أعاد واجه البحث API، app.bsky.feed.searchPosts، رمز 403 باستمرار، ما اضطرنا للانتقال إلى فحص خلاصات حسابات معروفة مثل @simonwillison.net و@404media.co كل على حدة؛ ولذلك لم نصل إلى معيار الإكمال البالغ «تحليل 20 منشورًا». ولم يظهر من المصادر المفتوحة سوى تقرير واحد عن تشغيل Qwen 3.7 27B محليًا.
Lemmy: حققت قصة تحول Midjourney نحو ماسحات الموجات فوق الصوتية الطبية—ضمن !techtakes—أكبر تفاعل منفرد. وعلى جانب المصادر المفتوحة، كان Lemmy المنصة الوحيدة من بين الست التي توفر قدرًا وافرًا من المعلومات الأولية؛ بما في ذلك إطلاق متزامن لعقد ComfyUI الخاصة بـMiniMax H3، ومنافسة معيارية على Qwen-Image-Bench بين LLaDA-Image وBoogu-Image-0.1.
Pinterest: جرى فحص 30 من أصل 50 دبوسًا جمعها العامل مسبقًا. وبسبب استعلام واحد من دون تصنيف، هيمنت مخططات مقارنة المنتجات المغلقة المصدر ورسومات الشرح، ولم يُعثر على اسم نموذج أو مشروع مفتوح المصدر واحد. كما لا يتضمن manifest وقت النشر أو أرقام التفاعل، لذا لا يمكن تقييم الحداثة.
ما يجب مراقبته
- استدلال فيديو MiniMax H3 / Sol-H3 الأسرع من الزمن الحقيقي، وتكاثر عقد تحسين ComfyUI — X (@xieenze_jr) / Lemmy (ComfyUI-Ref2VA-VSA وغيرها). إلى أي مدى ستلحق النسخ ذات الأوزان المفتوحة بالإعلان السحابي.
- اتساع التوليد البصري القائم على وكلاء GPT-6 Astra — Reddit (r/DefendingAIArt) / Bluesky (@simonwillison.net) / X (@synabreu). إلى أي مدى سيتسع التقليد لاحقًا.
- الصراع على قيادة المصادر المفتوحة بين FLUX.2/Flux 2 Klein وQwen-Image — YouTube (SECourses، Urban Decoders). كيف ستؤثر نتائج أكثر من 700 اختبار في التبني اللاحق.
- متابعة قصة تحول Midjourney إلى الأجهزة الطبية (Midjourney Medical) — Lemmy (عبر pivot-to-ai.com). هل سيكون تحول شركة توليد الصور مزحة عابرة أم تنفيذًا فعليًا.
- تداعيات إساءة استخدام فيديوهات الذكاء الاصطناعي في الإعلانات السياسية بانتخابات حاكم نيويورك — Bluesky (404media.co). هل ستتحرك التنظيمات والمنصات.
- مدى حل مشكلة اتساق الشخصيات والمشاهد في توليد الفيديو — Reddit (r/generativeAI) / X (@Aiden_Tech_Ai). هل تقترب الأدوات الشاملة فعلًا من الحل.
التوصيات
- الاستمرار في مراقبة التوليد البصري القائم على وكلاء GPT-6 Astra، بما في ذلك تشغيل Blender وإنشاء المدن ثلاثية الأبعاد، كموضوع تتبع متخصص في المرات القادمة.
- لتجنب تفويت إعلانات المصادر المفتوحة، أضف في الجولة المقبلة كلمات بحث محددة عبر المنصات مثل "FLUX" و"Stable Diffusion" و"Qwen-Image" و"Wan" و"ComfyUI".
- في بحث Bluesky، وسّع مسبقًا قائمة الحسابات الخاضعة للمراقبة على افتراض استمرار رمز 403 في API البحث.
- نظرًا لعدم توفر وقت النشر وأرقام التفاعل على Pinterest، قصر استخدامه على مراقبة الوعي بالأدوات بصورة دورية بدل مقارنات الأخبار العاجلة التي تتطلب حداثة.
- لأن قصة تحول Midjourney إلى الأجهزة الطبية غير محسومة من حيث الحقيقة والتفاصيل، تجنب الاقتباس الجازم منها حتى يظهر مصدر أولي، مثل إعلان رسمي من Midjourney.
- أعط أولوية لمجتمع
!stable_diffusionعلى Lemmy وقنوات الاختبار على YouTube باعتبارها مصادر رئيسية لتتبع تطورات المصادر المفتوحة.
جودة البيانات
كانت المعلومات الأضعف في Bluesky—إذ أعاد API البحث رمز 403 باستمرار فاقتصر الفحص على حسابات منفردة ولم يصل إلى 20 عنصرًا—وفي Pinterest، حيث لا يضم manifest أوقات النشر أو أرقام التفاعل، لذا تظل الحداثة غير معروفة، وحيث لم يظهر أي ذكر للمصادر المفتوحة في الاستعلام الواحد. واستخدم Reddit وX عبارة بحث واحدة هي عنوان الموجز نفسه، لذلك لم تُجمع عن قصد منشورات تسمح بمقارنة واضحة بين المغلق والمفتوح؛ وانتهى الأمر بتركز موضوعات المصادر المفتوحة في Lemmy وYouTube. كما تعذر على YouTube توفير أعداد المشاهدات والمشتركين بسبب قيود العرض المعتمد على JavaScript.
ملخص حسب المنصة
Reddit — أخبار الذكاء الاصطناعي لتوليد الصور والفيديو
أبرز ساحات النقاش (Subreddits)
جُمعت سلاسل النقاش الاثنتا عشرة من 12 subreddit مختلفًا، بمشاركة واحدة من كل منها. وكانت مجتمعات الصور والفيديو التوليديين المتخصصة قليلة، فيما برزت مجتمعات التحقق من الأفلام والمحتوى المزيف، والجدل الثقافي حول الذكاء الاصطناعي.
| Subreddit | عدد الأعضاء | عدد السلاسل المجمعة |
|---|---|---|
| r/whenthe | 813,975 | 1 |
| r/isthisAI | 406,607 | 1 |
| r/antiai | 317,903 | 1 |
| r/aiwars | 167,158 | 1 |
| r/generativeAI | 151,385 | 1 |
| r/RemoteWorkers | 75,332 | 1 |
| r/DefendingAIArt | 72,770 | 1 |
| r/pj_explained | 96,256 | 1 |
| r/NewRockstars | 15,523 | 1 |
| r/freetoolsAI | 7,887 | 1 |
| r/aivideomaking | 6,517 | 1 |
| r/GoogleFlow | 1,789 | 1 |
كانت عبارة البحث الوحيدة هي "Image and Video Generation AI News"، ولذلك مالت النتائج إلى مجتمعات الجدل حول الذكاء الاصطناعي—مثل r/antiai وr/aiwars وr/DefendingAIArt—ومجتمعات التحقق من «هل هذا ذكاء اصطناعي؟» مثل r/isthisAI وr/pj_explained وr/NewRockstars وr/whenthe، أكثر من المجتمعات المتخصصة مثل r/generativeAI وr/aivideomaking وr/GoogleFlow وr/freetoolsAI.
ردود فعل الناس
- GPT-6 يرسم رسومات «يدوية» بتحريك الفأرة، ما يتيح حتى تزوير الفيديوهات المسرعة (السلسلة 2، r/antiai، 7,013 نقطة و1,009 تعليقات، 2026-09-05، https://www.reddit.com/r/antiai/comments/1w81kdd/). يتحدث المنشور عن تزويد LLM، أي GPT-6، بالتحكم في الفأرة ولوحة المفاتيح ليستخدم برامج الرسم الرقمية، وينتج حتى فيديوهات مسرعة تبدو كدليل على أن العمل «حقيقي». وعبّر أبرز تعليق من u/Nayutantantan (2,507 نقطة) عن اليأس: «لم تعد لدي حتى طاقة لتسجيل فيديوهات مسرعة للتوثيق».
- GPT-6 «Astra» ينشئ عرضًا واقعيًا عبر Blender (السلسلة 9، r/DefendingAIArt، 143 نقطة و13 تعليقًا، 2026-09-06، https://www.reddit.com/r/DefendingAIArt/comments/1w970uy/). كان موضع النقاش أن الذكاء الاصطناعي لم يولّد الفيديو نفسه، بل شغّل Blender كوكيل وأنشأ العرض. وقال u/TheMaliciousSquid: «يبدو أن GPT-6 سيكون الأقوى بصريًا؛ أتساءل إن كان سيتفوق على Claude في البرمجة».
- إضافة AutoFlow لـGoogle Flow تدعم توليد فيديو متصل (السلسلة 12، r/GoogleFlow، 12 نقطة و6 تعليقات، 2026-09-01، https://www.reddit.com/r/GoogleFlow/comments/1w4eeyp/). أضيفت ميزة «Continue from Last Frame» التي تمرر تلقائيًا الإطار الأخير للمقطع السابق إلى الإطار الأول للمقطع التالي، إلى جانب إدارة طوابير التوليد والصور المرجعية. ويُعلن لاحقًا عن ميزة لدمج المقاطع في مقطع واحد بسلاسة.
- تجمع الاهتمام حول منشور ترويجي لـ«أداة مجانية لتوليد الصور بالذكاء الاصطناعي» (السلسلة 3، r/freetoolsAI، 39 نقطة و48 تعليقًا، 2026-09-04، https://www.reddit.com/r/freetoolsAI/comments/1w6w0rj/). اجتذب عرض خدمة تدّعي أنها مجانية وغير محدودة ولا تتطلب تسجيلًا تعليقات كثيرة. قال u/Puzzleheaded_Lab4757: «وفرت لي هذه مئات الدولارات وساعات من الوقت»، فيما تساءل u/thecragmire: «كيف يغطون تكاليف التشغيل؟».
- الفيديو الطويل واتساق الشخصيات لا يزالان أكبر عائقين في توليد الفيديو (السلسلة 10، r/generativeAI، 4 نقاط و15 تعليقًا، 2026-09-07، https://www.reddit.com/r/generativeAI/comments/1w9klb7/). ردًا على شخص يريد إنتاج فيديو سينمائي خيال علمي مدته بين دقيقتين وأربع دقائق، اقترحت u/Missy_Desu إنشاء الإطارات بـGPT Image 2 وتحويلها إلى فيديو بـSeedance 2.5، مع التنبيه إلى توقع نحو 100 دولار لكل دقيقة مكتملة. وقال u/KissinglyPolished إن القفزة من الصورة الثابتة إلى الفيديو تجعل الحفاظ على اتساق الشخصيات صعبًا جدًا، وإن الأدوات الشاملة لم تحل المشكلة بعد.
- توليد الفيديو مجانًا وعلى عتاد خفيف لا يزال غير واقعي (السلسلة 8، r/aivideomaking، 6 نقاط و15 تعليقًا، 2026-09-07، https://www.reddit.com/r/aivideomaking/comments/1w9h5a9/). ردًا على طلب إنتاج فيديو مجاني مدته 45 ثانية باستخدام هاتف وiPad فقط، قال u/NewLifeWares إن 45 ثانية تتطلب بنية بحجم مركز بيانات؛ والحل المجاني لن يتجاوز خمس ثوانٍ بعلامة مائية، ولا بد من تجميع المقاطع.
- صور الطعام المولدة بالذكاء الاصطناعي في الإعلانات ما تزال توصف بأنها «غير شهية» (السلسلة 4، r/aiwars، 4 نقاط و177 تعليقًا، 2026-09-03، https://www.reddit.com/r/aiwars/comments/1w69cdj/). ظهرت اعتراضات على استخدام الشركات لصور طعام مولدة بالذكاء الاصطناعي في الإعلانات. قال u/LCI_Jake: «يبدو هذا كأنه صورة صادمة مولدة عمدًا؛ ظننته عش حشرات». ورد u/Bassed_Hummble بنشر نتيجة ولّدها محليًا بـKrea 2 خلال 40 ثانية، معتبرًا أن تحسين الموجهات قادر على تحسين النتائج.
- تفاعل كثيف مع إعلان وظيفة عمل عن بعد لتقييم التسميات التوضيحية للذكاء الاصطناعي (السلسلة 5، r/RemoteWorkers، 152 نقطة و739 تعليقًا، 2026-09-04، https://www.reddit.com/r/RemoteWorkers/comments/1w7azwu/). الوظيفة تدفع 30 دولارًا في الساعة لفحص أخطاء التسميات التي يولدها الذكاء الاصطناعي، مثل التعرف الخاطئ على الأشياء والألوان وقراءة النص. وجاءت معظم التعليقات بصيغ نمطية تطلب رابط التقديم، مع نقاش محدود عن طبيعة العمل.
- ظهرت حالتا جدل حول أصالة «فيديو ذكاء اصطناعي واقعي أكثر من اللازم» (السلسلتان 1 و6، r/NewRockstars وr/pj_explained، إعادة نشر مكررة للمحتوى نفسه، 2026-09-02). واجه منشور يدعي أن لقطات مسربة لاصطدام Thor بعمود هي CGI وليست ذكاءً اصطناعيًا تعليقًا مضادًا من u/ceaserisnothome في r/pj_explained، قال إن انتشار الانفجار في دائرة كاملة دليل على الذكاء الاصطناعي. وهكذا انقسم الحكم على اللقطات نفسها.
- فيديو لموج يظهر داخل نافذة: هل هو ذكاء اصطناعي أم تصوير حقيقي؟ (السلسلة 7، r/isthisAI، 0 نقطة و79 تعليقًا، 2026-09-07، https://www.reddit.com/r/isthisAI/comments/1w9cyub/). أشار صاحب المنشور إلى غرابة ظهور الماء داخل الغرفة دون تحطيم النافذة، لكن u/RioReiser85 اعتبره سوء فهم للمنظور وأنه تصوير حقيقي، فيما قال u/bulbousEd إن حركة رغوة مقدمة القارب مستحيلة فيزيائيًا، ما جعله دليلًا على الذكاء الاصطناعي.
الإشارات
- ما الذي ينمو: الحذر من أن الذكاء الاصطناعي لم يعد يبدو «ذكاءً اصطناعيًا». حجم التفاعل في السلسلة 2، البالغ 7,013 نقطة و1,009 تعليقات، يشير إلى قلق قوي من وصول LLM إلى مرحلة يستطيع فيها تشغيل أدوات GUI مباشرة وتزوير حتى «دليل الرسم اليدوي».
- ما يُهمَل أو يُرفض: تُقابل الرغبة في «إنتاج فيديو طويل وعالي الجودة مجانًا» بالرفض المتكرر من المجتمع (السلسلتان 8 و10). وتبقى قيود العتاد والتكلفة شديدة، وهو إجماع Reddit.
- ما كان مفاجئًا: كان زخم النقاش والتفاعل في المجتمعات المختصة بتحديد الأصالة والجدل حول الذكاء الاصطناعي—r/isthisAI وr/antiai وr/aiwars وr/pj_explained وr/NewRockstars وr/whenthe—أعلى من المجتمعات «المتخصصة» في صور وفيديو الذكاء الاصطناعي مثل r/generativeAI وr/aivideomaking وr/GoogleFlow. أخبار الصور والفيديو التوليديين على Reddit اليوم تُناقش بوصفها احتكاكًا اجتماعيًا حول سؤال «هل هذا ذكاء اصطناعي أم لا؟»، أكثر مما تُناقش بوصفها تطورًا في النماذج.
- إشارات متعارضة: بالنسبة إلى فيديو التسريب نفسه عن «اصطدام Thor»، انقسمت تعليقات r/NewRockstars وr/pj_explained انقسامًا معاكسًا تمامًا بين «ليس ذكاءً اصطناعيًا» و«إنه ذكاء اصطناعي» (السلسلتان 1 و6). وبالمثل، تعادلت تقريبًا وجهة النظر المؤيدة للتصوير الحقيقي وتلك المؤيدة للذكاء الاصطناعي في السلسلة 7، ما يشير إلى أن الحكم البصري للمستخدمين العاديين لم يعد موثوقًا.
القيود
- استُخدمت عبارة البحث الوحيدة "Image and Video Generation AI News"، ولم يُجر العامل أي بحث بعبارات بديلة مثل "Stable Diffusion" أو "Midjourney" أو "Sora" أو "Kling" أو «توليد الصور مفتوح المصدر». لذلك لم تُجمع تقريبًا منشورات تسمح بمقارنة واضحة بين المصادر المغلقة—Midjourney وDALL-E وSora وVeo وRunway—والمصادر المفتوحة مثل Stable Diffusion وFlux ونظام ComfyUI.
- جُمعت السلاسل الاثنتا عشرة من 12 subreddit مختلفًا، واحدة فقط من كل مجتمع، لذلك لم يمكن التعمق داخل المجتمع نفسه أو مقارنة سلاسل متعددة بالموضوع ذاته.
- السلسلتان 9 و11 لا تحتويان على نص أساسي، بل عنوانًا وتعليقات فقط، ما يقلل من المعلومات الأولية عن قصد الناشر.
- السلسلتان 1 و6 إعادة نشر للمحتوى نفسه تقريبًا في مجتمعات مختلفة؛ ولذلك فإن اعتبارهما حالتين مستقلتين يجعل العينة الفعلية أقرب إلى 11 حالة.
- بحكم طبيعة جمع البيانات عبر المتصفح، لم يُجرَ في هذه الجولة وصول إضافي إلى Reddit، مثل إعادة البحث بعبارات أخرى أو توسيع كل التعليقات داخل السلاسل.
X
X — أخبار الذكاء الاصطناعي لتوليد الصور والفيديو
الحسابات
جُمعت 40 منشورًا من 37 حسابًا. كان معظمها منشورات منفردة «حققت انتشارًا أو دُفنت»؛ والحساب الوحيد المرتبط بتوليد الصور والفيديو الذي نشر سلسلة متعددة التغريدات هو @yu_ichi_suzuki (鈴木憂一).
| الحساب | عدد المنشورات | الاتجاه |
|---|---|---|
| @yu_ichi_suzuki(鈴木憂一) | 2 | سلسلة تقنية عن تشغيل MiniMax H3 على RTX 5090 محليًا، بإجمالي 309 إعجابات؛ شرح إجرائي لا انتشار منفرد |
| @xieenze_jr(Enze Xie) | 1 | منشور إعلان نموذج جديد من باحث MiniMax نفسه: 349 إعجابًا ونحو 85,000 مشاهدة |
| @voxelphotonics | 1 | عرض حجمي لـDuke Nukem 3D حقق انتشارًا كبيرًا في منشور واحد: 6,097 إعجابًا ونحو 297,000 مشاهدة |
| @synabreu | 1 | مدينة سيول ثلاثية الأبعاد بـGPT-6 Astra في منشور واحد: 2,700 إعجاب ونحو 235,000 مشاهدة |
| @GulatiYajat(Yajat Gulati) | 1 | إنشاء مدينة جورجاون ثلاثية الأبعاد بـGPT-6 Astra: 574 إعجابًا |
| @luccacerf | 1 | عرض يجمع Blender MCP وAstra وTripo: 445 إعجابًا |
| @He1s_Sammy | 1 | سلسلة مطولة عن تحول فيديوهات الأطفال بالذكاء الاصطناعي من دون ظهور الوجه إلى نشاط تجاري: 388 إعجابًا |
| @SD_Tutorial(Stable Diffusion Tutorials) | 1 | حساب شرح تقني لـSol-H3، لكن التفاعل محدود بـ22 إعجابًا |
| @Strength04_X, @atlas_remake, @Aiden_Tech_Ai, @alphafox | واحد لكل حساب | حسابات متوسطة الحجم تناقش جودة Seedance 2.5 وفيديو الذكاء الاصطناعي وحدوده |
باستثناء @xieenze_jr، لم يكن الناشرون مطورين للنماذج أنفسهم، بل مستخدمين ينشرون تجاربهم وإنجازاتهم. ويقود النقاش هيكل من طبقتين: منشورات فيروسية ضخمة قليلة من @voxelphotonics و@synabreu، ومشاركة إجراءات تقنية من أفراد مثل @yu_ichi_suzuki و@SD_Tutorial.
المنشورات
- MiniMax تعلن «Sol-H3»، توليد فيديو أسرع من التشغيل بالزمن الحقيقي (#2 @xieenze_jr، 349 إعجابًا و62 إعادة نشر و23 ردًا ونحو 85,000 مشاهدة، 2026-09-07، https://x.com/xieenze_jr/status/2097000082927399012). أعلنت أن «Five seconds of world. 1.653 seconds to infer.»؛ أي إمكانية توليد خمس ثوانٍ من فيديو بدقة 1344×768 خلال 1.653 ثانية على 8× NVIDIA B300 Blackwell. كان هذا المنشور نقطة انطلاق الاتجاه الأول في X Explore: «NVIDIA Speeds Up AI Video Generation Past Real-Time Playback».
- انتشار شرح تقني للإعلان المذكور (#3 @SD_Tutorial، 22 إعجابًا ونحو 2,100 مشاهدة، 2026-09-07، https://x.com/SD_Tutorial/status/2097061880175141224). يصفه بأنه «a high-performance video inference stack developed by NVIDIA Research that runs the MiniMax-H3 video generation model faster than real-time playback»، ويربط بصفحة Sol-Engine/Sol-H3 في nvlabs.github.io. وتبعت حسابات تقنية الإعلان الرسمي فورًا.
- نشر خطوات تشغيل MiniMax H3 محليًا على RTX 5090 (#4–5 @yu_ichi_suzuki، 295+14 إعجابًا ونحو 18,000+1,100 مشاهدة، 2026-09-07، https://x.com/yu_ichi_suzuki/status/2096819288997065192). شارك سير عمل فرديًا يجمع LoRA مقطرًا من Alibaba مع الترقية، قائلًا إنه يمكن توليد فيديو يتجاوز 2K ومدته 15 ثانية في نحو تسع دقائق باستخدام MiniMax H3 محليًا على RTX 5090، ثم رفع دقة مخرجات 480p إلى 2688×1536 بواسطة RTX Video Super Resolution. وهو مقابل عملي من مستخدم فردي للأوزان المفتوحة أمام إعلان السحابة (#1 و#2)، مع ملاحظات GitHub.
- توليد فيديو أزياء باستخدام Seedance 2.5 (#1 @Strength04_X، 68 إعجابًا وإعادتَا نشر و35 ردًا ونحو 7,700 مشاهدة، 2026-09-06، https://x.com/Strength04_X/status/2096441159887274302). نشر فيديو موسيقيًا سينمائيًا واقعيًا للأزياء والسفر مدته 30 ثانية، مع نص الموجه كاملًا، باستخدام «Seedance 2.5 on Dreamina_ai».
- إنشاء عالم على غرار Toy Story باستخدام Seedance 2.5 (#14 @atlas_remake، 3 إعجابات ونحو 133 مشاهدة، 2026-09-07، https://x.com/atlas_remake/status/2096847522602139995). أثنى على قدرة Seedance 2.5 على التعامل مع عدة شخصيات وأشياء متحركة، معتبرًا اتساق الشخصيات المتعددة نقطة قوة.
- التنبيه إلى أن فيديو الذكاء الاصطناعي لا يزال «آلة قمار» (#12 @Aiden_Tech_Ai، إعجاب واحد وإعادتَا نشر و4 ردود ونحو 494 مشاهدة، 2026-09-07، https://x.com/Aiden_Tech_Ai/status/2097020441470836791). يشير إلى أن العملية تصبح حلقة «تكتب موجهًا، تولد، تجد خطأً، ثم تولد من جديد»، ولا سيما في المشاهد التي تشمل فضاءات متعددة وحركة كاميرا وتموضع شخصيات واستمرارية. تفاعله محدود، لكنه يقابل التفاؤل في #5.
- إعادة إنتاج Duke Nukem 3D على شاشة ثلاثية الأبعاد حجمية (#10 @voxelphotonics، 6,097 إعجابًا و921 إعادة نشر و130 ردًا ونحو 297,000 مشاهدة، 2026-09-07، https://x.com/voxelphotonics/status/2096833425043005562). كان من أعلى منشورات الفترة تفاعلًا على X. ليس توليدًا للصور أو الفيديو بالذكاء الاصطناعي بحد ذاته، بل عرضًا لتقنية عرض ورسم، لكنه كان سببًا رئيسيًا للاتجاه الثالث في Explore: «Duke Nukem 3D Brought to Life in True 3D Display».
- تحويل كامل مدينة سيول إلى نموذج ثلاثي الأبعاد بواسطة GPT-6 Astra (#20 @synabreu، 2,700 إعجابًا و451 إعادة نشر و81 ردًا ونحو 235,000 مشاهدة، 2026-09-06، https://x.com/synabreu/status/2096557555086725159). انتشر على نطاق واسع كمثال تطبيقي للتوليد ثلاثي الأبعاد التفاعلي، إذ كتب: «for my first project created with GPT-6 Astra, I built the entire city of Seoul in 3D—a small revolution in digital geography!».
- إعادة إنشاء مدينة جورجاون ثلاثية الأبعاد بالمثل باستخدام GPT-6 Astra (#22 @GulatiYajat، 574 إعجابًا و28 إعادة نشر و53 ردًا ونحو 46,000 مشاهدة، 2026-09-06، https://x.com/GulatiYajat/status/2096659142534676684). مثال مباشر على ظهور متابعين لموجة #8؛ إذ كتب: «I saw everyone building all sorts of cool demos with Astra, so I decided to give it a shot»، ونشر حتى موقعًا مخصصًا على gurgaon-3d-atlas.cratorlabs-2435.chatgpt.site.
- عرض يجمع Blender MCP + Astra + Tripo (#21 @luccacerf، 445 إعجابًا و20 إعادة نشر و11 ردًا ونحو 31,000 مشاهدة، 2026-09-07، https://x.com/luccacerf/status/2097047098281672782). مثال على ربط عدة أدوات ذكاء اصطناعي عبر MCP، مع العبارة: «First time building a gUI with Blender MCP + Astra + Tripo This is insane. Html preview for AI is dead.»
- فيديوهات الأطفال بالذكاء الاصطناعي من دون إظهار الوجه تتحول إلى عمل تجاري للمحتوى (#23 @He1s_Sammy، 388 إعجابًا و96 إعادة نشر و17 ردًا ونحو 19,000 مشاهدة، 2026-09-06، https://x.com/He1s_Sammy/status/2096492880017736056). انتشر كمنشور عن العمل الجانبي وتحقيق الدخل باستخدام الفيديو التوليدي، مع القول إن الهاتف أو الحاسوب المحمول أو iPad يكفي للبدء بالتجربة.
الإشارات
- ما الذي ينمو: جعل وكلاء المحادثة ينشئون عوالم ثلاثية الأبعاد، مثل مدن GPT-6 Astra ثلاثية الأبعاد والتكامل مع Blender MCP، هو الاتجاه الذي ولّد أكبر قدر من التقليد والمتابعة في هذه الفترة. وقد قال GulatiYajat صراحة في #9 إنه فعل ذلك بعدما رأى الجميع ينشئون عروضًا مختلفة باستخدام Astra، ما يشير إلى سلسلة تقليد لا خبر منفرد.
- ما الذي ينمو أيضًا: ظهر في وقت متقارب استدلال الفيديو الأسرع من الزمن الحقيقي عبر Sol-H3 (#2 و#3)، وحركة إعادة إنتاجه على GPU محلي بواسطة أفراد (#3 لـ@yu_ichi_suzuki)، ما يوضح سير الإعلان المغلق المصدر والمتابعة بالأوزان المفتوحة جنبًا إلى جنب تقريبًا ومن دون فارق زمني على X.
- ما يُهمَل أو تنقسم الآراء حوله: اتساق الفيديو التوليدي عبر شخصيات وفضاءات متعددة. نُشرت في الفترة نفسها إشادة (#5: «يتعامل جيدًا مع عدة شخصيات متحركة») وانتقادات (#6: «مشكلة آلة القمار»)، لذلك لم يستقر تقييمه بعد.
- ما كان مفاجئًا: من بين تسعة اتجاهات في Explore كانت مصدر المنشورات الأربعين في هذه الجولة، لم يرتبط مباشرة بتوليد الصور والفيديو سوى أول ثلاثة: NVIDIA/Sol-H3، عودة VTuber Veibae إلى الرسوم المتحركة، وعرض Duke Nukem 3D الحجمي. أما الاتجاهات الستة الأخرى—Croatian وBuilding و$song وHarvey وUkrainian وDemocrats—فكانت اتجاهات إقليمية لا علاقة لها بالموضوع، إذ وُسم الاتجاه الرابع صراحة بأنه «Trending in Croatia». ومع ذلك، أسفر البحث عن «Building» عرضًا عن اكتشاف جيد: عروض مدن GPT-6 Astra ثلاثية الأبعاد في #8–#10.
- قضية VTuber Veibae: عند البحث عن الاتجاه الثاني في Explore، «VTuber Veibae Teases Return with Sunflower Farm Animation»، كانت النتائج الفعلية مجرد حسابات تلخص إيرادات شباك التذاكر في أميركا الشمالية—مثل @mediamanint ومنشورات مكررة—ولم تُجمع أي منشورات من Veibae نفسها أو عن إنتاج الرسوم المتحركة.
القيود
- لم ينتج البحث عن اتجاه Explore الثالث، «VTuber Veibae Teases Return with Sunflower Farm Animation»، منشورات مرتبطة بالموضوع؛ إذ كانت النتائج #6–#9 تكرارات غير مرتبطة عن شباك التذاكر. ولا يمكن من هذه البيانات معرفة ما إذا كان الذكاء الاصطناعي قد استُخدم في إنتاج الرسوم المتحركة لـVTuber أم لا.
- كانت الاتجاهات الستة المتبقية في Explore—Croatian وBuilding و$song وHarvey وUkrainian وDemocrats—غير مرتبطة تقريبًا بتوليد الصور والفيديو، بوصفها اتجاهات إقليمية وأخبارًا جارية. واستُبعدت لذلك 29 من أصل 40 منشورًا مجموعًا (#6–#9 و#13 و#15–#19 و#24–#40) من هذا التقرير.
- اقتصر البحث على نصوص عناوين الاتجاهات نفسها، ولم يُبحث بأسماء محددة مثل "Stable Diffusion" أو "Midjourney" أو "Sora" أو "Kling" أو "ComfyUI". ولذلك لا تكاد توجد منشورات تسمح بمقارنة صريحة بين المصادر المغلقة—Midjourney وSora وRunway وVeo—والمصادر المفتوحة—Stable Diffusion وFlux وComfyUI.
- يرتبط Explore نفسه جغرافيًا بموقع خادم هذه الجلسة، الذي يبدو أنه قرب كرواتيا، ولذلك لا يمثل اتجاهات X العالمية كلها.
- توقف الجمع عند 40 منشورًا، ولم يُجرَ تعمق إضافي في منشورات الحسابات نفسها أو الردود أو البحث بالوسوم ضمن هذه الجولة.
YouTube
YouTube — أحدث اتجاهات الذكاء الاصطناعي لتوليد الصور والفيديو
القنوات
- 動画編集の中の人 (القناة) — تنشر العديد من المقارنات العملية لتشغيل الذكاء الاصطناعي لتوليد الصور.
- AI大学【AI&ChatGPT最新情報】 (القناة) — تركز على فيديوهات ملخصات شهرية لأدوات الذكاء الاصطناعي التوليدي.
- 【さき】のAIでええやん。 (القناة) — تشرح تحديثات Google I/O وGemini.
- Qwen(公式) (القناة) — تبث فيديوهات الإعلان الرسمية عن سلسلة Qwen-Image.
- AIOnTrend (القناة) — مقارنات متوازية لنماذج الصور المفتوحة المصدر.
- Urban Decoders (القناة) — شروح لمعمارية نماذج Flux.
- SECourses (القناة) — اختبارات واسعة النطاق لتوليد الصور محليًا، مثل أكثر من 700 اختبار.
- Woollyfern (القناة) — قناة لمراقبة تحديثات Midjourney الشهرية بانتظام.
- 寺田部チャンネル (القناة) — مراجعات عملية لتوليد الفيديو محليًا باستخدام ComfyUI.
- 東京大学 吉田幸 研究室 (القناة) — شروح منتظمة لاتجاهات تقنيات الذكاء الاصطناعي التوليدي من جامعة طوكيو.
تعذر الحصول على أعداد المشتركين لأن صفحات نتائج البحث والفيديو في YouTube تُعرض عبر JavaScript، كما يرد في Limits أدناه.
الفيديوهات
المصادر المغلقة
- 【ド課金して判明】2026年おすすめ画像生成AIはコレ!NanoBananaPro・Seedream4.0・Midjourney・AdobeFireflyを徹底比較します! — 動画編集の中の人 — https://www.youtube.com/watch?v=vJLDbXaSKW4 — مقارنة عملية مدفوعة بين Nano Banana Pro وSeedream 4.0 وMidjourney وAdobe Firefly، مع خلاصة عن أفضل الخيارات في 2026.
- 【2026年冬最新】ここ数か月で過去イチ進化した無料の人気動画生成AIツール6選!~Sora 2、Veo 3.1、Kling 2.6など~ — AI大学【AI&ChatGPT最新情報】 — https://www.youtube.com/watch?v=T9iIlhittDc — يستعرض ست أدوات فيديو توليدية مجانية، بينها Sora 2 وVeo 3.1 وKling 2.6، مع التركيز على حجم تطورها خلال الأشهر الماضية.
- 【性能ランキング世界1位】xAIの動画生成AI「Grok Imagine」徹底解説! Sora/Veo級の映像を無料で作る方法! — AI大学【AI&ChatGPT最新情報】 — https://www.youtube.com/watch?v=0cYPwxg8le8 — يزعم أن Grok Imagine من xAI تصدر تصنيف الأداء عالميًا، ويشرح كيفية إنتاج فيديوهات بمستوى Sora وVeo مجانًا.
- 【最新】GoogleのAI Geminiのモデルが大幅アップデート!動画生成Omniも発表されたGoogle I/O 2026を解説するで! — 【さき】のAIでええやん。 — https://www.youtube.com/watch?v=vKtwoKCSGyE — شرح للتحديثات الكبيرة في Gemini ولإعلان نموذج الفيديو الجديد «Omni» في Google I/O 2026.
- Midjourney Update | July 2026: V8.2 is HERE! Personalization, NIJI Style Creator, and More! — Woollyfern — https://www.youtube.com/watch?v=dvfH5HzCARY — تقرير عن إصدار Midjourney V8.2 وإضافة التخصيص وNIJI Style Creator، بوصفه أحدث حلقة في التسلسل الشهري: V8 Alpha في مارس 2026، ثم V8.1 في أبريل، ومعاينة V8.2 في يونيو، والإصدار الرسمي في يوليو.
المصادر المفتوحة
- 🚀 Introducing Qwen-Image-2.0 — our next-gen image generation model! — قناة Qwen الرسمية — https://www.youtube.com/watch?v=1tM7Wd0lEeI — فيديو الإعلان الرسمي من فريق Alibaba Qwen عن Qwen-Image-2.0، المقدم بوصفه نموذج صور مفتوح المصدر من الجيل التالي.
- Qwen Image Dominates Text-to-Image: 700+ Tests Reveal Why It's Better Than FLUX - Presets Published — SECourses — https://www.youtube.com/watch?v=R6h02YY6gUs — اختبار يستند إلى أكثر من 700 حالة ويبحث في مواطن تفوق Qwen Image على FLUX، مع نشر إعدادات مسبقة.
- Flux 2 Klein vs Qwen vs Z Image Turbo vs Nano Banana Pro - Which AI Image Wins? — AIOnTrend — https://www.youtube.com/watch?v=CkAtP2EVhSM — مقارنة بين Flux 2 Klein وQwen وZ Image Turbo المفتوحة المصدر وNano Banana Pro المغلق المصدر باستخدام الموجه نفسه.
- Flux.2 New Open Source King? Architecture FULL guide + Nano Banana Pro comparisons — Urban Decoders — https://www.youtube.com/watch?v=Iu9Dm7lBeAk — شرح لمعمارية Flux.2 الصادر من Black Forest Labs، واختبار ما إذا كان «الملك الجديد للمصادر المفتوحة» عبر مقارنته بـNano Banana Pro.
- Flux 2 Klein Just Dropped—This Image Editing Model Isn't Just About Speed! — https://www.youtube.com/watch?v=JXgBe3twxbc — خبر عاجل عن إطلاق نموذج تحرير الصور الخفيف القابل للتشغيل محليًا «Flux 2 Klein» من Black Forest Labs.
- Wan 2.2, FLUX & Qwen Image Upgraded: Ultimate Tutorial for Open Source SOTA Image & Video Gen Models — https://www.youtube.com/watch?v=3BFDcO2Ysu4 — درس يجمع ترقيات النماذج المفتوحة المتقدمة للصور والفيديو، مثل Wan 2.2 من Alibaba وFLUX وQwen Image.
- 【無料・ComfyUI】ローカル動画生成AIを使って長編動画を制作するのは簡単か?無茶苦茶大変です — 寺田部チャンネル — https://www.youtube.com/watch?v=I8_wKOLnSlI — تقرير عملي عن إنتاج فيديو طويل باستخدام ComfyUI والذكاء الاصطناعي لتوليد الفيديو محليًا، يتضمن تجربة صادقة وخلاصتها أن الأمر «صعب جدًا».
الإشارات
- نقطة التنافس التي تتقدم فيها المصادر المغلقة هي «السعر والسرعة» مقابل «الجودة»: تظهر عدة مواد مقارنة تزعم فوز Nano Banana Pro في 63% من اختبارات الواقعية (الفيديوهان 1 و9)، فيما يروج المستوى المجاني أو الرخيص، مثل Grok Imagine في الفيديو 3، بعبارة استفزازية: «جودة Sora/Veo مجانًا».
- يواصل Midjourney تحسين سلسلة V8 بإيقاع شهري: تراقب قناة Woollyfern المسار شهريًا من الإعلان عن V8 في فبراير 2026 إلى Alpha في مارس، ثم V8.1 في أبريل، ومعاينة V8.2 في يونيو، والإصدار الرسمي في يوليو؛ ما يبرز سرعة وتيرة التحديثات (الفيديو 5).
- أُعلن توليد الفيديو Gemini «Omni» في Google I/O 2026 بوصفه خبرًا كبيرًا مستقلًا، وظهرت له شروح عاجلة حتى في القنوات اليابانية (الفيديو 4).
- يتنافس معسكر المصادر المفتوحة بين Qwen Image وFLUX على القيادة: تواصل قنوات التحليل العميق نشر فيديوهات تتحقق من «من الأفضل»، مثل اختبارات SECourses التي تتجاوز 700 حالة (الفيديو 7) وشرح Urban Decoders للمعمارية (الفيديو 9)، ما يدل على اهتمام مجتمع قوي.
- يُتابَع «Flux 2 Klein» من Black Forest Labs كنموذج فرعي خفيف وموجه للتشغيل المحلي بصورة مستقلة (الفيديو 10)، بالإضافة إلى Flux.2 كامل الحجم.
- تُعامل منظومة Alibaba، Wan وQwen Image، كجناحين مفتوحين للفيديو والصور إلى درجة جمعهما في درس واحد (الفيديو 11).
- لا يزال توليد الفيديو محليًا «صعبًا» وفق الخبرة العملية؛ فإنتاج فيديو طويل في ComfyUI وُصف بصراحة بأنه «صعب جدًا» (الفيديو 12). ولا تزال أعباء التشغيل، إلى جانب الجودة، مشكلة في توليد الفيديو المفتوح المصدر.
القيود
- لأن صفحة نتائج YouTube (
/results?search_query=...) وصفحات المشاهدة تعرض المحتوى باستخدام JavaScript، لم يتمكن WebFetch إلا من الحصول على HTML ثابت يتضمن روابط التذييل للشروط وحقوق النشر. ولذلك لم تُقرأ قائمة الفيديوهات أو أعداد المشاهدات أو تواريخ النشر أو الوصف أو التعليقات حتى عند فتح الصفحة مباشرة. ويتعارض ذلك مع افتراض دليل العمل أن HTML الصفحة يتضمن العنوان والقناة والمشاهدات وتاريخ النشر. - كبديل، جرى التحقق عبر بحث ويب من
site:youtube.comللحصول على العناوين وعناوين URL وملخصات محرك البحث وبعض التواريخ، وباستخدام نقطةoembedفي YouTube للحصول على العنوان الرسمي واسم القناة ورابط القناة بصيغة JSON. لكن لم يكن بالإمكان الحصول إطلاقًا على أعداد المشاهدات أو المشتركين أو نصوص أوصاف الفيديو أو التعليقات بهذه الطريقة، ولذلك لم تُدرج. - لم تُظهر عمليات البحث اليابانية المخصصة لشهري أغسطس وسبتمبر 2026 أخبارًا محددة لتوليد الصور أو الفيديو؛ بل اختلطت بها قنوات أخبار يومية عامة للذكاء الاصطناعي وأخبار طقس غير مرتبطة. ولم يُعثر على أخبار عاجلة مخصصة خلال الأسبوع الأخير، 1–8 سبتمبر.
- لم تُبحث Reddit وX وBluesky وLemmy وPinterest في هذه المرحلة، وفق ما يذكره brief.md، إذ خُصصت لمراحل أخرى.
Bluesky
Bluesky — أخبار الذكاء الاصطناعي لتوليد الصور والفيديو
الحسابات
| المعرّف | الصفة | المتابعون وغيرها | ملاحظة |
|---|---|---|---|
| @simonwillison.net | فرد، مدون تقني بارز في الذكاء الاصطناعي ومؤلف Datasette | — | يقارن قدرات توليد الصور لكل نموذج جديد باختباره الخاص: طلب رسم بجع يركب دراجة. كان أغنى مصدر بالمحتوى في هذه الجولة. |
| @404media.co | وسيلة إعلامية، تضم محرري وصحفيي 404 Media | — | يركز على تقارير المراقبة، لكنه ينشر أحيانًا تحقيقات حول الإعلام المولد بالذكاء الاصطناعي. |
| @aimod.social | إدارة مجتمع، واضع علامات للصور المشتبه بها | 2,555 متابعًا و94 منشورًا | خدمة وضع علامات رسمية في Bluesky للصور المشتبه بأنها مولدة بالذكاء الاصطناعي. هي بنية تحتية أكثر من كونها مصدر أخبار. |
| @stablediffusion.bsky.social | فرد يشارك موجهات SDXL/Stable Diffusion | — | توقفت المنشورات منذ يناير 2025. |
| @bm63ai.bsky.social | فرد ينشر فنًا بـComfyUI/Flux/Midjourney | — | كان ينشر فن الذكاء الاصطناعي حتى أبريل 2025، لكن آخر منشور له في يونيو 2026 عن تطوير تطبيق بأسلوب vibe coding بواسطة Codex؛ أما منشورات الفن فقد توقفت عمليًا. |
| @petapixel.bsky.social | وسيلة إعلام فوتوغرافية | — | تتناول ميزات Adobe التوليدية، مثل Firefly وLightroom، بنبرة نقدية، لكن آخر منشوراتها الحديثة كانت في فبراير 2025 ولا تدخل في دورة الأخبار الحالية. |
المنشورات
- عودة اختبار البجع الراكب للدراجة مع GPT-6 Astra (@simonwillison.net، 2026-09-04، 202 إعجابًا و9 إعادات نشر و18 ردًا، https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c). نشر مقارنة شبكية لرسوم SVG لبجع يركب دراجة، عبر أربعة نماذج GPT-6 Astra وGPT-5.6 Sol وTerra وLuna، ولكل منها ثلاثة مستويات استدلال، تحت عنوان «Got access to GPT-6 Astra. Want to see some pelicans?». وتصف النصوص البديلة Astra بأنه يقدم نتائج مصقولة ومتسقة، وSol بنسب متباينة، وTerra بتشريح غير طبيعي، وLuna بوضعيات أبسط وأكثر جمودًا. التفاصيل: static.simonwillison.net/static/2026/gpt-6-and-5.6-pelicans.html. وورد في الردود أن Astra هو أول نموذج يفهم أن الحيوان الخيالي رباعي الأرجل يحتاج دراجة ترادفية.
- GPT-6 Astra يشغّل Blender لإنشاء مشهد بجع ثلاثي الأبعاد (@simonwillison.net، 2026-09-05، 400 إعجاب و30 إعادة نشر، https://bsky.app/profile/simonwillison.net/post/3murtmdynq22s). نفذ ثلاث تعليمات متتابعة: «Use the already install /Applications/Blender to render a scene of a pelican riding a bicycle»، ثم «add a background and a lot of flair»، ثم «make it a whole lot better»، ونشر الناتج الذي جعل وكيل البرمجة يرسم مشهدًا ثلاثي الأبعاد في Blender. وقد طُرح الموضوع نفسه—«GPT-6 Astra ينشئ عرضًا واقعيًا في Blender»—مستقلًا في سلسلة r/DefendingAIArt على Reddit، ما يؤكد حضوره العابر للمنصات.
- Qwen 3.7 27B المفتوح المصدر يرسم بجعًا محليًا (@simonwillison.net، 2026-08-14، 183 إعجابًا و14 إعادة نشر، https://bsky.app/profile/simonwillison.net/post/3mt2ynhrlk22z). كتب: «The new Qwen 3.7 27B, running as a 17GB GGUF in LM Studio on my M5 Max MacBook Pro, just drew me the best pelican riding a bicycle I've seen from any model that runs on my laptop». وهو أحد المنشورات الملموسة القليلة التي تظهر تحسن توليد الصور في نموذج مفتوح المصدر قابل للتشغيل محليًا.
- مرشح لمنصب حاكم نيويورك يستخدم فيديو مزيفًا مولدًا بالذكاء الاصطناعي لمهاجمة منافسين (@404media.co، 2026-09-02، 124 إعجابًا و22 إعادة نشر و7 ردود، https://bsky.app/profile/404media.co/post/3muka24vu4v2q). بعنوان «The Republican Nominee for New York Governor Made a Creepy, AI-Generated Video of Mamdani and Hochul». وسخر منشور اقتباس من أحد العاملين في 404 Media من أننا نعيش زمن إنشاء إعلان Viagra مزيف للإساءة إلى خصوم سياسيين (194 إعجابًا و36 إعادة نشر، https://bsky.app/profile/404media.co/post/3muk7u6iepk2h). وهي حالة لاستخدام فيديو الذكاء الاصطناعي التوليدي في التضليل السياسي.
- شركة إنتاج Cocomelon تطلب من الفنانين إجراء تجارب بالذكاء الاصطناعي (@404media.co، 2026-09-06، 84 إعجابًا و23 إعادة نشر و21 ردًا، https://bsky.app/profile/404media.co/post/3musx3wgdvc2n). قالت Moonbug Entertainment، منتجة Cocomelon وBlippi ومحتوى أطفال شهير آخر، إنها ستبدأ باستخدام الذكاء الاصطناعي مع وجود «إنسان في الحلقة» دائمًا. وهو إعلان اعتماد للذكاء الاصطناعي لتوليد الصور والفيديو في حالة استخدام رئيسية هي إنتاج محتوى الأطفال.
- خدمة وضع علامات الصور المشتبه بها، aimod.social، تضم أكثر من 2,500 متابع (فحص الملف الشخصي، https://bsky.app/profile/aimod.social). تصف نفسها بأنها «Labeler for flagging suspected AI imagery»، وتوفر دليلًا لمعايير الحكم وقناة للاعتراضات. ليست مقالة إخبارية، لكنها تشير إلى نشوء طلب على مستوى المجتمع لخدمة تشكك في صور الذكاء الاصطناعي وتضع عليها علامات تلقائية.
- صمت متتابع في الحسابات القديمة المخصصة لفن الذكاء الاصطناعي (فحص خلاصات @stablediffusion.bsky.social و@bm63ai.bsky.social). لم ينشر stablediffusion.bsky.social منذ منشور 22 يناير 2025 عن موجه «the liberty statue playing electric guitar» مع #SDXL و#StableDiffusion و10 إعجابات. وأوقف bm63ai.bsky.social أيضًا منشورات الفن بعد «Star Trek: The Muppet Generation» بتاريخ 25 أبريل 2025 باستخدام #comfyui و#midjourney و#flux و5 إعجابات؛ وكان آخر منشور في 8 يونيو 2026 عن تطبيق موسيقى بُني بواسطة وكيل برمجة.
- نقد سابق لميزات Adobe التوليدية، كمعلومة مرجعية من دورة قديمة (@petapixel.bsky.social، 2025-02-12 و2025-01-09، 7 و33 إعجابًا على الترتيب). من ذلك أن أداة Adobe الجديدة لتحويل النص إلى فيديو ليست جاهزة إطلاقًا لتستحق سعرًا، ومنشور عن مصور استخدم Generative Remove في Lightroom لإزالة عنصر غير مرغوب فيه فحصل بدلًا منه على شعار Bitcoin. يسبق ذلك دورة أخبار سبتمبر 2026، لكنه يسجل استمرار النقد للأدوات التجارية المغلقة المصدر.
الإشارات
- ما الذي ينمو: مهام GPT-6 Astra ذات الطابع البصري، مثل رسم SVG للبجع وتشغيل Blender لإنشاء عرض ثلاثي الأبعاد، طُرحت مستقلة على Reddit، في r/DefendingAIArt وr/antiai، وعلى Bluesky لدى @simonwillison.net، لتصبح أكبر موضوع عابر للمنصات. لكن من المهم أنها ليست بدقة «توليد صور بنموذج انتشار»، بل فئة جديدة يخلق فيها وكيل LLM مرئيات عبر الكود وأدوات ثلاثية الأبعاد.
- ما يُهمَل أو يُرفض: موضوعات المصادر المفتوحة نادرة للغاية؛ والمنشور الوحيد المحدد الذي أمكن تأكيده هو تشغيل Qwen 3.7 27B محليًا. ولم تُعثر على منشورات إعلانية لنماذج مفتوحة متخصصة مثل إصدارات FLUX أو Stable Diffusion الجديدة أو Wan أو HunyuanVideo على Bluesky.
- ما كان مفاجئًا: في حين صمتت تقريبًا حسابات منشورات فن الذكاء الاصطناعي المتخصصة التي كانت نشطة حتى النصف الأول من 2025، مثل stablediffusion.bsky.social وbm63ai.bsky.social، استمرت خدمة وضع علامات على الصور المشتبه بها، aimod.social، ونمت كبنية مجتمعية مستقلة. وقد يشير ذلك إلى انتقال مركز ثقل الحديث عن الصور المولدة بالذكاء الاصطناعي على Bluesky من جانب «الصنع» إلى جانب «التمييز والضبط».
- إشارات متعارضة: تفوقت قضايا التطبيق المثيرة للجدل، مثل إساءة الاستخدام في الإعلانات السياسية عبر فيديو مزيف لانتخابات حاكم نيويورك، على أخبار المنافسة في أداء النماذج. وعلى Bluesky، تبدو قابلية رؤية الفيديو التوليدي بوصفه مشكلة اجتماعية أكبر من رؤيته كاتجاه تقني.
القيود
- أعاد API البحث العام في Bluesky،
app.bsky.feed.searchPosts، رمز HTTP 403 باستمرار لكل الاستعلامات بالإنجليزية واليابانية، مثل "image generation AI" و"Stable Diffusion" و"Midjourney" و"Sora" و"Veo" و"Kling"، فلم يمكن استخدامه. وفي الجلسة ذاتها استجابتapp.bsky.actor.getProfileوapp.bsky.feed.getAuthorFeedطبيعيًا، ما يرجح أن نقطة البحث وحدها أصبحت تتطلب مصادقة أو حُجبت. - واجهة الويب
bsky.app/searchتطبيق SPA يعرض المحتوى من جهة العميل، فلا يظهر نص المنشورات في HTML ولا تستطيع أداة جلب صفحات الويب قراءة النتائج الفعلية. - لهذه الأسباب تعذر اتباع خطوة دليل العمل الأصلية، «البحث بالكلمات المفتاحية ثم قراءة المنشورات». وبدلًا من ذلك، فُحص سجل المنشورات لحسابات معروفة ظهرت في بحث الويب: simonwillison.net و404media.co وpetapixel.bsky.social وaimod.social وstablediffusion.bsky.social وbm63ai.bsky.social. ولذلك يمثل الجمع عينة حسابات، لا بديلًا شاملًا للبحث بالكلمات المفتاحية.
- لم تكن حسابات متوقعة مثل OpenAI وGoogle DeepMind وMidjourney وRunway وStability AI وBlack Forest Labs وKrea وTechCrunch وThe Verge وArs Technica وEngadget موجودة على Bluesky، أو أعادت HTTP 400 لعدم العثور على الحساب، أو لم تكن لديها منشورات ذات صلة بتوليد الصور والفيديو.
- لم يتحقق معيار الإكمال، تحليل نحو 20 منشورًا لكل منصة، بسبب غياب API البحث. إذ اقتصر ما أمكن تحليله على العناصر الثمانية الواردة هنا، إضافة إلى معلومة مرجعية واحدة؛ ولم تتضمن الخلاصات المجلوبة منشورات ذات صلة أخرى. وكانت الخلاصات التي لم يظهر فيها شيء ذي صلة: techcrunch.com وtheverge.com وarstechnica.com وengadget.com وgarymarcus.bsky.social، مع حالة واحدة فقط للأخير.
- لم يُعثر على منشور محدد واحد حول نماذج الصور أو الفيديو المفتوحة مثل FLUX أو إصدار جديد من Stable Diffusion أو Wan أو HunyuanVideo. ولا تتيح طريقة البحث هذه تمييز ما إذا كان السبب هو عدم كونها موضوع نقاش أو تفويتها بسبب عدم إمكان البحث.
Lemmy
Lemmy — أخبار الذكاء الاصطناعي لتوليد الصور والفيديو
Lemmy شبكة اجتماعية اتحادية أصغر بمئات المرات من Reddit، ولذلك فإن «الانتشار» هنا ليس مئات الأصوات المؤيدة بل عشرات منها. ومع ذلك ظهرت معلومات ثرية على نحو مفاجئ 🐘✨. ركز الاستكشاف أساسًا على !«メールアドレス» لمطوري ComfyUI وإصدارات النماذج، و!ai_reddit وهو بوت يعيد نشر أخبار r/ArtificialIntelligence، ثم !technology و!techtakes ذوي الطابع الساخر غالبًا. وتم البحث مرارًا في lemmy.world/api/v3/search مع تغيير الكلمات المفتاحية.
المجتمعات
!«メールアドレス»— 5,709 مشتركين، منهم 893 محليًا. مركز لعقد ComfyUI المخصصة ومعلومات إطلاق النماذج، مع منشورات شبه يومية.!«メールアドレス»— 2,362 مشتركًا. معرض لأعمال منشأة بـStable Diffusion وFlux وKrea2.!«メールアドレス»— مخصص لفن الذكاء الاصطناعي بأسلوب الأنمي. عدد المشتركين غير معلن، لكن نشاطه يقارب نشاط المجتمع السابق.!«メールアドレス»— 87,904 مشتركين. يعيد نشر مقالات تقنية كبرى، وكانت قصة Midjourney موضع حديث فيه.!«メールアドレス»— 2,690 مشتركًا. مجتمع ساخر من صناعة الذكاء الاصطناعي، انتقد بشدة تخبط Midjourney.!«メールアドレス»— حساب إعادة نشر RSS من r/ArtificialIntelligence. لم يمكن الحصول على عدد مشتركين عبر API، لكنه كان الأعلى كثافة في الأخبار.!«メールアドレス»— 8,154 مشتركًا. مجتمع مناهض للذكاء الاصطناعي، نُشرت فيه أيضًا مقالات تنتقد سلاسل توريد الذكاء الاصطناعي التوليدي.
المنشورات
تميل إلى المصادر المغلقة
- تحول Midjourney إلى ماسحات الموجات فوق الصوتية الطبية «Midjourney Medical» (?) — 2026-06-18 إلى 19، أثار ضجة في
!techtakesو!hackernews. سخر The Register منه بوصفه «منتجع تجميل طبي بإضاءة ذهبية»، بينما هاجمه pivot-to-ai.com بأنه «تحول إلى Theranos LOL». تراوحت النتيجة بين 40 و58.
https://lemmy.world/post/48384985 (المقال الأصلي: pivot-to-ai.com/2026/06/19/midjourney-ai-pivots-to-theranos-ultrasonic-ct/) - Midjourney تطالب استوديوهات هوليوود بالكشف عن كيفية استخدامهم للذكاء الاصطناعي — مقال TechCrunch، في
!technologyبنتيجة 73. متابعة لمسار دعاوى حقوق النشر.
https://lemmy.world/post/49069400 - Google تطلق Nano Banana 2 Lite — نسخة خفيفة من نموذج توليد الصور من DeepMind. منشورات عبر
!hackernewsووسيلة تقنية سويسرية، itmagazine.ch، خلال 2026-06-30 إلى 07-02.
https://lemmy.world/post/48857780 (deepmind.google/models/gemini-image/flash-lite/) - MAI-Image-2.5 من Microsoft يلحق بـNano Banana 2 في المعايير — عبر the-decoder.com، في
!ai_reddit، 2026-05-28.
https://the-decoder.com/microsofts-mai-image-2-5-pulls-even-with-googles-nano-banana-2-on-benchmarks/ - مراجعة مقارنة جادة لـByteDance Seedream 5.0 Pro — تشير إلى قوة التحرير والتوليد التكراري، في
!ai_reddit، 2026-07-10.
https://www.reddit.com/gallery/1usc03q - Google توقف ميزة Earth AI بعد يوم من إطلاقها — أفادت Fortune أن المستخدمين استغلوا الميزة لوضع صور مزيفة على مواقع حقيقية، في
!ai_reddit، 2026-08-07.
https://fortune.com/2026/08/07/google-quietly-discontinues-its-earth-ai-feature-a-day-after-its-rollout-after-users-made-no-no-images/ - تضاعف أعمال Runway الموجهة للمؤسسات مع NRR يتجاوز 300% — خبر عن نمو الفيديو التوليدي لدى الشركات، في
!ai_reddit، 2026-08-30.
https://www.reddit.com/r/ArtificialInteligence/comments/1w2hnea/runway_says_enterprise_business_doubled_nrr_over/ - Amnesty International تنتقد أنظمة الذكاء الاصطناعي الكبرى بوصفها «غير قانونية بحكم التصميم» — في سياق الضغط التنظيمي على الذكاء الاصطناعي التوليدي عمومًا، في
!ai_reddit، 2026-06-24.
https://reddit.com/r/ArtificialInteligence/comments/1ue64s2 - Pax Silica: تسليح سلسلة توريد الذكاء الاصطناعي — تحليل للحرب الاقتصادية بين الولايات المتحدة والصين على أشباه موصلات الذكاء الاصطناعي وموارد الحوسبة، في
!fuck_aiبنتيجة 14 يوم 2026-09-06، بوصفه خطرًا جيوسياسيًا لشركات التقنية العملاقة المغلقة المصدر.
https://thecradle.co/articles/pax-silica-and-the-weaponization-of-ai-supply-chains-the-new-front-in-us-global-economic-warfare - طلبت من «Astra 6 max» أن يصنع فنًا يثير إعجابي — توليد فني فلسفي ذاتي الإشارة بنموذج تجاري مغلق، في
!ai_reddit، 2026-09-05.
https://i.redd.it/3h241pocalnh1.png
تميل إلى المصادر المفتوحة
- إطلاق LLaDA-Image — نموذج جديد يجمع Diffusion Transformer بحجم 6B ووحدة فهم بصري-لغوي مجمّدة، مبنيًا على LLaDA2.0-Mini. حقق 53.53 بالإنجليزية و53.38 بالصينية، وهي درجات SOTA في Qwen-Image-Bench. وأُطلق معه إصدار سريع باسم LLaDA-Image-Turbo يولد في 2 إلى 4 خطوات، مع أوزان وكود تدريب ووصفات مفتوحة بالكامل، في
!stable_diffusionيوم 2026-09-04.
https://lemmy.dbzer0.com/post/74988021 (الورقة: arxiv.org/abs/2609.03796، الكود: github.com/inclusionAI/LLaDA-Image) - إطلاق Boogu-Image-0.1 — عائلة نماذج مفتوحة تضم متغيرات Base وTurbo وEdit، بترخيص Apache-2.0 يتيح الاستخدام التجاري. وبحجم 10B معلمة حقق أعلى نتيجة للمصادر المفتوحة في Qwen-Image-Bench، وهي 53.58، في
!stable_diffusionيوم 2026-06-17.
https://boogu.org/ (الورقة: arxiv.org/abs/2607.13125) - ComfyUI-Ref2VA-VSA: عقدة تسريع استدلال لـMiniMax H3 — تحسن كثيرًا سرعة استدلال توليد الفيديو، في
!stable_diffusionيوم 2026-09-08.
https://github.com/Kablex/ComfyUI-Ref2VA-VSA - ComfyUI-AetherScale: رافع دقة فيديو أصلي لـNVIDIA GPU — في
!stable_diffusionيوم 2026-09-05.
https://github.com/vizart-vj/ComfyUI-AetherScale - ComfyUI-VDN-H3: انتباه هجين لـVideo Delta Net — عقدة لتحسين كفاءة نماذج توليد الفيديو، في
!stable_diffusionيوم 2026-09-05.
https://github.com/Saganaki22/ComfyUI-VDN-H3 - ComfyUI-Majoor-OmniCam: أداة لتخطيط الكاميرا وتحريكها — عقدة للتحكم في عمل الكاميرا لتوليد الفيديو والصور، في
!stable_diffusionيوم 2026-09-04.
https://github.com/MajoorWaldi/ComfyUI-Majoor-OmniCam - FastH3-Ref2V-Stream-Controller — أداة للتحكم في البث لنماذج توليد الفيديو من فئة MiniMax H3، في
!stable_diffusionيوم 2026-09-04.
https://github.com/EarthDefenceForces/FastH3-Ref2V-Stream-Controller - ComfyUI-InpaintCanvas: واجهة inpainting على نمط Krita — في
!stable_diffusionيوم 2026-09-08.
https://github.com/DenRakEiw/ComfyUI-InpaintCanvas - ComfyUI-MiniMax-H3-MotionCache-FastVAE / ComfyUI-H3VAE_TRT / ComfyUI-MiniMaxH3-CLSS — نُشرت تباعًا ثلاث عقد لتسريع وتخفيف نماذج الفيديو من فئة MiniMax H3، في 2026-09-01 إلى 02. وهو دليل على نشاط قوي للغاية في منظومة الفيديو المفتوحة المصدر.
https://github.com/Mozer/ComfyUI-MiniMax-H3-MotionCache-FastVAE - InterleaveThinker: بحث في التعلم المعزز للتوليد المتداخل القائم على الوكلاء — دراسة تضيف إلى نماذج الصور القائمة قدرة متعددة الوكلاء على التوليد المتتابع نص↔صورة، في
!stable_diffusionيوم 2026-06-12.
https://arxiv.org/abs/2606.13679 - سلسلة متواصلة من أعمال Flux/Krea2 turbo — تواصل
!stable_diffusion_artو!share_anime_artنشر أعمال فنية ورسوم أنمي مولدة بـFlux وKrea2 يوميًا تقريبًا. ليست أخبارًا منفردة، بل إشارة مستمرة إلى الاستخدام اليومي لنماذج الأوزان المفتوحة.
https://lemmy.dbzer0.com/post/75150630 وغيرها كثير
الإشارات
- 🔥 أكبر موضوع هو تخبط Midjourney. أثارت قصة دخول شركة توليد الصور في ماسحات الموجات فوق الصوتية الطبية نقاشًا في
!techtakesو!technology، وبنبرة ليست إيجابية، بل أقرب إلى «هل هذه الشركة بخير؟». وهي الأعلى بفارق واضح في أخبار المصادر المغلقة، بنتائج بين 40 و73. - 🛠️ على جانب المصادر المفتوحة، ظهرت خمس أو ست عقد ComfyUI لنماذج فيديو MiniMax H3 تباعًا في الأسبوع نفسه. وهو نمط نموذجي لاندفاع مجتمع المطورين نحو نموذج فيديو أساسي واحد والتنافس على تحسينه. وتوحي كثرة أسماء المطورين من الصين، مثل nazgut وlisitskyaa، بانتشاره عالميًا.
- 📊 يتخذ المهتمون بالمعايير من Qwen-Image-Bench مقياسًا مشتركًا. يتنافس LLaDA-Image بدرجة 53.53 وBoogu-Image-0.1 بدرجة 53.58 على المعيار نفسه، ما يجعل منافسة أداء المصادر المفتوحة مرئية بالأرقام.
- 😤 تسربت موضوعات الذكاء الاصطناعي التوليدي إلى خارج المجتمعات التقنية، إلى درجة أن مجتمعًا ناقدًا للذكاء الاصطناعي مثل
!fuck_aiينشر مقالات عن المخاطر الجيوسياسية لشركات المصادر المغلقة. - 🤖 Lemmy صغير من حيث الحجم، لذلك يختلف معيار «الانتشار» تمامًا عن Reddit وX؛ فدرجة في السبعينيات تعد خبرًا كبيرًا. وينبغي النظر إلى التفاعل نسبيًا لا إلى الأرقام المطلقة.
القيود
- Lemmy اتحادي وتختلف نتائج البحث حسب الخادم. ما أمكن جمعه من API لـ
lemmy.worldكان أساسًا منشوراتlemmy.worldنفسه أو ما وصل إليه عبر الاتحاد من خوادم أخرى. جرت محاولات للوصول إلى واجهات بحثlemm.eeوlemmy.ml، لكن اقتصرت هذه الجولة على API واحد لـlemmy.worldلقيود الوقت، ولم تشمل جميع الخوادم. - لم تُنتج عمليات البحث عن «Kling AI» و«Stability AI» و«Wan 2.2» و«Runway Gen» إلا صفر نتائج أو نتائج غير ذات صلة، مثل الأخبار السياسية. وعلى Lemmy، تكاد الموضوعات الخاصة بنماذج الفيديو الصينية مثل Kling وWan أو Stability AI بمفردها تكون غائبة. وظهرت موضوعات الفيديو فقط عبر اسم «MiniMax H3» داخل مجتمع مطوري ComfyUI.
!ai_redditبوت يعيد نشر r/ArtificialIntelligence تلقائيًا، أي إن أخباره أصلها Reddit وتظهر مجددًا في Lemmy؛ لذلك لا ينبغي اعتبارها معلومات أولية أصلية من Lemmy.- تحقق معيار الإكمال بتحليل نحو 20 منشورًا—إضافة إلى فحص نتائج مكررة وغير مرتبطة—لكن حجم المنشورات في Lemmy أقل بكثير من Reddit وX، ولذلك يظل أضعف من المنصات الأخرى من حيث كثافة المعلومات الأولية عالية الجودة.
Pinterest — أخبار الذكاء الاصطناعي لتوليد الصور والفيديو
من بين 50 دبوسًا جُمعت مسبقًا (output/pinterest.pins.md / images/pinterest/manifest.json، باستعلام واحد هو «Image and Video Generation AI News» من دون تصنيف)، فُتحت 30 صورة وفُحصت مباشرة. ويستند ما يلي إلى محتواها.
الموضوعات البصرية
- صور مصغرة على نمط «أخبار الذكاء الاصطناعي» المبالغ في جذب النقرات: رجل ملتحٍ مذهول مع شعارات أدوات نيونية ([11])، وابتسامة تشبه Sam Altman مع خلفية انفجار ([19])، ومذيع أخبار نصفه روبوت يحمل ميكروفونًا عليه «B» ([44]). وكثير منها صور مصغرة لفيديوهات YouTube كما هي، لا روابط مباشرة إلى مقالات.
- رسوم مقارنة «الأفضل» لمنتجات مغلقة المصدر: تتكرر قوائم داخل إطارات نيونية تضم Runway وPika وKling AI وLuma (Dream Machine) وCanva وHailuo AI وHeyGen وSynthesia وInVideo وSora وGoogle Veo [9، 27، 33]. وتظهر الصورة نفسها لتوليد الصور، مع ChatGPT وNano Banana وIdeogram وGenTube وZ-Image [36].
- تصوير الذكاء الاصطناعي كشخصية روبوت أو مذيع: روبوت أبيض على مكتب أخبار ([32])، مذيعات مركبات ([38، 49])، ومشاهد طبية تجمع روبوتًا بممرضة أو إنسان ([50]). ويبرز استعارة «الذكاء الاصطناعي يحل محل دور بشري، كالمراسل أو الطبيب»، بدل عرض واجهات الأدوات نفسها.
- صور تثير الخوف من التزييف والأصالة: صورة قط بختم «FAKE» وأرقام إعجاب ([3])، مسابقة «Which is AI?» تقارن صورتين لجبل ([10])، وكاشف مع موجة صوتية وعبارة «97% likely AI generated» ([25 الداخلية ومثيلتها 35]). أي إن الكشف والشك يمثلان محورًا مستقلًا عن التوليد نفسه.
- مرئيات مخزنية مجردة للذكاء الاصطناعي: صور عامة بخلفيات نيون أرجوانية وزرقاء، وحدود دماغ ولوحات دوائر وتأثيرات جسيمات، مع نص عنوان فقط ([2، 4، 5، 15، 20، 30]). وتستخدم كحشو بصري «يوحي بالذكاء الاصطناعي» دون أسماء منتجات أو لقطات شاشة محددة.
- شبكات عرض قبل/بعد لتحويل image-to-video: شبكات تقارن صورة أو فيديو أصليًا بأساليب مثل LEGO والأوريغامي وشخص مغطى بالزهور وسيارة لعبة ([7])، ورسومات توضح إنشاء خط زمني من خمس لقطات انطلاقًا من صورة واحدة ([1، 6]). وهي تعرض بصريًا وظيفة «صورة واحدة → فيديو» نفسها.
- تظهر أسماء منتجات حقيقية، لكنها كلها تقريبًا مغلقة المصدر: Veo 2/3 ([13، 24]) وVASA-1 من Microsoft Research ([41]) وGrok ([32]) وSora وChatGPT وNano Banana ([36]). ولم يظهر في الصور الثلاثين المفحوصة اسم نموذج أو مستودع يمكن تأكيد أنه مفتوح المصدر.
- رسوم توضح تحويل إنتاج الذكاء الاصطناعي إلى خط أنابيب: مخطط لأربعة وكلاء، «Scout→Script→Generate→Animate»، ينتج تلقائيًا vlog من رابط فيديو فيروسي ([47]). وهو يشير إلى انتقال توليد الفيديو من أداة منفردة إلى سير عمل مؤتمت.
دبابيس بارزة
- [1] Image to Video AI: How It Works and Why It Matters — أكثر دبوس محدد تقنيًا؛ يوضح انتقال صورة ثابتة إلى خط زمني للفيديو عبر منزلقات قوة الحركة والاتساق الزمني والتحكم البصري.
- [7] (بلا عنوان، شبكة تحويل LEGO/origami/flowers) — شبكة قبل/بعد 3×5 تحول فيديوهات أصلية، لشخص ودمية باندا وسيارة Tesla، إلى «كتل خشبية» و«أوريغامي» و«LEGO» و«زهور». وهو من أمثلة العرض العملي القليلة التي تظهر نتائج مولدة فعلية.
- [9] 10 FREE AI VIDEO TOOLS IN 2026 — عشر أدوات فيديو بالذكاء الاصطناعي مجانية: Pictory وRunway ML وVeed.io وSynthesia وInVideo وKling AI وD-ID وLumen5 وCanva وHyperwrite. ويعطي نظرة عامة على خطط الشركات المغلقة المجانية.
- [24] (بلا عنوان، image-to-video لشخصية وحش أرجوانية) — عرض لثلاثة فيديوهات مخرجة تضع صورة دخل واحدة في خلفيات متباينة تمامًا، مثل غرفة خوادم وآثار تحت الماء ومدينة من الحلوى. العنوان مرتبط بـVeo 3.
- [27] 5+ Best AI Video Generation Websites — يقارن Runway وPika وKling AI وLuma وCanva وHailuo، ويذكر في النهاية YouTube Shorts وTikTok ودبابيس فيديو Pinterest وفيديوهات المنتجات كحالات استخدام؛ ما يدل على اعتبار Pinterest نفسه وجهة لتوزيع فيديو الذكاء الاصطناعي.
- [36] Top AI Image Generation Tools — قائمة أدوات توليد الصور لعام 2026: ChatGPT وNano Banana وGenTube وIdeogram وZ-Image. وتظهر أسماء أحدث مثل Nano Banana وZ-Image في مقالات Pinterest المحسنة لمحركات البحث.
- [39] The Latest AI Developments (ثلاثة أخبار عاجلة) — الدبوس الوحيد الذي يجمع أخبارًا محددة بأسماء جهات وحوادث: رد أولي للذكاء الاصطناعي على مكالمات 911 في نيو أورلينز، وإتاحة Meta المجانية لنموذج الوكلاء غير المتصل Muse Glimmer، واستخدام Kimsuky الكورية الشمالية لحزمة ذكاء اصطناعي خاصة لأتمتة وثائق التصيد.
- [41] Microsoft Unveils VASA-1 — مخطط عرض تقني من Microsoft Research لتوليد تحريك وجوه محادثة آنية لعدة أشخاص من صورة واحدة ومقطع صوتي، مع إشارة تحكم تعبيري اختيارية. وهو من الدبابيس القليلة ذات المنشأ البحثي.
- [16] AI Image Video: Best Quality vs Best Free — دليل قرار يقارن ChatGPT Plus وGemini Advanced وMidjourney وAdobe Firefly وRecraft وRunway Gen-3 وLuma وPika Pro وKaiber وSynthesia، بأدوات مثل Ideogram وGemini Free وSeaArt وPlayground وKrea وCanva وInkscape وCapCut في فئتي «مدفوع عالي الجودة» و«مجاني». ويتناول معايير الاختيار، مثل قابلية قراءة النص وتوفر GPU والحاجة إلى تحرير SVG.
- [47] AI video creation just got crazy — اقتراح لخط أنابيب مؤتمت يتكون من أربعة وكلاء: «Scout→Script→Generate→Animate»، يحول رابط فيديو فيروسي إلى vlog مكتمل، متجاوزًا نموذج الأداة المنفردة.
الإشارات
- يهيمن على مجال «Image and Video Generation AI» في Pinterest رسومات معلوماتية للمقارنة والإرشاد بغرض SEO/التسويق بالعمولة، لا الأخبار العاجلة. تكاد تغيب الروابط المباشرة للمعلومات الأولية مثل الإعلانات الرسمية والأوراق البحثية ومنشورات الشبكات الاجتماعية، بينما تقود غالبية الدبابيس إلى مدونات أو فيديوهات YouTube.
- الأخبار المحددة التي أمكن رصدها تقتصر على العناصر الثلاثة في [39]—ذكاء اصطناعي يرد على 911، وMeta Muse Glimmer، وKimsuky الكورية الشمالية—وعلى دبابيس تذكر إطلاق Veo 2/3 وVASA-1 وGrok. ولم تتوفر معلومات أولية كافية لتسمية نحو 20 حالة «أخبار حديثة».
- حضور المصادر المغلقة طاغٍ؛ إذ تتكرر أسماء Runway وPika وKling AI وLuma وCanva وHailuo وHeyGen وSynthesia وSora وVeo وChatGPT/Nano Banana وIdeogram. في المقابل، لم يظهر اسم نموذج أو مشروع مفتوح المصدر واحد في العناصر المفحوصة؛ فلا ذكر لسلسلة Stable Diffusion أو ComfyUI أو Open-Sora. ولذلك Pinterest مصدر ضعيف للحديث عن تطورات المصادر المفتوحة.
- تتكرر مقابلتان بصريتان: «الذكاء الاصطناعي يتولى أدوار البشر»، كمذيع أخبار أو ممرضة أو موظف 911، و«الشك في أصالة المحتوى»، كختم FAKE وWhich is AI? وكواشف الذكاء الاصطناعي. وهذا يضع الأثر الاجتماعي والقلق على الثقة في موضع بارز بجانب التقنية التوليدية.
- في استخدامات توليد الفيديو، برزت عروض «تحريك صورة واحدة» و«تحويل نمط فيديو قائم إلى LEGO أو أوريغامي»، أي حالات الاستخدام التحويلية، أكثر من text-to-video الكامل من الصفر.
القيود
- لم تُصنَّف الدبابيس الخمسون التي جمعها العامل مسبقًا—حقل
genreفارغ لجميع العناصر—وهي نتائج استعلام واحد، لا بحث منقسم عمدًا بين المصدر المغلق والمفتوح. - فُتحت 30 صورة فقط من أصل 50 بسبب الوقت. العناصر غير المفحوصة تشمل الفهارس 14 و15 و18 و21 و22 و26 و28 و29 و31 و37 و40 و42 و43 و45 و48 وغيرها. عناوينها في
pinterest.pins.md، وغالبها يتكرر في الموضوعات المعروضة، مثل مقارنة أدوات مزامنة الشفاه وتحرير الفيديو وكشف محتوى الذكاء الاصطناعي، ولم يظهر ما يوحي باتجاه مختلف يقلب النتائج أعلاه. - لم يُتصفح Pinterest مباشرة، بل استند التقييم إلى الصور والعناوين التي جمعها العامل مسبقًا، حسب دليل العمل. ولا تتضمن بيانات manifest أو جدول الدبابيس تواريخ النشر أو أرقام التفاعل، ولذلك لا يمكن تحديد «متى نُشرت» أو «إلى أي درجة انتشرت».
- لم يُعثر على ذكر ذي دلالة لحركة المصادر المفتوحة على Pinterest؛ ولذلك ينبغي التصريح في التقرير الموحد اللاحق بأن Pinterest لا يصلح دليلًا على تطورات المصادر المفتوحة.
الإجراءات الموصى بها
- الاستمرار في متابعة التوليد البصري القائم على وكلاء GPT-6 Astra، مثل تشغيل Blender وإنشاء المدن ثلاثية الأبعاد، كموضوع متخصص في المرات المقبلة.
- إضافة أسماء محددة مثل "FLUX" و"Stable Diffusion" و"Qwen-Image" و"Wan" و"ComfyUI" إلى عمليات البحث عبر المنصات في الجولة المقبلة كي لا تُفوت إعلانات المصادر المفتوحة.
- توسيع قائمة الحسابات الخاضعة للمراقبة مسبقًا في Bluesky، على افتراض استمرار رمز 403 في API البحث.
- قصر Pinterest على المراقبة الدورية للوعي بالأدوات بدل المقارنات الإخبارية السريعة التي تتطلب حداثة، لأن وقت النشر وأرقام التفاعل غير متاحة.
- تجنب الاقتباسات الحاسمة من قصة تحول Midjourney إلى الأجهزة الطبية حتى يظهر مصدر أولي، مثل إعلان رسمي من Midjourney، لأن حقيقتها وتفاصيلها غير محسومة.
- إعطاء أولوية لمجتمع
!stable_diffusionعلى Lemmy وقنوات الاختبار على YouTube بوصفهما مصادر رئيسية لتتبع تطورات المصادر المفتوحة.
الصور المجمعة


















































ملاحظة حول جودة البيانات
لم يصل Bluesky إلى معيار الإكمال البالغ 20 عنصرًا لأن API البحث أعاد 403 باستمرار، ولم يمكن في Pinterest الحصول على وقت النشر أو أرقام التفاعل، لذلك تعذر تقييم الحداثة. ولم يجر Reddit وX مقارنة مقصودة بين المصادر المغلقة والمفتوحة بسبب استخدام عبارة بحث واحدة؛ ولذلك تركزت موضوعات المصادر المفتوحة في Lemmy وYouTube.



