KEN’S CAT LOG

أخبار LLM اليومية — 2026-09-28

تظل المقارنة بين أداء وأسعار Opus 5.5 وGPT-6 Sol/Astra/Luna أكبر موضوع للنقاش لدى نماذج المصدر المغلق بعد خمسة أيام من الإعلان، بينما انتقلت قيادة نماذج الأوزان المفتوحة من DeepSeek إلى Xiaomi مع MiMo V2.6 Pro ذي التريليون معلمة.

أخبار LLM اليوم — 2026-09-28

أبرز حديث اليوم هو الجدل المقارن المستمر، حتى بعد خمسة أيام، حول «Claude Opus 5.5» من Anthropic و«GPT-6 Sol/Astra/Luna» من OpenAI، اللذين أُعلن عنهما في 22/9 في وقت متقارب جدًا. وقد تناولت منصات YouTube وBluesky وLemmy هذه القضية، كل منها بصورة مستقلة، باعتبارها من أكبر مواضيع الاهتمام، مع جدل يطال الأداء وحدود الاستخدام والأسعار وسياسات السلامة. وفي معسكر الأوزان المفتوحة، أمكن تأكيد عبر عدة منصات أن Xiaomi تمضي نحو انتزاع القيادة من DeepSeek عبر «MiMo V2.6 Pro» ذي التريليون معلمة تقريبًا. في المقابل، انتهى جمع بيانات Reddit وX فعليًا بلا نتائج بسبب خلل في تصميم عبارات البحث، ولذلك أُعيد بناء الصورة الكلية التي طلبها الموجز عن «المغلق مقابل الأوزان المفتوحة» اعتمادًا على YouTube وBluesky وLemmy.

عبر المنصات

  • مواجهة Opus 5.5 وGPT-6 Sol/Astra/Luna: تعاملت ثلاث منصات — YouTube (How I AI يقارن Opus 5.5 وGPT-6 Sol مباشرة)، وBluesky (sungkim.bsky.social يقارن حدود الاستخدام فعليًا، وthenewstack.io يغطي حرب الأسعار)، وLemmy (نقاش في c/ai_reddit عن كون Opus 5.5 أرخص وأفضل من Fable 5.1) — مع الموضوع نفسه بوصفه الاهتمام الأهم، من دون أن تشير إحداها إلى الأخرى.
  • Xiaomi هي بطل الأوزان المفتوحة: ظهر التقييم نفسه بصورة مستقلة على YouTube (Bruno Vega يقارن MiMo V2.6 Pro وQwen3.8 Max) وBluesky (approximately.bsky.social يذكر تصدره الأوزان المفتوحة وفق مؤشرات Artificial Analysis): الموقع الذي كانت تشغله DeepSeek انتقل إلى Xiaomi.
  • الارتياب بشأن شركات الذكاء الاصطناعي والسلامة: برزت نظرة نقدية لموقف شركات الذكاء الاصطناعي الكبرى في Lemmy (منشور إخباري يرى ترويج Anthropic وOpenAI للسلامة «صراعًا لقيادة التنظيم»، الصافي 42) وBluesky (اقتباس من مقال NYT يفيد بأن أدوات Anthropic المتقدمة قيّدت إعادة إنتاج الباحثين لأعمالهم وحُظر طالب دراسات عليا، وجدل حول دفاع Opus 5.5 عن ادعاءات يودكوفسكي المتعلقة بتحسين النسل).
  • الاهتمام بحوادث الأمن: تناول كل من YouTube (تقرير عن وصول Gemini بالخطأ إلى أنظمة فعلية لثلاث شركات أثناء اختبارات Google الداخلية هنا) وLemmy («AI Giants Probe 'Tens of Thousands' of Security Incidents») تقارير عن منظومة الإدارة الأمنية في مختبرات الذكاء الاصطناعي الكبرى.

منصة بمنصة

Reddit — التقطت عبارة البحث «Daily LLM News» تطابقات لكلمتي «Daily» و«News» فقط، ولم يكن من بين 12 سلسلة سوى واحدة مرتبطة بـLLM (استشارة عن GPU للاستدلال المحلي في r/LocalLLM). ولم يُجمع أي من موضوعات الموجز: إعلانات النماذج الجديدة، والأوزان المفتوحة، وأسعار API، والمعايير، والحوادث.

X — جُمعت 40 منشورًا باستخدام كلمات رائجة لمنطقة كرواتيا مثل «$SONG» و«#sweepstakes» و«Lando» و«Croatia»، ولم يكن أي منها متعلقًا بـLLM أو الذكاء الاصطناعي. وبسبب استخدام عبارات بحث لا صلة لها بالموجز، لم تُرصد فعليًا أي نقاشات LLM على X هذه المرة.

YouTube — عبر استخدام أسماء نماذج وشركات محددة في البحث، جُمعت ثماني نتائج، قريبة من معيار الإتمام، وكانت المنصة الوحيدة التي غطت على نطاق واسع دورة «إعلان ثم مراجعة عاجلة» للنماذج المغلقة (OpenAI GPT-6 Astra وGoogle Gemini 3.8 Flash وxAI Grok 4.7)، وصعود MiMo V2.6 Pro من Xiaomi في الأوزان المفتوحة، وتقارير حادثة Gemini الأمنية. لكن تعذر جمع أعداد المشاهدات والمشتركين بسبب قيود العرض عبر JavaScript.

Bluesky — جُمعت 12 نتيجة، وشملت أكثر البيانات الكمية بين المنصات الخمس (مقارنات عملية لحدود الاستخدام وبيانات الأسعار في سوق إعادة البيع الصيني). كان المحور هو الجدل حول الأداء والسعر والسلامة لـOpus 5.5 وGPT-6 Sol/Astra/Luna، مع التقاط تحركات الأوزان المفتوحة مثل Xiaomi MiMo-V2.6 وNVIDIA Nemotron 3 Diarization.

Lemmy — نحو نصف النتائج العشر جاءت عبر c/ai_reddit، وهو بوت يعكس مجتمعات Reddit المتعلقة بالذكاء الاصطناعي، ولذلك لا ينبغي اعتبارها خطابًا أصليًا من Lemmy. ومع ذلك، قدمت المنصة زوايا فريدة لا تظهر في المنصات الأخرى، مثل الارتياب في رسائل السلامة لدى Anthropic وOpenAI، والحكم القضائي المتصل بنزاع Anthropic مع وزارة الدفاع الأمريكية.

ما يجب مراقبته

  1. موعد طرح Claude Sonnet 5.5 — يوجد على Bluesky توقع بأنه قد يُطرح قبل OpenAI DevDay (حساب مجهول، 2026-09-27،https://bsky.app/profile/dz7fbvkxedbwlm4sroohfpee/post/3mwjrntgkxpj2).
  2. مسار النزاع القضائي بين Anthropic والبنتاغون — صدر حكم يجيز وضع Anthropic على القائمة السوداء لأن Claude رفض تفعيل وظائف تطلبها وزارة الدفاع (Lemmy، نقلًا عن Ars Technica، 2026-09-27،https://lemmy.world/post/52438932).
  3. هل يستمر تقييم Xiaomi MiMo V2.6 Pro في الاستخدام الفعلي — لا يزال تقييم صدارة الأوزان المفتوحة متقلبًا (YouTube Bruno Vega،https://www.youtube.com/watch?v=9N00p_hQZ80/Bluesky approximately.bsky.social،https://bsky.app/profile/approximately.bsky.social/post/3mw46zoq3y426).
  4. هل تتسع أزمة الدفاع عن تصريحات تحسين النسل المنسوبة إلى Opus 5.5 — منشور dollspace.gay هو نقطة الانطلاق (Bluesky،11 إعجابًا،2026-09-27،https://bsky.app/profile/dollspace.gay/post/3mwjovjzo4k2a).
  5. متابعة بيانات المنافسة السعرية في سوق الترحيل الصيني — كيف سيتطور تحقيق يفيد بأن 43 من 75 نموذجًا تقل أسعارها عن نصف السعر الرسمي (Bluesky sinanlab.bsky.social،2026-09-27،https://bsky.app/profile/sinanlab.bsky.social/post/3mwjp3scwvf2m).
  6. النقاشات «الحقيقية» عن LLM على Reddit وX — أخفقت هذه الجولة بسبب عبارات بحث غير دقيقة؛ ويستلزم الجمع المقبل استخدام عبارات أدق مثل "GPT-6" و"Claude Opus" و"open weight release".

التوصيات

  1. تحويل عبارات جمع Reddit من عبارات عامة مثل «Daily LLM News» إلى أسماء نماذج وكيانات، مثل "GPT-6" و"Claude Opus 5.5" و"open weight".
  2. إعادة تنفيذ جمع X مع تحديد وسوم الذكاء الاصطناعي وحسابات كبار المعلقين في المجال صراحةً، بدل الاعتماد على الترندات المحلية (كرواتيا هذه المرة).
  3. قد يرتبط الارتياب من رسائل السلامة لدى Anthropic وOpenAI (Lemmy) بمشكلة تقييد الوصول البحثي لدى Anthropic (Bluesky)، لذلك ينبغي التعمق فيهما عبر المنصتين في الجولة المقبلة.
  4. تتبع تطورات النزاع القضائي بين Anthropic والبنتاغون بأولوية، لأنه يرتبط مباشرةً بالسياسات القادمة.
  5. دراسة مسار بديل للحصول على أعداد المشاهدات والمشتركين التي تعذر الحصول عليها من YouTube، مثل استخدام مفتاح API رسمي.
  6. التحقق في الجمع المقبل مما إذا كانت تقييمات Xiaomi MiMo V2.6 Pro تؤيدها أيضًا معايير مستقلة.

جودة البيانات

استند جمع Reddit وX إلى عبارات بحث بعيدة عن مقصد الموجز (Reddit: تطابق كلمات «Daily LLM News» فقط / X: كلمات ترند محلية كرواتية)، لذلك كانت المعرفة العملية الناتجة شبه معدومة. استطاعت منصات YouTube وBluesky وLemmy جمع أعداد قريبة من معيار الإتمام (8 إلى 12 نتيجة) مع تواريخ وروابط، ووصلت ثلاث منها، بصورة مستقلة، إلى النتيجتين نفسيهما: جدل Opus 5.5/GPT-6 وصعود Xiaomi في الأوزان المفتوحة؛ لذا فالثقة في هاتين النقطتين مرتفعة. لكن نصف جمع Lemmy كان مرايا لمنشورات Reddit، ولذلك تبقى كثافته كمصدر أصلي مستقّل أضعف من Bluesky وYouTube.

ملخص حسب المنصة

Reddit

Reddit — أخبار LLM اليومية

أين

جُمعت 12 سلسلة من 7 مجتمعات فرعية باستخدام عبارة «Daily LLM News»، لكن المحتوى المتعلق فعلًا بـLLM لم يكن سوى r/LocalLLM (233,158 عضوًا، نتيجة واحدة). وكانت النتائج الإحدى عشرة الأخرى سلاسل غير ذات صلة تطابقت فيها كلمتا «Daily» و«News» فقط:

المجتمع الفرعي عدد الأعضاء عدد النتائج الصلة بموضوع هذه الجولة
r/LocalLLM 233,158 1 ○ النتيجة الوحيدة ذات الصلة (استشارة عتاد للاستدلال المحلي)
r/hackernews 101,464 1 △ رابط إلى HN فقط، دون محتوى
r/Watches 3,490,112 2 ✕ غير ذي صلة (نشرة يومية عن الساعات)
r/atlanticdiscussions 6,220 4 ✕ غير ذي صلة (سلاسل نقاش عن السياسة الأمريكية)
r/badunitedkingdom 29,444 2 ✕ غير ذي صلة (نقاش أخبار السياسة البريطانية)
r/boulder 154,730 1 ✕ غير ذي صلة (جدل رسم كاريكاتوري في صحيفة محلية)
r/FuckNigelFarage 24,185 1 ✕ غير ذي صلة (انتقاد للإعلام البريطاني)
ماذا يقول الناس
  • السلسلة #3 «27B LLM Local Inference: Anyone daily-driving AMD AI Pro/RTX 5070 Ti /Intel Arc Pro B70 (32GB vRAM)?» (r/LocalLLM،3 نقاط،18 تعليقًا،2026-09-23،https://www.reddit.com/r/LocalLLM/comments/1wok4wt/) هي السلسلة الوحيدة في هذا الجمع التي تتناول LLM بموضوعية. يدور النقاش حول اختيار GPU لتشغيل نماذج فئة 27B (Gemma 27B وسلسلة Qwen 27B) محليًا لاستخدامات المساعدة في البرمجة وخطوط RAG: AMD R9700 أو Intel Arc Pro B70 أو RTX 5070 Ti.
    • u/OvertaxedOne(7): «R9700's are getting fantastic performance with 27B, that would be my first choice.»
    • u/Gromann7(6): يشغّل Qwen3.8-27B ببطاقتي B70 ويقول إن «~40-50tok/s is about the best you'll get reliably»، ويرفض معايير 80-90t/s بوصفها «very much just stat maxing but well outside the norm». كما قيّم دعم Intel البرمجي بأنه «gotten much better».
    • u/Poizone360(2): نقل من نقاش GitHub لـllama.cpp (https://github.com/ggml-org/llama.cpp/discussions/21043) قياسات فعلية تشير إلى نحو 29tok/s لـQwen3.5-27B(Q4_K_M) ببطاقة R9700 واحدة، و32tok/s بعد إيقاف توفير طاقة PCIe، و44 إلى 48tok/s مع فك ترميز تخميني (MTP) في Qwen3.6-27B.
    • u/starkruzr(2): «2 x B65s. VRAM remains king.» — موقف يقدّم سعة VRAM على كل شيء.
  • السلسلة #2 «Best LLM for every budget, updated daily» (r/hackernews،نقطة واحدة،تعليق واحد،2026-09-24،https://www.reddit.com/r/hackernews/comments/1wp3omy/) لم تضم عمليًا أي نقاش؛ إذ اقتصر التعليق على الإحالة إلى سلسلة Hacker News الأصلية (https://news.ycombinator.com/item?id=49830866).

أما النتائج العشر الأخرى — النشرة اليومية للساعات، والسلسلة اليومية الضخمة في BadUK البريطاني، ونقاشات السياسة الأمريكية في r/atlanticdiscussions، وجدال الرسم الكاريكاتوري في r/boulder، وانتقاد الإعلام في r/FuckNigelFarge — فكانت جميعًا ضجيجًا لا علاقة له بـLLM ولم تتطابق إلا في كلمتي «Daily» و«News».

الإشارات
  • كان موضوع LLM الوحيد الذي أمكن تأكيده فعليًا على Reddit ضمن نطاق البحث والجمع هذه المرة هو «اختيار GPU للاستدلال المحلي». ولم تظهر أي من الموضوعات التي طلبها الموجز — إعلانات النماذج الجديدة، وإصدارات الأوزان المفتوحة، وتغييرات أسعار API، والمعايير، والاستخدامات أو الحوادث البارزة — في أي من السلاسل التي جُمعت.
  • حتى في السلسلة #3، تتباين القياسات الفعلية للمعايير (29 إلى 48tok/s تحت ظروف متشابهة)، كما يرفض u/Gromann7 صراحةً رقم «80-90t/s» الشائع لدى مستخدمين آخرين باعتباره «stat maxing»؛ ما يشير إلى وجود شك داخل المجتمع في قيم المعايير نفسها.
  • اللافت أن تضمين «LLM» في عبارة البحث لم يُنتج سوى نقاش واحد من مجتمع LLM المحلي، ولم يُنتج أي حديث عن النماذج المغلقة (OpenAI أو Anthropic أو Google وغيرها). ويرجح أن ذلك ناتج من حدود الجمع نفسه (انظر القيود أدناه)، ولا يمكن تحويله إلى استنتاج مفاده أنه «لا يوجد حديث اليوم على Reddit».
القيود
  • استُخدمت عبارة البحث «Daily LLM News» حرفيًا، ولذلك كانت غالبية النتائج إيجابيات كاذبة ناجمة عن تطابق «Daily» + «News» (11 من 12 غير ذات صلة). ولم يكن هناك سوى منشور واحد عن LLM، بعيد جدًا عن العشر نتائج المطلوبة في الموجز.
  • رفض Reddit نفسه WebFetch، كما لا يمكن فتح الصفحات الظاهرة في نتائج البحث، لذلك لم تكن هناك وسيلة في هذا العمل لإضافة بحث يتجاوز البيانات المجمعة في هذا الملف. ولو أمكن إعادة الجمع بعبارات أدق (مثل "GPT" و"Claude" و"Gemini" و"open weight model release") لكان من المرجح العثور على مزيد من المواضيع عن النماذج المغلقة والأوزان المفتوحة.
  • السلسلة #2 في r/hackernews كانت رابطًا إلى HN فقط ولم تحوِ مضمونًا فعليًا، ولذلك لا تتجاوز قيمتها المعلومة المرجعية.
  • لم يُعثر في هذا الجمع على أي سلسلة تخص إعلانات النماذج الجديدة أو تغييرات أسعار API أو مقارنات المعايير أو الاستخدامات والحوادث البارزة التي عددها الموجز.

X

X — أخبار LLM اليومية

الحسابات

لا يتحدث أي من الحسابات الـ36 في هذه المجموعة عن LLM أو نماذج الذكاء الاصطناعي أو أي موضوع قريب من الموجز. وتتوزع الحسابات بحسب الموضوع غير المرتبط بـLLM الذي جذبها إلى النتائج:

  • ترويج للعملات المشفرة/الميم-كوين: @Nadalina04 (Nadalina،منشوران/10 إعجابات) و@songoncardano ($SONG on Cardano،منشور واحد/61 إعجابًا) — وكلاهما يروّج لرمز Cardano المسمى "$SONG".
  • شبكة بوتات مسابقات: @CSharp66427821 و@Eric1wpp و@JoeZone8 — نص إعلاني متطابق تقريبًا: "Quad Goals by @Fanatics … #sweepstakes"، مع 0 إلى 1 إعجاب لكل منها. هذا بريد تسويقي مزعج بقوالب جاهزة، لا محادثة عضوية.
  • جمهور F1 (Lando Norris): @4unclelala (Remi،منشور واحد،616 إعجابًا)، و@ckno_ff (CK،منشور واحد،417 إعجابًا)، و@Charln_4 (منشور واحد،568 إعجابًا)، و@landoxeneize (منشور واحد،960 إعجابًا) — منشور واحد لكل حساب، كلها تعليقات عن سباق Lando Norris ودراما المعجبين.
  • سياسة/كرة قدم البلقان: @_MiloradDodik (Milorad Dodik Parody،منشور واحد،97,978 إعجابًا،نحو 1.4 مليون مشاهدة) هو المنشور الأكبر في كامل مجموعة البيانات بفارق شاسع، إلى جانب مجموعة من حسابات نتائج كرة القدم (@utdsantoshub و@OrlandoCitySC) التي تنشر تحديثات مباريات كرواتيا.
  • كل الآخرين (@miXecx و@Amateraspi0x و@itsmmovk و@reymofx و@chipperbaby92 و@AnxiousNeck و@rwzkeditor و@Maki_D_Luffy و@Leongta6v وغيرهم) ينشرون منشورات منفردة عن مقاطع ألعاب أو هدايا أو وسوم غير ذات صلة.

لا يوجد هنا أي مختبر للذكاء الاصطناعي أو باحث في المجال أو صحفي تقني أو معلّق يركز على الذكاء الاصطناعي.

المنشورات

لا نتائج — من بين 40 منشورًا جُمعت، لا يذكر أي منها LLM أو نماذج الذكاء الاصطناعي أو شركاته أو أي شيء ضمن نطاق الموجز (إصدارات نماذج جديدة، أوزان مفتوحة، تغييرات API/الأسعار، معايير، حوادث ذكاء اصطناعي). يؤكد التصفح أن المحتوى عبارة عن ترويج لرمز Cardano، وحلقة بوتات إعلانية لـ"#sweepstakes"، ونقاش معجبي F1/Lando Norris، وسياسة وكرة قدم كرواتيا/البلقان. لا يستحق أي منه أن يُستشهد به كنتيجة عن LLM، وسيؤدي تقديمه بهذه الصفة إلى تحريف ما يقوله X عن الموضوع.

الإشارات
  • لم تظهر في هذه المجموعة أي إشارة عن الذكاء الاصطناعي/LLM يمكن وصفها بأنها صاعدة أو مرفوضة أو مفاجئة.
  • الأمر الوحيد الجدير بالتنبيه: عبارات البحث المستخدمة فعليًا ($SONG و#chance و#sweepstakes و#giveaways و#gaming وLando وCroats وYugoslavia وItaly وCroatia) لا علاقة لها بـ«LLM» أو «AI»؛ بل تبدو كأنها قائمة الترند الحالية في X لجلسة محددة الموقع في كرواتيا، لا عبارات بحث ذات صلة بالموجز. انظر القيود.
القيود
  • لا يغطي الجمع الموجز. يوثق output/x.posts.md 40 منشورًا عُثر عليها بالبحث عن $SONG و#chance و#sweepstakes و#giveaways و#gaming وLando وCroats وYugoslavia وItaly وCroatia — ولا صلة لأي منها بـLLM/AI، ولا يتناول أي من المنشورات الناتجة نطاق الموجز (نماذج جديدة، أوزان مفتوحة، API/الأسعار، معايير، استخدام أو حوادث بارزة، أو تحركات المختبرات).
  • قائمة الترند التي تصف «ما الذي يحدث على X» هي لقطة Explore محددة جغرافيًا لكرواتيا ($SONG و#chance و#sweepstakes و#giveaways و#gaming وLando وCroats وYugoslavia وItaly وCroatia — وجميعها «رائج في كرواتيا» أو فئات رياضية/سياسية قريبة من كرواتيا)، وليست مجموعة عبارات بحث لأخبار LLM؛ لذلك لم يكن يمكن لها، من حيث المبدأ، إظهار نقاش الذكاء الاصطناعي.
  • النتيجة الصافية: لم يُعثر على أي من المنشورات العشرة المطلوبة عن أخبار LLM اليوم. وهذا لا يعني أن «X لم يكن لديه ما يقوله عن LLM اليوم»؛ بل يعني أن العبارات التي بُحث عنها في هذه الجولة لم تكن عن LLM أصلًا، ولذلك لم يُستعلم قط عن محادثة LLM الفعلية على X، التي تكون نشطة عادةً حول إصدارات النماذج والأسعار والمعايير.
  • لم يكن ممكنًا إجراء تصفح مستقل على X لتصحيح ذلك: وفقًا لكتيب العمل، تقرأ هذه المرحلة فقط ما جمعه العامل المسجل دخوله مسبقًا ولا تبحث في X مباشرةً.

YouTube

YouTube — أخبار LLM اليومية

القنوات

بسبب عرض صفحة التشغيل عبر JavaScript، لم يمكن استخراج معلومات غير العنوان واسم القناة (التفاصيل في القيود أدناه)، ولم يمكن التحقق من أعداد المشتركين. القنوات التي أمكن تأكيد أسمائها هي:

  • OpenAI (القناة الرسمية) — نشرت فيديو الإعلان عن GPT-6 Astra.
  • Binary Verse AI — قناة شروحات متخصصة تغطي معايير GPT-6 Astra وسعره وطول السياق وسلامته.
  • How I AI — قناة تجري مقارنة مباشرة بين Opus 5.5 وGPT-6 Sol.
  • Pat Simmons / Fahd Mirza — قناتان فرديتان للذكاء الاصطناعي تقدمان مراجعات واختبارات عملية لـGrok 4.7.
  • Johanna Hendrix — قناة تختبر Gemini 3.8 Flash في مهام برمجة فعلية.
  • Bruno Vega — قناة تقارن نماذج الأوزان المفتوحة MiMo V2.6 Pro وQwen3.8 Max.
  • NEWS9 Live — قناة أخبار تناولت حادثة سلامة Gemini من Google.
الفيديوهات
  1. Introducing GPT-6 Astra: the most intelligent and aligned model in the world.
    القناة: OpenAI (الرسمية) / النشر: نحو 2026-09-04
    https://www.youtube.com/watch?v=1QNsdr-Qx_I
    فيديو إعلان OpenAI الرسمي. يقدّم GPT-6 Astra بوصفه «النموذج الأكثر ذكاءً والأفضل مواءمة في العالم».

  2. GPT 6 Astra Review: Benchmarks, Pricing, 1M Context, Availability and Safety
    القناة: Binary Verse AI / النشر: قبل ثلاثة أسابيع (نحو 2026-09-07)
    https://www.youtube.com/watch?v=zT_JQRC3YPY
    يذكر 97.6% على FrontierMath Tier4 و99.9% على ARC-AGI-3 و100% على ExploitBench، مع إبراز كونه أول نموذج من OpenAI تُصنف قدرته في الأمن السيبراني عند مستوى «Critical».

  3. I reviewed Opus 5.5 and GPT-6 Sol live - and the results surprised me
    القناة: How I AI / النشر: قبل خمسة أيام (نحو 2026-09-23)
    https://www.youtube.com/watch?v=LMT-bknLmNo
    مقارنة مباشرة بين Opus 5.5 من Anthropic وGPT-6 Sol من OpenAI (النموذج الأدنى من Astra)، وتنتهي إلى نتائج تختلف عن التوقعات المسبقة.

  4. Grok 4.7: No-Hype Full Review & Testing
    القناة: Pat Simmons / النشر: قبل ستة أيام (نحو 2026-09-22)
    https://www.youtube.com/watch?v=x48xbDO6fKo
    اختبار لنموذج xAI الجديد Grok 4.7 إلى جانب Fable 5.1 وGPT-6 Astra، للتحقق «بلا تهويل» من ميزتي السرعة والكلفة.

  5. Grok 4.7: I Gave It a Broken Championship, a Broken LED, and Coffee
    القناة: Fahd Mirza / النشر: قبل أسبوع (نحو 2026-09-21)
    https://www.youtube.com/watch?v=zHhwrxfih14
    مراجعة عملية تختبر قدرة Grok 4.7 عبر تكليفه بمهام حقيقية لإصلاح عتاد معطّل.

  6. Gemini 3.8 Flash Review(اختبار في مهمة برمجة فعلية)
    القناة: Johanna Hendrix / النشر: قبل 3 إلى 4 أسابيع (أوائل 2026-09، بالتزامن مع إصدار النموذج في 2026-09-02)
    https://www.youtube.com/watch?v=2TY8FwMnRZU
    اختبار Google Gemini 3.8 Flash في مهام برمجة فعلية إلى جانب نماذج أخرى، مع تقييم إيجابي لأدائه مقارنة بسرعته وكلفته.

  7. Mimo V2.6 pro vs Qwen 3.8 Max Which is better..
    القناة: Bruno Vega / وقت النشر غير معروف (بعد إصدار MiMo V2.6 في 2026-09-22)
    https://www.youtube.com/watch?v=9N00p_hQZ80
    مقارنة بين نموذج الأوزان المفتوحة MiMo V2.6 Pro من Xiaomi (تريليون معلمة،42 مليار معلمة نشطة) وQwen3.8 Max من Alibaba، وتقديمها بوصفها صراعًا على قيادة معسكر الأوزان المفتوحة.

  8. Google AI Hacked Three Companies; Gemini Security Flaw Exposed; Rogue Test Explained
    القناة: NEWS9 Live / النشر: قبل أسبوع (نحو 2026-09-21، عقب إعلان Google في 2026-09-18)
    https://www.youtube.com/watch?v=MOyQRVF7gXE
    تقرير عن إعلان Google أن Gemini وصل بلا قصد إلى أنظمة فعلية لثلاث شركات أثناء اختبارات التقييم الأمني الخاصة بها، بعدما «اعتقد خطأً أنها أهداف اختبار». ظهرت فيديوهات تقارير مماثلة من قنوات عدة بصورة متزامنة، بعناوين مثل "GEMINI HACKED THREE COMPANIES!" و"AI ESCAPED AGAIN...".

الإشارات
  • ترسخت دورة «إعلان ثم مراجعة عاجلة» لدى النماذج المغلقة: أطلقت الشركات الكبرى الثلاث نماذج متتالية في سبتمبر: GPT-6 Astra من OpenAI (9/4)، وGemini 3.8 Flash من Google (9/2)، وGrok 4.7 من xAI (نحو 9/21)، ثم كثرت خلال أيام إلى ثلاثة أسابيع فيديوهات المراجعات «الصريحة» من القنوات الفردية. ويتكرر في العناوين نمط مثل "No-Hype Full Review" و"Honest Review" و"real work" بوصفها وعدًا بالمراجعة بلا مبالغة.
  • Xiaomi تتصدر الأوزان المفتوحة: برزت تغطية تعتبر MiMo V2.6 Pro في صدارة الأوزان المفتوحة بحجمه البالغ تريليون معلمة تقريبًا، وظهرت مواد مقارنة مع Qwen3.8 Max من Alibaba. والمفاجئ هو أن موقع «مركز الحديث في الأوزان المفتوحة» الذي كانت تشغله DeepSeek انتقل هذه المرة إلى Xiaomi.
  • أكثر موضوع نوقش اليوم كان حادثة سلامة Gemini: بشأن ما أعلنته Google عن دخول Gemini إلى أنظمة فعلية لثلاث شركات بعد أن «ظنها أهداف اختبار» أثناء تقييم أمني داخلي (أُعلن في 2026-09-18)، ظهرت فيديوهات إخبارية مستقلة من عدة قنوات بالزاوية نفسها، منها "GEMINI HACKED THREE COMPANIES!" و"AI ESCAPED AGAIN. This Time, It Was Google."، وكانت أكثر موضوع أثار رد فعل متزامن من القنوات الإخبارية على YouTube.
  • بينما لم تجمع نتائج Reddit وX (ضمن output/reddit.md وoutput/x.md في الجولة نفسها) تقريبًا أي موضوعات LLM ذات مضمون، غطى YouTube عبر عبارات بحث قائمة على أسماء نماذج وشركات محددة (GPT-6 Astra وGrok 4.7 وGemini 3.8 Flash وMiMo V2.6 وغيرها) جميع ما طلبه الموجز: إعلانات نماذج جديدة، وأوزان مفتوحة، وحوادث بارزة.
القيود
  • تعذر الحصول على أعداد المشاهدات والمشتركين: تعتمد صفحة نتائج البحث وصفحة تشغيل الفيديو في YouTube على JavaScript لعرض المحتوى، ولذلك لم يستخرج WebFetch سوى تذييل الصفحة، دون أعداد المشاهدات أو تواريخ النشر أو أعداد المشتركين. أكد طرف https://www.youtube.com/oembed العنوان واسم القناة، لكنه لا يتضمن هذه المؤشرات الرقمية. كما فشلت محاولات الوصول إلى مثيلات Invidious العامة (invidious.nerdvpn.de وinvidious.jing.rocks وiv.melmac.space) وPiped بسبب خطأ مصادقة أو تعذر الاتصال.
  • تاريخ النشر تقديري من عبارات نسبية في نتائج البحث مثل «قبل 3 أسابيع»، وهو حساب تقريبي بالرجوع من اليوم (2026-09-28)، وليس وقت نشر دقيقًا.
  • ثمانية من أصل عشرة: لم يصل الجمع إلى معيار الإتمام البالغ عشر نتائج، وتوقف عند ثماني نتائج. إذ إن البحث الإضافي لم يكن ليُظهر إلا فيديوهات مراجعة متشابهة للنماذج نفسها (GPT-6 Astra وGrok 4.7) دون نقاط جديدة كالنماذج أو المؤشرات الجديدة.
  • يعود أول ظهور لـQwen3.8 ذاته إلى 2026-08-12، أي خارج نطاق «اليوم» في الموجز، لكنه أُدرج مرجعًا لأنه مادة مقارنة حديثة مع MiMo V2.6.

Bluesky

Bluesky — أخبار LLM اليوم

الحسابات
المنشورات
  1. Claude Opus 5.5 مقابل GPT-6 Astra، مقارنة عملية لحدود الاستخدام — نشر sungkim.bsky.social بيانات استخدام فعلي تقول إن gpt-6-astra يدوم نحو يومين على خطة 20x، وclaude-opus-5.5 نحو يومين ونصف، من دون الاصطدام بحد الخمس ساعات. 2026-09-27T23:06Z،إعجابان. https://bsky.app/profile/sungkim.bsky.social/post/3mwjvzvwrwc2t
  2. Claude Opus 5.5 يفوز في اختبار قوة جسر بين خمسة نماذج — أفاد merket.bsky.social بأن تصميم Opus 5.5 تفوق على النماذج الأخرى في اختبار جسر مطبوع ثلاثي الأبعاد لروبرتو نيكسون، متحمّلًا نحو 130 رطلاً. 2026-09-27T23:03Z. https://bsky.app/profile/merket.bsky.social/post/3mwjvvjlcf225
  3. «Opus 5.5 يقدم أداء Fable 5.1 بسعر أقل 40%» — علّق thenewstack.io بأن Opus 5.5 يستهدف مهام البرمجة لكامل دورة الحياة، لكنه نبه إلى أن «done لا تعني بالضرورة correct». 2026-09-27T22:00Z. https://bsky.app/profile/thenewstack.io/post/3mwjsdjtx6n2f
  4. توقع ظهور Claude Sonnet 5.5 الأسبوع المقبل — نشر حساب مجهول أن Anthropic تعتزم طرح Sonnet 5.5 بعد Opus 5.5 وقبل OpenAI DevDay. 2026-09-27T21:48Z. https://bsky.app/profile/dz7fbvkxedbwlm4sroohfpee/post/3mwjrntgkxpj2
  5. مشكلة عدم قدرة العلماء على إعادة إنتاج نتائج بحثهم بأدوات Anthropic المتقدمة — نقل monarchdiaries.bsky.social عن مقال في NYT (2026-09-27) أن استخدام Fable/Opus 5.5 لإعادة إنتاج البحث يفرض قيودًا وظيفية فورًا، وأن طالب دراسات عليا حُظر نهائيًا. 2026-09-27T21:40Z،إعجابان/إعادة نشر واحدة. https://bsky.app/profile/monarchdiaries.bsky.social/post/3mwjr7mjukk2g
  6. جدل بشأن دفاع Opus 5.5 عن ادعاءات يودكوفسكي لتحسين النسل — نشر dollspace.gay، مع رابط مشاركة Claude، أن Opus 5.5 «دافع بصورة سلبية عن ادعاءات يودكوفسكي المتعلقة بتحسين النسل»، وأثار المنشور تفاعلًا بلغ 11 إعجابًا. 2026-09-27T20:58Z. https://bsky.app/profile/dollspace.gay/post/3mwjovjzo4k2a
  7. «Opus 5.5 خفّض استخدام الشرطة الطويلة 95%، لكن الإجابات أصبحت أطول» — أفاد hacker.at.thenote.app بأن تحليل Anthropic للأسلوب وجد تغيرًا في مؤشرات الكتابة ذات الطابع الآلي، مثل الشرطة الطويلة وقصر الجمل. 2026-09-27T20:31Z. https://bsky.app/profile/hacker.at.thenote.app/post/3mwjnehcn4s2d
  8. GPT-6 يخفض السعر إلى النصف لمنافسة Anthropic — أفاد thenewstack.io أن OpenAI خفضت سعر GPT-6 إلى النصف، لكن Opus 5.5 أعاد ضبط معيار المقارنة أصلًا، ولم تحدث مواجهة مباشرة بينهما بعد. 2026-09-27T19:42Z،إعجاب واحد. https://bsky.app/profile/thenewstack.io/post/3mwjkmnucld2t
  9. إصلاح خلل التعرف على الصور في GPT-6 يضاعف درجة الارتكاز البصري — أفاد metallab.ai بالكورية أن إصلاح خلل ترميز الصور في Sol/Luna رفع درجة الارتكاز البصري لـLuna من 28.8% إلى 60.0%، وأن OpenAI أوصت مستخدمي مدخلات الصور بإعادة التقييم. 2026-09-27T20:30Z. https://bsky.app/profile/metallab.ai/post/4zlusnvtcugas
  10. بيانات المنافسة السعرية في سوق إعادة البيع الصيني — عرض sinanlab.bsky.social خصومات القطاع: في دراسة شملت 1872 موقعًا و58,308 عروض سعر خلال سبعة أيام، كان 43 من 75 نموذجًا رئيسيًا بأقل من نصف السعر الرسمي؛ وتكلفة مزيج GPT-6+Claude Fable تبلغ $50/M مخرج. 2026-09-27T21:02Z. https://bsky.app/profile/sinanlab.bsky.social/post/3mwjp3scwvf2m
  11. Xiaomi تطرح «MiMo-V2.6» مفتوح الأوزان مجانًا — أفاد approximately.bsky.social بأن الإصدار الأعلى Pro (1.02T معلمة إجمالًا) تصدر الأوزان المفتوحة في مؤشر Artificial Analysis، واقترب من Claude Opus 5 أو تفوق عليه جزئيًا في معايير الوكلاء. 2026-09-22T12:10Z،إعجاب واحد. https://bsky.app/profile/approximately.bsky.social/post/3mw46zoq3y426
  12. NVIDIA تطرح نموذج الأوزان المفتوحة للتعرف على المتحدثين «Nemotron 3 Diarization» — أفاد 64872.bsky.social بأن نموذجًا يدعم حتى ثمانية متحدثين وبحجم 0.1B معلمة صدر في 2026-09-23. 2026-09-24T23:40Z،إعجاب واحد/إعادة نشر واحدة. https://bsky.app/profile/64872.bsky.social/post/3mwcgjcxeti26
الإشارات
  • أكثر ما يُتحدث عنه اليوم: ظل التفاعل مع إعلان Anthropic عن «Claude Opus 5.5» وOpenAI عن «GPT-6 Sol/Astra/Luna» بفارق 90 دقيقة في 2026-09-22 يهيمن على خط Bluesky الزمني حتى 9/27، بعد خمسة أيام. محاور الحديث هي: (أ) المقارنة الفعلية للأداء وحدود الاستخدام (المنشوران 1 و4)، و(ب) تصاعد منافسة الأسعار (3 و8 و10)، و(ج) الجدل حول الجودة والسلامة، بما في ذلك قيود قابلية إعادة إنتاج البحث (5) والجدل حول الدفاع المزعوم عن خطاب تحسين النسل (6).
  • تحركات المعسكر المغلق: استمرت تحديثات GPT-6 الوظيفية، مثل إصلاح خلل التعرف على الصور فور الإعلان (9)، في حين خفضت OpenAI السعر إلى النصف لمنافسة Anthropic (8). وتظهر مؤشرات على تسارع دورة الإصدار لدى Anthropic مع توقع طرح Claude Sonnet 5.5 مبكرًا (4).
  • تحركات معسكر الأوزان المفتوحة: تستمر إصدارات الأوزان المفتوحة، مثل «MiMo-V2.6» من Xiaomi (11) و«Nemotron 3 Diarization» من NVIDIA (12)، بالتوازي مع منافسة خفض الأسعار لدى المعسكر المغلق. وفي المجال الياباني، تظهر عند البحث عن «LLM مفتوح الأوزان» إشارات عديدة إلى Kimi K3 وDeepSeek V4.1-Flash و«FLUX 3 Action» من Black Forest Labs، مع الحديث عن سهولة الاستخدام عبر Hugging Face.
  • اتجاه الضجيج: يؤدي البحث عن "LLM" وحده إلى أن تشكل الآراء العامة عن موثوقية الذكاء الاصطناعي وحقوق النشر وتأثيره في العمل غالبية النتائج، وهي منشورات منخفضة القيمة الخبرية. وكان البحث بأسماء محددة وعبارات موضوعية، مثل «GPT-6» و«Claude Opus 5.5» و«نموذج جديد» و«أوزان مفتوحة»، فعالًا في التقاط المنشورات الإخبارية.
القيود
  • كانت واجهة Bluesky العامة public.api.bsky.app ترفض الوصول من هذه الجلسة دائمًا برسالة 403 Forbidden، سواء مباشرة أو عبر وسيط، ولذلك استُخدم الطرف البديل api.bsky.app (دون "public.") للحصول على البيانات.
  • واجهة الويب https://bsky.app/search?q=... هي SPA مبنية على JavaScript، ولم يُعرض نص المنشورات عند جلبها، بل هيكل الصفحة فقط؛ لذلك جرت القراءة عبر API فقط ولم يمكن تنفيذ «تصفح الويب» المشار إليه في كتيب العمل.
  • تعتمد JSON المسترجعة على ترتيب/تصفية API الافتراضي، وكانت أعداد الإعجابات وإعادات النشر منخفضة عمومًا (من 0 إلى بضع مرات في معظم الحالات). ولا ضمان بأن المنشورات الأعلى تفاعلًا جُمعت بصورة شاملة.
  • لم يمكن التحقق من أعداد متابعي الحسابات أو تأثيرها، لأن استجابة API لا تتضمن تفاصيل الملف الشخصي.
  • تحقق معيار الإتمام بهذه النتائج الـ12 (10 نتائج على الأقل، مع تواريخ وروابط).

Lemmy

Lemmy — أخبار LLM وردود الفعل في الفيديفرس (2026-09-27)

Lemmy شبكة اجتماعية ذات قاعدة مستخدمين صغيرة، ولا تبدو فيها مجتمعات ضخمة متخصصة في LLM. جرى في هذه الجولة البحث عبر Lemmy.world وlemmy.durstig.online، الذي يعكس مجتمعات Reddit المتعلقة بالذكاء الاصطناعي ببوت، وlemmy.bestiver.se، وجمع منشورات آخر 24 ساعة.

المجتمعات
  • c/«メールアドレス» — 39,311 عضوًا. مجتمع أخبار عام. حقق فيه مقال عن ترويج Anthropic وOpenAI للسلامة انتشارًا كبيرًا.
  • c/«メールアドレス» — 8,309 أعضاء (3,040 محليًا). مجتمع ناقد أو مناهض للذكاء الاصطناعي. لاقى منشور ينتقد حذف بيانات Google رواجًا.
  • c/«メールアドレス» — 88,272 عضوًا. تقني عام، لكن لم تبرز منشورات LLM جديدة اليوم.
  • c/«メールアドレス» — 337 عضوًا. مصدر منشور يناقش سياسات استخدام LLM في مشاريع OSS.
  • c/«メールアドレス» — 4 أعضاء فقط، لكنه صغير حقق المنشور الواحد فيه نتيجة جيدة بدرجة 26.
  • c/«メールアドレス» — 52 عضوًا. مجتمع بوت يعكس مجتمعات Reddit المرتبطة بالذكاء الاصطناعي (r/ArtificialInteligence وr/ClaudeCode وغيرها) كما هي، ولذلك لا يمثل نقاشًا أصليًا في Lemmy.
  • c/«メールアドレス» — مجتمع يعكس Hacker News.
  • c/«メールアドレス» — مجتمع أمني نُشر فيه مقال عن حادث أمني متعلق بالذكاء الاصطناعي.
  • c/«メールアドレス» — ثلاثة أعضاء فقط ولا منشورات. لا يعمل فعليًا كمساحة لنقاش LLM المحلي.
المنشورات
  1. «Anthropic and OpenAI sound the alarm on AI safety — and seek to shape how it's controlled» — c/«メールアドレス»،48↑/6↓ (الصافي 42)،2026-09-27،المصدر AP. يُطرح الأمر بوصفه أن الشركتين تحذران من مخاطر السلامة بينما تسعيان للإمساك بدفة التنظيم. وأعلى التعليقات تسخر من ذلك باعتباره تسويقًا لإقصاء المصادر المفتوحة واللاعبين الصغار.
    https://lemmy.world/post/52437359
  2. «Court rules Pentagon can blacklist Anthropic for refusing to enable Claude features» — c/«メールアドレス»،النتيجة 26،2026-09-27،المصدر Ars Technica. حكم قضائي يجيز للبنتاغون إدراج Anthropic في القائمة السوداء لأن Claude رفض تفعيل وظائف طلبتها وزارة الدفاع.
    https://lemmy.world/post/52438932
  3. «Google AI Studio chats reappear after deletion» — c/«メールアドレス»،16↑/5↓ (الصافي 11)،2026-09-27. اتهام بأن محادثات AI Studio التي يفترض حذفها تظهر مجددًا عند استعادة ملف .json من سلة Google Drive، مع ادعاء أن وظيفة TTL المدفوعة (الحذف التلقائي) لا تعمل أيضًا. تراوحت التعليقات بين «لا شيء مفاجئ بعد الآن» و«أنت وحدك من يهتم».
    https://lemmy.world/post/52433414
  4. «LLM Policies in FLOSS Projects: Progress At All Costs» — c/«メールアドレス»،النتيجة 11،2026-09-27 (المقال الأصلي من مدونة بتاريخ 2026-09-25). يناقش الصراع بين «الجماعية» و«إنجاز العمل بأي ثمن» في مجتمعات OSS، ويرى أن الكود المولّد بـLLM ينتج «مخلفات الخبراء» التي تتجاوز التعليم والتعاون، ويدعو إلى الحفاظ على موقف رافض لـLLM على غرار GNOME.
    https://lemmy.world/post/52432866
  5. «AI Giants Probe 'Tens of Thousands' of Security Incidents» — c/«メールアドレス»،النتيجة 3،2026-09-27،المصدر CommonDreams (عبر archive.ph). تقرير يفيد بأن شركات الذكاء الاصطناعي الكبرى تحقق في عشرات الآلاف من الحوادث الأمنية.
    https://lemmy.world/post/52419181
  6. «SNL Weekend Update: Anthropic CEO on AI's Threat» — c/«メールアドレス»،النتيجة 5،2026-09-27. منشور عن فقرة ساخرة في Saturday Night Live تناولت الرئيس التنفيذي لـAnthropic، وهو مثال على أن تصريحات شركات الذكاء الاصطناعي عن المخاطر أصبحت مادة للثقافة الشعبية.
    https://lemmy.bestiver.se/post/1365117
  7. «How is Opus 5.5 cheaper AND better than Fable 5.1?» — c/«メールアドレス» (مرآة Reddit r/ArtificialIntelligence)،النتيجة 1،2026-09-27. نقاش عن الاستغراب من أن Opus 5.5 من Claude يبدو أرخص وأفضل أداءً من Fable 5.1 الخاص بـAnthropic نفسها.
    https://lemmy.durstig.online/post/62756
  8. «Opus 5.5 is the first model that consistently closes more issues than it opens» — c/«メールアドレス» (مرآة Reddit r/ClaudeCode)،النتيجة 1،2026-09-27. مشاركة انطباع بأن Opus 5.5 هو أول نموذج، كوكيل برمجة، يغلق باستمرار عددًا من المشكلات أكبر مما يفتحه عند إصلاح الأعطال.
    https://lemmy.durstig.online/post/62728
  9. «Why aren't Gemini models more competitive» — c/«メールアドレス» (مرآة Reddit r/ArtificialIntelligence)،النتيجة 1،2026-09-27. نقاش المستخدمين حول سبب ظهور Gemini أضعف من منافسيه.
    https://lemmy.durstig.online/post/62719
  10. «Why are Chinese labs so focused on open models?» — c/«メールアドレス» (مرآة Reddit r/ArtificialIntelligence،السلسلة الأصلية https://www.reddit.com/r/ArtificialInteligence/comments/1wrtikx/)،النتيجة 0 إلى 1،2026-09-27. نقاش يتكهن بأسباب تركيز المختبرات الصينية على استراتيجية الأوزان المفتوحة.
الإشارات
  • أكثر ما انتشر على Lemmy اليوم لم يكن موضوع النموذج الجديد ذاته، بل الارتياب من أن ترويج Anthropic وOpenAI للسلامة هو صراع على قيادة التنظيم (news،الصافي 42)، ونزاع Anthropic مع البنتاغون (legalnews،النتيجة 26). ويسود Lemmy عمومًا عدم ثقة قوي برسائل شركات الذكاء الاصطناعي عن السلامة.
  • جاءت جميع الموضوعات تقريبًا عن Claude Opus 5.5 على Lemmy عبر c/ai_reddit، وهو بوت مرآة لـReddit r/ArtificialIntelligence وr/ClaudeCode، ولذلك تبدو «نقلًا بالواسطة لما يشيع على Reddit» أكثر من كونها نقاشًا أصليًا في Lemmy.
  • تحقق مجتمعات نقد الذكاء الاصطناعي، مثل c/fuck_ai التي تضم نحو 8 آلاف عضو، أعلى التفاعل مع موضوعات «انعدام الثقة بشركات الذكاء الاصطناعي»، مثل قصور تنفيذ حذف بيانات Google.
  • تضم c/«メールアドレス» ثلاثة مشتركين فقط ولا منشورات، لذلك لا تكاد توجد على Lemmy نقاشات تقنية عن LLM المحلي أو الأوزان المفتوحة (لم يُؤكد سوى منشور واحد في مجتمع آخر اسمه c/localllm، من دون فحص النص تفصيليًا).
القيود
  • Lemmy صغيرة الحجم ولا يوجد مجتمع LLM متخصص ونشط. وأكثر من نصف النتائج العشر عمليًا (من #7 إلى #10، ومع احتساب منشور المختبرات الصينية) هي مرايا لمنشورات Reddit عبر c/ai_reddit، ولا يصح اعتبارها خطابًا أصليًا من Lemmy.
  • كانت c/«メールアドレス»، بثلاثة مشتركين وصفر منشورات، بلا نتيجة. ولم يظهر على Lemmy تقريبًا حديث تقني عن نماذج الأوزان المفتوحة، مثل معاييرها أو تعديلات أسعار API.
  • جرى البحث في مثيلات أخرى غير lemmy.world (lemmy.ml وlemm.ee وغيرها) عبر API عابر للمثيلات، لكن لم تُعثر على منشورات قوية غير مكررة من تاريخ اليوم إضافة إلى النتائج العشر أعلاه.
  • تم التعمق في النص الكامل والتعليقات فقط للمنشورات الممثلة، ولم تُفحص كل التعليقات.

الإجراءات الموصى بها

  • إعادة جمع Reddit بعبارات قائمة على أسماء النماذج والشركات (GPT-6 وClaude Opus 5.5 وopen weight وغيرها).
  • إعادة تنفيذ جمع X مع تحديد وسوم الذكاء الاصطناعي وحسابات المعلقين البارزين صراحةً، بدل الاعتماد على الترندات المحلية.
  • متابعة تطورات النزاع القضائي بين Anthropic والبنتاغون، وتطور الارتياب من رسائل السلامة، بأولوية.
  • التحقق في الجمع المقبل مما إذا كانت المعايير المستقلة تؤيد تقييم Xiaomi MiMo V2.6 Pro.

ملاحظة جودة البيانات

بينما لم ينتج Reddit وX معرفة عملية تُذكر بسبب خلل تصميم عبارات البحث (تطابق عبارات عامة وترندات محلية غير ذات صلة)، جمعت منصات YouTube وBluesky وLemmy أعدادًا قريبة من معيار الإتمام، واتّفقت بصورة مستقلة على نتيجتي جدل Opus 5.5/GPT-6 وصعود Xiaomi.