موجز الخميس، ٦ أغسطس

افهم ما يحدث.
قبل أن يتكرر.

جريدة تحوّل ضوضاء الذكاء الاصطناعي إلى قصص واضحة، موثقة، ومكتوبة للقارئ العربي.

منشور اليوم
٩
وقت الموجز
٣ دقائق
المنهج
مصادر أولية
الرئيسية

نبض الذكاء الاصطناعي

محدّث الآن
غلاف جريدة لمقال: بحث جديد: هل تستعيد نماذج اللغة الكبيرة قواعد تحسين يغفِلها المجمعون؟
الموجز الأول قيد المراجعة التحريرية.

آخر القصص

عرض الكل
جريدة.بحث

ما قبل التهيئة بالمنطق: تهيئة نماذج اللغة على استدلالات رسمية تُسرِّع التعلم وتُسهِم في ضغط النماذج

ورقة تقترح Logic-PPT: تهيئة أولية لنماذج اللغة على بيانات استدلال رسمية. على مقياس 100B توكين، تؤدي إلى اكتساب أسرع للمهارات اللغوية (80% دقة مع تقليل ~36B توكين) وتغيّر هندسة التمثيلات داخلياً بما يُسهِم في ضغط أفضل (مطابقة النموذج الكثيف عند ≈33% تشذيب). النتائج من الورقة على arXiv.

اقرأ المقال
جريدة.إصدار نموذج

Transformers v5.14: وصول Inkling (975B، أوزان مفتوحة) وتحسينات أداء وبنية مهمة للمطوّرين

إصدار Transformers v5.14 يضيف Inkling — نموذجًا متعدد الوسائط بقياس 975B إجمالي (41B نشط) مع أوزان مفتوحة للبحث والتكامل، إلى جانب إدخال TIPSv2 وTIPSv2 DPT، وتحسينات أداء مهمة (FlashAttention، SDPA prefill مع StaticCache حتى +260% بحسب الملاحظة)، وإصلاحات توافقية لمطوّري vLLM.

اقرأ المقال
جريدة.إصدار نموذج

مايكروسوفت تُطلق Aurora 1.5: نموذج أساسي مفتوح للتنبؤات الجوية بنطاقات زمنية وبيانات أوسع وتنبؤ احتمالي

أعلنت مايكروسوفت عن Aurora 1.5، توسيع كبير لنموذج Aurora الأرضي المفتوح: 22 متغيّراً جويّاً إضافياً، دقة زمنية بالساعة، وقدرة ensemble احصائية لتمثيل عدم اليقين. النموذج متاح على GitHub ومع نقاط تفتيش على Hugging Face، مع مسارات لعبور البحث إلى خدمات تشغيلية عبر Microsoft Weather.

اقرأ المقال
جريدة.بحث

SocietyBench: معيار جديد لتقييم قدرة النماذج على توقع تطورات العالم الاجتماعي في إطار «عوالم مضادة للواقع»

SocietyBench إطار تقييمي يحول تغطية الأخبار ووسائل التواصل إلى جداول زمنية مؤرخة ثم يُجهّلها عبر استبدال الكيانات وتحريك التواريخ لإنتاج «عوالم مضادة». ينتج عن ذلك بنوك أسئلة تنبؤية تُقَيَّم على معايرة الاحتمال والدقة الزمنية؛ أفضل من بين ستة LLMs حقق 75/100 مقابل مرجع بسيط 50. جميع البيانات والشفرات منشورة على arXiv.

اقرأ المقال
جريدة.بحث

Video-DeepResearch: وكيل متعدد الوسائط لفهم الفيديو مع بحث ويب مرحلي—مقتطفات من ورقة على arXiv

ورقة على arXiv تعرض Video-DeepResearch (Video-DR)، إطارًا لوكلاء يتعاملون مع تدفقات الفيديو المتصلة ويجبرون الوكيل على التأريض عبر الإطارات قبل استخدام بحث الويب. تقدم أيضاً مرجعية Video-DR-Bench (200 حالات VQA متعددة القفز) ووصفة تدريب: ضبط خاضع للإشراف يليه Group Relative Policy Optimization (GRPO). المؤلفون يبلغون عن أداء رائد على المعيار المخصص.

اقرأ المقال
جريدة.بحث

بحث جديد يوضّح «توسيع الاختبار» في نماذج اللغة: تعريف منهجي، مقاييس قابلة للتكرار وإطلاق أثرية ضخمة

ورقة بحثية (arXiv) تؤطّر "test-time scaling" كاستدلال بميزانية على شجرة البادئات الضمنية لنماذج autoregressive، تميّز ثلاث نظم (مسار واحد، أوراق مع تجميع، ومستوى البادئات)، تقترح ملف تقييم ومواصفات قابلة للتكرار، وتعلن عن تجميع أكثر من 2 مليار أثر استدلالي للإصدار.

اقرأ المقال

الدليل

ابدأ التعلّم

كل الأدلة

جريدة، كل يوم

معرفة أقل ضجيجاً.
قرار أكثر وضوحاً.

ادخل غرفة الأخبار