الوسائط المتعددة الموحدة بلا VAE: SenseNova U1 و NEO-Unify، والتقديم في البنية المحلية
أطلقت SenseTime نموذج 日日新 SenseNova U1 برخصة Apache 2.0. تعتمد بنية NEO-Unify التي تلغي كلاً من المشفر البصري و VAE، وتعالج الفهم والتوليد والتحرير والتوليد ...
أطلقت SenseTime نموذج 日日新 SenseNova U1 برخصة Apache 2.0. تعتمد بنية NEO-Unify التي تلغي كلاً من المشفر البصري و VAE، وتعالج الفهم والتوليد والتحرير والتوليد ...
أطلقت Moonshot نموذج Kimi K3، أكبر نموذج مفتوح الأوزان في العالم حتى الآن. المثير ليس فقط تفوقه على أفضل النماذج المغلقة في اختبار برمجة الواجهات الأمامية، ب...
نموذج Qwen3.6-27B-NVFP4 من NVIDIA يضغط نموذج استدلال بـ 27 مليار معامل ذا انتباه هجين إلى 4 بت، فيخفض الذاكرة بنحو 2.5 ضعف مع إبقاء فجوة المعايير ضمن نقطة وا...
أصدرت Google DeepMind نموذج Gemma 4 في أبريل 2026، وهو عائلة متعددة الوسائط مفتوحة الأوزان مكوّنة من خمسة نماذج تمتد من E2B إلى 31B. نشرح رخصة Apache 2.0، وس...
نموذج Gemma-4-26B-A4B-NVFP4 الذي أصدرته NVIDIA يعمل على جهاز DGX Spark واحد (128 جيجابايت من الذاكرة الموحدة) بتوازي 16 ضعفاً، محققاً نحو 18 رمزاً في الثانية...
يحتفظ Kimi K2.6 من Moonshot AI ببنية MoE تُنشّط 32B معاملًا فقط من أصل تريليون، محققًا تكلفة استدلال مماثلة لنماذج dense بحجم 32B مع دعم سياق 256K ومعالجة مت...
يعالج GLM-5.2 من Z.ai سياقًا بطول مليون رمز بتوفير 2.9x في FLOPs باستخدام DSA (الانتباه المتفرق الديناميكي). ترخيص MIT يتيح النشر المحلي بحرية، وتتوفر 29 نسخ...
FastContext-1.0-4B-SFT الصادر عن Microsoft هو نموذج وكيل فرعي مبني على Qwen3-4B ومخصص لاستكشاف مستودعات الشفرات. يستخدم ثلاثة أدوات فقط: READ وGLOB وGREP، وي...
أطلق Google DeepMind نموذج DiffusionGemma-26B-A4B-it، وهو نموذج متعدد الأوضاع مبني على بنية MoE، غير أنه يعتمد الانتشار المتقطع للنصوص بدلاً من التوليد التلق...