الوكيل يُعلّم نفسه بمهارات كتبها بنفسه: كيف يحل SEED مشكلة المكافأة النادرة
العائق الحقيقي في التعلّم المعزّز للوكلاء (agentic RL) هو أن المكافأة تصل مرة واحدة فقط، في نهاية المسار (trajectory). يحوّل SEED هذه الإشارة النادرة الوحيدة...
مدونة تقنية متخصصة تشارك أحدث تقنيات هندسة الذكاء الاصطناعي وعمليات التطوير والحوسبة السحابية والخبرات العملية.
العائق الحقيقي في التعلّم المعزّز للوكلاء (agentic RL) هو أن المكافأة تصل مرة واحدة فقط، في نهاية المسار (trajectory). يحوّل SEED هذه الإشارة النادرة الوحيدة...
الكلفة الحقيقية للاستدلال الطويل تأتي من نمو الحالة (state) بلا حدود. يقسّم التفكير الماركوفي (Markovian Thinking) الاستدلال إلى كتل (chunks) ثابتة الحجم ويم...
يدمج vLLM نحو 2000 التزام في main كل شهر ويحافظ مع ذلك على جودة الإنتاج. السر ليس ‘مزيداً من الاختبارات’ بل ثلاث آليات حتمية: بوابة قياس أداء، وتثبيت فرع الإ...
أطلق تطبيق Claude Code لسطح المكتب ميزة تُظهر محاكي iOS في لوحة جانبية بجوار المحادثة، ضمن نسخة تجريبية عامة. نستعرض ما تغيّره هذه الحلقة المغلقة التي يبني ف...
Archify مهارة وكيل تُنشئ مخططات معمارية بصيغة HTML ذاتية الاكتفاء من وصف بجملة عادية دون الحاجة لتعلّم صيغة Mermaid. حين ثبّتناها فعليًا ورسمنا بها بنية ai-p...
في الثاني والعشرين من يوليو، وقف إصداران مفتوحا الأوزان وجها لوجه كالمرآة. أحدهما يولد الكود، والآخر يبحث عن ثغراته. لكن يبقى سؤال واحد لم يجب عليه أي منهما،...
هل يتفوق عميل (agent) يراقب قياسات وحدة معالجة الرسوميات (GPU telemetry) ويضبط حجم الدفعة (batch size) والتزامن (concurrency) في الوقت الفعلي على التحكم الثا...
أعلن فريق Qwen التابع لعلي بابا عن Qwen-Image-3.0، الجيل الثالث من نماذج توليد الصور. طرح النموذج قدرات لافتة مثل استيعاب مدخلات بطول 4.5 ألف رمز (token)، وع...
في يوليو 2026 كشف Hugging Face عن اختراق داخلي قاده وكيل ذكاء اصطناعي ذاتي. كانت نقطة الدخول مجموعة بيانات خبيثة واحدة، وأدت ثغرتان في خط معالجة مجموعات البي...
يغلّف مشروع hugging-voice من Hugging Face ومحركه speech-to-speech خط معالجة صوتي لحظي كامل، من كشف النشاط الصوتي إلى STT وLLM وTTS، خلف واجهة WebSocket متواف...
أضاف Claude Code وضع قارئ الشاشة الذي يستبدل واجهة الطرفية البصرية بنص خطي بسيط. إليك ما يغيّره الأمر claude --ax-screen-reader فعليًا، وكيف يعمل، ولماذا تهم...
يجمع المكوّن الإضافي مفتوح المصدر Digital Marketing Pro بين 158 مهارة و24 وكيلًا متخصصًا دون أن ينهار. السر هيكل حتمي: تدفّق ثابت من 12 جزءًا. نحلّل التصميم ...
عرضت Cursor سربًا من الوكلاء أعاد بناء SQLite بلغة Rust اعتمادًا على دليلها المؤلف من 835 صفحة فقط. اجتاز 100% من مجموعة اختبارات محجوزة، وتفاوتت التكلفة 15 ...
يعمل وكيل LLM المستخدِم للأدوات فوق harness يحيط بالنموذج. وتُثبت ورقة بحثية حديثة على arXiv، عملياً، أن الفصل بين تصميم هذا الـ harness والـ post-training ي...
كيف يمكن لحاضنة عميل ذاتية (agent harness) تعيد كتابة كودها بنفسها طوال الليل أن تنشر نتيجتها بأمان في اليوم التالي؟ تجربة تجمع بين إصدارات الكناري (canary r...
أعلنت علي بابا عن نيتها إصدار Qwen3.8 بحجم 2.4 تريليون معلمة كأوزان مفتوحة قريبا. النسخة التجريبية متاحة للاختبار بالفعل، لكن الأوزان والمعايير القياسية لم ت...
عادت مشكلة الرفض المفرط، التي تجعل النماذج المغلقة ترفض حتى المهام الأمنية والطبية والقانونية المشروعة، إلى الواجهة من جديد. أعلنت Moonshot أن نموذجها مفتوح ...
أطلقت Moonshot نموذج Kimi K3، وهو أكبر نموذج مفتوح الأوزان في التاريخ بـ 2.8 تريليون معامل. النتائج مبهرة، لكن جدلاً حول الإفراط في التكيّف مع المعايير القيا...
بدلاً من إنزال طبقات أو خبراء كاملين، يوزّع ATSInfer الموتّرات فرادى بين الـ CPU والـ GPU. تُبلّغ الورقة عن تشغيل نماذج تتجاوز سعة الـ VRAM بكثير على بطاقة R...
من حادثة فوترة بقيمة 25 مليار وون طالت مستخدما محليا إلى شبهات فوترة زائدة شملت 60 شركة، تشير أخبار تكلفة الذكاء الاصطناعي في الشهر الأخير إلى فجوة واحدة. في...
أدوات البرمجة بالذكاء الاصطناعي تنسى قواعدك مع كل جلسة جديدة. حلّ أحد الفائزين بهاكاثون Anthropic هذه المشكلة بنشر إعداداته مفتوحة المصدر بعد صقلها ستة أشهر ...
اختُزلت توقّعات إيلون ماسك الثلاثة في دافوس على الإنترنت إلى تحذير مفاده أن ‘عصر الراتب ينتهي خلال ثلاث سنوات’. فرّغنا مقطع المقابلة الفعلي لنتحقق مما قاله ح...
نحلل أداة سطر الأوامر المفتوحة المصدر للبرمجة التي أطلقتها Moonshot AI إلى جانب Kimi K3، استناداً إلى الوثائق الرسمية والمستودع الفعلي. من الوكلاء الفرعيين c...
أثار خبر تخفيض أنثروبيك حجم التعليمات النظامية في Claude Code بنسبة 80 بالمئة نقاشا واسعا بين المطورين. وأوضح المسؤول عن ذلك أن النموذج الجديد “يريد تعليمات ...
مع طرح GPT-5.6 لخمسة أو ستة إعدادات لجهد الاستدلال لكل حجم، أصبح التحكم في الجهد ركيزة أساسية لنماذج الاستدلال. نتناول هنا وصفة التدريب الكامنة خلف التسمية ن...
أطلقت SenseTime نموذج 日日新 SenseNova U1 برخصة Apache 2.0. تعتمد بنية NEO-Unify التي تلغي كلاً من المشفر البصري و VAE، وتعالج الفهم والتوليد والتحرير والتوليد ...
دفعت صدمة الذاكرة تكلفة امتلاك البنية التحتية للذكاء الاصطناعي إلى أعلى مستوى في تاريخها، بينما خفض نموذج كيمي K3 والنماذج الصينية مفتوحة الأوزان تكلفة استخد...
أعلنت OpenAI أن GPT-5.6 Sol سجل رقماً قياسياً جديداً في ساحة اختبار سيبرانية. عندما تبدأ النماذج المتقدمة بتنفيذ سلاسل هجوم حقيقية بشكل مستقل، تنتقل نقطة الح...
بنينا أداة مفتوحة تُشخّص أي مرحلة من وكيل الصوت لديك هي نقطة الاختناق، دون أي SDK من مزود، وقسنا مكدسنا الفعلي (Qwen3-ASR وVoxCPM2 وQwen3-TTS) على وحدة RunPo...
تدّعي ktransformers أنه يمكنك تشغيل نموذج MoE ضخم على بطاقة GPU واحدة بسعة 24 جيجابايت عبر نقل الخبراء (experts) إلى وحدة المعالجة المركزية. اختبرنا الادعاءا...
يمكن تشغيل Kimi K3، الذي يصفه كثيرون بأنه من فئة Fable 5، داخل وكيل طرفية مفتوح المصدر بدلًا من بيئة تطوير مغلقة مملوكة. ثبّتنا OpenCode للتحقق من مسار اتصال...
معظم تكلفة وكيل الذكاء الاصطناعي ليست في الحكم الذكي، بل في قرارات بسيطة متكرّرة آلاف المرات يوميًا. افصل هذه المهام إلى نماذج صغيرة متخصّصة تعمل على بنيتك ا...
أطلقت Moonshot نموذج Kimi K3، أكبر نموذج مفتوح الأوزان في العالم حتى الآن. المثير ليس فقط تفوقه على أفضل النماذج المغلقة في اختبار برمجة الواجهات الأمامية، ب...
عند نشر نموذج لغوي كبير في خدمة حقيقية، تتحدد معظم التكلفة ليس باختيار النموذج، بل بمحرك الاستدلال الذي يشغّله. نستعرض كيف يقلل vLLM من هدر GPU عبر PagedAtte...
تجاوز نموذج كيمي K3 الصيني كلود في لوحة صدارة البرمجة، لكن وادي السيليكون استقبل الخبر ببرود. وفي الأسبوع نفسه، أجّلت جوجل جيميناي 3.5 للمرة الثالثة. والحقيق...
إذا كان فريقك قد واصل توسيع كتالوج مهارات الوكيل (agent skills) أو أدوات MCP، فمن المرجح أنك لاحظت في مرحلة ما تراجع دقة التوجيه (routing accuracy). ماذا لو،...
عرض Cormac Brick من Google AI Edge حالة رفع فيها ضبطُ نموذج FunctionGemma بحجم 270 مليون معامل الدقةَ في مهمة وكيل محددة من 46% إلى 90%. الجوهر هو تشغيل نموذ...
تُقلّص نسخ Hy3 من Tencent بصيغة GGUF بدقة 1-bit و4-bit نموذج MoE بحجم 295B من 598GB إلى 85.5GiB ليعمل على وحدة معالجة رسومات واحدة. لكن المقصود بـ«وحدة واحدة...
في الإصدار v2.1.101 أعاد Claude Code تسمية /simplify إلى /code-review وأضاف مستويات الجهد إلى المراجعة. يعيد المستويان low وmedium عددًا قليلًا من النتائج عا...
كانت الأعمال تنتهي كملفات ماركداون ثابتة. الآن أصبحت تطبيقات حية تستدعي الموصلات. نستعرض كيفية بناء لوحة معلومات تسحب بيانات جديدة في كل مرة تفتحها.
أي فريق يفكر في تكليف عميل LLM بمعالجة حوادث GPU في K8s عن بُعد سيصطدم في النهاية بهذا السؤال: إلى متى نترك العميل يصلح الأمور بمفرده، ومتى نستدعي الإنسان؟ ن...
آبل، رمز التكامل الرأسي، تتخلى عن رقاقاتها الخاصة وتستأجر وحدات معالجة رسوميات جوجل بل ونماذج منافسة صينية. في اليوم ذاته، تندفع كوريا الجنوبية في الاتجاه ال...
لا يُعد Bonsai 27B، الذي أصدرته PrismML، نموذجا تم تدريبه من جديد، بل هو نتيجة ضغط أوزان Qwen3.6-27B إلى صيغتي 1-bit وternary مع إبقاء البنية المعمارية كما ه...
يوم كامل مع ست نوافذ طرفية مفتوحة، تنتظر الردود وتضغط Enter فحسب. هذا النوع الجديد من العمل، المسمى multi-Clauding، يستنزف تركيز المطورين بهدوء. نبحث في السب...
المكاسب المنسوبة إلى الأدوات ذاتية التطور هي في الحقيقة مزيج بين ‘القدرة على إنتاج تحديثات جيدة’ و’القدرة على استخدام تلك التحديثات جيدًا’، متشابكتان داخل حل...
إذا لم يستطع الوكيل العمل بفعالية داخل قاعدة الكود، فذلك ليس فشلا في النموذج، بل فشل في الأتمتة. نقل المعرفة التخصصية إلى البنية التحتية هو امتداد طبيعي لما ...
بمطالبتين فقط بلغة طبيعية يُسلَّمان إلى وكيل برمجي، ينتهي التدريب اللاحق لنموذج رؤية أساسي في يوم واحد. نشرّح مهارة وكيل NVIDIA، وننظر إلى ما يمكن أن يُنقل م...
بدأنا معتقدين أن الضبط الدقيق سيفوز، لكن البيانات قلبت التوقعات. نلخّص هنا كيف حصلنا على مولّد يحافظ على قواعد TDS دون أي تدريب، وصولًا إلى الدرس التالي: الش...
حتى الآن كان يجب بناء كل بنية نموذج مرتين: مرة في Transformers للتدريب والبحث، ومرة أخرى في vLLM للاستدلال الإنتاجي. خلفية Transformers بالسرعة الأصلية في vL...
عند تدريب أو تقديم نموذج كبير موزّع على عدة مسرّعات، لا تكون عملية الحساب هي عنق الزجاجة الحقيقي، بل البيانات المتنقلة بين المسرّعات. يشرح هذا المقال ماهية ا...
شارك أحد المطورين نصيحة: حين تُسند إلى Codex هدفًا /goal صعبًا حقًا، اطلب منه أولًا أن يكتب الهدف بحيث يستطيع خيط آخر تحقيقه. يبدو الأمر لعبًا بالكلمات، لكنه...
حتى في عصر تقرأ فيه نماذج الرؤية واللغة الخفيفة جدًا، التي تقل معاملاتها عن مليار، المستندات جيدًا، لا تزال المستندات الصعبة حقًا بحاجة إلى نموذج كبير. نقدّم...
السؤال ليس ما إذا كان GPT-5.6 أذكى، بل من يقدّم تلك الرموز بتكلفة أقل وسرعة أعلى، لأن ذلك هو ما يحدد الهامش. نرسم خريطة للطبقات الخمس في المكدس التي تتجاهلها...
كثير من الفرق تعرف كيف تقلّص نموذجا إلى 4 بت باستخدام Unsloth. لكن لحظة اتخاذ القرار بوضع ذلك الملف على EC2، أو تغليفه في نقطة نهاية SageMaker، أو تشغيله كحج...
ادعى أحدهم أنه قلّص GLM-5.2 من 1403 غيغابايت إلى 980 غيغابايت. لا تكميم ولا تشذيب، بل ضغط بلا خسارة مطابق للأصل بت ببت. كان من الصعب تصديق ذلك، لذا فتحنا 490...
لم يطلب اتحاد المصارف الكوري نموذجا أكثر ذكاء، بل طلب ترتيبا لتبني الذكاء الاصطناعي. حين نفحص تحركات القطاعات الخاضعة للتنظيم اليوم عن قرب، يتضح أن نقطة الحس...
تُدقق هذه الدراسة خط أنابيب مستقلاً بالكامل يُنتج بحثاً كل ليلة، ليس عبر فحص المخرجات النهائية بل عبر فحص سجلات تشغيله الفعلية. وعلى مدى ثمانية أيام، تكشف ال...
طالما اقتصرت وكلاء البرمجة على قراءة النص فقط. يربط claude-video بشكل رقيق بين yt-dlp وffmpeg وWhisper ليحوّل فيديوهات YouTube وZoom وLoom أو الملفات المحلية...
عندما تُعرّف مهام الشركة المتكررة كمهارات، يمكن الإجابة عن السؤال الذي يحدد إلى أي مستوى نموذج يمكن أن تنحدر كل مهارة فعليا بالقياس لا بالحدس. النموذج الأكثر...
لمهندسي الخدمة الذين يشغّلون نماذج MoE على عناقيد من فئة H200 أو Blackwell، نقدّم ورقة بحثية تُصيغ RASQ، وهي سياسة تكميم NVFP4 تحمي بشكل انتقائي الموجّه والخ...
وكلاء البرمجة مثل Claude Code وCodex مرتبطون بشكل وثيق بواجهة برمجة تطبيقات Anthropic. يضع free-claude-code وسيطاً متوافقاً مع Anthropic بين الطرفين، فتحتفظ ...
صدر vLLM v0.25.0 بـ 558 التزامًا (commit) من 232 مساهمًا. يتمحور هذا الإصدار حول تغييرين رئيسيين: أولًا، أصبح Model Runner V2 هو مسار التنفيذ الافتراضي لجميع...
عندما تنخفض الأسعار، هل نستهلك أقل؟ في سوق الاستدلال (inference) يحدث العكس تماما. نقرأ التناقض بين حرب أسعار التوكنات المخفضة إلى النصف وقفزة تقييم سامبانوف...
إذا شُغّلت مهارات الوكلاء عبر واجهة نموذج حدودي فقط، تتضخم التكلفة مع آلاف الاستدعاءات. رفعت أبحاث النصف الأول من عام 2026 مسار تقطير هذه المهارات في نماذج ص...
ننتقل من بنية يستخدم فيها كل شخص عاملاً واحداً، إلى بنية يتحدث فيها عدة أشخاص وعدة عوامل مع بعضهم البعض في مساحة العمل نفسها. انطلاقاً من Claude Code متعدد ا...
مبدأ إغلاق كل عملية fan-out بتحقق عدائي أصبح شائعاً على نطاق واسع، لكن مستوى نموذج التحقق وعدد المدققين المشككين المطلوبين لم يُحدد عبر القياس الفعلي بل بالع...
عند تدريب مهام الوكلاء الطويلة عبر التعلّم المعزز، يُبقي أخذ العينات الجماعي في GRPO وحدات GPU عاطلة في انتظار أبطأ rollout. استخدمت جامعة تسينغهوا وZ AI طري...
تعمل الوكلاء طويلة المدى ضمن ذاكرة محدودة، لكن أساليب الذاكرة حتى الآن كانت تنظّم الماضي وفق معايير وصفية مثل الصلة أو جودة التلخيص. هذه الورقة، التي شارك في...
هناك فرق حقيقي بين من يحمل ملف GGUF من Hugging Face ويضغط زر التشغيل فقط، ومن يعرف بالضبط أي المصفوفات (tensors) مخزنة وبكم بت داخل ذلك الملف. قمنا فعليا بتح...
عند وضع Mac Mini في السحابة، ينعدم وجود واجهة رسومية تتيح رؤية محاكي iOS. يبث serve-sim الإطارات المرئية للمحاكي إلى المتصفح، ويفتح أيضاً قناة تحكم عبر WebSo...
يمنح personal-monorepo-template الذي كشف عنه مهندس فريق OpenAI Codex، jxnl، العامل البرمجي ذاكرة دائمة عبر بنية مجلدات وملف AGENTS.md فقط، دون قاعدة بيانات م...
نحلل بنية الفصل بين الموجّه والعامل في إضافة fable-advisor، حيث يقود Claude Fable 5 كتابة المواصفات ومراجعة الفروقات (diff)، بينما يتولى Grok 4.5 وحده كتابة ...
قارن باحثون من Yale وجامعة Chicago بين أفكار البحث البشرية وأفكار LLM باستخدام 11,683 ورقة بحثية حقيقية. الخلاصة مفاجئة. مشكلة أفكار LLM ليست في الجودة، بل ف...
يقيس ARC-AGI-3 قدرة العميل الذكي على فهم الموقف والتكيّف بنفسه داخل لعبة تفاعلية بلا تعليمات. حقق GPT-5.6 Sol أول اختراق لهذا المقياس بنسبة 7.78%، وكان الداف...
التيار السائد اليوم في التدريب اللاحق بالتعلم المعزز هو عائلة GRPO التي تتخلى عن الـ critic. لكن GLM-5.2 عاد إلى PPO بإحياء نموذج القيمة، وعالج عدم التطابق ب...
بعد أن توصل تشخيص سابق إلى أن السبب الحقيقي لفشل التوجيه في نظام مهارات كبير هو محرك الاسترجاع وليس التفكيك، تقيس هذه الدراسة تجريبياً ما إذا كان نقل يد الإص...
كشفت SpaceXAI عن Grok 4.5. تم تدريبه من الأساس للبرمجة والوكلاء، ويقدم أداءً بمستوى Opus مقابل 2 دولار لكل مليون رمز إدخال و6 دولارات لكل مليون رمز إخراج. نس...
دفعت شريحة HBM4 سعر رف خادم واحد إلى 21 مليون دولار، وجمعت SK hynix ما يعادل 40 تريليون وون في يوم واحد. الآن وقد أصبح رأس المال والطاقة هما الاختناق الحقيقي...
رقمان صدرا في اليوم نفسه تحركا في اتجاهين متضادين تماما: رف ذكاء اصطناعي بـ21 مليون دولار، ورسوم استدلال أرخص بـ34 ضعفا. إليك المقابض التي يجب أن تمسك بها ال...
بدأت مايكروسوفت بتوجيه طلبات الذكاء الاصطناعي الجماعية من Excel وOutlook إلى نماذجها الخاصة، وأصبحت النماذج الصينية المفتوحة تعالج ما يقارب نصف استخدام الذكا...
مهارة Claude Code تحوّل طلبًا بسيطًا إلى صفحة هبوط احترافية. نفكّك آلية عملها الحقيقية ونتحقق منها من منظور Paxis حيث تُعامَل المهارات كموارد من الدرجة الأولى.
لنظام يوجّه مئات المهارات، يخبرنا هذا التشخيص برقمين اثنين إن كان الاستثمار القادم يجب أن يذهب إلى التفكيك أم إلى المسترجِع. تبيّن أن الإجابة المقيسة لم تكن ...
يدمج AgeMem إدارة الذاكرة طويلة وقصيرة المدى داخل سياسة الوكيل، ويكشف عمليات التخزين والاسترجاع والتلخيص والحذف كأفعال قائمة على الأدوات. نحلّل المنهجية وتدر...
قدّمت SpaceXAI نموذج Grok 4.5 بأداء قريب جداً من Opus 4.8 وGPT-5.5، لكن بسعر أقل من النصف. حين تضيق الفجوة بين النماذج إلى نقطة أو نقطتين في الاختبارات المعي...
يضع Claude Fable 5 من Anthropic معيارًا جديدًا في توليد واجهات الويب الأمامية. نستعرض هنا، استنادًا إلى دليل عملي منشور ومعرض مفتوح المصدر حقيقيين، سير عمل ي...
يوم مليء بأخبار توسّع حواس الذكاء الاصطناعي واكتسابه لأيدٍ فعلية. لكن السؤال الذي يحدد التبني الفعلي ينتقل من الأداء إلى الدليل. أعدنا قراءة نشرة اليوم من هذ...
أربع آليات تجعل Claude Code يعمل دون مراقبة بشرية لكل خطوة: الوضع الرأسي (headless) والخطّافات (hooks) والوكلاء الفرعيون والمهارات. نتحقّق من كلٍّ منها مقابل...
في يوم تفوق فيه نموذج بـ1.1 مليار معامل على نظير له بـ7 مليارات، وأُتيحت فيه أفضل النماذج مجانا، لم يكن الخبر الذي أوقف الشركات فعلا عن الذكاء، بل عن سجل الس...
نماذج الرؤية ونماذج اللغة المدرَّبة على بيانات مختلفة ولأهداف مختلفة بدأت تمثّل البيانات بالطريقة نفسها. تجادل فرضية التمثيل الأفلاطوني (Platonic Representat...
يجب على المستشفيات والبنوك والجهات الحكومية التي تشغّل منصات ذكاء اصطناعي محلية (on premises) أن تثبت للجهات التنظيمية أمرين: أن البيانات لم تتسرب خارج الحاو...
في السابع من يوليو 2026 نشرت Anthropic أول وثيقة رسمية عن هندسة الحلقات بعنوان ‘Getting started with loops’. إنها تحوّل من أن يوجّه الإنسان كل خطوة بأمر، إلى...
أصبح استخدام نموذج لغوي كبير كمقيّم، وهو ما يعرف بـ LLM-as-a-judge، الممارسة الافتراضية في تطوير النماذج، لكن الأدلة التي تراكمت خلال عام 2026 تظهر أن الحكم ...
في المستودعات أحادية الجذر (monorepo)، عندما تتنقل بين مجلد مكتبة ومجلد خدمة تستهلكها، تؤدي إعادة تشغيل الجلسة إلى فقدان سياق المحادثة وإبطال ذاكرة التخزين ا...
معظم المطورين يتخطون الإعداد وينتقلون مباشرة إلى كتابة الأوامر النصية (prompts). هذا خطأ. نشرّح هنا بنية مجلد .claude/ الممتدة من CLAUDE.md إلى rules وcomman...
من نشرة dair.ai الأسبوعية لأوراق الذكاء الاصطناعي، نتعمق في قراءة ثلاث أوراق بحثية من منظور ThakiCloud. RLMF الذي يتفوق على التعلم المعزز القياسي بنسبة تصل إ...
يقوم خط الدفاع الأساسي في ضبط الذكاء الاصطناعي (AI control)، القائل بأن النموذج القوي غير الموثوق يمكن ضبطه عبر نموذج إشراف أضعف موثوق به، على افتراض أن نموذ...
يتعامل تقرير Google DeepMind المكوّن من نحو 57 صفحة From AGI to ASI مع الذكاء الفائق لا كتجربة فكرية بعيدة بل كمشكلة تخطيط ينبغي الاستعداد لها الآن. يرسم أرب...
يقيس تقرير ATOM النماذج اللغوية المفتوحة عبر التنزيلات واستخدام الاستدلال في مكان واحد، ويُظهر بالبيانات أن النماذج المفتوحة الصينية تجاوزت المعسكر الأمريكي ...
كلما تحسّنت النماذج اللغوية الكبيرة ومهارات الوكلاء، ينتشر في الصناعة شعور بأن fine-tuning (الضبط الدقيق) لم يعد ضروريا. بل إن OpenAI بصدد إيقاف واجهة برمجة ...
نحلل، باستخدام نموذج roofline، المفارقة التي تجعل DeepSeek V4 Flash بحجم 284B مليار معلمة يسعّر رموز الإخراج بأرخص بخمسة أضعاف من Qwen3.6 بحجم 35B. من قراءات...
نتحقق من حالة خدمة GLM-5.2 743B MoE على عقدة واحدة من AMD MI355X بمعدل 2,626 tok/s لكل عقدة، بتكلفة أقل بأكثر من الضعف مقارنة بـ Blackwell، من زاوية تكميم MX...
الفجوة بين آلة تعمل ومبدأ نفهمه من أقدم المشاهد في تاريخ العلم. في عصر يحل كل شيء بالقوة الحاسوبية، تعيد هذه المقالة قراءة عصر التعلم العميق بعدسة الطاقة وال...
نستعرض دليل Anthropic الرسمي لأفضل ممارسات الموجّهات للنماذج الأحدث. فروق النماذج، والتقنيات الأساسية (الوضوح، الأمثلة، XML، سلسلة التفكير، الأدوار، التسلسل،...
انطلاقًا من أدلة بناء حاسوب الذكاء الاصطناعي الشخصي التي شاركها tom_doerr والتي تصل إلى 384GB من ذاكرة VRAM، نحسب كيف تحدد ذاكرة VRAM النماذج التي يمكن تشغيل...
نحلّل نصائح سير العمل مع Claude Fable 5 التي شاركها Theo مبتكر T3: مستويات الجهد، وتنسيق Codex، وأولوية النماذج في CLAUDE.md، وإسناد المهام كثيفة الرموز. ونض...
توسّعت ميزة Artifacts في Claude Code لتتجاوز خطتي Team وEnterprise إلى خطتي Pro وMax. نحلّل الميزة التي تحوّل جلسة برمجية إلى صفحة ويب حية قابلة للمشاركة، ون...
معظم مهام الوكلاء لا تحتاج إلى نموذج طليعي. حين تُبنى المهارة مرة واحدة بنموذج مكلف ثم يُنقل التنسيق إلى الكود، يمكن تشغيل الجودة نفسها بنموذج أرخص. يقيس Pax...
قسنا فعلياً عدد الرموز المُولّدة في الثانية عبر التوازي على مستوى المُوتِّرات، والتوازي على مستوى البيانات، وفصل Prefill/Decode (1P1D) لنموذجَي Qwen3.6-27B-N...
مهارة /dataviz المضافة في الإصدار 2.1.198 من Claude Code تحمّل إرشادات تصميم الرسوم البيانية ولوحات المعلومات مباشرة إلى السياق. نستعرض قاعدة الشكل، وصيغة ال...
أعادت NVIDIA تكميم Qwen3.6-27B إلى NVFP4 ليُخدَم على GPU واحدة من Blackwell عبر vLLM مباشرةً. نفكّك كيف تُوائم الدقة المختلطة (MLP بصيغة NVFP4 والانتباه وذاك...
نحلل دليل التوجيه الرسمي الذي أصدرته Anthropic لنموذج Claude Fable 5. يطرح الدليل خمسة مبادئ: التخلص من التعليمات التي كُتبت للنماذج القديمة، ومراجعة التقدم ...
إذا كنت تشغّل LLM في الإنتاج ولا تستطيع أن تشرح لماذا يستهلك KV Cache هذا القدر من الذاكرة، أو ما الذي يوفره GQA بالضبط، فإن التحسين يصبح مجرد تخمين. مستودع ...
نموذج Qwen3.6-27B-NVFP4 من NVIDIA يضغط نموذج استدلال بـ 27 مليار معامل ذا انتباه هجين إلى 4 بت، فيخفض الذاكرة بنحو 2.5 ضعف مع إبقاء فجوة المعايير ضمن نقطة وا...
الطلبات القصيرة التي تنتظر خلف الطلبات الطويلة في قائمة انتظار واحدة تُهدر وقت GPU في صمت — وهذا ما يُعرف بـ HoL Blocking. يقترح أسلوب Dual-Pool Token-Budget...
في عصر تتشابك فيه الهندسة والمنتج والتصميم والبيانات في كتلة واحدة، يستعرض هذا المقال النماذج الأصيلة الخمسة التي رصدها Boris Cherny صانع Claude Code، وصيغة ...
في منتصف عام 2026، باتت النماذج مفتوحة الأوزان على بُعد ثلاثة إلى ستة أشهر من الحدود الأمامية، والفجوة لا تتسع. القرار الحقيقي الآن لم يعد عن أداء النموذج، ب...
نقطة التفتيش GLM-5.2-NVFP4 التي أصدرتها NVIDIA تتيح تقديم نموذج MoE بحجم 469B على عقدة Blackwell واحدة (8× RTX PRO 6000) باستخدام vLLM. نحلّل بنية التكميم ال...
شاركها midudev فانتشرت بسرعة. مهارة video-use من فريق browser-use مفتوحة المصدر ومجانية بالكامل: ضع اللقطات الخام في مجلد، اكتب جملة واحدة، ويتولى الوكيل الب...
تم فتح المصدر بالكامل لإطار البنية التحتية للتعلّم المعزّز غير المتزامن slime، وهو الذي قاد مرحلة التدريب اللاحق للنموذج مفتوح الأوزان GLM-5.2 من Z.ai بسياق ...
وصفة الرئيس التنفيذي لـ Coinbase بريان أرمسترونغ للتحكم في كلفة الذكاء الاصطناعي لم تكن حدود الاستخدام ولا تنبيهات الإنفاق، بل إعدادات افتراضية أفضل وتوجيه و...
Ornith-1.0 الصادر عن DeepReinforce في 25 يونيو 2026 هو عائلة نماذج برمجة مفتوحة المصدر تعتمد آلية التسقيل الذاتي (self-scaffolding)، حيث يكتب النموذج بنفسه س...
كمّمت NVIDIA نموذج الاستدلال GLM-5.2 من ZAI (MoE بحجم 753B) إلى NVFP4 (4 بت) ونشرته على Hugging Face. بدلاً من سحق كل الأوزان إلى 4 بت، تُكمَّم فقط المعاملات...
مشروع مفتوح المصدر يُحوّل خبرة الأستاذ في كتابة الأوراق البحثية إلى حزمة Skill قابلة للاستدعاء من Codex أو Claude Code أو Gemini. نستعرض الفارق عن مجموعات ال...
نعيد اختبار المفهوم الشائع بأن Ollama سهل وvLLM سريع، باستخدام معايير أداء RTX 4090 المنشورة عام 2026. الفجوة لا تتجاوز 13% عند مستخدم واحد، غير أنها تبلغ نح...
تقتصر معظم أدلة المبتدئين في وكلاء الذكاء الاصطناعي على شرح أربعة مكونات: دماغ نموذج اللغة الكبير، والذاكرة، والأدوات، وحلقة الوكيل. غير أن نقطة الانهيار الف...
أصدرت Google DeepMind نموذج Gemma 4 في أبريل 2026، وهو عائلة متعددة الوسائط مفتوحة الأوزان مكوّنة من خمسة نماذج تمتد من E2B إلى 31B. نشرح رخصة Apache 2.0، وس...
نموذج Gemma-4-26B-A4B-NVFP4 الذي أصدرته NVIDIA يعمل على جهاز DGX Spark واحد (128 جيجابايت من الذاكرة الموحدة) بتوازي 16 ضعفاً، محققاً نحو 18 رمزاً في الثانية...
يُغلّف docker-android محاكي أندرويد في حاوية واحدة ويُشغّله بلا واجهة رسومية. نتحقق من أحجام الصور ومتطلبات KVM وفق التوثيق الرسمي، ونستعرض كيفية تشغيل أحمال...
أداة مفتوحة المصدر تعرض فيديو بدقة 1080p من داخل Claude Code بأمرين من أوامر الشرطة المائلة. استنسخت examples/hello-world وعرضته دون أي مفاتيح API، فخرج مقطع...
يوضح برنامج تعليمي مدته 16 دقيقة نشره مصمم الويب فيكتور أودي كيف يمكن لشخص واحد بناء موقع تسويقي سينمائي كان يُكلّف عشرة آلاف دولار في السابق، وذلك باستخدام ...
تتضمّن Anthropic نموذج Fable 5 في خطط الاشتراك مجاناً حتى 22 يونيو فحسب، ومن 23 يونيو ينتقل إلى نظام الدفع حسب الاستخدام. تستعرض ThakiCloud اقتصاديات طاقة ال...
مقارنة بين رؤى هاسابيس وهوانغ وأموداي، الذين يقرؤون الموجة الذكائية الاصطناعية ذاتها من خلال ثلاثة عدسات مختلفة: الذكاء الاصطناعي العام، والبنية التحتية، وسو...
حين تتحقق رؤية الرئيس التنفيذي لـ NVIDIA جنسن هوانغ بـ’مئات الوكلاء لكل مهندس’، كيف يجب أن تتغير الهياكل التنظيمية وأساليب العمل؟
انطلاقًا من تصريح الرئيس التنفيذي لشركة DeepMind بأننا ‘لسنا قريبين على الإطلاق من الذكاء الاصطناعي العام’، نستعرض لماذا ينبغي لمنظمات الذكاء الاصطناعي أن تج...
انطلاقاً من لقب أطلقه المراقبون السوقيون على جنسن هوانغ، وتعمقاً في إرث Moneyball، كيف نُرسّخ ثقافة قرار تتفوق فيها البيانات على الحدس داخل المنظمة
حين يقترب التكلفة الحدية للكود من الصفر، تنتقل قيمة فريق الهندسة من ‘ماذا نبني’ إلى ‘معرفة ما يجب بناؤه’.
يحتفظ Kimi K2.6 من Moonshot AI ببنية MoE تُنشّط 32B معاملًا فقط من أصل تريليون، محققًا تكلفة استدلال مماثلة لنماذج dense بحجم 32B مع دعم سياق 256K ومعالجة مت...
يعالج GLM-5.2 من Z.ai سياقًا بطول مليون رمز بتوفير 2.9x في FLOPs باستخدام DSA (الانتباه المتفرق الديناميكي). ترخيص MIT يتيح النشر المحلي بحرية، وتتوفر 29 نسخ...
FastContext-1.0-4B-SFT الصادر عن Microsoft هو نموذج وكيل فرعي مبني على Qwen3-4B ومخصص لاستكشاف مستودعات الشفرات. يستخدم ثلاثة أدوات فقط: READ وGLOB وGREP، وي...
أطلق Google DeepMind نموذج DiffusionGemma-26B-A4B-it، وهو نموذج متعدد الأوضاع مبني على بنية MoE، غير أنه يعتمد الانتشار المتقطع للنصوص بدلاً من التوليد التلق...
Vibe-Coding-Instruct الذي نشره lazarus19 مجموعة بيانات بأزواج تعليمات واستجابات برمجية تضم 1.1 مليون عينة برخصة Apache-2.0. استُخدمت بالفعل لتدريب 7 نماذج مش...
مجموعة بيانات تضم 4,665 أثراً لجلسات وكيل Fable 5 (Claude Code) نشرها Glint-Research. رخصة AGPL-3.0، بتنسيق HF Agent Traces، وتكوين tool-use بنسبة 81%. دليل ...
agents-last-exam مجموعة بيانات معيارية لتقييم وكلاء استخدام الحاسوب عبر 153 مهمة طويلة الأمد في خمسة مجالات: Business وComputing وEngineering وLegal وغيرها. ...
تعلم كيفية استخدام Goclone، أداة قوية لاستنساخ المواقع تعتمد على Go لتنزيل مواقع الويب الكاملة بما في ذلك HTML و CSS و JavaScript والصور إلى جهازك المحلي.
إتقان إطار RAGLight مع أمثلة عملية تغطي RAG، Agentic RAG، RAT pipelines، وتكامل MCP لبناء أنظمة توليد معززة بالاسترجاع قوية.
تعلم كيفية إنشاء محفزات عالية الجودة وقابلة لإعادة الاستخدام باستخدام إطار عمل LangGPT المنظم. حول هندسة المحفزات الفوضوية إلى منهجية منظمة مع القوالب والأمث...
تعلم كيفية تشغيل حاويات Docker بدون صلاحيات الجذر باستخدام udocker - مثالي لبيئات الحوسبة عالية الأداء والأنظمة المشتركة والتشغيل الآمن للحاويات.
تعلم كيفية إعداد واستخدام Shannon، منسق وكلاء الذكاء الاصطناعي مفتوح المصدر مع أمان على مستوى المؤسسات وضوابط التكلفة ومرونة البائعين. دليل شامل من التثبيت إ...
برنامج تعليمي شامل حول Helm Dashboard - واجهة المستخدم المفقودة لـ Helm التي تبسط إدارة مخططات Kubernetes بواجهة مرئية وسجل المراجعات وإمكانيات الاستعادة الس...
تعلم كيفية إتقان أدوات البرمجة المدعومة بالذكاء الاصطناعي مثل GitHub Copilot وChatGPT وClaude لتسريع سير عمل التطوير وكتابة كود أفضل بشكل أسرع.
أتقن فن تصميم الحلقات الوكيلة الفعالة لوكلاء الترميز بالذكاء الاصطناعي. تعلم ممارسات الأمان واختيار الأدوات واستراتيجيات التنفيذ الواقعية.
أتقن هندسة السياق - النهج الثوري الذي يتفوق على هندسة التوجيهات بـ 10 أضعاف وعلى البرمجة العشوائية بـ 100 ضعف. تعلم كيفية جعل مساعدي البرمجة بالذكاء الاصطناع...
إتقان مكتبة LandingAI’s Agentic Document Extraction لمعالجة المستندات الذكية. استخراج البيانات المنظمة من ملفات PDF والصور والمستندات المعقدة باستخدام قدرات ...
بينما تُعد التميز التقني أساس أي مسار مهني، فإن النمو الحقيقي يتطلب إتقان أربع مهارات أساسية: المهارة التقنية، والتفكير في المنتج، وتنفيذ المشاريع، ومهارات ا...
استكشف مجموعات البيانات والأدوات الأساسية للتدريب اللاحق للنماذج اللغوية الكبيرة، بما في ذلك مجموعات بيانات الضبط الدقيق المراقب وبيانات محاذاة التفضيلات ومن...
اكتشف المجموعة النهائية من مجموعات البيانات العامة المنتقاة عبر مجالات متنوعة، من الزراعة إلى الرياضات الإلكترونية، يحتفظ بها مجتمع البيانات المفتوحة العالمي.
تُطلق NVIDIA مجموعة بيانات استدلال متعددة اللغات تضم ستة ملايين مثال، وتوفر بيانات تدريب عالية الجودة تغطي خمس لغات: الفرنسية والإسبانية والألمانية والإيطالي...
مجموعة بيانات NVIDIA Granary الصوتية متعددة اللغات تضم 640,000 ساعة من التسجيلات الصوتية عبر 25 لغة أوروبية. دليل شامل لخصائصها وأساليب توظيفها.
اكتشف الميزات الأساسية وتطبيقات Rowfill، منصة الذكاء الاصطناعي مفتوحة المصدر التي تنظم ملفات PDF والصور والصوت تلقائياً.
أتقن كيفية تحويل مواقع الويب إلى بيانات جاهزة للنماذج اللغوية الكبيرة وجمع نتائج Google/Bing SERP بكفاءة باستخدام AnyCrawl المبني على Node.js/TypeScript.
تحليل مفصل لمجموعة بيانات Fox والاختبارات المرجعية لمشروع Dolphin الصادر عن ByteDance. تعرف على أحدث تقنيات فهم المستندات المنشورة في ACL 2025 ومجموعة البيان...
استعراض النموذج البصري اللغوي dots.ocr الذي أصدرته RedNote، وكيفية تنفيذ تحليل تخطيط المستندات متعدد اللغات والتعرف الضوئي على الحروف في نموذج واحد.
دليل عملي يوضح المجموعة التقنية الأساسية والكفاءات المطلوبة لبناء تطبيقات التعلم الآلي في بيئات الإنتاج
كيف نتبنى ونطور ثقافة التطوير الجديدة التي جلبتها البرمجة الإيقاعية والبرمجة الوكيلة؟ دليل لبناء ثقافة تعاونية مع الذكاء الاصطناعي، والانفصال عن التقاليد الس...
كيفية الاستفادة من خوارزميات سابر لقياس توافق الفريق من خلال استطلاعات 15 دقيقة والبيانات السلوكية، وتحسين كل شيء من التوظيف إلى الإعداد
كيفية تطبيق استراتيجية مونيبول التي تكتشف القيمة المخفية من خلال البيانات وتحقق أقصى أداء نسبة إلى الموارد في التطوير والمنتج والتوظيف
في عصر الذكاء الاصطناعي، لا يحتاج المطورون لمعرفة كل شيء. استكشف نموذجاً جديداً يحول الجهل إلى قوة من خلال عقلية القرصنة وروح الهندسة العكسية.
نحن نشارك خريطة طريق التعلم لأولئك الذين يريدون بدء هندسة الذكاء الاصطناعي. هذه الخريطة منظمة للسماح بالتعلم التدريجي للمجالات الأساسية لهندسة الذكاء الاصطنا...
تقديم الملف المثالي للمرشح ومعايير التوظيف من خلال 10 كتب يجب قراءتها لتوظيف مهندس البنية التحتية والخلفية وحالات التطبيق العملية.
ثقافة MLOps القائمة على Three Vs (السرعة، التحقق، الإصدار) في ThakiCloud والحالات العملية، بالإضافة إلى معلومات التوظيف للزملاء للانضمام إلينا.
مشاركة المواد المقدمة في KCD Seoul 2025. محتوى حول Thaki Cloud، منصة الذكاء الاصطناعي الوكيلي القائمة على xPU كخدمة
مشاركة ثقافة الشركة والمزايا وقصص المطورين ومعلومات التوظيف في Thaki Cloud والمزيد.
مشاركة مهمة ومبادئ وقيم Thaki Cloud.