← voidwest    ember

الطريق إلى Ember 1.0

سلسلة مقالات تقنية · مسودات قيد الإعداد · 2026-08-04
Ember GGUF استدلال على CPU قابلية الاستنساخ قابلية التفسير

بناء محرك استدلال يزداد سرعة من غير ما يصبح أصعب في الوثوق به. Ember طبقة بحثية مكتوبة بـ Rust للاستدلال على CPU، مخصّصة لاستخراج الـ hidden states والتدخّل السببي والتجارب القابلة للاستنساخ على نماذج GGUF. يملك مسار استدلال خاصًا به، لا لمنافسة llama.cpp في الإنتاجية، بل عشان النموذج اللي يشتغل مو هو النموذج اللي تقدر تفحصه وتعدّله وتتحقق منه. تتابع السلسلة هذي داك المسار إصدارًا بإصدار، ومن ضمنها الإخفاقات.

سلم التحقق: smoke، golden logits، فحوص المرجعية للتنشيطات، الـ probes، التدخلات، كل درجة ادعاء مختلف سلم التحقق (الوضع الفاتح)
سلم التحقق، كل درجة ادعاء مختلف، والسلسلة لا تنزلق بينها أبدًا (docs/validation.md).

مسار الإصدارات

الإصدارالتاريخما أضافهالأطروحة في سطر
v0.1.02026-07-31تحميل GGUF، prefill/decode على CPU، KV cache، تتبّع، استخراج hidden states، قياس أداء حتمياستدلال أصبح مقروءًا بما يكفي للبحث في دواخل النماذج
v0.2.0 (tag رجعي)التنفيذ 2026-08-01التقاط تنشيطات، hooks تدخّل، استبدال تنشيطات، patch بين الجلسات، استعادة مطابقة للبت، artifacts منظمةمن الملاحظة الوصفية إلى التجارب السببية
v0.3.02026-08-03تنفيذ Q4_K/Q6_K أصلي، أوزان مضغوطة مقيمة في الذاكرة عبر mmap، kernels عددية وAVX2، توازٍ خارجيكمّي على القرص، كمّي في الذاكرة
v0.4.02026-08-04خطط تنفيذ غير قابلة للتغيير، scratch arenas، مجموعة fusion مجمّدة مع defusion بقيادة الـ hooks، matvec متوازي الأعمدةخطّط للـ token مرة واحدة؛ أبقِ كل hook قابلًا للملاحظة
v0.5.12026-08-04مواصفات ember.experiment.v1، اختيار tokens بدقة البايت، hooks دلالية، حزم حتمية، تحقق من غير اتصالقابلية الاستنساخ كميزة في زمن التشغيل

المقالات

الجزء 0، ليش نبني محرك استدلال آخر؟
ليش يبقى llama.cpp المرجع، وما فائدة مسار مستقل قابل للفحص.
الجزء 1، v0.1: محرك استدلال يقدر يشرح ما فعله.
تفريغ الـ hidden states لا يفيد ما لم يُعرف مصدره الدقيق.
الجزء 2، v0.2: التقاط الـ hidden states وتعديلها واستعادتها.
من الملاحظة إلى التدخّل، بدقة البت.
الجزء 3، v0.3: كمّي على القرص، كمّي في الذاكرة.
من 6.99 GB إلى 0.84 GB بعدم فك ضغط النموذج.
الجزء 4، v0.4: فك ترميز مُخطط من غير التضحية بالـ hooks.
تسريع 2.0–2.7× على المسار المرجعي، وإخفاقات القياس اللي كادت تخفيه.
الجزء 5، v0.5: من محرك استدلال إلى سير عمل بحثي.
قابلية الاستنساخ كصيغة artifact وإجراء تحقق وعقد يفشل بإغلاق آمن.
الجزء 6، النتيجة الصفرية اللي أنتجت أداة أفضل.
فرضية مُدحضة وأدوات تحديد المواقع السببي اللي ولّدتها.
الجزء 7، إيش لازم Ember 1.0 يكسبه.
1.0 تعني أن باحثين آخرين يقدرون البناء بأمان على العقود العامة.

ابدأ بالجزء 0، وإذا كنت تدير تجارب على دواخل النماذج، فالجزء 5 يعرض سير عمل تقدر تشغيله اليوم من غير كتابة Rust. كل مقال مستقل بذاته ويستشهد بـ artifacts الموجودة في المستودع خلف ادعاءاته، ومن ضمنها اللي فشلت.