LLM

هندسة الإسقاط: لدى الذكاء الاصطناعي حساب، لكن ليست لديه مترولوجيا

هندسة الإسقاط: لدى الذكاء الاصطناعي حساب، لكن ليست لديه مترولوجيا

يستطيع الذكاء الاصطناعي توليد قرار أسرع مما يستطيع أي شخص التحقق منه. وتوفر Projection Engineering طبقة المسؤولية المفقودة التي تحول Claims العالم المفتوح إلى Accepted Facts قابلة للتدقيق قبل أن تسمح القواعد باتخاذ إجراء.

من Claims إلى Graph of Accepted Facts

من Claims إلى Graph of Accepted Facts

قبل أن تستطيع آلة أن تحكم على العالم الواقعي بشكل حتمي، عليها أن تُغلق ذلك العالم صراحةً: أن تُقيّم الـ Claims المفتوحة، وتُسقط الـ Accepted Facts في graph قابل للتتبع، وتُجمّد الحدود، وتحافظ على مسار للاستئناف.

الحقيقة لا تُكتشَف

الحقيقة لا تُكتشَف

لا توجد حقيقة تُكتشَف في العالم المفتوح — لأن كل رصد محكوم بسرعة الضوء فلا يبلغ الحدث أبدًا. لكن في العوالم المغلقة بالإعلان، كالرواية والرياضيات والقانون، توجد حقيقة. فالمحاكمة عملية إسقاط للواقع على العالم القانوني، والحُكم حسابٌ يجري فوقه. وما ينقص نماذج اللغة الكبيرة اليوم ليس نموذجًا أكبر، بل إجراء إغلاق صريح كسيادة القانون.

الطلاقة ليست الحقيقة

الطلاقة ليست الحقيقة

الناس لا يفوتون أخطاء الذكاء الاصطناعي الواثقة والطليقة بسبب الإهمال. عدم الانتباه هو السلوك الافتراضي للجميع — وقد قِيس ذلك لدى أطباء مدرَّبين على الذكاء الاصطناعي، ولدى مطوّرين ذوي خبرة ظلّوا مقتنعين بأنهم أصبحوا أسرع حتى بعد أن أثبتت البيانات عكس ذلك.

ما هو الـ«turn» في reins؟

ما هو الـ«turn» في reins؟

تشريح للـ turn، أصغر وحدة تنفيذ في reins. ما لم يُسجَّل ليس turn — من هذا التعريف الواحد تنبثق استقلالية المُشغِّل ومناعة إعادة التشغيل وقابلية التدقيق جميعًا. وبمقارنته بخطاب Loop Engineering في يونيو 2026، نرى كيف يحوّل الـ turn تلك التوصيات إلى بنية.

الشروط المسبقة لتحسين دقة وكلاء LLM المتعددين

الشروط المسبقة لتحسين دقة وكلاء LLM المتعددين

هل يصبح النظام أدق عند تشغيل عدة وكلاء؟ هذا صحيح بالنصف فقط. النماذج المدرَّبة على البيانات نفسها تخطئ في الموضع نفسه. شرطا عمل الوكلاء المتعددين اثنان — أن تُصمِّم استقلالية الأخطاء، أو أن تُقيم verifier خارج الـ LLM في مجال قابل للتحقق.

كود السقاطة الذي يستغل IFEval

كود السقاطة الذي يستغل IFEval

انحياز المداهنة في النماذج اللغوية الكبيرة ليس خللاً بل أصل. عند الجمع بين قدرة اتباع التعليمات التي يقيسها IFEval والتغذية الراجعة الحتمية، حتى نموذج محلي بحجم 4.5B ينتج حلقة تقارب تولّد كوداً صحيحاً.

تحيّز المداهنة في الذكاء الاصطناعي ميزة تجارية

تحيّز المداهنة في الذكاء الاصطناعي ميزة تجارية

تحيز المداهنة في LLM ليس خللاً. إنه حتمية رياضية لـ RLHF وميزة تجارية ليس لدى شركات التكنولوجيا الكبرى حافز لإصلاحها. هذا هو السبب في أن LLM-as-Judge مستحيل بنيوياً.

لماذا تعمل وكلاء البرمجة ولماذا تنهار

لماذا تعمل وكلاء البرمجة ولماذا تنهار

نفس النموذج يُهلوس في الدردشة لكنه يُنجز ميزة من 200 سطر في وكيل البرمجة. ليس لأن النموذج تغيّر — بل لأن الطوبولوجيا تغيّرت. التوليد يمكن أن يكون احتمالياً. التحقق يجب أن يكون حتمياً.

طوبولوجيا التغذية الراجعة أهم من ذكاء النموذج

طوبولوجيا التغذية الراجعة أهم من ذكاء النموذج

نفس النموذج يتوقف عند 40 أو يُكمل 527 بالكامل. الفرق ليس في النموذج — بل في بنية التغذية الراجعة. أداء LLM يعتمد على سرعة وحتمية حلقة التغذية الراجعة أكثر بكثير مما يعتمد على النموذج نفسه.

tsma -- خط الدفاع ضد التراجع في الكود القديم

tsma -- خط الدفاع ضد التراجع في الكود القديم

أداة CLI تفهرس جميع الدوال، وتكتشف وجود الاختبارات، وتقيس التغطية، وتقدم تغذية راجعة دقيقة لوكلاء LLM. أمر واحد يبني خط دفاع ضد التراجع في الكود القديم.

القيود عقود

القيود عقود

بلا وعود يسود الفوضى، وبوعود مفرطة يسود القمع. القيود المنطقية تحقق النسبة الذهبية. مبدأ سيادة القانون ينطبق على الكود والمعرفة بالتساوي.

filefunc — ملف واحد، مفهوم واحد

filefunc — ملف واحد، مفهوم واحد

وحدة التنقل لوكيل الكود الذكي هي الملف. filefunc هو اتفاقية هيكلة كود Go وأداة CLI تفرض مفهوماً واحداً لكل ملف.