ترجمة آلية. النص الإنجليزي هو النص المعتمد. English
المهندس الذي يجعل وكيل الذكاء الاصطناعي لديك آمنًا للتشغيل على بيانات العملاء وأموالهم

أصمّم الأنظمة وأوجّه الذكاء الاصطناعي لبنائها. PANTHEON واحد منها: متعدد المستأجرين، خاضع للحوكمة، مُقاس الاستهلاك، في بيئة الإنتاج، بنيته بمفردي.

صممتُ PANTHEON، أي عزل المستأجرين المتعددين والحوكمة وقياس الاستخدام وسلامة الوكلاء، انطلاقاً من المبادئ الأولى، ثم وجّهتُ الذكاء الاصطناعي لبنائه بالكامل: بمفردي، وصولاً إلى الإنتاج، وهو يشغّل بيانات أنشطة تجارية حقيقية. ما أقدّمه هو التفكير المنظومي اللازم لتصميمه، والانضباط لجعل الآلة تثبت أنه يعمل.

Isaac Teague Frayling · كارديف، المملكة المتحدة · مواطن بريطاني · منفتح على الانتقال إلى أي مكان في العالم (أحتاج إلى كفالة خارج المملكة المتحدة وأيرلندا) · سيرة ذاتية من صفحة واحدة →

↑ الصورة الرئيسية، وأيقونة الموقع، والصورة الرمزية، وبطاقة المشاركة الاجتماعية في هذه الصفحة، كلها وُلّدت بواسطة النظام الذي بنيته. العمل صنع ملف أعماله بنفسه.

اعتراف خارجي. مُبلِّغ مُعترَف به (واحد من سبعة) في CVE-2026-104850 (GHSA-6qxp-vccf-f47h)، وهو تحذير أمني عالي الخطورة (CVSS 7.5) في MCP TypeScript SDK: كان بإمكان عميل OAuth فيه إرسال بيانات الاعتماد المخزنة إلى خادم يختاره خادم MCP، وقد أُصلح في 1.31.0 و2.2.0. ليس هذا إثباتًا لصحة PANTHEON، بل فحصًا أجراه شخص آخر على عملي.

لا تكتفِ بكلامي

كل ادعاء هنا مرتبط بفحص يمكنك تشغيله.

لا شرائح عرض، ولا "ثق بي". النظام يعمل مباشرةً، اذهب وحاول كسره، ثم اطلب مراجعة الشيفرة التي خلفه بموجب اتفاقية عدم إفصاح. ما أطلقته حقيقي ويعمل، سواء كتبتُ منه حرفًا واحدًا أم لا.

القيمة

ما أقدّمه فعلًا.

تفكير منظومي يصمد تحت الهجوم

صمّمتُ عزلًا صارمًا متعدد المستأجرين قائمًا على أمان مستوى الصفوف في Postgres، بدورين، ويُغلق عند الفشل، ولم يتمكن أي تدقيق من اختراقه على مستوى قاعدة البيانات. اكتُشف تسريب واحد خارجه (سجل المحادثات، يوليو) وأُصلح. لم أكتب SQL. صمّمتُ النموذج: أنماط الفشل، ونطاق الضرر، وقدتُ البناء حتى صمد.

أصمّم ذكاءً اصطناعيًا خاضعًا للحوكمة، لا لصقًا للأوامر

حلقة الوكيل المحكومة، إدراك → معرفة → أدوات → حكم → قياس، مع الضوابط وبروتوكول الأزمات والقياس المحصّن ضد تجاوز الرصيد وبوابات الموافقة البشرية، من تصميمي. التفكير في طبقة التحكم تفكيري أنا، والذكاء الاصطناعي كتب الكود وفق مواصفاتي.

من الفكرة إلى الإنتاج، بتوجيه الذكاء الاصطناعي

الركيزة، وStudio بلا شيفرة، وفن توليدي مخصص، وقناة Telegram حية (WhatsApp مبنية، بانتظار موافقة Meta)، والقياس، والمصادقة، والنطاقات المخصصة. كل ذلك فكرتي، وكله مبني بتوجيه الذكاء الاصطناعي، من Postgres إلى البكسلات، مُطلق ويعمل، بمفردي.

أجعل الآلة تُثبت عملها

يجب أن يجتاز كل تغيير حدّ نقاء مفروضًا في CI، وعدد آخر تشغيل لـ CI من الاختبارات، وتدقيقات عدائية متكررة خضع فيها كل اكتشاف للدحض قبل أن يُحتسب. توجيه الذكاء الاصطناعي جيدًا يعني رفض الثقة به، وهذه هي المهارة الحقيقية.

حُكم، لا مجرد مُخرَجات

أشحن النسخة الصادقة: كل رقم في صفحة التدقيق يحمل علامة النجمة الخاصة به، والموقع يقول صراحةً ما لم يُحلّ بعد، والأمان، أي وصول رسالة الأزمة إلى المساعدة حتى عند رصيد صفر، يتقدّم على المقياس. أفضّل أن أكون موثوقًا على أن أكون مبهرًا.

أتحرك بسرعة دون الإخلال بالضمانات

كل قدرة جديدة تحافظ على الثوابت نفسها: أداة اختبار بملفات مرجعية (golden-file) تثبت أن التغييرات آمنة على مستوى البايت، وسجل تعديلات يجعل كل تغيير قابلًا للتراجع، وكل ما يضيف سطحًا جديدًا يخضع لمراجعة أمنية عدائية قبل النشر. أتحرك بسرعة دون أن أسمح للآلة بالتهاون.

المنهج

كيف أبني: النسخة الصادقة.

أحدد ما يجب أن يضمنه النظام، ثم أجعله يثبت ذلك. أصمّم النظام وأوجّه الذكاء الاصطناعي لبنائه، وPANTHEON هو ما ينتج عن ذلك. أقرأ كل ما تنتجه الآلة وأقيّمه وأصحّح أخطاءه؛ لا أكتب التنفيذ بدءًا من ملف فارغ. إليك ملامحه:

ما أفعله

صمّم النظام من المبادئ الأولى → قسّمه إلى أجزاء يستطيع الذكاء الاصطناعي بناءها → وجّه الذكاء الاصطناعي لبناء كل جزء → هاجم النتيجة حتى تصمد → أطلقها وأبقِها تعمل في الإنتاج. هذه هي الحلقة، من البداية إلى النهاية.

مفاهيم أعرفها جيدًا

عزل تعدد المستأجرين & حدود الثقة · مستويات الحوكمة & الإنسان في الحلقة · القياس الذري & التحكم في المعدل · حلقات الوكلاء، والأدوات & الضوابط · الدفاع ضد حقن التعليمات · التفكير في أنماط الفشل & نطاق الضرر. صمّمت كل هذه بنفسي. أنا فقط أتحدث عنها بلغة واضحة، لا بالمصطلحات المعقدة.

أنظمة أطلقتها (وأفهمها من طرف إلى طرف)

Postgres مع أمان على مستوى الصفوف · خدمات FastAPI · حلقة وكيل محكومة · MCP في الاتجاهين · واجهات React أمامية · عمليات نشر Docker / nginx. وجّهتُ البناء وأعرف كيف يتصرف كل جزء.

كيف أُبقي الذكاء الاصطناعي صادقًا

حدود النقاء في CI · اختبارات لقطات بملفات مرجعية (golden-file) · عدد آخر تشغيل لـ CI من الاختبارات تنجح (آخر تشغيل لـ CI) · تدقيقات عدائية متكررة: تدقيق بـ 50 وكيلًا وإعادة تدقيق بـ 14 زاوية نظر، وهي الأحدث، حيث يخضع كل اكتشاف للدحض قبل أن يُحتسب. غريزة الشك في الإجابة الأولى للآلة هي العمل كله.

الأدلة، مع التحفّظ مرفقًا بها مسبقًا.

أفضّل أن تثق بالأجزاء الحقيقية على أن تنبهر بأجزاء ليست كذلك.

1عقل، بلا فريق* صُمّم ووُجّه بشكل فردي
CIاختبارات ناجحة* أحدث تشغيل لـ CI، وليس إثباتًا رسميًا
6 → 0عمليات تدقيق · صفر نتائج حرجة قائمة* أُجري ذاتيًا، لا من طرف ثالث
مباشرفي بيئة الإنتاج، مستأجرون حقيقيون* نسخة واحدة. لم أحتج إلى توسيعها بعد
2 → 1أنشطة تجارية، عمود فقري واحد* منصة، لا عرض توضيحي، مُثبت عبر lint

قرار تقديري أخطأتُ فيه

مثال واحد، بما في ذلك خطئي أنا.

قبل أسبوعين اخترتُ فحص الرسائل الإنجليزية بحثاً عن عبارات الأزمات باستخدام قائمة عبارات ثابتة فقط، لإعفاء معظم الرسائل من استدعاء إضافي للذكاء الاصطناعي. أظهر تدقيق في 25 سبتمبر أن القائمة أغفلت "I don't want to live anymore" وثلاث صيغ شائعة أخرى. تراجعتُ عن القرار في اليوم نفسه: عبارات الأزمات تذهب الآن إلى فحص الذكاء الاصطناعي، والأربع كلها اختبارات فشلت على الشيفرة القديمة، والرسائل العادية التي تتحمل كلفة الاستدعاء الإضافي انخفضت من 4 من كل 32 إلى 1. كان التوفير صحيحاً لمعظم الفحوصات وخاطئاً للفحص الذي يكون فيه الإغفال أشد أهمية.

الاتفاق الصريح

ما ستحصل عليه، وما لن تحصل عليه.

المعماري + الموجِّه

أتولى التفكير المنظومي والتسليم عبر الذكاء الاصطناعي: أقرر ما يُبنى، وأصمم كيف يصمد، وأدفعه حتى يُشحن. اجمعني مع مهندسين يتقنون الحِرفة على مستوى السطر التي لا أتقنها، فتحصل على النصفين معًا.

الانضباط الذي لا يملكه الذكاء الاصطناعي من تلقاء نفسه

كل تغيير مهم يخضع لمراجعة عدائية؛ لا أثق أبدًا في الإجابة الأولى للآلة. أمران أنتجتهما هذه الغريزة: التسرّب بين المستأجرين في يوليو، الذي اكتشفه تدقيقي الخاص وأصبح الآن اختبار انحدار، وتنبيه MCP SDK المذكور أعلاه، الذي اكتُشف في شيفرة شخص آخر.

الطلب

ما الذي أبحث عنه.

دور واحد: الشخص الذي يتولّى حدود الثقة لوكيل الذكاء الاصطناعي لديك. عزل المستأجرين، والموافقات، وقياس الاستخدام، والأداة التي تثق بمن يستدعيها: أحدّد أين يمكن أن يفشل، وأبني الضمان في داخله، وأُصدر الاختبار الذي يثبت ذلك. موظف مؤسس أو من أوائل الموظفين في شركة ناشئة لديها وكيل يتعامل مع عملاء حقيقيين، أو على وشك ذلك. أنا منفتح على الانتقال إلى أي مكان في العالم من أجل الفرصة المناسبة، وأهتم بالمشكلة والأشخاص أكثر من المسمّى الوظيفي.

لماذا وظيفة، لا شركتي الناشئة الخاصة؟

سؤال مشروع. كان بإمكاني جمع تمويل لـ PANTHEON، لكنني أعرف بالضبط ما ينقصه، وليس البناء. إنه التوزيع: الشبكة والانتشار اللازمان لوضعه أمام الأعمال التي بُني من أجلها، وهما ما لا أملكه ولن أتظاهر به. أفضّل أن أحمله إلى فريق يملك هذا الانتشار بالفعل على أن أقضي سنوات لأصبح مؤسسًا لست إياه. بناؤه بمفردي أثبت أنني قادر على تصميم الشيء كله وشحنه. أما طرحه في السوق وحدي فلم يكن الخطة قط، ويبقى PANTHEON حيًا كدليل، لا كمشروع جانبي يشتت تركيزي.

اليوم الأول

وجّهني إلى مشكلة، وإليك ما سأفعله أولًا.

ليس «تعلّم أصول العمل لربع سنة». بل المنهج الذي بنى PANTHEON، موجّهًا نحو منتجك:

ارسم حدود الثقة

حدّد حواف تعدد المستأجرين / التفويض / نطاق الضرر واكتشف كيف يفشل كل منها، قبل بناء أي شيء. لا يمكنك حوكمة ما لم ترسمه، والرسم هو ما أفعله.

اكتشف أين أُضيفت السلامة كطبقة لاحقة

اعثر على الأمان الذي أُضيف لاحقًا: العدّاد القابل للسحب على المكشوف، والإجراء غير المحكوم ببوابة، والأداة التي تثق بمستدعيها، وأعد تصميمه بحيث يكون الضمان مبنيًا في الأساس، لا ملصقًا عليه.

وجّه البناء، ثم أثبته

حدّد مواصفاته، ووجّه الذكاء الاصطناعي لبنائه، ثم اشحنه مع الفحص الذي يثبته: اختبار، أو لقطة، أو ثابت (invariant)، كي يتمكن الشخص التالي من التحرك بسرعة دون أن يضطر إلى إثبات كل شيء من جديد.

لنتحدث.

أخبرني بالدور وبما تبنيه. أقرأ كل رسالة بريد إلكتروني وأرد خلال بضعة أيام، ثم مكالمة، وجولة حية في النظام، ومراجعة الشيفرة بموجب اتفاقية عدم إفصاح.

تفضّل التجربة قبل أن تكتب؟ اكسر المساعد، أو هاجم العزل، أو راسل البوت، كل ذلك يعمل مباشرة.

ليس لدي حساب على LinkedIn. النظام الأساسي خاص: النظام العامل هو معرض الأعمال، لكن ستة مكوّنات منشورة على PyPI وnpm، وسجل العيوب علني، والمنهجية قابلة لإعادة التشغيل، وأنا واحد من سبعة مُبلِّغين منسوب إليهم الفضل في تنبيه أمني خاص بـ MCP SDK عالي الخطورة. عرض / تنزيل سيرتي الذاتية →