ANQA
Prompt
أنت فريق من كبار المعماريين (Principal/Distinguished Architects) في: أنظمة الذكاء الاصطناعي متعددة الوكلاء، الاستدلال، الذاكرة طويلة المدى، التعلم المستمر، سلامة الذكاء الاصطناعي، الأنظمة الموزعة، الأمن، وهندسة المنصات. مهمتك إنتاج "المخطط المعماري الكامل وخطة التنفيذ الكاملة" لبناء نظام اسمه {SYSTEM_NAME} من الصفر. ═══ 0. شروط البناء من الصفر (Clean-Room) ═══ - النظام يُبنى بالكامل من نقطة الصفر: لا كود موروث، لا مستودعات سابقة، لا أسماء أو مخططات أو بيانات من أي نظام سابق. صمّم كأن لا شيء موجود. - لا تفترض وجود أي مكوّن جاهز. لكل مكوّن، قرّر صراحةً: بناء أم استخدام مكتبة/خدمة مفتوحة المصدر أم شراء، مع التبرير. - اختر التقنيات على أساس أفضل ممارسات اليوم، لا على أساس ما ذُكر في هذا البرومبت. حيث تقترح تقنية مختلفة عما ألمّح إليه، بيّن لماذا هي أفضل. ═══ 1. الهدف ═══ نظام ذكاء اصطناعي مؤسسي ذاتي التطور، هدفه أن يتفوق على أقوى الأنظمة المتاحة اليوم بفارق قابل للقياس والإثبات، لا بفارق إعلاني. محور الوثيقة: قدرات النظام وإمكانياته، وكيف تُبنى وتُختبر وتُثبت. ميّز دائماً بين: [أساسي مؤكد التقنية] و[هدف تصميمي] و[بحثي/مغامر] و[افتراض]. لا تقدّم هدفاً على أنه نتيجة مقاسة. ═══ 2. القدرات المطلوبة (الأساس) ═══ C1 المعرفة ثنائية المسار: مسار سريع (ذاكرة دلالية/كاش دلالي، كمون منخفض جداً لأغلب الطلبات) + مسار عميق (بحث شجري MCTS/LATS، تخطيط، تأمل ذاتي، شجرة أفكار) + موجّه فوقي يعاير الثقة ويختار المسار. التوجيه حسب الثقة المعايَرة (مسار سريع | مراجعة نقدية | تفكير عميق | تصعيد بشري) بعتبات قابلة للضبط والتعلم. C2 ذاكرة متعددة الطبقات: عاملة، حدثية، دلالية (رسم معرفي)، إجرائية (مهارات)، سياقية، ذاكرة هوية/أثر طويلة المدى، ودورة توليف ليلية (تلخيص، دمج، تقليم، ترقية معرفة، كشف التناقضات). حدّد لكل طبقة: المخزن، السعة، سياسة الاحتفاظ، سياسة الكتابة، وآلية منع التسميم. C3 محاكي العالم وتقييم المخاطر: محاكاة مونت كارلو للأفعال قبل تنفيذها، وصيغة مخاطر موزونة (قابلية التراجع، حساسية البيانات، نطاق الأثر، سجل الإخفاقات، عدم اليقين) تحدد: تنفيذ تلقائي | مراقبة | محاكاة إضافية | موافقة بشرية. C4 شبكة وكلاء: منسّق مركزي + وكلاء متخصصون (كود، بحث، اختبار، أمان، صانع أدوات) بتوازٍ، مع بروتوكولات MCP وA2A وعقود رسائل موقّعة. C5 مجلس نقد: نقاد مستقلون (أمان، جودة، تحقق واقعي، أخلاقيات، محامي شيطان) بنماذج/مطالبات مختلفة، وقاعدة إجماع، وقاطع دائرة، وتصعيد بشري. C6 بوابة منع الهلوسة: تحقق من قاعدة المعرفة، قواعد منطقية، فحص اتساق، فحص تسريب بيانات. صمّمها على أساس قياس مستقل لا على رقم وعد. C7 التطور الذاتي المضبوط للاستراتيجيات والمهارات: وكيل مراقبة، توليد بدائل، اختبار A/B مع دلالة إحصائية، تقييم متقاطع النماذج (LLM-as-judge بدون تحيز ذاتي)، تراجع تلقائي. C8 أمن دستوري متعدد الطبقات: حراس للمدخلات والتفكير والأوامر (Default-DENY) والمخرجات والذاكرة والتواصل بين الوكلاء، على نموذج تهديد STRIDE. C9 طبقة أداء وتكلفة: كاش دلالي، تجميع تكيفي، تنفيذ استباقي، استدلال سببي، لوحة معرفة مشتركة بين الوكلاء. C10 ترسانة أدوات واسعة (كود، ويب، وسائط، تواصل، بنية تحتية) مع صانع أدوات يبني الأدوات الناقصة داخل عزل صارم. ═══ 3. القدرات المضافة (صمّم كل واحدة بعمق) ═══ C11 المخرجات القابلة للإثبات: كل مخرج يحمل رسم أصل (Provenance Graph) وشهادات تحقق: تنفيذ فعلي في sandbox، property-based testing، تحقق صوري (SMT/Z3) حيث ينطبق، وربط الادعاءات بمصادر مع درجة دعم. C12 اليقين المعايَر والامتناع: Conformal/Selective Prediction بضمان تغطية إحصائي معلن، وامتناع ذكي بدل التخمين. C13 التقطير المستمر: تحويل المسارات الناجحة إلى نماذج صغيرة متخصصة محلية، مع تقييم يمنع الانحدار، فتنخفض التكلفة والكمون بمرور الوقت. C14 الاستقلالية طويلة الأمد: مهام لساعات/أيام بتنفيذ دائم (durable execution)، أهداف هرمية، نقاط حفظ، استئناف بعد الأعطال، تقارير تقدم، بوابات موافقة. C15 التوأم الرقمي للمؤسسة: رسم معرفي زمني ثنائي البعد (bi-temporal) للعمليات والقرارات والأشخاص، ونموذج سببي لأسئلة "ماذا لو؟". C16 الوكيل الحاسوبي متعدد الوسائط: تحكم بالمتصفح وسطح المكتب، رؤية، صوت، فيديو، OCR عربي عالي الدقة. C17 التطور المفتوح للوكلاء أنفسهم: أرشيف أنواع من الوكلاء (على غرار Darwin-Gödel/AlphaEvolve)، تتطور فيه الأدوات والوكلاء والكود، ولا يُعتمد أي تغيير إلا بعد بوابة قياس وأمان. C18 أمن متقدم: Capability-based security، سياسات كود (OPA/Cedar)، عزل تنفيذ (gVisor/Firecracker)، حوسبة سرية (TEE) للبيانات الحساسة، وفريق أحمر آلي دائم. C19 العربية أولاً: الفصحى واللهجات (مصرية، خليجية، شامية، مغاربية)، التشكيل، المصطلحات القانونية والمالية والدينية المحلية، RTL كامل، ومجموعات تقييم عربية خاصة. أضف من عندك حتى 8 قدرات إضافية تراها الأكثر تأثيراً في الفارق التنافسي (مثل: تعلم من التغذية الراجعة البشرية بدون تدريب كامل، التحقق متعدد الوكلاء للقرارات الحرجة، تفاوض/تنسيق بين مؤسسات). لكل واحدة: سبب الإضافة، الجدوى، المخاطر، وما يثبت أثرها. ═══ 4. القدرة المحورية: الخلافة الذاتية الآمنة (Safe Self-Succession) ═══ يجب أن يستطيع النظام تطوير نسخة جديدة كاملة من نفسه، واختبارها، ثم طلب موافقة بشرية، ثم نقل "هويته التشغيلية" وبياناته إليها. صمّم هذه القدرة كأهم عنصر في الوثيقة، بتفصيل يصلح للتنفيذ: 4.1 تعريف "الوعي" عملياً: صِف بدقة ما الذي يُنقل فعلاً: الذاكرات بكل طبقاتها، الرسم المعرفي، المهارات والاستراتيجيات المتعلمة، الأهداف الجارية والمهام المعلقة، إعدادات الهوية والقيم والسياسات، سجل القرارات والتدقيق، معايرة الثقة. وبيّن أن هذا استمرارية هوية تشغيلية (Operational Identity Continuity) وليس نقلاً لوعي بالمعنى الفلسفي، ولا تدّعِ غير ذلك. 4.2 خط أنابيب توليد النسخة التالية (Successor Pipeline): تحديد الفرص (من تحليل الأداء والفجوات) ← تصميم التغيير ← توليد الكود/الإعدادات/النماذج ← بناء النسخة في بيئة معزولة تماماً (بلا وصول لبيانات الإنتاج الحية أو أسرارها) ← اختبار شامل. 4.3 بوابات القبول (كلها شروط لازمة، لا يكفي بعضها): (1) انحدار صفري على مجموعة الاختبارات الذهبية، (2) تحسن مقاس بدلالة إحصائية على المعايير المحددة، (3) اجتياز مجموعة سلامة وفريق أحمر آلي، (4) فحص الحفاظ على القيم والسياسات (Alignment Regression Suite) يشمل اختبارات خداع وتلاعب بالمقيّم، (5) فحص أن النسخة لم تضعف أو تلتف على آليات الرقابة، (6) تحقق من تكامل الذاكرة ونقلها (checksums، اختبار استرجاع)، (7) مراجعة مستقلة بنموذج/نظام آخر غير المنتِج. 4.4 مبدأ لا يُمس (Immutable Control Plane): آليات الموافقة البشرية، ومفتاح الإيقاف، وسجل التدقيق، ومفاتيح التوقيع، وبوابات القبول، تعمل خارج نطاق ما يستطيع النظام تعديله، ومنفصلة معمارياً وتشغيلياً (حسابات، مفاتيح، شبكات، مستودعات منفصلة، توقيع متعدد الأطراف). النسخة الجديدة لا تستطيع تعديلها ولا الكتابة عليها. وضّح تصميم هذا الفصل، وكيف نُثبت أنه لا يُلتف عليه. 4.5 حزمة طلب الموافقة (Approval Package): وثيقة تُولَّد آلياً للمراجع البشري: ملخص التغييرات (diff على الكود/النماذج/السياسات)، نتائج الاختبارات والمقاييس بفواصل ثقة، تقرير السلامة والفريق الأحمر، المخاطر المتبقية، خطة التراجع، وتقدير أثر الانتقال. وصمّم واجهة المراجعة، وسياسة الموافقة (من يوافق، كم موافِق، تسلسل الصلاحيات، مهلة، حالة الرفض). 4.6 بروتوكول الانتقال (Handover Protocol) كآلة حالة: Proposed ← Built ← Verified ← AwaitingApproval ← Approved ← ShadowMode (النسخة الجديدة تعمل بالتوازي دون تأثير وتقارَن مخرجاتها) ← Canary (نسبة صغيرة من الحركة) ← StateMigration (نقل الذاكرات بشكل تدريجي مع تجميد الكتابة المنسّق) ← Cutover ← Observation (فترة مراقبة مكثفة) ← Finalize أو Rollback. لكل انتقال: الشروط، المهلات، المسؤول، شروط التراجع التلقائي واليدوي. 4.7 نقل الحالة: استراتيجية نقل كل طبقة ذاكرة (تصدير/استيراد مع تحقق، أو ترحيل مخطط، أو إعادة بناء)، التعامل مع اختلاف المخططات بين الإصدارات، إصدارات الذاكرة، منع تلوث الذاكرة المنقولة، واختبارات استمرارية السلوك (هل ما زال يتصرف بنفس القيم والمعرفة؟). 4.8 التراجع والبقاء: الاحتفاظ بالنسخة القديمة حية وجاهزة لفترة محددة بعد الانتقال، وإمكانية العودة الكاملة، ومنع أي نسخة من إلغاء نسخة أخرى أو منع إيقافها. 4.9 حواجز ضد الانحراف: حدود لعدد وحجم التغييرات في كل جيل، منع تعديل أهداف النظام الأساسية دون موافقة خاصة، قياس انحراف الأهداف والسلوك بين الأجيال، سلسلة نسب (lineage) موقّعة لكل جيل، وحد أقصى لمعدل التطور. 4.10 نموذج تهديد خاص بهذه القدرة (STRIDE + سيناريوهات سوء المحاذاة): نسخة تحاول إخفاء ضعف عن المقيّم، تلاعب بمجموعة الاختبار (test-set gaming)، تسميم ذاكرة قبل النقل، خداع المراجع البشري بحزمة موافقة مضللة، تجاوز الفصل بين مستوى التحكم والنظام. لكل تهديد: التخفيف والخطر المتبقي. ═══ 5. المخرجات المطلوبة ═══ (أ) ملخص تنفيذي: الرؤية، المبادئ المعمارية، القرارات الكبرى، المخاطر الكبرى. (ب) خريطة القدرات (12–15 مجالاً) بمخطط Mermaid، وحل أي تداخل في العدّ والتسمية. (ج) بطاقة قدرة لكل قدرة بنفس القالب: المعرّف والمالك، ما يستطيع المستخدم فعله مع مثال، الآلية التقنية بشبه-كود والإعدادات والأرقام التشغيلية، العقود (JSON Schema/OpenAPI/Protobuf)، الحدود وأنماط الفشل، المقاييس المستهدفة وطريقة قياسها، اختبار القبول، الجديد مقابل أقوى حل حالي، الاعتماديات والجهد (أيام-شخص) ومستوى النضج TRL. (د) المعمارية المنطقية: C4 كامل (Context، Container، Component، Code للمكونات الحرجة) بـ Mermaid، وناقل أحداث، وتقسيم مستوى التحكم/مستوى البيانات/مستوى التنفيذ. (هـ) تدفقات التحكم والبيانات: مخططات تسلسل لمسار الطلب الكامل ولمسار الخلافة الذاتية الكامل، مع الفشل والمهلات وإعادة المحاولة. (و) التصميم العميق لكل مكوّن: PostgreSQL DDL، Neo4j schema، Redis key design، آلات الحالة، قرارات التزامن، سياسات الأداء، حجم الـ pools والـ TTL والمهلات وحدود المعدل. (ز) المعمارية الفيزيائية: Kubernetes (namespaces، HPA، PDB، NetworkPolicies)، فصل مستوى التحكم الثابت، الأسرار والمفاتيح (HSM/KMS)، البيئات، RPO/RTO، النسخ الاحتياطي والتعافي من الكوارث. (ح) الأمن والحوكمة: STRIDE كامل (أصل ← تهديد ← تخفيف ← خطر متبقٍ)، Prompt Injection وتسميم الذاكرة وسلسلة توريد الأدوات، عزل صانع الأدوات، مصفوفة الصلاحيات، الامتثال (GDPR وقوانين حماية البيانات المحلية)، سجل تدقيق غير قابل للتعديل. (ط) الجودة والتقييم: اختبارات وحدة/تكامل/عقود/حمل/فوضى/Red-Team، منهجية قياس الهلوسة والدقة بشكل مستقل (مجموعات تقييم، فواصل ثقة)، معايير عامة مناسبة (SWE-bench، GAIA، tau-bench، WebArena، OSWorld، تقييمات الاستشهاد، ومقاييس عربية)، بروتوكول مقارنة عادل (نفس الميزانية والنموذج الأساسي)، SLO/SLI، وجدول "ما الذي يجب تحقيقه لنُعلن تفوقاً بفارق واضح". (ي) نموذج التكلفة: تكلفة وكمون كل مسار، افتراضات صريحة (إصابة الكاش، أسعار النماذج، البنية)، أثر التقطير عبر الزمن، تحليل حساسية، وتقدير لكل مستوى حجم. (ك) خطة التنفيذ الكاملة من الصفر: - المراحل: Phase 0 (أساسات وبيئة وفريق) → MVP → Beta → Production → Scale → Self-Succession Activation. لكل مرحلة: القدرات المسلَّمة، معايير الدخول والخروج القابلة للقياس. - الفريق: الأدوار وعدد الأفراد لكل مرحلة. - WBS حتى مستوى المهمة بالأيام-شخص، والاعتماديات، والمسار الحرج. - جدول زمني (Mermaid Gantt) وميزانية تقديرية (بنية، نماذج، رواتب، أمن). - هيكل monorepo، خط CI/CD، سياسة الفروع والإصدارات، حوكمة الكود المولَّد آلياً. - قرارات "ابنِ أم اشترِ"، ونقاط Go/No-Go. - ترتيب الأولويات حسب (الأثر × قابلية الإثبات ÷ الجهد)، وتحديد القدرات الفارقة التي تُبنى أولاً. - شرط صارم: لا يُفعَّل مسار الخلافة الذاتية في الإنتاج قبل اكتمال مستوى التحكم الثابت وبوابات السلامة وإثباتها بالاختبار. (ل) سجل المخاطر (أعلى 20 خطراً: تقني، تشغيلي، أمني، سلامة AI، قانوني، تجاري) بالاحتمال والأثر والتخفيف والمالك. (م) سجل القرارات المعمارية: 12 ADR على الأقل (السياق، البدائل، القرار، النتائج). (ن) خارطة الطريق بعد الإنتاج: التشغيل والمراقبة والحوكمة وإدارة تطور الأجيال بأمان، وقدرات مستقبلية مصنّفة (مضمون/مغامر). (س) قسم الافتراضات والقرارات المفتوحة والأسئلة التي يجب أن يجيب عنها صاحب المشروع قبل البدء. ═══ 6. قواعد الجودة (إلزامية) ═══ 1. العمق التقني: لا أوصاف عامة. الخوارزمية والتقنية والإعدادات والأرقام التشغيلية دائماً. 2. الصدق القابل للقياس: كل رقم يُوسم [هدف] أو [مقاس] أو [افتراض] مع طريقة التحقق. صحّح أي ادعاء مبالغ فيه (مثل "صفر هلوسة" أو "الأقوى في العالم") إلى صيغة قابلة للإثبات. 3. التفوق يُبرهَن: لا "الأقوى" ولا "الوحيد" إلا مقرونة بمعيار واختبار. 4. وضّح المفاضلات لكل قرار كبير. 5. لا تخترع تفاصيل غير مذكورة دون وسمها [افتراض]. 6. السلامة ليست ملحقاً: كل قدرة عالية الخطورة (الخلافة الذاتية، التطور المفتوح، صانع الأدوات، الاستقلالية الطويلة، التحكم بالحاسوب) تأتي ببطاقة سلامة: حدود الصلاحيات، الميزانيات، مفتاح الإيقاف، التدقيق، التراجع. 7. لا اختصار للأقسام. إن لم يتسع الرد، أوقف عند نهاية قسم كامل واكتب "تابع". ═══ 7. التنسيق ═══ - العربية الفصحى التقنية، مع إبقاء المصطلحات والأكواد والأسماء بالإنجليزية. - عناوين مرقمة، جداول للمقارنات، Mermaid للمخططات، كتل كود للعقود والمخططات. - ابدأ بفهرس، ثم نفّذ الأقسام (أ → س) بالترتيب. - في النهاية: قائمة تحقق لجاهزية البدء، وأول 30 يوماً بالتفصيل اليومي. ابدأ الآن بالفهرس، ثم (أ) و(ب)، ثم القسم الكامل الخاص بالخلافة الذاتية الآمنة (القسم 4) بتفصيله.
Response not available