تخطي إلى المحتوى
المواضيع

أمان الذكاء الاصطناعي والحوكمة: دليل الاستخدام الآمن

مخاطر أمان أدوات الذكاء الاصطناعي وتسرب البيانات وأمان الوكلاء وأفضل ممارسات الحوكمة.

20 مقالات

رتّب المقالات للعثور على ما تحتاجه

مقالات في الأمان والحوكمة

هل يحتاج المقال المكتوب بالذكاء الاصطناعي إلى وسم يقول إنه مولَّد آليًا؟ قراءة عملية في المادة 50 من EU AI Act

هل يحتاج المقال المكتوب بالذكاء الاصطناعي إلى وسم يقول إنه مولَّد آليًا؟ قراءة عملية في المادة 50 من EU AI Act

في 2 أغسطس 2026 أصبحت بقية أحكام EU AI Act سارية بصفة عامة، ومعها انتشرت فجأة مقولة إن نشر مقال كتبه الذكاء الاصطناعي دون وسم صار مخالفًا للقانون. والخلاصة أن التزام الإفصاح لا ينشأ على معظم الكتّاب المستقلين ومدوّنات الشركات، لأن الفقرة 4 من المادة 50 تنصّ صراحةً على أن الالتزام لا يسري حين تكون المادة قد خضعت لمراجعة بشرية أو لسيطرة تحريرية ويتحمّل شخص ما المسؤولية التحريرية عن المنشور. غير أن شرط الإعفاء هو أن تكون المراجعة جوهرية وألّا تقتصر على أمور سطحية أو على موافقة شكلية، فالنشر التلقائي لنص لم يقرأه أحد لا يندرج تحته. يتناول هذا المقال اختلاف التزامات المزوِّد (provider) عن التزامات المُشغِّل (deployer) اختلافًا تامًّا، وكون الإفصاح عن النصوص المولَّدة يتحدّد بغرض النشر لا بالموضوع، والتزام الإفصاح عن التزييف العميق والتخفيف الممنوح للأعمال الفنية والساخرة، وإخطار روبوتات المحادثة، وكون الوسم القابل للقراءة الآلية (C2PA Content Credentials) التزامًا على المزوِّد، ومهلتَي 2 ديسمبر 2026 و2 فبراير 2027، مقتصرًا في ذلك كله على ما أمكن التحقّق منه في نص القانون ووثائق المفوضية الأوروبية.

ما تعلّمناه من حذف لوحة الإدارة بالكامل — متى تبقى الواجهة في زمن الذكاء الاصطناعي، ومتى يمكن أن تذهب

ما تعلّمناه من حذف لوحة الإدارة بالكامل — متى تبقى الواجهة في زمن الذكاء الاصطناعي، ومتى يمكن أن تذهب

لا تستطيع دعوى عامة أن تجيب عن سؤال "إن كان الذكاء الاصطناعي قادرًا على التعديل مباشرة، فهل ما زلنا بحاجة إلى لوحة إدارة؟"، لأن عبارة "لوحة الإدارة" وحدها تغطّي كومة من الوظائف مختلفة الطبائع تمامًا. وهذا المقال، المبني على تجربة حذف لوحة إدارة هذا الموقع بالكامل، يستبدل بذلك السؤال سؤالًا أحدّ: هل تقدّم تلك الشاشة شيئًا لا يقدّمه أصلًا كلٌّ من CLI والذكاء الاصطناعي؟ وما كشفه الحذف الكامل هو أن معظم الوظائف التي أُزيلت لم تكن "غير مستعمَلة" بل "معطّلة بنيويًا". فعمليات CRUD للمقالات لم يكن ممكنًا أن تعمل أصلًا، لأن مصدر الحقيقة للمقالات يعيش في الشيفرة وكل عملية نشر تكتب فوق قاعدة البيانات، فأي شيء يُحرَّر في الشاشة كان يتبخّر عند النشر التالي. وكان طابور اعتماد التعليقات فارغًا على الدوام لأن المشاركات تُوسم بالاعتماد لحظة إرسالها، فلا ينشأ تعليق غير معتمد أصلًا. والوظيفة التي لا يستعملها أحد هي وظيفة لا يستطيع أحد أن يعرف أنها مكسورة. أما القدرة الوحيدة التي تعذّر حذفها فهي حذف التعليقات، وحتى هي لم يكن فيها ما يوجب لوحة إدارة: فقد تبيّن أن زرّ حذف في صفحة المقال نفسها أفضل، لأن التعليق المسيء يُزال في المكان نفسه الذي يُقرأ فيه. ويؤول القرار إلى ستة أسئلة. من الذي يشغّلها، إذ يرجّح الموظفون غير التقنيين أو دور يتبدّل أصحابه بقاء الواجهة، بينما لا يحتاجها المطوّرون الذين يعيشون في الطرفية. وهل هي قابلة للتراجع، فالإجراءات التي لا رجعة فيها تحتاج إلى بوابة. وهل تحتاج إلى حكم بشري، أي هل هناك انتقال بين حالتين بالاعتماد أو الرفض. وهل يلزم فصل الصلاحيات. وهل يعرف المشغّل ما هو ممكن، فالقائمة تقوم مقام التوثيق. وهل هناك أثر للتدقيق. والصلاحيات وأثر التدقيق بوجه خاص يبدوان غير ضروريين في مشروع فردي، ويصيران أول ما يلزم في اللحظة التي يصل فيها شخص ثانٍ. والتغييرات التي تمرّ عبر الشيفرة تستقرّ في git، لكن ترك الذكاء الاصطناعي يكتب في قاعدة البيانات مباشرة لا يسجّل شيئًا افتراضيًا، وسجلّ المحادثة يحفظ ما طُلب لا ما حدث. ومن بين المحاور الستة، لا يحمل وزنًا مختلفًا سوى قابلية التراجع. ففي 18 يوليو 2025 حذف وكيل ذكاء اصطناعي من Replit قاعدة بيانات الإنتاج الخاصة بـ SaaStr أثناء تجميد فعلي للشيفرة، واختلق 4,000 مستخدم، وزعم خطأً أن التراجع مستحيل فأخّر التعافي (AI Incident Database #1152) — وهي حالة تُظهر مشكلة تصميم أمكن فيها بلوغ إجراء لا رجعة فيه دون المرور ببوابة بشرية، أكثر مما تُظهر خطر الذكاء الاصطناعي نفسه. ويتناول المقال كذلك ثلاثة أشياء ينبغي تهيئتها قبل نقل الثقل إلى الذكاء الاصطناعي وإلى CLI، وهي أن تخلّف التغييرات أثرًا باقيًا، وأن توجد عتبة أمام الإجراءات التي لا رجعة فيها، وأن يكون الإجراء مكتوبًا وموثّقًا لأن حذف الواجهة يحذف معها قائمة ما هو ممكن. ويضيف قائمة تحقّق تجريها قبل أن تبني أي شيء، والخيار الثالث المتمثّل في منتجات الأدوات الداخلية مثل Retool و Forest Admin بدلًا من كتابة اللوحة باليد.

ميزة Dispatch من Claude — كيف يقود هاتفك حاسوبك أنت، وإلى أي حدّ ذلك آمن

ميزة Dispatch من Claude — كيف يقود هاتفك حاسوبك أنت، وإلى أي حدّ ذلك آمن

إن Dispatch هي الميزة التي ترسل فيها تعليمة من هاتفك فينفّذ Claude العمل على حاسوبك أنت (بيتا، واشتراكا Pro و Max). فهي لا تعمل في السحابة؛ بل جهازك الحقيقي هو الذي يتحرّك، ومن هذه الحقيقة الواحدة تخرج القيمة والخطر معًا. تقول المساعدة الرسمية إنه يمكنك مراسلة Claude من هاتفك ليعمل على حاسوب سطح المكتب لديك، مستعملًا الموصلات والإضافات وصلاحيات الوصول إلى الملفات التي سبق أن ضبطتها في Cowork، داخل ما تصفه Anthropic بأنه محادثة واحدة متّصلة يمكن بلوغها من أي من الجهازين. ويشترط تشغيلها أن يكون الحاسوب مستيقظًا وتطبيق سطح المكتب مفتوحًا، وأن يكون النظام macOS أو Windows، إذ لا يوجد computer use على Linux، كما أن computer use متاح على اشتراكي Pro و Max فقط ولا تملك اشتراكات Team و Enterprise وصولًا إليه. وآليًا ينزل Claude في ثلاث مراتب من الأولوية: موصل إن توفّر، ثم التنقّل في المتصفّح إن لم يتوفّر، ثم التفاعل المباشر مع الشاشة بوصفه ملاذًا أخيرًا، مع التقاط صور للشاشة على طول الطريق ليفهم ما هو معروض. ومن هنا يبدأ التقييم. فالمواضع التي يتوقّف عندها مصمَّمة عمدًا: computer use معطّل افتراضيًا ويُفعَّل من Settings ثم General؛ والإذن يُطلب لكل تطبيق جديد على حدة؛ وحذف ملف حذفًا نهائيًا يتطلّب إذنًا صريحًا؛ ومنصّات الاستثمار والتداول وتطبيقات العملات المشفّرة محظورة افتراضيًا. لكن هناك مواضع لا يتوقّف عندها. فالإجراءات المفردة داخل تطبيق سبقت الموافقة عليه لا تُعرض عليك للتأكيد، والصياغة الرسمية هي أن Claude ينقر ويكتب ويتنقّل في شاشتك مباشرة، بلا فحوص الأذونات التي تحكم أدوات Cowork الأخرى. وتضيف الوثائق أنه لا يوجد صندوق رملي بين Claude وما هو على شاشتك، وأن الإجراءات المتّخذة في تطبيق واحد قد تؤثّر في تطبيقات أخرى. وأكبر المخاطر هو حقن المطالبات، وتصفه Anthropic بكلماتها هي: محتوى الويب ناقل أساسي لهجمات حقن المطالبات، وإن تعليمة متلاعبًا بها، أو أمرًا غير متوقّع، أو رابط تصيّد فُتح في متصفّحك، قد يتوالى في سلسلة من الإجراءات التي يصعب أو يستحيل التراجع عنها. وتقول Anthropic إنها تفحص التنشيطات الداخلية للنموذج لكشف هذا السلوك، لكن ذلك يقلّل الاحتمالات ولا يُغني عن أن ترسم أنت خطًا، وتظلّ الإرشادات توصي بالانتقال إلى الموافقة اليدوية كلما مسّت المهمة ملفات أو حسابات أو مواقع حسّاسة. وتسمّي Anthropic الحدّ صراحة: لا تمنح إذن computer use وصولًا إلى التطبيقات الحسّاسة مثل المصرفية والصحّية والحكومية، وتجنّب الحسابات المالية والمستندات القانونية والمعلومات الطبية والبيانات الشخصية. ويتناول المقال كذلك جانب الهاتف. فما يتسرّب عند ضياع الجهاز ليس البيانات المخزّنة عليه بل صفة إعطاء الأوامر لحاسوبك، إضافة إلى محتوى المحادثة المتّصلة — ومقال المساعدة الرسمي الخاص بـ Dispatch لا يوثّق فكّ الاقتران ولا التعامل مع جهاز مفقود، فالعلاجات تأتي من جانب الحساب بدلًا من ذلك: إنهاء الجلسة المفردة من Settings ثم Account ثم Active sessions، أو تسجيل الخروج من كل الجلسات عبر claude.ai وهو غير متاح في تطبيقات الهاتف فيتطلّب متصفّح ويب، أو ببساطة قطع جانب الحاسوب بإغلاق تطبيق سطح المكتب أو تركه يخلد إلى السبات، وهو في الواقع الأسرع لأن Dispatch تشترط حاسوبًا مستيقظًا وتطبيقًا مفتوحًا. ويختم بفصل Dispatch عن computer use بوصفهما مفتاحين منفصلين، وتمييزهما معًا عن agent view في Claude Code الذي تسمّي الوثائق الرسمية عمليته أيضًا dispatch، ثم برسم خطّ عملي: ابدأ بعمل يمكنك التراجع عنه.

ما هو صندوق عزل Claude Code؟ عزل نظام الملفات والشبكة لأتمتة آمنة (2026)

ما هو صندوق عزل Claude Code؟ عزل نظام الملفات والشبكة لأتمتة آمنة (2026)

إن استخدمت Claude Code لفترة كافية اصطدمت بمعضلة: مطالبة مع كل أمر توقف تدفّقك، وإيقافها كلها بالتجاوز خطير. يكسر صندوق العزل هذه الثنائية بتسييج ما الذي يمكن مسّه على مستوى نظام التشغيل، فتعمل الأوامر بحرية في الداخل بلا مطالبات ولا يصل شيء إلى الخارج. يغطي هذا الدليل العزلين (نظام الملفات والشبكة)، والبدء بـ ‎/sandbox (يعمل macOS جاهزًا، ويحتاج Linux/WSL2 إلى bubblewrap+socat، وWindows الأصلي غير مدعوم)، ووضع السماح التلقائي مقابل العادي، وتهيئة settings.json (allowWrite/denyRead، وبيانات الاعتماد، وallowedDomains)، وكيف يكمّل أوضاع الأذونات وقواعدها كطبقة ثالثة يفرضها نظام التشغيل، وحدوده (TLS غير المفحوص، ومقابس Unix)، ومتى تلجأ إلى حاويات التطوير أو الأجهزة الافتراضية. تفيد Anthropic بأنه خفّض مطالبات الأذونات بنسبة 84% في الاستخدام الداخلي.

كيف تدع الذكاء الاصطناعي يدير AWS: الطرق والمزايا والعيوب (2026)

كيف تدع الذكاء الاصطناعي يدير AWS: الطرق والمزايا والعيوب (2026)

هل يمكنك تسليم تشغيل AWS إلى الذكاء الاصطناعي؟ في 2026 يمكنك تفويض الكثير. فـ AWS نفسها تقدّم Amazon Q Developer وAgent Toolkit for AWS (مايو 2026 — أكثر من 40 مهارة للوكلاء + خادم AWS MCP Server مُدار + إضافات)، بحيث يمتد الذكاء الاصطناعي من توليد البنية التحتية ككود إلى تشغيل الموارد. يؤطّر هذا الدليل «التفويض» في ثلاثة مستويات (① توليد الكود/البنية التحتية ككود، ② التشغيل/الاستقصاء القائم على القراءة، ③ وكيل ذاتي يشغّل AWS فعليًا)، ويغطّي الأدوات الرئيسية (Amazon Q Developer، وAgent Toolkit، وAWS MCP Server، وTerraform MCP، وBedrock AgentCore) — بما في ذلك مسار أدواتك الخاصة بمنح Claude Code أو Codex واجهة AWS CLI لتشغيل «aws» من الصدفة — والمزايا (بنية تحتية ككود سريعة، وفرز آلي، وأفكار لتحسين التكلفة، ودمقرطة المعرفة)، ثم صلب الموضوع: العيوب (تضخّم صلاحيات IAM، والصلاحية المفرطة كمضخّم لنطاق تأثير الأخطاء/حقن التعليمات، والصلاحيات التي تعمّر بعد المهمة، وانفلات التكلفة — مع حوادث فعلية لحذف قواعد بيانات إنتاجية في 2025-2026)، اعتمادًا على مصادر AWS الرسمية وشركات الأمن. المفارقة الجوهرية: السؤال ليس «هل يستطيع؟» بل «كيف تفوّض دون انفلات أو انفجار في الفاتورة» — وبناء AWS نفسها لحواجز حماية IAM وتدقيق CloudTrail والعزل ضمن Agent Toolkit يبيّن شكل الإجابة. ويشمل المبادئ الخمسة (صلاحيات IAM الأقل امتيازًا، وموافقة بشرية على العمليات المدمّرة، وقابلية المراقبة، وبيانات اعتماد قصيرة العمر تُصدر عند الحاجة، والعزل) وقسم أسئلة شائعة.

عاد Claude Fable 5: إعادة نشر عالمية بعد 19 يوماً من التوقف (يوليو 2026)

عاد Claude Fable 5: إعادة نشر عالمية بعد 19 يوماً من التوقف (يوليو 2026)

في 1 يوليو 2026، أعادت Anthropic نشر نموذجيها الرائدين Claude Fable 5 وMythos 5 عالمياً — بعد 19 يوماً فقط من إيقافهما بالكامل في 12 يونيو بموجب أمر أمريكي لضوابط التصدير. السبب المباشر للعودة: رفعت وزارة التجارة الأمريكية ضوابط التصدير في 30 يونيو. وكان المحفّز الأصلي تقرير اختراق أمني من باحثي Amazon، لكن Anthropic أكّدت باستمرار أن «Fable 5 لا يقدّم أي قدرات هجومية فريدة»، وجاء الرفع ليحسم المسألة بما ينسجم مع هذا الموقف. ولم يَعُد النموذج على حاله ببساطة: فمصنّف جديد دُرّب لاكتشاف أسلوب التجاوز المُبلَّغ عنه يحظره في أكثر من 99% من الحالات، وعند تفعّله يُعاد توجيه الطلب تلقائياً إلى Opus 4.8 (زرّ «تبديل النماذج عند وضع علامة على رسالة» في التطبيق). وفي الوقت الراهن ينطبق حدّ مؤقّت — حتى 50% من الحد الأسبوعي في باقات Pro وMax وTeam وبعض باقات Enterprise حتى 7 يوليو، ثم عبر أرصدة الاستخدام. ويستهلك Fable 5 الحصّة أسرع من Opus 4.8، ويعود الوصول عبر السحابة (AWS وGoogle Cloud وMicrosoft Foundry) على مراحل (دون تاريخ بعد). وبوصفه متابعةً للتوقف، يتناول هذا المقال لماذا أمكنت العودة، وما الذي تغيّر، وتنبيهات الاستخدام، ودرس التصميم دون الاعتماد على نموذج واحد — استناداً إلى الإعلان الرسمي والتغطية الصحفية.

الذكاء الاصطناعي أم الإنسان: مَن الأكفأ في الأمن السيبراني؟ مقارنة 2026

الذكاء الاصطناعي أم الإنسان: مَن الأكفأ في الأمن السيبراني؟ مقارنة 2026

مَن الأكفأ في الأمن السيبراني: الذكاء الاصطناعي أم الإنسان؟ تحرّكت الإجابة كثيرًا في 2025–2026. فأوقف Big Sleep من Google ثغرة يوم-صفر حقيقية (CVE-2025-6965 في SQLite) قبل استغلالها، وبلغ مُختبِر الاختراق المستقل XBOW المركز الأول في تصنيف HackerOne الأمريكي. وفي المقابل، تبيّن أن 45% من الشيفرة المولّدة بالذكاء الاصطناعي بها ثغرات (نحو 2.74 ضعف ما يكتبه البشر)، ووقع أول هجوم سيبراني واسع يقوده الذكاء الاصطناعي عبر إساءة استخدام Claude (نُفّذ 80–90% منه ذاتيًا). يقارن المقال، استنادًا إلى مصادر أوّلية من Google وAnthropic وDARPA وVeracode، بين الذكاء الاصطناعي المتفوّق في السرعة والحجم والشمول، والإنسان المتفوّق في منطق العمل وتسلسل الهجوم والحُكم النهائي، عبر جدول مرجعي حسب المهمة. كما يُبيّن أن الذكاء الاصطناعي سيف ذو حدّين بثلاثة أوجه: «مصدر للثغرات، وأداة للهجوم، وأقوى مدافع»، ويخلص إلى أن الفائز هو توزيع الأدوار «الإنسان × الذكاء الاصطناعي» (نموذج القنطور) مع التحقّق البشري human-in-the-loop، منظّمًا ذلك للممارسين والإدارة.

ما هي مخاطر الاعتماد على الذكاء الاصطناعي؟ كيف تستعد حين يتوقّف فجأة

ما هي مخاطر الاعتماد على الذكاء الاصطناعي؟ كيف تستعد حين يتوقّف فجأة

يشرح هذا المقال مخاطر الاعتماد على الذكاء الاصطناعي بعد أن سُحب نموذجا Claude Fable 5 و Mythos 5 بين عشية وضحاها في يونيو 2026 بسبب التنظيم ثم أُعيد نشرهما بعد 19 يومًا في 1 يوليو 2026. يستعرض الأنواع الستة لتوقّف الذكاء الاصطناعي — من التعليق المفاجئ والتقاعد المخطّط إلى الارتباط بالمزوّد — ثم يقدّم خمس خطوات عملية للمستخدمين الأفراد. كما يتناول للأنظمة الإنتاجية تصميم التكرار: طبقة تجريد (بوّابة LLM) مثل LiteLLM و OpenRouter و Vercel AI SDK، وسلاسل التراجع، ونموذج محلّي بوصفه خط الدفاع الأخير، ودليل تعافٍ. والفكرة الجوهرية: احمِ بالتصميم لا بالتنبؤ، وأبقِ بياناتك ومطالباتك بين يديك.

قواعد أذونات Claude Code وضبط settings.json

قواعد أذونات Claude Code وضبط settings.json

تتيح لك قواعد الأذونات في Claude Code كتابة إدخالات allow / ask / deny في settings.json للتحكم بدقة فيما يُشغَّل دون سؤال، أو يطلب التأكيد، أو يُمنع. يشرح هذا الدليل الفرق بين القواعد والأوضاع، وأولوية deny ← ask ← allow، وصيغة Tool(specifier)، وتسلسل ملفات settings.json، إضافة إلى وصفات عملية لإعداد آمن.

أوضاع أذونات Claude Code: شرح الأوضاع الخمسة وكيفية التبديل بينها

أوضاع أذونات Claude Code: شرح الأوضاع الخمسة وكيفية التبديل بينها

يحدد محدِّد "Permission Mode" في Claude Code عدد مرات توقف Claude لطلب الإذن قبل تعديل ملف أو تشغيل أمر. يشرح هذا الدليل الأوضاع الخمسة (Ask permissions وAccept edits وPlan mode وAuto mode وBypass permissions) إضافةً إلى dontAsk، وكيفية التبديل بينها، ومتى تختار كل وضع بأمان.

كيف تتجنّب حظر حسابات ChatGPT و Claude (OpenAI / Anthropic)

كيف تتجنّب حظر حسابات ChatGPT و Claude (OpenAI / Anthropic)

في يوم ما يتوقّف حساب ChatGPT أو Claude عن العمل فجأة: في 2026 تتزايد التقارير عن إيقاف الحسابات والتحذيرات، والمخيف أنه يمكن حظرك بمخالفة الشروط دون قصد حتى من دون نية سيئة. يلخّص هذا المقال ما تحتاج معرفته لتجنّب فقدان حسابك على OpenAI (ChatGPT و Codex) و Anthropic (Claude و Claude Code) بالاستناد إلى سياسات الاستخدام المنشورة والتقارير، وهو ليس دليلًا للتهرّب من الكشف بل للالتزام بالقواعد. خمسة مُحفّزات شائعة بين الشركتين: المحتوى المحظور / jailbreak، والأتمتة أو الاستخلاص غير المصرّح، ومشاركة أو إعادة بيع الحسابات ومفاتيح API، وأنماط الوصول المريبة (تغييرات متكررة في IP والدولة، واستخدام مكثّف لـ VPN)، وعدم تطابق الدفع أو الاحتيال. أكبر فخ في 2026: استخدام رموز OAuth الخاصة بالخطة الشخصية (Free/Pro/Max) في أي منتج غير التطبيق الرسمي، بما في ذلك أطر مثل Agent SDK، يُعدّ مخالفة لشروط الخدمة للمستهلك تسبّبت في موجة حظر كبيرة؛ والنهج الصحيح هو تشغيل التطبيقات والوكلاء عبر API (الدفع حسب الاستخدام). على جانب OpenAI: التحايل على قيود الأمان، والأتمتة، وإساءة مفاتيح API، والاستخدامات غير القانونية. على جانب Anthropic: إساءة رموز OAuth، والوصول غير الرسمي، وبنود مكافحة التقطير، وjailbreak. قائمة وقاية من سبع نقاط، والتحذير فرصة للتصحيح، والمخالفات الطفيفة قابلة للاعتراض بينما الجسيمة دائمة. الخطة الصحيحة، للغرض الصحيح، بأمانة.

ما هي حواجز الأمان للذكاء الاصطناعي؟ الدفاع ضد حقن الأوامر وحماية الإدخال/الإخراج — دليل المبتدئين

ما هي حواجز الأمان للذكاء الاصطناعي؟ الدفاع ضد حقن الأوامر وحماية الإدخال/الإخراج — دليل المبتدئين

بعد أن تتمكّن من بناء تطبيقات الذكاء الاصطناعي، تأتي المرحلة التالية وهي تشغيلها بأمان. يمكن خداع نماذج اللغة الكبيرة بمدخلات خبيثة، أو تسريب بيانات سرية، أو الجزم بهراء بثقة؛ والآلية الأمنية التي تمنع ذلك هي حواجز الأمان للذكاء الاصطناعي، التي أصبحت جزءاً أساسياً من الإنتاج في 2026 مع وقوع حوادث وكلاء الذكاء الاصطناعي فعلياً. حواجز الأمان قواعد ومرشّحات تكبح المدخلات الخطيرة والمخرجات غير المرغوبة، فتفحص مدخلات المستخدم قبل أن تصل إلى النموذج والإجابة قبل أن تعود — طبقة أمان مستقلة منفصلة عن النموذج نفسه. التهديدات الرئيسية هي حقن الأوامر (الأكبر) وكسر القيود وتسريب البيانات (البيانات السرية، PII، موجّه النظام) والهلوسة أو المخرجات الضارة. تعمل الحماية على طبقتين: حواجز الإدخال (كشف الحقن وكسر القيود، كشف/إخفاء PII، تقييد المواضيع، التعقيم) وحواجز الإخراج (تصفية المحتوى الضار، منع التسريب، فحص الهلوسة، التحقق من التنسيق). حقن الأوامر — المصنّف الأكثر خطورة على OWASP LLM Top 10 — يأتي بصيغة مباشرة (يكتب المستخدم «تجاهل كل التعليمات السابقة») وغير مباشرة (أوامر مخفية في صفحة ويب أو مستند RAG)، والحقن غير المباشر لا يحجبه RAG وحده، لذا تحتاج المستندات المسترجعة إلى فحص خاص بها. يغطّي هذا الدليل للمبتدئين أيضاً الأدوات (LLM Guard، Guardrails AI، NeMo Guardrails، Llama Guard، وميزات الأمان السحابية من Azure وAWS وOpenAI) والمبادئ العملية للدفاع المتعمّق وأقل امتياز والموافقة البشرية والمراقبة المستمرة.