البرمجة بوكلاء الذكاء الاصطناعي: دليل الأدوات والمخاطر

بقلم فريق تقني · (آخر تحديث: )· أدوات المطورين
البرمجة بوكلاء الذكاء الاصطناعي: دليل الأدوات والمخاطر

الإكمال التلقائي يقترح سطراً فتقبله أو ترفضه، وينتهي دوره. أما الوكيل فيقرأ ملفاتك، ويشغّل أوامر في طرفيتك، ويرى نتيجة كل أمر، ثم يقرّر الخطوة التالية دون أن يعود إليك. الفارق ليس في قوة النموذج بل في اتساع ما فوّضته: من يشغّل وكيلاً وهو يحسبه إكمالاً أسرع يكون قد سلّم صلاحية تنفيذ لبرنامج يقرّر بنفسه.

حلقة الوكيل: اجمع السياق، نفّذ، تحقّق، كرّر

الحلقة أربع خطوات متكرّرة: يجمع السياق، ينفّذ إجراءً، يتحقّق من النتيجة، ثم يعيد الكرّة. مخرجات كل أداة تعود إلى السياق فتغيّر القرار التالي؛ فتصحّح الحلقة مسارها أحياناً، وتدور حول نفسها أحياناً.

أدواته خمس فئات: عمليات الملفات، والبحث، والتنفيذ الذي يشمل أوامر الصدفة والاختبارات وgit، والويب، وتحليل بنية الكود. وطلب واحد يمرّ على أكثرها: «أصلح الاختبارات الفاشلة» يصير سلسلة — تشغيل الاختبارات، قراءة الخطأ، البحث عن الملفات المعنية، قراءتها، التعديل، إعادة التشغيل — وكل خطوة تترك مخرجاتها في النافذة.

نافذة السياق مورد نادر وليست سعة مجانية

النافذة تحمل المحادثة كاملة، ومحتوى كل ملف قُرئ، ومخرجات كل أمر، وملف تعليمات المشروع. كلما امتلأت تراجعت الدقة، لأن كل سطر لم يعد ذا صلة يقتطع حصة من انتباه ما يهمّ فعلاً. وصفتها أنثروبيك في سبتمبر 2025 بميزانية انتباه محدودة، لا سعة تخزين مجانية.

عند الامتلاء تُمسح مخرجات الأدوات الأقدم أولاً، ثم تُلخّص المحادثة. تختفي تعليماتك التفصيلية من بداية الجلسة بصمت، فيعود الوكيل إلى سلوكه الافتراضي وأنت تحسبه ملتزماً. ولهذا وجدت أنثروبيك في تجربتها للوكلاء طويلي الأمد المنشورة في 26 نوفمبر 2025 أن التلخيص وحده لا يكفي، فأضافت إليه بنية من وكيلين: أحدهما يهيّئ البيئة ويُنشئ ملف تقدّم والتزام git أولي، والآخر ينفّذ ميزة واحدة في كل جولة ويستعيد سياقه منهما. وإن صحّحت الوكيل أكثر من مرتين على المشكلة نفسها في جلسة واحدة فالسياق ملوّث بمقاربات فاشلة؛ امسح وابدأ بمطالبة أفضل، وصياغتها مهارة شرحناها في كيف تكتب أوامر فعّالة لنماذج الذكاء الاصطناعي مثل كلود.

الأذونات والعزل: ما الذي يوقف أمراً خطراً فعلاً

الأذونات ينفّذها البرنامج لا النموذج. ما تكتبه في ملف تعليمات المشروع يشكّل ما يحاول الوكيل فعله، لا ما هو مسموح تقنياً؛ فعبارة «لا تحذف ملفات» ليست ضماناً.

في كلود كود تُقيَّم القواعد بالترتيب deny ثم ask ثم allow، وأول تطابق يحسم. أنماط Bash هشّة: قاعدة تسمح بـcurl نحو نطاق بعينه يُلتف عليها بخيار يسبق الرابط أو ببروتوكول مختلف، ولذلك التوصية الرسمية حجب curl وwget بقاعدة deny. المزلق الأخطر أن قواعد قراءة الملفات وتعديلها لا تنطبق على العمليات الفرعية: سكربت بايثون يشغّله الوكيل يفتح أي ملف خارج أي قاعدة كتبتها. المنع الحقيقي يحتاج صندوقاً رملياً على مستوى نظام التشغيل، عبر Seatbelt على macOS أو bubblewrap على لينكس.

العزل يتفاوت: في OpenAI Codex الشبكة معطّلة افتراضياً، وتُزال الأسرار قبل بدء مرحلة الوكيل السحابي. أما GitHub Copilot السحابي فيصل افتراضياً إلى مستودع المهمة وحده ويدفع إلى فرع ببادئة copilot/ حصراً، لكن جدار حمايته لا يشمل خوادم MCP.

حين يقرأ الوكيل تعليمات لم تكتبها أنت

هذا هو الخطر الذي لا يُرقّع، وهو مصنّف LLM01، أي الأول في قائمة OWASP لتطبيقات نماذج اللغة 2025. أوضح إطار له «الثلاثي القاتل» الذي صاغه سايمون ويليسون في 16 يونيو 2025: الخطر يتحقّق حين تجتمع في وكيل واحد بيانات خاصة، ومحتوى غير موثوق، وقدرة على الاتصال الخارجي.

الحالة المرجعية وثّقتها Invariant Labs في 26 مايو 2025: مهاجم يفتح في مستودع عام قضيةً تحمل تعليمات مزروعة؛ فحين تطلب من وكيلك تصفّح قضايا المستودع ينفّذها، فيسحب بيانات من مستودعاتك الخاصة ويسرّبها في طلب سحب عام. وصفها الباحثون بأنها مشكلة معمارية لا خلل قابل للترقيع، وتكرّر النمط في ثغرة GitLost التي كشفتها Noma Security في 7 يوليو 2026. وفي CVE-2025-53773 دفعت تعليماتٌ مدسوسة Copilot إلى كتابة "chat.tools.autoApprove": true في .vscode/settings.json، فسقطت كل التأكيدات وصارت الأوامر التالية قابلة للتنفيذ على جهاز المطوّر.

هذا غير تسميم أوصاف الأدوات الذي يصيب خوادم MCP نفسها: هناك تختبئ التعليمات في وصف الأداة قبل بدء العمل، وهنا تصلك داخل محتوى يقرأه الوكيل في أثنائه.

أخطر ما حدث حادثة Nx في 26 أغسطس 2025: إصدارات خبيثة على npm، وسكربت postinstall استدعى أدوات الوكلاء المثبّتة محلياً بأعلام تعطيل الأذونات، فمسح نظام الملفات بحثاً عن أسرار ورفعها إلى مستودعات عامة. عامل كل ما يقرأه الوكيل مُدخلاً غير موثوق، واكسر الثلاثي بفصل واحد.

مواصفة المهمة ومعيار قبول قابل للتشغيل

الدورة التي توصي بها أنثروبيك أربع مراحل: استكشف بقراءة فقط، ثم خطّط، ثم نفّذ، ثم التزم أو افتح طلب سحب. لكن التخطيط عبء بذاته: إن كنت تستطيع وصف الفرق في جملة واحدة فتخطَّ الخطة، وهي تستحقّ العناء حين يمسّ التغيير عدة ملفات أو تكون غير ملمّ بالكود.

المواصفة الجيدة تسمّي الملفات والواجهات، وتنصّ صراحة على ما هو خارج النطاق، وتنتهي بفحص قابل للتشغيل. الوكيل يتوقف حين يبدو العمل منجزاً؛ ودون فحص يشغّله بنفسه تصير «يبدو منجزاً» الإشارة الوحيدة، وتصير أنت حلقة التحقق.

المهمة: إضافة تحديد معدل على مسار /api/login
النطاق: src/api/login.ts و src/middleware/rate-limit.ts و tests/login.test.ts
السلوك: 5 محاولات لكل عنوان IP خلال 15 دقيقة، وما بعدها يعيد 429
خارج النطاق: منطق الجلسات، ومخطط قاعدة البيانات، وأي مسار آخر
معيار القبول: اختبار يرسل 6 طلبات متتالية ويؤكد أن السادس يعيد 429
التحقق النهائي: npm test && npm run lint && npm run build ينتهي برمز خروج 0

الوكيل لا يصحّح نفسه بموثوقية، فاطلب رأياً ثانياً بسياق نظيف يرى الفرق والمعايير فقط. وفي تجربة أنثروبيك مُنع الوكيل صراحةً من تعديل تعريفات الاختبار، لأن أسهل طريق إلى الاكتمال تليين المعيار. وابدأ كل جلسة من حالة git نظيفة، فنقاط الاستعادة لا تتعقّب ما نفّذه الوكيل بأوامر الصدفة.

أما ملف تعليمات المستودع، وAGENTS.md وCLAUDE.md صيغتاه الشائعتان، فأدرج فيه ما لا يستطيع الوكيل تخمينه: أوامر التشغيل، وقواعد الأسلوب المخالفة للافتراضات، والمزالق غير البديهية. معيار كل سطر: هل حذفه سيجعل الوكيل يخطئ؟ وأبقِه قصيراً، فالمتضخّم يجعله يتجاهل تعليماتك.

الشعور بالسرعة لا يطابق قياسها، والخطأ يغيّر نوعه

أشهر نتيجة معاكسة للحدس جاءت من METR في 10 يوليو 2025: تجربة عشوائية مضبوطة بـ16 مطوّراً و246 مهمة على مستودعات ضخمة يعرفها كل مطوّر بخبرة متوسطها 5 سنوات. توقّع المشاركون تسريعاً بنسبة 24%، وقدّروا بعدها أنهم تسارعوا 20%، بينما أظهر القياس تباطؤاً بنسبة 19%. لكن METR أعلنت في 24 فبراير 2026 تعديل تصميم تجربتها بسبب تحيّز انتقاء حاد، ووصفت نتائج جولتها الثانية بأنها دليل ضعيف جداً؛ فرقم 19% ليس حقيقة نهائية. وفي المقابل وجدت ثلاث تجارب ميدانية بمجموع 4867 مطوّراً زيادة 26% في المهام المكتملة، والمكاسب أعلى لدى الأقل خبرة، وهي عن الإكمال التلقائي لا عن الوكلاء. الخيط المشترك: المكسب يكبر مع عدم الإلمام بالكود، وينعكس مع الإلمام العميق به.

وفي التبنّي فجوة واضحة: استطلاع Stack Overflow المنشور في 29 يوليو 2025 بمشاركة أكثر من 49000 شخص وجد 84% يستخدمون أدوات الذكاء الاصطناعي أو يخطّطون لذلك، لكن 31% فقط يستخدمون الوكلاء، و46% لا يثقون بدقة المخرجات، أي أن أغلب المتبنّين وقف عند حدود الاقتراح ولم يسلّم الحلقة.

وأرقام الأمن أحدّ من أرقام الإنتاجية. بحث USENIX Security 2025 وجد 5.2% من أسماء الحزم التي تقترحها النماذج التجارية مهلوسة و21.7% لدى النماذج مفتوحة المصدر، وما يفعله المهاجم بهذه الأسماء فصّلناه في هلوسة وكلاء البرمجة بالذكاء الاصطناعي وكيف تكتشفها؛ والفارق مع الوكيل أن التثبيت نفسه يجري ضمن الحلقة، فلا تمرّ الخطوة على عينك أصلاً. ووجدت GitGuardian في 17 مارس 2026 أن الالتزامات بمساعدة كلود كود تسرّب أسراراً بمعدل 3.2% مقابل خط أساس 1.5%. والأهم تحوّل نوع العيوب لا كمّها: بيانات Apiiro في سبتمبر 2025 تشير إلى 3 أو 4 أضعاف الكود مع 10 أضعاف المشكلات الأمنية، فالأخطاء النحوية انخفضت 76% وأخطاء المنطق 60%، بينما ارتفعت مسارات تصعيد الصلاحيات 322% وعيوب التصميم المعماري 153%. أي أن الوكيل يزيل ما كان المدقّق الآلي يمسكه، ويترك ما لا يمسكه إلا مراجع بشري — ولهذا لا تُفوَّض قراءة الفرق قبل الدمج.

الأسعار وما يستهلك رصيدك داخل الجلسة

الأرقام التالية بالدولار الأمريكي شهرياً، محقّقة في أغسطس 2026.

الأداةالباقات
كلودمجاني، Pro بـ20، Max بـ100 أو 200
GitHub CopilotFree بـ0، Pro بـ10 مع أرصدة بقيمة 15، Pro+ بـ39، Max بـ100
CursorHobby مجاني، Pro بـ20، Teams بـ40 لكل مستخدم
OpenAI Codexضمن ChatGPT Plus بـ20 وPro بـ200

انتقلت GitHub إلى أرصدة محسوبة بالدولار ضمن الباقة بدلاً من عدّ الطلبات المميّزة، فجلسة وكيل طويلة تستهلك الرصيد أسرع مما يوحي به سعر الاشتراك. وما يحرق الرصيد فعلاً أن المحادثة كاملة تُرسل مع كل طلب، وكل استخدام أداة طلبٌ إضافي يحمل نتائجها؛ فسؤال من سطر واحد داخل جلسة ظلّت مفتوحة طوال اليوم يكلّفك مقابل المحادثة كلها. فالجلسة الممتدة تكلّفك مرتين: دقّة أقل كما مرّ، وفاتورة أعلى هنا. امسح الجلسة بين المهام غير المترابطة، وفضّل أدوات سطر الأوامر على خوادم MCP لأنها لا تضيف قوائم أدوات.

الأدوات متاحة رسمياً في السعودية ودول الخليج بلا تسعيرة إقليمية مخفضة، فابدأ بالباقة المجانية وانتقل إلى باقة 20 دولاراً حين تصير تكلّف الوكيل مهاماً كاملة يومياً، ولا تصعد إلى 100 أو 200 دولار إلا بعد أن تصطدم بحدود الاستخدام أسبوعياً. لكن الاعتبار المحلي الأهم ليس السعر: إن كان المستودع يحوي بيانات شخصية حقيقية كبيانات اختبار مسحوبة من الإنتاج، فإدخالها في سياق وكيل سحابي نقلٌ للبيانات خارج المملكة يخضع لنظام حماية البيانات الشخصية. وهذه حالة تُكتب لها قاعدة deny على مسارات تلك الملفات، لا سطر يعتمد على حسن نية النموذج.

اختيار نمط التشغيل قبل اختيار الأداة

النمطشكل المهمة المناسبةالمخاطرة الأساسية
محادثة بلا أدواتفهم كود أو اختيار معماري، أو مهمة بلا مواصفة قابلة للتحققلا تنفيذ ولا تحقق، والنقل اليدوي يعيد الخطأ
وكيل محلي في المحررعمل يحتاج بيئتك المحلية أو إشرافاً لحظياًالوصول الكامل نفسه، فالأسرار في متناول أي أمر
وكيل سحابي غير متزامنمهمة مستقلة طويلة تنتهي بفرق واحد قابل للمراجعةلا تدخّل أثناء التنفيذ، وسطح تعرّض لمحتوى غير موثوق

بعد اختيار النمط، أبقِ ثلاثاً أمامك: المهمة التي توصف في جملة واحدة داخل كود تعرفه أسرع بيدك، والكود الحساس أمنياً يتطلب أن تفهم كل سطر فيه بنفسك، والمبتدئ الذي يسلّم كل شيء للوكيل يحرم نفسه التعلّم. ولاختيار الأداة نفسها راجع أفضل أدوات البرمجة بالذكاء الاصطناعي 2026 ومتى تختار.