كيف تكتب أوامر فعّالة لنماذج الذكاء الاصطناعي مثل كلود

بقلم فريق تقني · (آخر تحديث: )· ذكاء اصطناعي
كيف تكتب أوامر فعّالة لنماذج الذكاء الاصطناعي مثل كلود

أكثر النصائح تداولاً عن كتابة الأوامر إمّا بطلت رسمياً أو ثبت أن أثرها أصغر مما يُشاع. تمهيد رد المساعد الذي تُعلّمه أغلب الأدلة العربية صار يُرجع خطأ 400 على نماذج كلود الحديثة، و«فكّر خطوة بخطوة» قد تخفض الدقّة على النماذج الاستدلالية، و«لا تتجاوز 500 كلمة» طلب أضعف فاعلية مما تظن لأن النموذج يعدّ رموزاً لا كلمات. ما يلي مبنيّ على التوثيق الرسمي والأوراق المحكّمة، وأرقام تحدّد متى تتوقف عن تحسين الصياغة.

نصائح 2023 التي لم تعد تعمل مع كلود

ثلاث ممارسات قياسية صارت مرفوضة أو مضرّة. أوّلها تمهيد رد المساعد: بدءاً من نماذج كلود 4.6، لم تعد الاستجابة المُمهَّدة على دور المساعد الأخير مدعومة، والطلب الذي يتضمّنها يُعيد خطأ. بدائلها الرسمية: الإخراج المنظّم، أو تعليمة «أجب مباشرة بلا مقدّمة»، أو استدعاء الأدوات.

أما حدّ الكلمات فيصطدم بما ينصّ عليه توثيق Anthropic: النماذج تعدّ رموزاً لا كلمات، فطلب عدد كلمات أضعف من طلب عدد فقرات أو جمل. بدل «لا تتجاوز 200 كلمة» اطلب «فقرتين».

يبقى رفع الصوت. ما كنت تكتبه بصيغة «حرج: يجب عليك استخدام هذه الأداة حين…» يكفي فيه اليوم «استخدم هذه الأداة حين…»؛ وبدل التشديد علّل القيد، لأن كلود يعمّم من التفسير إلى حالات لم تذكرها.

وسوم XML ومعامل system: أين يذهب كل جزء من أمرك

في وسوم XML تناقض يستحق أن تعرفه. توثيق Anthropic يقول إنها تساعد كلود على تحليل الأوامر المعقّدة حين تختلط فيها التعليمات والسياق والأمثلة. لكن دورتها الرسمية تقول إنه خارج استدعاء الدوال لا توجد وسوم ذات وصفة سحرية دُرِّب عليها كلود؛ القيمة في الفصل لا في اسم الوسم. ثم خفّضت مدونة Anthropic وزن التقنية في نوفمبر 2025: النماذج الحديثة أفضل في فهم البنية دونها.

الفصل ليس ترفاً شكلياً: النموذج لا يملك قناتين، واحدة لتعليماتك وأخرى لبياناتك، فما يشبه الأمر يُعامَل معاملة الأمر. لهذا يتصدّر حقن الأوامر تصنيف LLM01 عند OWASP، وشكوى عميل تنتهي بعبارة «تجاهل التعليمات السابقة» تُقرأ تعليمةً ما لم يعزلها وسم صريح.

فصل ثانٍ يخصّ الواجهة: system معامل مستقل في Messages API، ولا يوجد دور بهذا الاسم داخل مصفوفة الرسائل. ضع فيه الثابت — الدور والقواعد والتعريفات — واترك المتغيّر لرسالة المستخدم؛ ولهذا الترتيب أثر في الفاتورة لأنه شرط التخزين المؤقت.

ترتيب المستند والسؤال داخل الأمر الطويل

في الأوامر الطويلة، نحو 20 ألف رمز فأكثر، توصية Anthropic صريحة: المستندات في الأعلى والسؤال في النهاية، وقد يرفع ذلك جودة الاستجابة حتى 30 بالمئة في اختباراتها. وورقة «الضياع في المنتصف» المنشورة في TACL 2024 تعطي الرقم من زاوية أخرى: في إعداد من 20 مستنداً على GPT-3.5-Turbo كانت الدقّة 75.8 بالمئة حين تقع الوثيقة الصحيحة في المقدّمة، وتهبط إلى ما بين 53.8 و57.2 بالمئة في المنتصف، وترتفع إلى 63.2 بالمئة في آخر القائمة. والمقارنة الأهم أن الدقّة بلا أي مستندات كانت 56.1 بالمئة: دفن الإجابة في منتصف سياق طويل قد ينزل بالأداء دون مستوى ألّا ترفق شيئاً أصلاً.

نوافذ 2026 الطويلة لم تحلّ هذه المشكلة: دراسة Chroma عن «تعفّن السياق» على 18 نموذجاً، منها عائلة كلود 4 وGPT-4.1 وGemini 2.5، وجدت أن مشتّتاً واحداً يكفي لخفض الأداء، فحشو مستندات «احتياطية» يضرّ ولا ينفع. وإن كنت تلصق الملفات يدوياً في كل جلسة فأنت تحلّ المشكلة الخطأ، وهذه وظيفة بروتوكول MCP.

«فكّر خطوة بخطوة» صارت تكلفة بلا عائد أحياناً

في يونيو 2025 اختبر تقرير Wharton GAIL العبارة على GPQA Diamond بـ25 تكراراً لكل شرط. على النماذج غير الاستدلالية كان المكسب معتبراً: 13.5 بالمئة على Gemini Flash 2.0 و11.7 بالمئة على Sonnet 3.5. أما على الاستدلالية فتضاءل إلى 2.9 بالمئة على o3-mini، وانقلب إلى سالب 3.3 بالمئة على Gemini Flash 2.5، مقابل تكلفة زمن بين 20 و80 بالمئة. والأهم أن مقياس «الصحيح في كل المحاولات» سجّل سالب 17.2 بالمئة على Gemini Pro 1.5، أي أن العبارة قلبت إجابات كانت صحيحة.

أما «To CoT or not to CoT» في ICLR 2025، وهو تحليل بَعدي لأكثر من 100 ورقة على 14 نموذجاً، فيحدّد أين يقع المكسب: الرياضيات والمنطق أساساً، ويكاد يختفي في غيرهما.

يذهب توثيق Anthropic أبعد: فضّل التعليمات العامة على تفصيل الخطوات، لأن أمراً مثل «فكّر بتمعّن» غالباً ينتج استدلالاً أفضل من خطة خطوة بخطوة مكتوبة يدوياً. لكن التقسيم اليدوي يبقى صحيحاً في سير عمل البرمجة بوكلاء الذكاء الاصطناعي وحين تسلّم هدفاً كاملاً بدل سؤال، لا داخل طلب واحد لنموذج استدلالي.

ثلاثة أمثلة متنوّعة تهزم عشرة متشابهة

في توثيق Anthropic رقم محدّد: من 3 إلى 5 أمثلة لأفضل النتائج، بشرط أن تكون متنوّعة حتى لا يلتقط كلود أنماطاً غير مقصودة. والشرط الثاني هو الأهم: إن كانت أمثلتك الثلاثة كلها شكوى مكتملة الحقول، فسيفترض النموذج أن كل شكوى مكتملة ويخترع ما ينقص.

آلية ذلك معروفة من أوراق جيل GPT-3، تفسيرٌ لا رقم راهن: وجد Lu وزملاؤه في ACL 2022 أن ترتيب الأمثلة وحده قد يصنع فرقاً بين أداء ممتاز وأداء قريب من التخمين العشوائي، وردّ Zhao وزملاؤه ذلك إلى انحياز الحداثة. فنوّع أمثلتك بحالات حدّية، ولا تجعل آخرها النمط الذي لا تريد تعميمه.

«أخرج JSON فقط» رجاء لا ضمان

الجملة ليست عقداً؛ يكفي سياج شيفرة أو جملة تمهيدية لينكسر التحليل في خط الإنتاج. البديل الرسمي يعمل بفك ترميز مقيّد عبر قواعد نحوية مُصرَّفة تمنع توليد أي رمز يخالف المخطط: output_config.format لصيغة الرد، أو أداة بـstrict: true. ومقابل الضمان قيود على المخطط: لا تعاودية، وadditionalProperties يجب أن تكون false.

هنا خلاف لم يُحسم. تقول Anthropic في نوفمبر 2025 إن الإخراج المنظّم لا يؤثّر في أداء النموذج، بينما وجدت ورقة Tam وزملائه في EMNLP 2024 أن فك الترميز المقيّد في وضع JSON قد يعيق الاستدلال لكنه يرفع دقّة التصنيف. والمخرج من الخلاف ألّا تختار بينهما: دع النموذج يستدلّ نصّاً أولاً، ثم اطلب البنية في استدعاء منفصل.

أعد بناء أمر ضعيف: من شكاوى العملاء إلى جدول

المهمة واقعية: استخراج بيانات منظّمة من 300 شكوى عميل بالعامية. الأمر الضعيف هو «استخرج المعلومات المهمة من هذه الشكاوى وأخرجها JSON» ثم لصق الشكاوى بعده. وعيوبه أربعة: لا فصل بين التعليمة والبيانات؛ التعليمة قبل بيانات طويلة؛ لا إذن بقول «لا أعرف» فيُخترع الناقص؛ وكل استدعاء يعيد إرسال التعليمات بلا تخزين مؤقت.

الأمر المُعاد بناؤه:

system:
  الدور في جملة، وتعريف كل حقل في السجل
  إن لم يُذكر الحقل صراحةً فاكتب "غير مذكور" ولا تستنتج
  السبب: المخرج يدخل قاعدة بيانات وأي حقل مخترع يفسد التقارير
  << نقطة التخزين المؤقت هنا >>

user:
  <examples>
    شكوى مكتملة، وشكوى ناقصة حقلين، وشكوى تحوي شكويين
  </examples>

  <complaints>
    <complaint index="1">...</complaint>
  </complaints>

  اقتبس الجملة التي استخرجت منها كل حقل، ثم أخرج السجل.

ثم القيد على مستوى الواجهة بدل جملة «أخرج JSON فقط». والإذن الصريح بقول «لا أملك معلومات كافية» أرخص دفاع عملي؛ فالنبرة الواثقة ليست دليل صحة كما يتضح في هلوسة وكلاء البرمجة.

ما تدفعه مقابل كل كلمة زائدة، ولماذا يدفع النص العربي أكثر

سمّت مدونة Anthropic الهندسية في سبتمبر 2025 هذا القيد «ميزانية الانتباه»: المحوّل يبني علاقات ثنائية بعدد n²، وقدرته على التقاطها تضعف كلما طال السياق. ومعناها عملياً: كل جملة تضيفها تزاحم الجملة التي تهمّك، وتُحاسَب عليها ثلاث مرات — في الفاتورة، وفي زمن الرد، وفي الدقّة.

الجانب المالي محسوم بأرقام. التخزين المؤقت يشترط التسلسل tools ثم system ثم messages، والثابت قبل المتغيّر. ومضاعفات السعر الرسمية: كتابة لخمس دقائق 1.25×، وكتابة لساعة 2.0×، وقراءة من التخزين 0.1×، أي توفير 90 بالمئة. والخطأ الكلاسيكي وضع نقطة التخزين على كتلة متغيّرة كتاريخ اليوم أو رقم الجلسة؛ عندها لن تتطابق البادئة أبداً، فتدفع زيادة الكتابة دون أن تقبض توفير القراءة ولو مرة.

علاوة الترميز ولغة التعليمات

أثبتت ورقة Petrov وزملائه في NeurIPS 2023 فروقاً تصل إلى 15 ضعفاً في طول الترميز بين اللغات، وقياس أحدث في 2026 يقدّر علاوة العربية بـ1.44 ضعف على مُرمِّز o200k_base، فنافذة 128 ألف رمز تصبح عملياً نحو 89 ألفاً للنص العربي. وهذه النِّسَب مقيسة على مُرمِّزات أخرى لا على مُرمِّز كلود، فخذها مؤشّراً: نصّك العربي يبلغ منطقة تعفّن السياق أبكر، فالاختصار والتخزين المؤقت ليسا رفاهية.

سؤال متّصل: بأي لغة تكتب التعليمات؟ دراسة على 11 مهمة عربية في 2024 وجدت أن الأمر بغير اللغة الأم يعطي الأفضل في المتوسط، ثم المختلط، ثم العربية؛ لكن كلود لم يُختبر فيها، ومهامها كانت تصنيفية لا توليدية. فالدليل المتاح يميل إلى تعليمات بالإنجليزية مع إبقاء البيانات والمخرج بالعربية، وهو فرض تختبره لا قاعدة مثبتة. وأياً كان اختيارك، حدّد اللغة صراحةً: «اكتب بالفصحى المبسّطة، وأبقِ أسماء الأوامر والمكتبات كما هي».

متى تتوقف عن تعديل الصياغة وتغيّر البنية

إذا جاءت الإجابة قريبة لكنها ناقصة، فتعليق تصحيحي واحد أفضل من إعادة الطلب من الصفر، لأن الإعادة تُفقدك الجزء الجيد. لكن لكل عَرَض حدّ تصير بعده الصياغة مضيعة وقت:

العَرَض الذي تراهالصياغة لن تحلّه لأن…الحلّ البنيوي
مخرج JSON ينكسر في المعالجةالطلب النصّي رجاء لا قيد على التوليدoutput_config.format أو أداة بـstrict: true
الدقّة تتدهور كلما طال المستندالمشكلة موضع المعلومة لا العبارةالمستندات أعلى والسؤال أسفل، واحذف المشتّتات
التكلفة والزمن يرتفعان مع التكرارإعادة الإرسال ثابتة مهما حسّنت الكلماتافصل الثابت في system وضع نقطة تخزين عليه
النموذج يخترع حقولاً ناقصةلا خيار لديه غير التخمينإذن صريح بـ«غير مذكور» وطلب اقتباس داعم
محاولتان فشلتا بالصياغة نفسهاالمشكلة سياق ناقص لا تعبير ناقصألصق الملف أو نص الخطأ كما ظهر فعلاً

القاعدة التنفيذية: امنح الصياغة محاولتين، ثم انتقل إلى البنية بالترتيب — الفصل، فالترتيب، فالأمثلة المتنوّعة، فالقيد على مستوى الواجهة. وإن بقيت المشكلة بعدها فهي في الأداة لا في الأمر، وعندها راجع أفضل أدوات البرمجة بالذكاء الاصطناعي 2026 قبل أن تكتب سطراً إضافياً.