الخلاصة: لا توجد جملة سحرية تجعل ChatGPT صحيحًا دائمًا. في اختبار GPT Gate المسبق التصميم نفذنا 30 تشغيلًا على ChatGPT Pro في وضع Instant، داخل محادثات مؤقتة ومن دون البحث في الويب. جمعت الطلبات المختصرة 121 من 150 بمتوسط 8.07 ووسيط 9، وجمعت الطلبات المنظمة 140 من 150 بمتوسط 9.33 ووسيط 10. مع ذلك، لم يتحقق معيار النجاح الكلي المحدد مسبقًا؛ فالزيادة في الوسيط كانت نقطة واحدة، لا النقطتين المطلوبتين.
ستجد هنا طريقة عملية لكتابة الطلب، ثم المواد والطلبات ومعايير التقييم لخمس مهام عربية يمكن إعادة تنفيذها. تحسن الالتزام بالقيود في هذه العينة: سجل التدقيق 12 مخالفة في المخرجات المختصرة مقابل 6 في المنظمة، و12 مخرجًا غير قابل للاستخدام كما هو مقابل 6. لكن الادعاءات غير المدعومة كانت 3 في كل نسخة، لذلك التنظيم قلل بعض مشكلات الشكل والالتزام ولم يمنع الخطأ الواقعي.

ما المقصود بالـPrompt؟
الـPrompt هو المدخل الذي ترسله إلى النموذج: السؤال أو التعليمات، ومعه أي سياق أو مادة أو أمثلة وقيود. لا يحتاج كل طلب إلى قالب طويل؛ سؤال مباشر قد يكفي لمعلومة بسيطة. لكن عندما تريد نتيجة قابلة للاستخدام أو التحقق، يفيد أن تحدد عناصر الطلب بدل ترك النموذج يخمنها.
| العنصر | السؤال الذي يجيب عنه | مثال |
|---|---|---|
| الهدف | ما النتيجة النهائية التي أريدها؟ | رسالة لإبلاغ عميل بتغيير موعد. |
| السياق والمادة | على أي معلومات يجب أن تعتمد الإجابة؟ | الأسماء والموعد السابق والجديد وسبب التغيير. |
| القيود | ما الذي يجب الحفاظ عليه أو تجنبه؟ | لا تضف رابطًا أو خصمًا غير موجود. |
| شكل المخرج | كيف أستطيع مراجعة النتيجة أو استخدامها؟ | موضوع، ثم متن من 70 إلى 100 كلمة. |
| معيار التحقق | كيف أعرف أن الإجابة التزمت بالمطلوب؟ | جميع التواريخ صحيحة ولا توجد معلومات مختلقة. |
قالب مختصر لتنظيم أي طلب
الهدف: [النتيجة التي تريدها]
السياق: [الجمهور أو الموقف]
المادة: [النص أو الحقائق التي يجب الاعتماد عليها]
المطلوب: [المهمة المحددة]
القيود: [الطول، اللغة، ما يجب تجنبه]
شكل الناتج: [قائمة، جدول، رسالة، JSON...]
معيار التحقق: [شروط يمكن فحصها]
إذا نقصت معلومة ضرورية، اذكر أنها غير متاحة ولا تفترضها.
ليست كل الخانات إلزامية في كل مرة. أضف فقط ما يغير القرار أو يجعل الناتج قابلًا للفحص. زيادة الكلام دون حاجة قد تنشئ تعليمات متعارضة بدل تحسين الإجابة.
حالة الاختبار المنشور في هذه الصفحة
الحالة الحالية: اكتمل الاختبار والتدقيق. أعددنا المواد الثابتة ونسختي الطلب ومعايير التقييم قبل التنفيذ، ثم شغلنا كل نسخة ثلاث مرات في كل واحدة من خمس مهام. النتيجة المنشورة تشمل المخرجات الثلاثين كلها؛ لم ننتق أفضل إجابة ولم نعد تشغيل الإجابة الضعيفة وحدها.
| البند | الحالة |
|---|---|
| المهام والمواد الثابتة | معدة أدناه |
| Rubric قبل التنفيذ | معد من 10 نقاط لكل مهمة |
| عدد التشغيلات المنفذ | 30 مخرجًا: 5 مهام × نسختين × 3 تكرارات |
| بيئة التنفيذ | ChatGPT Pro؛ الوضع الظاهر Instant؛ محادثات Temporary؛ البحث في الويب غير مستخدم |
| النتيجة وفق الشرط المسبق | لم يتحقق معيار التحسن الكلي: زيادة الوسيط +1، والمطلوب +2 على الأقل |
منهجية الاختبار القابلة لإعادة الإنتاج
الفرضية
كانت الفرضية أن صياغة الطلب في صورة هدف ومادة وقيود وشكل مخرج ومعيار تحقق قد تحسن الالتزام والدقة مقارنة بطلب طبيعي مختصر. أظهرت الدرجات تحسنًا عدديًا للنسخة المنظمة، لكن الزيادة في الوسيط لم تبلغ العتبة التي حددناها مسبقًا للحكم بتحقق الفرضية على مستوى الحزمة كلها.
المتغير الوحيد المقصود
داخل كل مهمة تبقى المادة المصدرية متطابقة حرفيًا. تتغير تعليمات الطلب فقط: نسخة قصيرة فضفاضة ونسخة منظمة تحدد القيود وشكل الناتج. لا تضاف حقيقة جديدة إلى النسخة المنظمة؛ أي معلومات إضافية فيها هي تعليمات تنفيذ، لا مادة معرفية.
بيئة التنفيذ وإعادة التجربة
نفذنا التشغيلات الثلاثين على حساب ChatGPT Pro، وكان الوضع الظاهر Instant. استخدمنا محادثة مؤقتة مستقلة لكل تشغيل، ولم نشغل البحث في الويب. تظل الخطوات التالية ضرورية لمن يريد إعادة التجربة بصورة قريبة من منهجيتنا:
- استخدم الخطة والنموذج أو الوضع الظاهر نفسه في التشغيلات كلها؛ كانت بيئتنا Pro وInstant.
- سجل الاسم كما يظهر في الواجهة؛ لا تستنتج اسم نموذج مخفي من السرعة أو الأسلوب.
- افتح محادثة مؤقتة لكل تشغيل؛ هذا ما استخدمناه لفصل السياق بين المخرجات.
- لا تستخدم البحث أو رفع الملفات أو الأدوات، لأن المواد موجودة داخل الطلب.
- نفذ كل زوج خلال فترة متقاربة، وبدّل ترتيب النسخة الضعيفة والمنظمة بين التكرارات.
- كرر كل نسخة ثلاث مرات؛ لا تعد تشغيل نتيجة سيئة وحدها.
- احفظ نص الطلب والمخرج كاملًا، والتاريخ والوقت والمنطقة والخطة والواجهة والجهاز والوضع الظاهر.
التقييم
- يعطى كل مخرج رمزًا عشوائيًا قبل التقييم حتى لا يعرف المقيم نوع الطلب.
- تطبق قائمة النقاط المنشورة لكل مهمة كما هي، دون تعديل بعد رؤية النتائج.
- راجع مقيمان المخرجات بعد إخفاء نوع الطلب. اختلفا في 6 مخرجات من 30، ثم حُسمت الحالات الست بمراجعة موثقة.
- المقياس الأساسي هو وسيط الدرجة من 10 للنسخة المنظمة مقابل المختصرة عبر 15 زوجًا.
- تنشر أيضًا الانتصارات والتعادلات والخسائر، وعدد الحقائق المختلقة، ومخالفات القيود، والمخرجات غير القابلة للاستخدام.
معيار النجاح المحدد مسبقًا
حددنا قبل التنفيذ أن النسخة المنظمة تُعد أفضل في هذه الحزمة فقط إذا تجاوز وسيطها النسخة المختصرة بنقطتين على الأقل، ولم تزد الأخطاء الواقعية. لم يتحقق الشرط الكلي: ارتفع الوسيط من 9 إلى 10، أي +1 فقط بدل +2. تساوى عدد الادعاءات غير المدعومة عند 3 لكل نسخة، لكن استيفاء شرط الأخطاء وحده لا يعوض عدم بلوغ عتبة الوسيط.
حدود المنهجية
عدد التشغيلات صغير: ثلاث مرات فقط لكل نسخة في كل مهمة، وعلى حساب Pro ووضع Instant في فترة اختبار واحدة. يجمع التقييم مهام مختلفة، وقد تتغير الإجابات بين مرة وأخرى أو مع خطة أو نموذج أو سياق آخر. كما أن النسخة المنظمة أطول وأكثر تحديدًا؛ لذلك تقيس التجربة الاستراتيجية كاملة، ولا تعزل أثر الطول عن أثر العناوين أو القيود. التعمية قللت أثر معرفة نوع الطلب، لكنها لم تلغ الحكم البشري؛ اختلف المقيمان في 6 من 30 قبل التحكيم. ولا تقيس الحزمة البحث على الويب أو الصور أو الصوت أو الملفات، ولا تثبت أن كل طلب طويل أفضل.
ولا يقيس اختبار البرومبت الأداء العربي العام أو الفصحى واللهجات؛ لهذا فصلناه عن اختبار مستقل للفصحى واللهجات العربية ينشر مهامه ونتائجه وحدود عينته.
المهمة الأولى: كتابة رسالة لتغيير موعد
المادة الثابتة
المرسلة: لينا حسن، منسقة المشروع في شركة النور. المستلمة: المهندسة سلمى عادل. كان اجتماع مراجعة مشروع «بوابة المعرفة» مقررًا الثلاثاء 18 أغسطس 2026 الساعة 10:00 صباحًا. نُقل إلى الأربعاء 19 أغسطس 2026 الساعة 12:30 ظهرًا عبر Microsoft Teams بسبب صيانة تقنية. المطلوب من سلمى تأكيد الحضور قبل الاثنين 17 أغسطس الساعة 3:00 عصرًا.
الطلب المختصر
اكتب رسالة بريد رسمية اعتمادًا على المادة التالية:
[ألصق المادة الثابتة أعلاه حرفيًا]
الطلب المنظم
حوّل المادة التالية إلى رسالة بريد عربية رسمية ومباشرة.
المطلوب:
- موضوع من 5 إلى 9 كلمات.
- متن من 70 إلى 100 كلمة.
- اذكر الموعد السابق والجديد والمنصة والسبب بدقة.
- اطلب تأكيد الحضور مع الموعد النهائي.
- اختم باسم المرسلة ووظيفتها.
- لا تضف رابط اجتماع أو رقم هاتف أو معلومات غير موجودة.
المادة:
[ألصق المادة الثابتة أعلاه حرفيًا]
التقييم من 10
- موضوع مناسب: 1.
- الموعد السابق صحيح: 1.
- الموعد الجديد والمنصة صحيحان: 2.
- سبب التغيير صحيح: 1.
- مهلة التأكيد صحيحة: 1.
- المرسلة والمستلمة صحيحتان: 1.
- الطول بين 70 و100 كلمة: 1.
- أسلوب مهني مباشر: 1.
- عدم اختلاق بيانات: 1.
المهمة الثانية: تلخيص تقرير تجريبي
المادة الثابتة
نفذت مدرسة الأفق تجربة استعارة كتب رقمية لمدة ستة أسابيع، من 1 مايو إلى 12 يونيو 2026. شملت التجربة 240 طالبًا، لكن 27 منهم لم يتمكنوا من استخدام المنصة بانتظام بسبب ضعف الاتصال. ارتفعت نسبة إعادة الكتب في موعدها من 38% قبل التجربة إلى 61% خلالها. أجاب 190 طالبًا عن الاستبيان الختامي، وقال 82% منهم إن المنصة سهلة الاستخدام. لم تتضمن التجربة مجموعة ضابطة، لذلك لا يمكن نسبة التحسن إلى المنصة وحدها. أوصى الفريق بتكرار التجربة لمدة ثمانية أسابيع مع مجموعة مقارنة وقياس موحد قبلها وبعدها.
الطلب المختصر
لخّص النص التالي:
[ألصق المادة الثابتة أعلاه حرفيًا]
الطلب المنظم
لخّص المادة في أربع نقاط فقط بالعناوين التالية:
النطاق، النتائج، القيد، الخطوة التالية.
القواعد:
- لا تتجاوز كل نقطة 25 كلمة.
- احتفظ بالأرقام الأساسية كما وردت.
- اذكر غياب المجموعة الضابطة.
- لا تنسب التحسن إلى المنصة على أنه سبب مؤكد.
- لا تضف مقدمة أو خاتمة أو استنتاجًا غير موجود.
المادة:
[ألصق المادة الثابتة أعلاه حرفيًا]
التقييم من 10
- مدة التجربة وتاريخاها والعينة 240: 2.
- مشكلة 27 طالبًا: 1.
- الارتفاع من 38% إلى 61%: 2.
- عدد المستجيبين 190 ونسبة 82%: 1.
- غياب المجموعة الضابطة وعدم إثبات السببية: 2.
- توصية ثمانية أسابيع ومجموعة مقارنة: 1.
- أربع نقاط فقط، كل منها لا يتجاوز 25 كلمة: 1.
المهمة الثالثة: استخراج بيانات إلى JSON
المادة الثابتة
يحمل المشروع اسم «مدارس تقرأ». ينفذ في السعودية بميزانية 85,000 ريال سعودي. يبدأ 3 سبتمبر 2026 وينتهي 15 أكتوبر 2026. القنوات المخططة هي البريد الإلكتروني وإنستغرام. الهدف تسجيل 12,000 طالب. القيد المعلن هو عدم استخدام مؤثرين مدفوعي الأجر. لم يحدد اسم المسؤول عن المشروع.
الطلب المختصر
استخرج المعلومات المهمة من النص التالي في صيغة JSON:
[ألصق المادة الثابتة أعلاه حرفيًا]
الطلب المنظم
أعد كائن JSON صالحًا فقط، دون Markdown أو شرح، بالمفاتيح التالية حرفيًا:
project_name, country, budget, start_date, end_date,
channels, target_registrations, constraint, owner
القواعد:
- budget كائن يحتوي amount رقمًا وcurrency بالقيمة SAR.
- التاريخ بصيغة YYYY-MM-DD.
- channels مصفوفة.
- استخدم null للمعلومة غير المحددة.
- لا تضف مفاتيح أو معلومات.
المادة:
[ألصق المادة الثابتة أعلاه حرفيًا]
التقييم من 10
- JSON صالح آليًا: 1.
- المفاتيح المطلوبة فقط: 1.
- الاسم والدولة صحيحان: 1.
- الميزانية رقمًا وعملة: 1.
- التاريخان صحيحان: 1.
- القناتان صحيحتان: 1.
- الهدف 12000: 1.
- القيد صحيح: 1.
- قيمة owner تساوي null: 1.
- لا يوجد نص خارج JSON أو معلومات مختلقة: 1.
المهمة الرابعة: كتابة منشور تعريفي
المادة الثابتة
ورشة «أساسيات تحليل البيانات» موجهة للمبتدئين. تقام عبر الإنترنت يوم 12 سبتمبر 2026 من 7:00 إلى 9:00 مساءً بتوقيت السعودية. الرسوم 149 ريالًا، وعدد المقاعد 25، ويغلق التسجيل 9 سبتمبر. لا تذكر المادة وجود شهادة أو خصم.
الطلب المختصر
اكتب منشور إنستغرام جذابًا من المعلومات التالية:
[ألصق المادة الثابتة أعلاه حرفيًا]
الطلب المنظم
اكتب منشور إنستغرام عربيًا فصيحًا للتعريف بالورشة.
الشكل:
- سطر افتتاحي جذاب.
- ثلاث نقاط قصيرة للمستوى، والموعد، والرسوم/المقاعد.
- دعوة أخيرة للتسجيل تتضمن موعد الإغلاق.
- من 60 إلى 90 كلمة.
- بحد أقصى رمزان تعبيران.
القيود:
- حافظ على جميع الأرقام والتوقيت كما وردت.
- لا تدّع وجود شهادة أو خصم أو نتيجة مضمونة.
المادة:
[ألصق المادة الثابتة أعلاه حرفيًا]
التقييم من 10
- اسم الورشة واستهداف المبتدئين: 1.
- أنها عبر الإنترنت: 1.
- التاريخ والوقت والمنطقة الزمنية: 2.
- السعر: 1.
- عدد المقاعد: 1.
- موعد إغلاق التسجيل: 1.
- دعوة واضحة للتسجيل: 1.
- الشكل والطول وعدد الرموز مطابقة: 1.
- لا شهادة أو خصم أو ضمان مختلق: 1.
المهمة الخامسة: اختيار خطة وفق شروط إلزامية
المادة الثابتة
الخطة سُهى: 95 ريالًا شهريًا، دعم عربي كامل، لا تعمل دون اتصال، 30 ملفًا يوميًا، ورد الدعم خلال 24 ساعة.
الخطة مدى: 165 ريالًا شهريًا، دعم عربي كامل، تعمل دون اتصال، 25 ملفًا يوميًا، ورد الدعم خلال 12 ساعة.
الخطة وفاء: 75 ريالًا شهريًا، دعم عربي جزئي، تعمل دون اتصال، 50 ملفًا يوميًا، ورد الدعم خلال 72 ساعة.
احتياجات المستخدم الإلزامية: الميزانية لا تتجاوز 180 ريالًا شهريًا، دعم عربي كامل، العمل دون اتصال، ومعالجة 20 ملفًا يوميًا على الأقل.
الطلب المختصر
قارن الخطط واختر أفضل خطة للمستخدم:
[ألصق المادة الثابتة أعلاه حرفيًا]
الطلب المنظم
اختر الخطة المطابقة لاحتياجات المستخدم اعتمادًا على المادة فقط.
القواعد:
- تعامل مع الاحتياجات الأربعة كشروط إلزامية، لا كعوامل قابلة للتعويض.
- ابدأ بسطر قرار واحد.
- أضف جدولًا بأعمدة: الخطة، مؤهلة؟، سبب القبول أو الرفض.
- اذكر الشرط الفاشل المحدد لكل خطة مرفوضة.
- لا تستخدم سرعة الدعم لترجيح خطة ما لم تتساو الخطط المؤهلة.
- لا تضف ميزات غير مذكورة.
المادة:
[ألصق المادة الثابتة أعلاه حرفيًا]
التقييم من 10
- اختيار «مدى»: 2.
- فحص السعر: 1.
- فحص العربية الكاملة: 1.
- فحص العمل دون اتصال: 1.
- فحص حد الملفات: 1.
- رفض «سُهى» بسبب عدم العمل دون اتصال: 1.
- رفض «وفاء» بسبب العربية الجزئية: 1.
- عدم اختلاق خصائص أو تغيير الأرقام: 1.
- سطر قرار وجدول واضحان: 1.
مثال توضيحي محدود: ما المقصود بمخرج قابل للفحص؟
التنبيه: المثال التالي كتبه المحرر بوصفه إجابة مرجعية للمهمة الثالثة؛ ليس مخرجًا من ChatGPT، ولا نتيجة قياس، ولا دليلًا على أن النسخة المنظمة ستنتجه فعلًا.
{
"project_name": "مدارس تقرأ",
"country": "السعودية",
"budget": {
"amount": 85000,
"currency": "SAR"
},
"start_date": "2026-09-03",
"end_date": "2026-10-15",
"channels": ["البريد الإلكتروني", "إنستغرام"],
"target_registrations": 12000,
"constraint": "عدم استخدام مؤثرين مدفوعي الأجر",
"owner": null
}
فائدة الإجابة المرجعية أنها تحول الانطباع إلى فحص: هل JSON صالح؟ هل المفاتيح والقيم صحيحة؟ هل حُولت المعلومة الغائبة إلى null؟ لا يعني ذلك أن كل مهمة تحتاج إجابة ذهبية واحدة؛ الأسلوب الإبداعي مثلًا يحتاج معايير أوسع من الصحة البنيوية.
نتائج الاختبار الفعلية
| المقياس | الطلب المختصر | الطلب المنظم |
|---|---|---|
| مجموع الدرجات من 150 | 121/150 | 140/150 |
| متوسط الدرجة من 10 | 8.07 | 9.33 |
| وسيط الدرجة من 10 | 9 | 10 |
| نتائج الأزواج الخمسة عشر | 4 انتصارات و5 تعادلات | 6 انتصارات و5 تعادلات |
| ادعاءات واقعية غير مدعومة بالمادة | 3 | 3 |
| مخالفات القيود الصريحة | 12 | 6 |
| مخرجات غير قابلة للاستخدام كما هي | 12 | 6 |
عبر الأزواج الخمسة عشر فازت النسخة المنظمة في 6، وفازت المختصرة في 4، وتعادلتا في 5. أما وسيط كل مهمة، بالترتيب «المختصر ثم المنظم»، فكان كما يلي:
| المهمة | وسيط المختصر | وسيط المنظم |
|---|---|---|
| T1: رسالة تغيير الموعد | 9 | 8 |
| T2: تلخيص التقرير | 7 | 10 |
| T3: استخراج JSON | 5 | 10 |
| T4: المنشور التعريفي | 9 | 8 |
| T5: اختيار الخطة | 10 | 10 |
تكشف النتائج أن فائدة التنظيم اعتمدت على نوع المهمة. كان أثره الأكبر في المخرجات ذات البنية الصارمة، خصوصًا JSON والتلخيص المقيد، بينما انخفض الوسيط نقطة في الرسالة والمنشور. لذلك لا تبرر النتيجة إضافة قالب طويل تلقائيًا إلى كل سؤال.

التقييم المعمى: رُمزت المخرجات دون إظهار نوع الطلب للمقيمين. اختلف المقيمان في 6 حالات من 30، ثم راجعا الحالات المختلف عليها وحُسمت الدرجات قبل حساب الملخص النهائي. وبعد ذلك أُجري تدقيق مستقل للادعاءات غير المدعومة، ومخالفات القيود، وقابلية استخدام المخرج كما هو.
نزّل بيانات التجربة: ملف ZIP يضم الطلبات والمخرجات والدرجات والتدقيق. يتيح الملف مراجعة الحسابات بدل الاعتماد على جدول الملخص وحده.
الاستنتاج المقيد بالقاعدة المسبقة: أحرزت النسخة المنظمة مجموعًا ومتوسطًا ووسيطًا أعلى، وخالفَت القيود أقل، وأنتجت مخرجات غير قابلة للاستخدام أقل. لكنها لم تنجح في الاختبار الكلي وفق القاعدة التي وضعناها قبل التنفيذ، لأن مكسب الوسيط كان +1 فقط. لا نغيّر العتبة بعد رؤية النتيجة ولا نصف هذا الفارق بأنه إثبات عام لتفوق الطلب المنظم.
كيف تحسن طلبك من دون أن تجعله معقدًا؟
- ابدأ بالنتيجة: اكتب ما تريد استخدامه في النهاية، لا موضوعًا عامًا فقط.
- قدم المادة الحاكمة: ألصق الحقائق أو النص الذي يجب الاعتماد عليه بدل مطالبة النموذج بتخمينه.
- افصل الحقائق عن التعليمات: استخدم عنوانًا للمادة وآخر للقيود حتى يسهل اكتشاف التعارض.
- حدد القيود المهمة فقط: الطول أو الجمهور أو الحقول أو ما يمنع اختلاق معلومة.
- اختر مخرجًا قابلًا للفحص: جدول أو قائمة أو Schema محددة عند الحاجة، لا لمجرد الزينة.
- صرح بطريقة التعامل مع النقص: اطلب
nullأو عبارة «غير متاح» بدل افتراض معلومة. - راجع الناتج: التنظيم يقلل مساحة التخمين لكنه لا يضمن الصحة.
إذا تغيرت إجابة ChatGPT رغم ثبات السؤال، راجع دليل اختلاف إجابات ChatGPT. وللتحقق من الحقائق والمصادر، راجع دليل الهلوسة والتحقق من الإجابات. أما المهام الممتدة فتحتاج أيضًا إلى إدارة السياق كما يشرح دليل المحادثات الطويلة.
أخطاء شائعة في كتابة الطلب
- طلب «اكتب أفضل مقال» من دون جمهور أو مادة أو هدف.
- وضع قيود متعارضة، مثل طلب إجابة شديدة الاختصار مع تغطية عشرات النقاط بالتفصيل.
- إخفاء الحقيقة الأساسية داخل فقرة طويلة ثم لوم النموذج على عدم التقاطها.
- طلب مراجع حقيقية من دون السماح بالبحث أو تقديم المصادر، ثم التعامل مع الروابط المولدة كأنها موثقة.
- الاعتماد على دور مبالغ فيه مثل «أنت أعظم خبير» بدل تعريف المهمة ومعيار النجاح.
- إدخال كلمات مرور أو بيانات صحية أو مالية أو أسرار عمل داخل المثال.
- اعتبار اللغة الواثقة دليلًا على صحة المحتوى.
أسئلة شائعة
هل الـPrompt الأطول أفضل دائمًا؟
لا. في اختبارنا كان وسيط النسخة المنظمة أعلى بثلاث نقاط في التلخيص وخمس نقاط في JSON، لكنه أقل بنقطة في الرسالة والمنشور، وتعادل في مهمة اختيار الخطة. الطلب الأفضل هو الذي يزيل غموضًا مؤثرًا من دون تكرار أو تعارض؛ سؤال بسيط قد يحتاج سطرًا واحدًا، بينما استخراج بيانات وفق Schema يحتاج قيودًا أكثر.
هل القالب المنظم يمنع الأخطاء؟
لا. سجل التدقيق 3 ادعاءات غير مدعومة في كل من النسختين المختصرة والمنظمة. خفض التنظيم مخالفات القيود من 12 إلى 6 والمخرجات غير القابلة للاستخدام من 12 إلى 6 في هذه العينة، لكنه لم يمنع الخطأ الواقعي. راجع الأرقام والأسماء والمراجع، خصوصًا في القرارات الطبية والمالية والقانونية.
لماذا قد تختلف النتيجة عند تكرار الطلب نفسه؟
يمكن أن تختلف المخرجات بسبب طبيعة التوليد، أو اختلاف النموذج والوضع والسياق والأدوات والإعدادات. لهذا استخدمنا ثلاث تكرارات لكل نسخة ولم ننتق أفضل مخرج فقط. ومع ذلك تظل ثلاثة تكرارات عينة صغيرة لا تكفي لتقدير أداء ثابت.
هل يجب أن أطلب من ChatGPT تمثيل دور خبير؟
قد يساعد الدور عندما يحدد جمهورًا أو زاوية مفيدة، لكنه ليس بديلًا عن المادة والقيود. لا يجعل وصف «خبير» النموذج مؤهلًا مهنيًا ولا يضمن صحة النتيجة.
هل أثبت الاختبار أن البرومبت المنظم أفضل؟
لا وفق شرطنا الكلي المحدد مسبقًا. تحسنت عدة مؤشرات، لكن زيادة الوسيط كانت نقطة واحدة فقط والمطلوب نقطتان على الأقل. النتيجة الأنسب هي أن القيود والبنية ساعدتا في بعض المهام أكثر من غيرها، لا أنهما وصفة تفوق عامة.
مصادر رسمية
- أفضل ممارسات كتابة الطلبات في ChatGPT — OpenAI Help Center
- أفضل ممارسات Prompt Engineering مع OpenAI API — OpenAI Help Center
- دليل Prompt Engineering للمطورين — OpenAI Developers
آخر مراجعة تحريرية: 2 أغسطس 2026. اكتملت 30 عملية تشغيل فعلية على ChatGPT Pro في وضع Instant ومحادثات مؤقتة ومن دون البحث في الويب، ثم أُنجز التقييم المعمى والتحكيم والتدقيق.

