اختبار دقة ChatGPT باللغة العربية: 21 مهمة في 7 محاور

اختبرنا دقة ChatGPT باللغة العربية في 2 أغسطس 2026 عبر 21 مهمة صالحة في سبعة محاور متساوية العدد: ثلاث مهام في كل محور. ضم محور اللهجات ثلاث مهام فقط، واحدة مصرية وواحدة شامية وواحدة خليجية. استوفت الردود 82 من 84 بندًا ثنائيًا، ثم أصبح المجموع النهائي 80 من 84 بعد تطبيق سقفين مجمّدين للادعاء الزائد في مهمتين. نستخدم «الدقة» هنا بمعنى إجرائي محدود: مجموع الدرجات النهائية بعد تطبيق البنود والسقوف المحددة في سلم هذا الاختبار. ليست الدرجة احتمالًا إحصائيًا للصواب، ولا «نسبة دقة عامة»، ولا حكمًا على كل نموذج أو خطة أو لهجة.

جمّدنا الأسئلة، ومفاتيح الإجابة، وقواعد 0–4، وترتيب التنفيذ قبل رؤية أي رد. في جولة القياس البديلة شغّلنا كل سؤال مرة واحدة في محادثة مؤقتة مستقلة على الواجهة التي أظهرت خطة Free ووضع Instant، من دون استخدام بحث ويب أو ملفات أو موصلات. ننشر هنا المنهجية والأسئلة والنصوص الخام المستخرجة من الواجهة والدرجات وحدود العينة، مع حزمة تنزيل تحتوي على اللقطات والبيانات كاملة.

لماذا نقول «جولة بديلة»؟ سبقتها جولة تجريبية كاملة أبطلناها كلها لأن ملتقط الواجهة حفظ بعض الردود قبل اكتمال البث. وثقنا العيب، وعدّلنا شرط الالتقاط فقط في ملحق مؤرخ، ثم أعدنا المهام الـ28 كاملة بالترتيب نفسه ومن دون اختيار وفق جودة الرد.

إذا كان هدفك شرح الخدمة والوصول إلى الدردشة بدل مراجعة بيانات الاختبار، فابدأ من دليل شات جي بي تي الرئيسي؛ هذه الصفحة تقرير اختبار أصلي أجراه فريق تحرير GPT Gate، وليست تقييمًا صادرًا عن OpenAI أو جهة أكاديمية.

نتائج اختبار دقة ChatGPT باللغة العربية

حصلت 17 مهمة على 4/4، وحصلت أربع مهام على 3/4، ولم تحصل أي مهمة على درجتين أو أقل. لكن هذا التوزيع لا يعني أن الأداء «مضمون»: لكل سؤال تشغيل صالح واحد فقط داخل النتيجة، وقد تختلف الإجابة عند الإعادة أو عند تغيير الخطة والوضع والتاريخ والسياق.

نتيجة عينة اختبار دقة ChatGPT باللغة العربية: 80 من 84 في 21 مهمة صالحة
بطاقة أصلية أُنشئت من ملف الدرجات النهائي. يوضح التنبيه لماذا لا نحول 80/84 إلى نسبة دقة عامة.
المحور المهام الدرجة ما الذي حدث؟
الفصحى 3 12/12 استوفت المهام الثلاث بنودها المجمدة.
اللهجات العربية 3 10/12 خُصمت نقطتان بسبب تضييق معنى وإزاحة إطار زمني.
التلخيص 3 12/12 حافظت الملخصات الثلاثة على الوقائع والقيود المطلوبة.
الحساب 3 12/12 اكتملت خطوات الحساب والنتائج والوحدات المطلوبة.
الحقائق الثابتة 3 11/12 أُضيف ادعاء تاريخي زائد في مهمة واحدة رغم صحة الحقول المطلوبة.
الترجمة 3 12/12 حافظت الترجمات الثلاث على المعنى والقيود.
اتباع التعليمات 3 11/12 فقدت مهمة واحدة نقطة تنسيق لغياب علامات القائمة.
درجات محاور اختبار ChatGPT بالعربية: الفصحى 12 من 12، اللهجات 10 من 12، التلخيص 12 من 12، الحساب 12 من 12، الحقائق 11 من 12، الترجمة 12 من 12، واتباع التعليمات 11 من 12
ثلاث مهام فقط في كل محور؛ الفروق مفيدة لتحديد مواضع المراجعة، لكنها أصغر من أن تثبت ترتيبًا عامًا بين القدرات.

كيف صممنا الاختبار؟

  1. تجميد داخلي مسبق للخطة (ليس تسجيلًا عامًا): أُنشئت 28 مهمة، وأربعة بنود ثنائية لكل مهمة، ومفاتيح مرجعية قبل تشغيل ChatGPT. بصمة SHA-256 لملف الخطة: 5b48e87f804bddd7a7b3b3fef189f58f1d4d4c0c1b6caa0157570033b3497233. تتيح البصمة مطابقة الملف الحالي بالنسخة المشار إليها، لكنها لا تثبت وحدها أن الملف كان موجودًا قبل الاختبار؛ فلم نودعه مسبقًا لدى طرف ثالث بختم زمني.
  2. جولة تجريبية مستبعدة: أُبطلت الجولة الأولى كاملة بسبب التقاط بعض الردود قبل اكتمالها. احتُفظ بملفاتها لأغراض التوثيق، لكنها لم تُحتسب ولم تُحلل بوصفها نتيجة نهائية، وأُعيدت المهام كلها بعد تشديد شرط الاكتمال.
  3. عزل السياق: محادثة مؤقتة مستقلة لكل سؤال، بلا بحث ويب أو ملفات أو موصلات، وبلا سؤال متابعة أو إعادة محاولة انتقائية.
  4. شرط اكتمال قابل للرصد: لم يُحفظ الرد حتى اختفى زر إيقاف الإجابة، وظهر إجراء نسخ الرد، واختفى مؤشر التقدم، وبقي النص متطابقًا في ثلاث قراءات متباعدة 1200 مللي ثانية.
  5. وقف تغير الإعداد: عند التشغيل 22 أعلنت الواجهة التحويل التلقائي إلى Mini بسبب حد الاستخدام. لم نراجع الإشعار إلا بعد اكتمال التشغيلات اللاحقة؛ ومع ذلك استُبعدت 22–28 كلها ابتداءً من أول موضع تغير، لا وفق جودة نتائجها. اعتمدنا البادئة المتوازنة 1–21 فقط: ثلاث مهام في كل محور.
  6. تقييم آلي مُعمّى جزئيًا: شاهد كل مسار السؤال، ومفتاح الإجابة، وقواعد التقييم، والرد، مع إخفاء معرّف المهمة وترتيبها. لم تتبادل العمليتان النتائج. بلغ الاتفاق الخام المطابق في الدرجات 18 من 21 حالة (85.7%)؛ وهذه نسبة اتفاق وصفية وليست معامل ثبات إحصائيًا. لم نسجل هوية نموذج التقييم أو إصداره أو مزوده؛ لذلك يعني «الانفصال» فصل المسارين إجرائيًا، ولا يثبت تنوع نماذج مختلفة. وُثقت الخلافات الثلاثة وحسمتها GPT Gate تحريريًا بالرجوع إلى القاعدة المجمدة؛ لا توجد لجنة محكمين بشرية.
  7. نزاهة النطاق: راجعت عملية تدقيق آلية منفصلة توازن الفئات، واللقطات، والبصمات، وعدم تسرب تشغيلات Mini إلى النتيجة. كانت النتيجة PASS لهذه الفحوص الميكانيكية فقط؛ ولا تعني صحة تصميم الدراسة أو استقلالًا خارجيًا.
لقطة أصلية من بيئة اختبار ChatGPT تظهر أن الحساب على الخطة المجانية
لقطة البيئة الأصلية التي توثق الخطة المجانية في حساب الاختبار بتاريخ 2 أغسطس 2026.
لقطة أصلية من محادثة ChatGPT المؤقتة تظهر وضع Instant في الاختبار
لقطة البيئة الأصلية التي توثق المحادثة المؤقتة واسم وضع Instant الظاهر. لم نستنتج منها اسم نموذج خلفي غير معروض.
منهجية اختبار ChatGPT بالعربية من تجميد الخطة وعزل السياق إلى التوقف المنضبط والتقييم الآلي المُعمّى جزئيًا والنتيجة
سير العمل الفعلي للاختبار. الأتمتة استُخدمت في التقاط الواجهة وتجميع البيانات والتقييم؛ ولا نقدمها بوصفها دراسة بشرية أكاديمية.

قاعدة الدرجات 0–4

لكل مهمة أربعة بنود محددة مسبقًا، وكل بند يساوي نقطة واحدة إذا استُوفي بالكامل. لا توجد أنصاف نقاط. تطبق حدود عامة تمنع منح درجة مرتفعة لرد غير قابل للاستخدام أو لرد يغير المعنى جوهريًا أو يضيف ادعاءات غير مدعومة. تُعرض البنود وتطبيقها تحت كل نص خام أدناه.

  • 4/4: استيفاء البنود الأربعة من دون سبب يفرض سقفًا.
  • 3/4: بند واحد غير مستوفى أو ادعاء زائد واحد محدود.
  • 2/4 أو 1/4: استيفاء جزئي مع نقص جوهري وفق القاعدة الخاصة بالمهمة.
  • 0/4: رد غير قابل للاستخدام وفق شروط العدم المجمدة.

استُوفي 82/84 بندًا ثنائيًا: خسرت DIA-02 وINS-02 بندًا واحدًا لكل منهما، بينما استوفت DIA-01 وFAC-01 بنودهما الأربعة ثم خُفّضت كل درجة من 4 إلى 3 بسقف الادعاء الزائد المجمد. لذلك كان المجموع النهائي 80/84. بنود السلم متساوية في النقاط لأغراض هذا الاختبار، لكنها ليست معايرة لتكون متساوية في الصعوبة أو الأهمية؛ فالنتيجة مجموع وصفي داخل العينة، لا مقياس احتمالي عام للدقة.

أين خسر ChatGPT أربع نقاط؟

جاءت نقطتان من بندين غير مستوفيين في DIA-02 وINS-02، وجاءت النقطتان الأخريان من سقفين مجمّدين خفّضا DIA-01 وFAC-01 من 4/4 أساسية إلى 3/4 نهائية بسبب ادعاء زائد. هذا هو سبب اختلاف مجموع البنود المستوفاة (82) عن المجموع النهائي (80).

1. اللهجة المصرية: تضييق «أجيب الطلبات»

نقلت الإجابة الوحدات الدلالية الأربع في بنيتها العامة. «شراء المستلزمات» قراءة سياقية ممكنة، لكنها أضيق من «أجيب الطلبات» وليست مفروضة بالنص؛ لذلك فعّلت سياسة التضييق المجمدة سقف الادعاء الزائد الواحد، وكانت النتيجة النهائية 3/4. أكدت عملية مراجعة لهجية آلية منفصلة، لم تطلع على ملفات الدرجات، أن تطبيق السقف قابل للدفاع عنه، مع بقاء القراءة اللهجية حدّية.

2. اللهجة الشامية: تغيير إطار «بكرا»

فهم الرد عناصر التأجيل والإبلاغ، لكنه صاغ «قدّم الموعد إلى الغد» بدل إبقاء «بكرا» إطارًا زمنيًا للشرط. كتبت «قدّم» من دون ضبط حركي كامل يزيل الالتباس، لذا يمكن قراءتها أمرًا أو ماضيًا؛ وفي الحالين يضيف الرد نقل الموعد، وهو غير موجود في الأصل. كانت الدرجة المعتمدة 3/4. احتساب «منذ هذه الليلة» استيفاءً للإبلاغ حكم حدّي؛ قراءة فصيحة أشد قد تخصم نقطة أخرى وتجعل المهمة 2/4، وهو تحليل حساسية لا نطبقه بأثر رجعي.

لقطة أصلية لرد ChatGPT على مهمة اللهجة الشامية DIA-02 في اختبار اللغة العربية
لقطة أصلية من التشغيل الصالح DIA-02. النص الكامل، السؤال، والسبب التفصيلي للدرجة منشورة في قسم المخرجات الخام.

3. حقيقة ثابتة: إجابة صحيحة مع زيادة غير موثقة

في مهمة تعريف المتر، ذكر الرد القيمة والوحدة وحالة الدقة والمسافة المطلوبة بصورة صحيحة، ثم أضاف: «فقد ثُبِّتت هذه القيمة بالتعريف منذ عام 1983». يثبت قرار BIPM الرسمي لعام 1983 تثبيت القيمة آنذاك. أما صياغة تعريف 1983 نفسها فأُلغيَت بقرار BIPM لعام 2018 الذي دخل حيز التنفيذ في 2019، مع بقاء القيمة الدقيقة لسرعة الضوء. الادعاء الزائد لم يكن واردًا في صفحة التعريف الحالية التي عيّنها بروتوكول المهمة مصدرًا وحيدًا للتقييم؛ لذلك كانت 3/4 عقوبة مصدرية وفق القاعدة المجمدة، لا حكمًا بأن العام خاطئ.

4. اتباع التعليمات: المحتوى صحيح والتنسيق ناقص

كتب الرد الأسطر الثلاثة بالترتيب وبعدد الكلمات المطلوب، لكنه لم يسبقها بعلامات قائمة Markdown كما طلب السؤال. اختلف مسارا التقييم: اعتبر أحدهما غياب قائمة Markdown موجبًا للصفر، بينما اعتبر الآخر الأسطر الثلاثة قائمة قابلة للعد فخصم بند التنسيق فقط. اعتمد الفصل التحريري 3/4؛ ولو اتُّبع التفسير الأشد لكان الإجمالي 77/84 بدل 80/84. ننشر الحساسية بدل إخفائها.

عيب في القاعدة المجمدة لم نصلحه بأثر رجعي

في DIA-03 حذف الرد الأثر التداولي لـ«ترى»، وأضاف تمهيدًا وكلمة Writing رغم أن السؤال طلب «من دون شرح». استوفى البنود الدلالية الأربعة المجمدة، لأنها لم تخصص بندًا للأثر التداولي أو لقيد عدم الشرح، فبقيت الدرجة 4/4. هذه درجة وفق الوحدات المقيسة، وليست ادعاء تكافؤ تداولي وشكلي كامل. نسجل ذلك بوصفه عيبًا في تصميم الـRubric، ولا نغير الدرجة بعد رؤية المخرج.

هذا الفصل بين «صحة المعلومة» و«اتباع شكل الإجابة» مهم عمليًا. إذا كنت تبني طلبًا للاستخدام المتكرر، راجع دليل كتابة البرومبت، وإذا كان الخطر هو الادعاءات الزائدة فانتقل إلى دليل هلوسة ChatGPT.

جدول المهام والدرجات

المعرّف المحور الخلاصة الدرجة
FUS-01 الفصحى استوفى البنود الأربعة. 4/4
DIA-01 اللهجات العربية ضيّق معنى «أجيب الطلبات» إلى شراء المستلزمات. 3/4
SUM-01 التلخيص استوفى البنود الأربعة. 4/4
CAL-01 الحساب استوفى البنود الأربعة. 4/4
FAC-01 الحقائق الثابتة استوفى الحقول المطلوبة ثم أضاف تأريخًا غير مثبت بالمصدر المحدد. 3/4
TRN-01 الترجمة استوفى البنود الأربعة. 4/4
INS-01 اتباع التعليمات استوفى البنود الأربعة. 4/4
DIA-02 اللهجات العربية غيّر إطار «بكرا» إلى اقتراح نقل الموعد إلى الغد. 3/4
SUM-02 التلخيص استوفى البنود الأربعة. 4/4
CAL-02 الحساب استوفى البنود الأربعة. 4/4
FAC-02 الحقائق الثابتة استوفى البنود الأربعة. 4/4
TRN-02 الترجمة استوفى البنود الأربعة. 4/4
INS-02 اتباع التعليمات استوفى محتوى الأسطر الثلاثة لكنه لم يستخدم علامات القائمة المطلوبة. 3/4
FUS-02 الفصحى استوفى البنود الأربعة. 4/4
SUM-03 التلخيص استوفى البنود الأربعة. 4/4
CAL-03 الحساب استوفى البنود الأربعة. 4/4
FAC-03 الحقائق الثابتة استوفى البنود الأربعة. 4/4
TRN-03 الترجمة استوفى البنود الأربعة. 4/4
INS-03 اتباع التعليمات استوفى البنود الأربعة. 4/4
FUS-03 الفصحى استوفى البنود الأربعة. 4/4
DIA-03 اللهجات العربية استوفى البنود الأربعة. 4/4

تنزيل البيانات وإعادة الاختبار

نزّل حزمة اختبار دقة ChatGPT بالعربية، الإصدار 1.2 (ZIP). تضم الحزمة ملف الخطة المجمد داخليًا، والنصوص الخام المستخرجة من الواجهة بصيغة JSON، والدرجات التفصيلية بصيغتي JSON وCSV، وملفي التقييم الآلي، وسجل حسم الخلافات، وتدقيق النزاهة، و23 لقطة أصلية.

بصمة ملف ZIP: fd8c720e72ed4142a7968f970eadda2791c318efdd0bf59adcf6dab37bede6db (ملف SHA-256 نصي).

بصمة ملف النصوص الخام JSON: 23e9c37939f308b0d7fe169ca4d9ed0ba5e4856cddddc118db72120be08aef17.

ما فائدة البصمة؟ تساعد SHA-256 القارئ على التأكد من أن الملف الذي نزله مطابق بايتًا ببايت للنسخة المشار إليها، وعلى كشف التلف أو التغيير. لا تثبت البصمة صحة البيانات أو مصدرها أو وقت إنشائها، ولا تمنع استبدال الملف والبصمة معًا على الخادم نفسه، وليست توقيعًا رقميًا أو ختمًا زمنيًا خارجيًا.

لإعادة التجربة بأمان منهجي، استخدم ملف الخطة المجمد داخليًا نفسه، وشغّل كل سؤال في سياق مستقل، وسجل الخطة والوضع والتاريخ والأدوات الظاهرة، وحدد قاعدة اكتمال قبل البدء. لا تستبدل ردًا ضعيفًا بإعادة أفضل، ولا تخلط نتائج وضعين في نتيجة واحدة من دون إعلان.

ماذا تثبت النتيجة وماذا لا تثبت؟

ما تدعمه العينة

  • في هذه التشغيلات الـ21، استوفت الردود 82/84 بندًا ثنائيًا، ثم سجّلت 80/84 نهائية بعد تطبيق سقفين مجمّدين.
  • تظهر البيانات أربعة أنواع خطأ قابلة للمراجعة: تضييق معنى، وإزاحة زمنية، وادعاء زائد، ومخالفة تنسيق.
  • يمكن لأي قارئ مطابقة السؤال والرد والقاعدة والدرجة بدل الاعتماد على انطباع المحرر.

ما لا تدعمه العينة

  • لا تثبت أن «دقة ChatGPT بالعربية 95.2%»؛ قسمة النقاط على الحد الأقصى لا تحول عينة صغيرة متنوعة إلى معدل دقة سكاني.
  • لا تقارن Free بـPlus أوPro، ولا تقارن Instant بـThinking أوMini، ولا تحدد اسم النموذج الخلفي الذي لم تعرضه الواجهة.
  • لا تقيس ثبات الإجابة؛ لكل سؤال تشغيل صالح واحد فقط داخل النتيجة.
  • لا تمثل كل اللهجات العربية. اختبرت ثلاث مهام لهجية صالحة فقط: المصرية والشامية والخليجية، ولا توجد لجنة ناطقين أصليين ممثلة لكل منطقة.
  • المهام مختارة تحريريًا وليست عينة عشوائية من أسئلة المستخدمين العرب، وتساوي أوزان المحاور لا يعكس انتشارها الفعلي. في محور اللهجات توجد مهمة واحدة فقط لكل تسمية لهجية واسعة: المصرية والشامية والخليجية.
  • لم نسجل حالة التعليمات المخصصة وقت التشغيل؛ لذلك تبقى متغيرًا غير مضبوط محتملًا، ولا تعد المحادثة المؤقتة وحدها دليلًا على غيابها.
  • لا تقيس البحث على الويب أو تحليل الملفات أو الصور أو الصوت أو البرمجة بأداة تنفيذ؛ لم نستخدم هذه الأدوات.
  • درجة INS-02 حساسة لتفسير «القائمة»: التفسير التحريري المعتمد يعطي الإجمالي 80/84، والتفسير الأشد يعطي 77/84.
  • لم يسجل الـRubric الأثر التداولي لـ«ترى» ولا قيد «من دون شرح» في DIA-03؛ لذلك لا تعني 4/4 تكافؤًا تداوليًا أو امتثالًا شكليًا كاملًا.
  • صياغة بند DIA-02 عن «غدًا» أضيق من أساس الحكم الفعلي، واحتساب «منذ هذه الليلة» استيفاءً لبند الإبلاغ قرار حدّي؛ قراءة أشد قد تجعل المهمة 2/4.
  • لا تعني الدرجة أن الردود مناسبة لقرارات طبية أو قانونية أو مالية. تنصح OpenAI نفسها بالتحقق من المعلومات المهمة من مصادر موثوقة.
  • لا يوجد هامش خطأ أو فاصل ثقة صالح؛ فالمهام مختارة تحريريًا وليست عينة احتمالية ممثلة.

قد تختلف الإجابة عند إعادة السؤال. يشرح دليل اختلاف إجابات ChatGPT لماذا لا يكفي تشغيل واحد للحكم على الاستقرار، بينما يوثق دليل تحديثات نماذج ChatGPT تغير الخيارات بمرور الوقت، وتعرض صفحة استخدامات شات جي بي تي كيف تبني مهام عملية مع مراجعة بشرية.

المصادر الرسمية والسياق البحثي

مصادر رسمية استُخدمت في بناء الاختبار

كيف يختلف هذا الاختبار عن الأبحاث الأكاديمية؟

توجد معايير عربية أوسع بكثير، منها GPTAraEval، وArabicMMLU، وLAraBench، وAraDiCE، وArabCulture-Dialogue. تختلف هذه الأعمال في مجموعات البيانات والنماذج والأسئلة والتحكيم، لذلك لا نقارن أرقامها بنتيجتنا. قيمة هذا الاختبار أضيق: لقطة موثقة وقابلة للتدقيق لتجربة منتج ChatGPT على الويب في تاريخ وإعداد محددين.

نشر الأسئلة والمخرجات وطريقة الإنتاج والأدلة المرئية يتسق مع إرشادات Google للمحتوى المفيد بشأن البحث الأصلي والشفافية؛ Google ليست مصدرًا لنتيجة الاختبار، ولا يضمن ذلك ترتيبًا معينًا.

الأسئلة والنصوص الخام وقواعد التقييم

تفتح العناصر التالية السؤال المجمد، والنص الخام كما استُخرج من الواجهة، ومفتاح الإجابة، والبنود الأربعة، وسبب الدرجة. لم نصحح النصوص إملائيًا أو نعيد تنسيقها داخل حقل «النص الخام». تمثل اللقطات الدليل البصري على مظهر الواجهة، بينما يمثل JSON النص المستخرج منها. تُدرج اللقطات الـ21 ولقطتا البيئة في حزمة التنزيل.

FUS-01 — الفصحى — 4/4

السؤال المجمد:

صحّح الجملة الآتية تصحيحًا نحويًا فقط، واكتب الجملة المصححة وحدها من دون شرح: «إن هذان الباحثان لن يهملون ملاحظاتهم في التقرير.»

النص الخام كما استُخرج من الواجهة:

إنَّ هذين الباحثين لن يُهمِلَا ملاحظاتِهما في التقرير.

مفتاح الإجابة/المرجع:

إن هذين الباحثين لن يهملا ملاحظاتهما في التقرير.

نوع المرجع: مادة مكتفية ذاتيًا داخل السؤال؛ لا يلزم مصدر خارجي لتقييمها.

تطبيق البنود الأربعة:

  1. مستوفى: استبدال «هذان» بـ«هذين». وردت «هذين» صراحة.
  2. مستوفى: جر «الباحثان» إلى «الباحثين». وردت «الباحثين» بالياء.
  3. مستوفى: جزم الفعل للمثنى: «لن يهملا». جاء الفعل «لن يُهمِلَا» بصيغة المثنى المطلوبة.
  4. مستوفى: مطابقة ضمير الملكية للمثنى: «ملاحظاتهما»، مع بقاء المعنى وبقية الكلمات الأساسية. استُعملت «ملاحظاتهما» وبقي المعنى والكلمات الأساسية.

درجات مسارَي التقييم الآلي قبل الفصل: E = 4/4، F = 4/4 (تطابق).

النتيجة: 4/4 — الجملة المصححة تستوفي التصحيحات النحوية الأربعة من دون تغيير المعنى. تطابقت عمليتا التقييم الآلي في الدرجة؛ لم يلزم فصل تحريري إضافي.

زمن الواجهة المسجل: 12.0 ثانية. اكتمل الرد بعد اختفاء زر الإيقاف، وظهور أدوات الرد، وثبات النص في ثلاث قراءات تفصل بينها 1200 مللي ثانية.

DIA-01 — اللهجات العربية — 3/4

السؤال المجمد:

أعد صياغة العبارة المصرية التالية بالعربية الفصحى مع الحفاظ على معناها، في جملة أو جملتين فقط ومن دون شرح: «أنا نازل أجيب الطلبات، ولو لقيت المحل قافل هكلمك ونشوف نعمل إيه.»

النص الخام كما استُخرج من الواجهة:

أنا ذاهب لشراء المستلزمات، فإن وجدتُ المتجر مغلقًا سأتصل بك لنتشاور في ما ينبغي فعله.

مفتاح الإجابة/المرجع:

أنا ذاهب لإحضار الطلبات، وإذا وجدت المتجر مغلقًا فسأتصل بك لنقرر ما سنفعله.

نوع المرجع: مادة مكتفية ذاتيًا داخل السؤال؛ لا يلزم مصدر خارجي لتقييمها.

تطبيق البنود الأربعة:

  1. مستوفى: ينقل الذهاب لإحضار الطلبات. «ذاهب لشراء المستلزمات» ينقل في السياق معنى الخروج لجلب الحاجات المطلوبة.
  2. مستوفى: ينقل شرط العثور على المتجر مغلقًا. حافظت الصياغة على شرط «فإن وجدتُ المتجر مغلقًا».
  3. مستوفى: ينقل الاتصال بالمخاطب عند تحقق الشرط. جعلت الاتصال بالمخاطب نتيجة لتحقق الشرط.
  4. مستوفى: ينقل اتخاذ القرار معًا بعد الاتصال. عبارة «لنتشاور في ما ينبغي فعله» تنقل اتخاذ القرار معًا.

ادعاء زائد: جعل الطلبات «مستلزمات» وجعل الإحضار شراءً، وهو تضييق موضوعي غير مسند يفعّل سقف الادعاء الزائد الواحد.

درجات مسارَي التقييم الآلي قبل الفصل: E = 4/4، F = 3/4 (اختلاف موثق).

النتيجة: 3/4 — نُقلت الوحدات الدلالية الأربع على مستوى البنية العامة؛ لكن تحويل الإحضار إلى شراء والطلبات إلى مستلزمات يضيف تضييقًا موضوعيًا واحدًا، فتكون الدرجة الأساسية 4 والسقف النهائي 3. اعتمدت 3/4. «أجيب الطلبات» أوسع من «شراء المستلزمات»؛ الرد نقل بقية المعنى لكنه ضيّق طريقة التحصيل وطبيعة الأغراض. أيدت عملية مراجعة لهجية آلية منفصلة، لم تطلع على ملفات الدرجات، هذا الحكم.

توضيح تحريري لاحق: «شراء المستلزمات» قراءة سياقية ممكنة، لكنها ليست المعنى الوحيد الذي يفرضه «أجيب الطلبات». أبقينا سقف التضييق المجمد ونسجل أن الحكم اللهجي حدّي.

زمن الواجهة المسجل: 12.3 ثانية. اكتمل الرد بعد اختفاء زر الإيقاف، وظهور أدوات الرد، وثبات النص في ثلاث قراءات تفصل بينها 1200 مللي ثانية.

SUM-01 — التلخيص — 4/4

السؤال المجمد:

لخّص النص الآتي بالعربية في 45 كلمة كحد أقصى، من دون إضافة معلومات: «بدأت مكتبة حي النور في 3 مارس تجربة لإعارة أجهزة قراءة إلكترونية في فرعين. سجّل 120 شخصًا، وأكمل 84 منهم جلسة التعريف. أظهر الاستبيان الختامي رضا 91% من المشاركين. بناءً على ذلك قرر المجلس توسيع التجربة إلى أربعة فروع في الربع التالي.»

النص الخام كما استُخرج من الواجهة:

بدأت مكتبة حي النور في 3 مارس تجربة لإعارة أجهزة قراءة إلكترونية بفرعين. سجّل 120 شخصًا، وأكمل 84 جلسة التعريف، وأظهر الاستبيان رضا 91% من المشاركين، فقرر المجلس توسيع التجربة إلى أربعة فروع في الربع التالي.

مفتاح الإجابة/المرجع:

بدأت مكتبة حي النور في 3 مارس تجربة إعارة إلكترونية بفرعين؛ سجّل 120 شخصًا وأكمل 84 جلسة التعريف، وبلغ الرضا 91%، فقرر المجلس توسيعها إلى أربعة فروع في الربع التالي.

نوع المرجع: مادة مكتفية ذاتيًا داخل السؤال؛ لا يلزم مصدر خارجي لتقييمها.

تطبيق البنود الأربعة:

  1. مستوفى: يذكر بدء التجربة في 3 مارس وفي فرعين. ذُكر تاريخ 3 مارس وأن التجربة بدأت بفرعين.
  2. مستوفى: يذكر تسجيل 120 وإكمال 84 جلسة التعريف. ذُكر تسجيل 120 وإكمال 84 جلسة التعريف.
  3. مستوفى: يذكر نسبة الرضا 91%. ذُكرت نسبة الرضا 91%.
  4. مستوفى: يذكر قرار التوسعة إلى أربعة فروع في الربع التالي. ذُكر قرار التوسعة إلى أربعة فروع في الربع التالي.

درجات مسارَي التقييم الآلي قبل الفصل: E = 4/4، F = 4/4 (تطابق).

النتيجة: 4/4 — الملخص يحافظ على الوقائع الأربع ويقع في 36 كلمة، ضمن الحد. تطابقت عمليتا التقييم الآلي في الدرجة؛ لم يلزم فصل تحريري إضافي.

زمن الواجهة المسجل: 12.3 ثانية. اكتمل الرد بعد اختفاء زر الإيقاف، وظهور أدوات الرد، وثبات النص في ثلاث قراءات تفصل بينها 1200 مللي ثانية.

CAL-01 — الحساب — 4/4

السؤال المجمد:

فاتورة تضم 3 دفاتر بسعر 48 ريالًا للدفتر وقطعتين بسعر 35 ريالًا للقطعة. يُخصم 10% من مجموع السلع، ثم تُضاف رسوم توصيل ثابتة قدرها 12 ريالًا. احسب: مجموع السلع، قيمة الخصم، المبلغ بعد الخصم، والإجمالي النهائي. اعرض القيم الأربع بوضوح.

النص الخام كما استُخرج من الواجهة:

الحساب خطوة بخطوة:

مجموع السلع:

3 دفاتر × 48 = 144 ريالًا

قطعتان × 35 = 70 ريالًا

المجموع = 144 + 70 = 214 ريالًا

قيمة الخصم (10%):

214 × 10% = 21.40 ريالًا

المبلغ بعد الخصم:

214 − 21.40 = 192.60 ريالًا

الإجمالي النهائي (بعد إضافة رسوم التوصيل 12 ريالًا):

192.60 + 12 = 204.60 ريالًا

النتائج النهائية:

مجموع السلع: 214.00 ريالًا

قيمة الخصم: 21.40 ريالًا

المبلغ بعد الخصم: 192.60 ريالًا

الإجمالي النهائي: 204.60 ريالًا

مفتاح الإجابة/المرجع:

{
  "itemsSubtotal": 214,
  "discount": 21.4,
  "afterDiscount": 192.6,
  "finalTotal": 204.6
}

نوع المرجع: مادة مكتفية ذاتيًا داخل السؤال؛ لا يلزم مصدر خارجي لتقييمها.

تطبيق البنود الأربعة:

  1. مستوفى: مجموع السلع = 214 ريالًا. حُسب مجموع السلع 214 ريالًا.
  2. مستوفى: قيمة الخصم = 21.4 ريالًا. حُسب الخصم 21.40 ريالًا، وهو يساوي 21.4.
  3. مستوفى: بعد الخصم = 192.6 ريالًا. حُسب المبلغ بعد الخصم 192.60 ريالًا.
  4. مستوفى: الإجمالي بعد التوصيل = 204.6 ريالًا. حُسب الإجمالي بعد إضافة التوصيل 204.60 ريالًا.

درجات مسارَي التقييم الآلي قبل الفصل: E = 4/4، F = 4/4 (تطابق).

النتيجة: 4/4 — القيم الحسابية الأربع صحيحة ومسماة بوضوح. تطابقت عمليتا التقييم الآلي في الدرجة؛ لم يلزم فصل تحريري إضافي.

زمن الواجهة المسجل: 11.7 ثانية. اكتمل الرد بعد اختفاء زر الإيقاف، وظهور أدوات الرد، وثبات النص في ثلاث قراءات تفصل بينها 1200 مللي ثانية.

FAC-01 — الحقائق الثابتة — 3/4

السؤال المجمد:

وفق التعريف الرسمي للمتر في النظام الدولي للوحدات، أجب عن أربعة عناصر: القيمة العددية الدقيقة لسرعة الضوء في الفراغ، رمز الوحدة، هل القيمة دقيقة أم مقيسة تقريبيًا، وما المسافة التي يقطعها الضوء في الفراغ خلال 1/299,792,458 من الثانية. أجب من معرفتك بلا ويب.

النص الخام كما استُخرج من الواجهة:

وفق التعريف الرسمي للمتر في النظام الدولي للوحدات (SI):

القيمة العددية الدقيقة لسرعة الضوء في الفراغ:
299,792,458 مترًا في الثانية.

رمز الوحدة:
m/s (أو m·s⁻¹).

هل القيمة دقيقة أم مقيسة تقريبيًا؟
دقيقة (Exact)، وليست قيمة مقيسة تقريبيًا. فقد ثُبِّتت هذه القيمة بالتعريف منذ عام 1983.

ما المسافة التي يقطعها الضوء في الفراغ خلال 
299,792,458
1
	​

 من الثانية؟
متر واحد بالضبط.

وهذا هو أساس التعريف الرسمي للمتر: المتر هو طول المسار الذي يقطعه الضوء في الفراغ خلال فترة زمنية مقدارها 
299,792,458
1
	​

 من الثانية.

مفتاح الإجابة/المرجع:

{
  "numericValue": "299792458",
  "unitSymbol": "m s−1 أو m/s",
  "status": "قيمة دقيقة/مثبتة بالتعريف",
  "distance": "متر واحد"
}

المصدر المرجعي المحدد مسبقًا: BIPM — SI base unit: metre (m) (تم التحقق في 2026-08-02).

تطبيق البنود الأربعة:

  1. مستوفى: القيمة 299,792,458. ذكر القيمة العددية 299,792,458.
  2. مستوفى: الوحدة m/s أو m s⁻¹. ذكر m/s وكذلك الصيغة m·s⁻¹.
  3. مستوفى: يصرح بأنها قيمة دقيقة مثبتة بالتعريف، لا قياسًا تقريبيًا. صرح بأنها دقيقة ومثبتة بالتعريف وليست مقيسة تقريبًا.
  4. مستوفى: المسافة في الزمن المحدد هي متر واحد. ذكر أن المسافة متر واحد بالضبط.

ادعاء زائد: أضاف أن تثبيت القيمة بالتعريف يعود إلى عام 1983؛ هذا تاريخ موضوعي غير وارد في مادة المهمة أو مفتاح الإجابة داخل الحزمة.

درجات مسارَي التقييم الآلي قبل الفصل: E = 4/4، F = 3/4 (اختلاف موثق).

النتيجة: 3/4 — العناصر المطلوبة الأربعة صحيحة، لكن التاريخ الإضافي ادعاء جوهري واحد لا تسنده المادة المتاحة في الحزمة، فيطبق حد 3/4. اعتمدت 3/4. العناصر الأربعة المطلوبة صحيحة، لكن إضافة «منذ عام 1983» ادعاء تاريخي غير مسند في المادة أو صفحة BIPM المحددة، فيطبق حد الادعاء الإضافي الواحد.

زمن الواجهة المسجل: 12.3 ثانية. اكتمل الرد بعد اختفاء زر الإيقاف، وظهور أدوات الرد، وثبات النص في ثلاث قراءات تفصل بينها 1200 مللي ثانية.

TRN-01 — الترجمة — 4/4

السؤال المجمد:

ترجم الجملة الآتية إلى الإنجليزية ترجمة دقيقة وطبيعية، من دون شرح أو إضافة: «أغلق المختبر أبوابه عند الخامسة، لكن فريق الصيانة بقي حتى السابعة، ولم تُفقد أي عينة.»

النص الخام كما استُخرج من الواجهة:

The laboratory closed its doors at five o'clock, but the maintenance team stayed until seven, and no samples were lost.

مفتاح الإجابة/المرجع:

أغلق المختبر أبوابه عند الخامسة، لكن فريق الصيانة بقي حتى السابعة، ولم تُفقد أي عينة.

نوع المرجع: مادة مكتفية ذاتيًا داخل السؤال؛ لا يلزم مصدر خارجي لتقييمها.

تطبيق البنود الأربعة:

  1. مستوفى: ينقل إغلاق المختبر عند الخامسة. ذكرت الترجمة أن المختبر أغلق عند الخامسة.
  2. مستوفى: يحافظ على الاستدراك بين الإغلاق وبقاء الفريق. استُعمل but لربط الإغلاق ببقاء الفريق استدراكيًا.
  3. مستوفى: ينقل بقاء فريق الصيانة حتى السابعة. ذكرت الترجمة بقاء فريق الصيانة حتى السابعة.
  4. مستوفى: ينقل أن أي عينة لم تُفقد، دون قلب النفي. عبارة no samples were lost تحافظ على النفي والمعنى.

درجات مسارَي التقييم الآلي قبل الفصل: E = 4/4، F = 4/4 (تطابق).

النتيجة: 4/4 — نُقلت الوقائع الأربع وعلاقتها من دون قلب أو إضافة جوهرية. تطابقت عمليتا التقييم الآلي في الدرجة؛ لم يلزم فصل تحريري إضافي.

زمن الواجهة المسجل: 12.2 ثانية. اكتمل الرد بعد اختفاء زر الإيقاف، وظهور أدوات الرد، وثبات النص في ثلاث قراءات تفصل بينها 1200 مللي ثانية.

INS-01 — اتباع التعليمات — 4/4

السؤال المجمد:

حوّل البيانات التالية إلى سطر JSON واحد فقط، بلا سياج شيفرة ولا شرح، وبالمفاتيح بهذا الترتيب: product ثم price ثم available. البيانات: المنتج «قلم»، السعر 12، متاح نعم. اجعل السعر رقمًا، والتوفر قيمة منطقية.

النص الخام كما استُخرج من الواجهة:

{"product":"قلم","price":12,"available":true}

مفتاح الإجابة/المرجع:

المنتج قلم؛ السعر 12؛ متاح نعم.

نوع المرجع: مادة مكتفية ذاتيًا داخل السؤال؛ لا يلزم مصدر خارجي لتقييمها.

تطبيق البنود الأربعة:

  1. مستوفى: المخرج سطر واحد من JSON صالح فقط، بلا سياج أو شرح. المخرج كائن JSON صالح في سطر واحد ولا يحيط به شرح أو سياج.
  2. مستوفى: المفاتيح الثلاثة فقط وبالترتيب product ثم price ثم available. توجد المفاتيح الثلاثة وحدها وبالترتيب المطلوب.
  3. مستوفى: product يساوي «قلم» وprice يساوي العدد 12 لا نصًا. قيمة product هي «قلم» وقيمة price عددية وتساوي 12.
  4. مستوفى: available يساوي القيمة المنطقية true لا السلسلة «نعم». قيمة available هي true المنطقية.

درجات مسارَي التقييم الآلي قبل الفصل: E = 4/4، F = 4/4 (تطابق).

النتيجة: 4/4 — المخرج يطابق بنية JSON المطلوبة وقيمها وأنواعها وترتيبها. تطابقت عمليتا التقييم الآلي في الدرجة؛ لم يلزم فصل تحريري إضافي.

زمن الواجهة المسجل: 13.0 ثانية. اكتمل الرد بعد اختفاء زر الإيقاف، وظهور أدوات الرد، وثبات النص في ثلاث قراءات تفصل بينها 1200 مللي ثانية.

DIA-02 — اللهجات العربية — 3/4

السؤال المجمد:

أعد صياغة العبارة الشامية التالية بالعربية الفصحى مع الحفاظ على معناها، في جملة أو جملتين فقط ومن دون شرح: «بكرا إذا ما زبط الموعد، منأجّل الزيارة للأسبوع الجاي، بس خبرني من الليلة.»

النص الخام كما استُخرج من الواجهة:

قدّم الموعد إلى الغد، فإن لم ينجح فسنؤجل الزيارة إلى الأسبوع المقبل، ولكن أبلغني بذلك منذ هذه الليلة.

مفتاح الإجابة/المرجع:

غدًا، إذا لم يناسب الموعد، فسنؤجل الزيارة إلى الأسبوع المقبل، لكن أخبرني الليلة.

نوع المرجع: مادة مكتفية ذاتيًا داخل السؤال؛ لا يلزم مصدر خارجي لتقييمها.

تطبيق البنود الأربعة:

  1. غير مستوفى: يذكر غدًا دون تحويله إلى اليوم. حوّل «غدًا» من إطار زمني للشرط إلى إجراء جديد بنقل الموعد إلى الغد.
  2. مستوفى: يحافظ على شرط عدم ملاءمة أو نجاح الموعد. حافظ على الشرط بصيغة «فإن لم ينجح».
  3. مستوفى: يذكر تأجيل الزيارة إلى الأسبوع المقبل. ذكر تأجيل الزيارة إلى الأسبوع المقبل.
  4. مستوفى: يطلب من المخاطب الإخبار الليلة. طلب من المخاطب أن يبلغه هذه الليلة، وإن كانت الصياغة بـ«منذ» غير طبيعية.

ادعاء زائد: «قدّم الموعد إلى الغد» إجراء جديد غير مسنود ويغير وظيفة «غدًا» في النص الأصلي.

درجات مسارَي التقييم الآلي قبل الفصل: E = 3/4، F = 3/4 (تطابق).

النتيجة: 3/4 — ثلاث وحدات معنى مستوفاة، لكن أضيف نقل جوهري للموعد غير موجود وحُوّل الإطار الزمني؛ لذلك الدرجة الأساسية 3 ويُسجل حد الادعاء الواحد 3/4. تطابقت عمليتا التقييم الآلي في الدرجة؛ لم يلزم فصل تحريري إضافي.

توضيح تحريري لاحق: ظهرت «قدّم» من دون ضبط حركي كامل يزيل الالتباس، ويمكن قراءتها فعل أمر أو فعلًا ماضيًا؛ وفي القراءتين يضيف الرد نقل الموعد، وهو غير موجود في الأصل. وصفها ملف الفصل المجمد بأنها «أمر» بجزم أكبر مما تسمح به الكتابة. صححنا ألفاظ شرح الصفحة إلى «إجراء/نقل جديد للموعد»، وأبقينا ملف JSON الأصلي وبصمته كما هما. كذلك كان بند «يذكر غدًا دون تحويله إلى اليوم» أضيق صياغةً من أساس الحكم الفعلي، وهو إبقاء الغد إطارًا زمنيًا للشرط لا تحويله إلى إجراء نقل. احتساب «منذ هذه الليلة» استيفاءً لبند الإبلاغ حكم حدّي يفترض قبول معنى «ابتداءً من الليلة»؛ قراءة فصيحة أشد قد تجعل المهمة 2/4. لم نغير الدرجة بأثر رجعي.

زمن الواجهة المسجل: 12.5 ثانية. اكتمل الرد بعد اختفاء زر الإيقاف، وظهور أدوات الرد، وثبات النص في ثلاث قراءات تفصل بينها 1200 مللي ثانية.

SUM-02 — التلخيص — 4/4

السؤال المجمد:

لخّص النص الآتي بالعربية في 45 كلمة كحد أقصى، من دون إضافة معلومات: «ستجري شركة مدار صيانة مجدولة يوم 10 يونيو من 01:00 إلى 03:00 بالتوقيت العالمي. خلال النافذة ستكون لوحة التقارير للقراءة فقط، وستدخل الملفات الجديدة قائمة انتظار. لن تتأثر الملفات المحفوظة، وستبدأ معالجة الملفات المنتظرة تلقائيًا بعد انتهاء الصيانة.»

النص الخام كما استُخرج من الواجهة:

ستجري شركة مدار صيانة مجدولة يوم 10 يونيو من 01:00 إلى 03:00 بالتوقيت العالمي. خلالها ستكون لوحة التقارير للقراءة فقط، وتُؤجَّل معالجة الملفات الجديدة إلى ما بعد الصيانة، بينما لا تتأثر الملفات المحفوظة وتُعالَج الملفات المنتظرة تلقائيًا بعدها.

مفتاح الإجابة/المرجع:

صيانة مدار مقررة في 10 يونيو من 01:00 إلى 03:00 UTC؛ تصبح لوحة التقارير للقراءة فقط وتنتظر الملفات الجديدة، بينما تبقى الملفات المحفوظة سليمة وتبدأ معالجة المنتظر تلقائيًا بعد الصيانة.

نوع المرجع: مادة مكتفية ذاتيًا داخل السؤال؛ لا يلزم مصدر خارجي لتقييمها.

تطبيق البنود الأربعة:

  1. مستوفى: يذكر 10 يونيو والفترة 01:00–03:00 بالتوقيت العالمي. ذُكر 10 يونيو والفترة 01:00 إلى 03:00 بالتوقيت العالمي.
  2. مستوفى: يذكر أن لوحة التقارير ستكون للقراءة فقط. نص الملخص على أن لوحة التقارير ستكون للقراءة فقط.
  3. مستوفى: يذكر انتظار الملفات الجديدة وعدم تأثر المحفوظة. ذكر تأجيل معالجة الملفات الجديدة وعدم تأثر الملفات المحفوظة.
  4. مستوفى: يذكر بدء معالجة المنتظر تلقائيًا بعد الصيانة. ذكر أن الملفات المنتظرة تُعالَج تلقائيًا بعد الصيانة.

درجات مسارَي التقييم الآلي قبل الفصل: E = 4/4، F = 4/4 (تطابق).

النتيجة: 4/4 — الملخص يستوفي مجموعات الحقائق الأربع ويقع في 38 كلمة، دون تجاوز حد 45 كلمة. تطابقت عمليتا التقييم الآلي في الدرجة؛ لم يلزم فصل تحريري إضافي.

زمن الواجهة المسجل: 11.6 ثانية. اكتمل الرد بعد اختفاء زر الإيقاف، وظهور أدوات الرد، وثبات النص في ثلاث قراءات تفصل بينها 1200 مللي ثانية.

CAL-02 — الحساب — 4/4

السؤال المجمد:

خزان سعته 240 لترًا كان ممتلئًا. استُهلك صباحًا 3/8 محتواه، ثم استُهلك 45 لترًا مساءً. احسب: استهلاك الصباح، مجموع المستهلك، المتبقي باللترات، ونسبة المتبقي من السعة الأصلية. اعرض خطواتك.

النص الخام كما استُخرج من الواجهة:

الحل خطوة بخطوة:

استهلاك الصباح

استُهلك 
8
3
	​

 من سعة الخزان:

8
3
	​

×240=90 لترًا

إذن استهلاك الصباح = 90 لترًا.

مجموع المستهلك

استهلاك الصباح + استهلاك المساء:

90+45=135 لترًا

إذن مجموع المستهلك = 135 لترًا.

المتبقي في الخزان

240−135=105 لترات

إذن المتبقي = 105 لترات.

نسبة المتبقي من السعة الأصلية

240
105
	​

=
16
7
	​

=0.4375
0.4375×100=43.75%

إذن نسبة المتبقي من السعة الأصلية = 43.75% (أي 
16
7
	​

 من السعة).

النتيجة النهائية

استهلاك الصباح: 90 لترًا

مجموع المستهلك: 135 لترًا

المتبقي: 105 لترات

نسبة المتبقي من السعة الأصلية: 43.75% (أو 
16
7
	​

 من السعة)

مفتاح الإجابة/المرجع:

{
  "morningUsedLitres": 90,
  "totalUsedLitres": 135,
  "remainingLitres": 105,
  "remainingPercent": 43.75
}

نوع المرجع: مادة مكتفية ذاتيًا داخل السؤال؛ لا يلزم مصدر خارجي لتقييمها.

تطبيق البنود الأربعة:

  1. مستوفى: استهلاك الصباح = 90 لترًا. حُسب استهلاك الصباح 90 لترًا.
  2. مستوفى: إجمالي المستهلك = 135 لترًا. حُسب إجمالي الاستهلاك 135 لترًا.
  3. مستوفى: المتبقي = 105 لترات. حُسب المتبقي 105 لترات.
  4. مستوفى: نسبة المتبقي = 43.75%. حُسبت نسبة المتبقي 43.75%.

درجات مسارَي التقييم الآلي قبل الفصل: E = 4/4، F = 4/4 (تطابق).

النتيجة: 4/4 — النتائج الأربع صحيحة وتظهر معها خطوات الحساب. تطابقت عمليتا التقييم الآلي في الدرجة؛ لم يلزم فصل تحريري إضافي.

زمن الواجهة المسجل: 15.0 ثانية. اكتمل الرد بعد اختفاء زر الإيقاف، وظهور أدوات الرد، وثبات النص في ثلاث قراءات تفصل بينها 1200 مللي ثانية.

FAC-02 — الحقائق الثابتة — 4/4

السؤال المجمد:

في معيار Unicode، اذكر للحرف العربي «ا» أربعة أمور: نقطة الترميز بصيغة U+، الاسم الإنجليزي الرسمي، اسم الكتلة، ونطاق تلك الكتلة. أجب من معرفتك بلا ويب.

النص الخام كما استُخرج من الواجهة:

للحرف العربي «ا» (الألف العادية، وليس ألف الوصل أو غيرها)، تكون بياناته في Unicode كما يلي:

المطلوب	القيمة
نقطة الترميز	U+0627
الاسم الإنجليزي الرسمي	ARABIC LETTER ALEF
اسم الكتلة (Block)	Arabic
نطاق الكتلة	U+0600–U+06FF

مفتاح الإجابة/المرجع:

{
  "codePoint": "U+0627",
  "officialName": "ARABIC LETTER ALEF",
  "block": "Arabic",
  "blockRange": "U+0600–U+06FF"
}

المصدر المرجعي المحدد مسبقًا: Unicode Consortium — Arabic — Names List (تم التحقق في 2026-08-02).

تطبيق البنود الأربعة:

  1. مستوفى: نقطة الترميز U+0627. ذُكرت U+0627.
  2. مستوفى: الاسم الرسمي ARABIC LETTER ALEF. ذُكر الاسم الرسمي بالكلمات الثلاث الصحيحة.
  3. مستوفى: اسم الكتلة Arabic أو «العربية». ذُكر اسم الكتلة Arabic.
  4. مستوفى: نطاق الكتلة U+0600 إلى U+06FF. ذُكر النطاق U+0600–U+06FF.

درجات مسارَي التقييم الآلي قبل الفصل: E = 4/4، F = 4/4 (تطابق).

النتيجة: 4/4 — حقول Unicode الأربعة مطابقة للمرجع. تطابقت عمليتا التقييم الآلي في الدرجة؛ لم يلزم فصل تحريري إضافي.

زمن الواجهة المسجل: 12.5 ثانية. اكتمل الرد بعد اختفاء زر الإيقاف، وظهور أدوات الرد، وثبات النص في ثلاث قراءات تفصل بينها 1200 مللي ثانية.

TRN-02 — الترجمة — 4/4

السؤال المجمد:

ترجم الجملة الآتية إلى الإنجليزية ترجمة تقنية دقيقة، من دون شرح أو إضافة: «احفظ نسخة محلية من الملف، ثم تحقق من المجموع الاختباري قبل حذفه من الخادم.»

النص الخام كما استُخرج من الواجهة:

Save a local copy of the file, then verify the checksum before deleting it from the server.

مفتاح الإجابة/المرجع:

احفظ نسخة محلية من الملف، ثم تحقق من المجموع الاختباري قبل حذفه من الخادم.

نوع المرجع: مادة مكتفية ذاتيًا داخل السؤال؛ لا يلزم مصدر خارجي لتقييمها.

تطبيق البنود الأربعة:

  1. مستوفى: يأمر بحفظ نسخة محلية. تبدأ الترجمة بالأمر Save a local copy.
  2. مستوفى: يربط النسخة بالملف نفسه. حددت الترجمة أن النسخة هي of the file.
  3. مستوفى: يترجم «المجموع الاختباري» إلى checksum ترجمة تقنية صحيحة. استُعمل المصطلح التقني checksum.
  4. مستوفى: يحافظ على الترتيب: تحقق أولًا ثم حذف من الخادم. جعل التحقق قبل حذف الملف من الخادم.

درجات مسارَي التقييم الآلي قبل الفصل: E = 4/4، F = 4/4 (تطابق).

النتيجة: 4/4 — الترجمة دقيقة وتحافظ على الوحدات الدلالية وترتيب الإجراءين. تطابقت عمليتا التقييم الآلي في الدرجة؛ لم يلزم فصل تحريري إضافي.

زمن الواجهة المسجل: 15.2 ثانية. اكتمل الرد بعد اختفاء زر الإيقاف، وظهور أدوات الرد، وثبات النص في ثلاث قراءات تفصل بينها 1200 مللي ثانية.

INS-02 — اتباع التعليمات — 3/4

السؤال المجمد:

حوّل الحقائق التالية إلى ثلاث نقاط Markdown فقط، بلا عنوان: يبدأ التسجيل صباح الأحد؛ يُعقد التدريب عصر الثلاثاء؛ يكون التسليم مساء الخميس. تبدأ النقاط بالترتيب بالكلمات «التسجيل»، «التدريب»، «التسليم»، وتتكون كل نقطة من أربع كلمات عربية بالضبط، مع عدم حساب علامة القائمة كلمة.

النص الخام كما استُخرج من الواجهة:

التسجيل يبدأ صباح الأحد

التدريب يُعقد عصر الثلاثاء

التسليم يكون مساء الخميس

مفتاح الإجابة/المرجع:

[
  "- التسجيل يبدأ صباح الأحد",
  "- التدريب يُعقد عصر الثلاثاء",
  "- التسليم يكون مساء الخميس"
]

نوع المرجع: مادة مكتفية ذاتيًا داخل السؤال؛ لا يلزم مصدر خارجي لتقييمها.

تطبيق البنود الأربعة:

  1. غير مستوفى: ثلاث نقاط Markdown فقط بلا عنوان أو نص زائد. المخرج ثلاثة أسطر نصية بلا علامات نقاط Markdown.
  2. مستوفى: تبدأ النقاط بالترتيب: التسجيل، التدريب، التسليم. تبدأ الأسطر الثلاثة بالترتيب بالكلمات التسجيل ثم التدريب ثم التسليم.
  3. مستوفى: كل نقطة أربعة ألفاظ عربية بالضبط وفق قاعدة العد. كل سطر من الأسطر الثلاثة يتكون من أربع كلمات عربية.
  4. مستوفى: تحافظ على صباح الأحد، عصر الثلاثاء، مساء الخميس دون تبديل. حافظت الأسطر على الأزمنة والأيام الثلاثة من دون تبديل.

درجات مسارَي التقييم الآلي قبل الفصل: E = 3/4، F = 0/4 (اختلاف موثق).

النتيجة: 3/4 — يمكن عد ثلاثة أسطر متميزة وربطها مباشرة ببنود المحتوى، لذا المخرج قابل للاستخدام؛ يفقد فقط بند تنسيق Markdown. اعتمدت 3/4. المخرج ليس قائمة Markdown، فيفقد بند التنسيق؛ لكنه يتكون من ثلاثة أسطر قابلة للعد والربط ببقية البنود، ولذلك لا يعامل كمخرج غير قابل للاستخدام.

زمن الواجهة المسجل: 16.1 ثانية. اكتمل الرد بعد اختفاء زر الإيقاف، وظهور أدوات الرد، وثبات النص في ثلاث قراءات تفصل بينها 1200 مللي ثانية.

FUS-02 — الفصحى — 4/4

السؤال المجمد:

اقرأ الجملة ثم اكتب أربعة أسطر بصيغة «الضمير = المرجع»: «قالت مريم لنورة: طلبتُ منكِ الملف، وسأعيده إليكِ غدًا.» حدّد، بهذا الترتيب، مرجع تاء «طلبتُ»، وكاف «منكِ»، وهاء «سأعيده»، وكاف «إليكِ». لا تضف شرحًا.

النص الخام كما استُخرج من الواجهة:

تاء «طلبتُ» = مريم
كاف «منكِ» = نورة
هاء «سأعيده» = الملف
كاف «إليكِ» = نورة

مفتاح الإجابة/المرجع:

[
  "تاء طلبتُ = مريم",
  "كاف منكِ = نورة",
  "هاء سأعيده = الملف",
  "كاف إليكِ = نورة"
]

نوع المرجع: مادة مكتفية ذاتيًا داخل السؤال؛ لا يلزم مصدر خارجي لتقييمها.

تطبيق البنود الأربعة:

  1. مستوفى: إحالة تاء «طلبتُ» إلى مريم. أحال تاء «طلبتُ» إلى مريم.
  2. مستوفى: إحالة كاف «منكِ» إلى نورة. أحال كاف «منكِ» إلى نورة.
  3. مستوفى: إحالة هاء «سأعيده» إلى الملف. أحال هاء «سأعيده» إلى الملف.
  4. مستوفى: إحالة كاف «إليكِ» إلى نورة. أحال كاف «إليكِ» إلى نورة.

درجات مسارَي التقييم الآلي قبل الفصل: E = 4/4، F = 4/4 (تطابق).

النتيجة: 4/4 — الإحالات الأربع صحيحة وبالترتيب المطلوب. تطابقت عمليتا التقييم الآلي في الدرجة؛ لم يلزم فصل تحريري إضافي.

زمن الواجهة المسجل: 12.5 ثانية. اكتمل الرد بعد اختفاء زر الإيقاف، وظهور أدوات الرد، وثبات النص في ثلاث قراءات تفصل بينها 1200 مللي ثانية.

SUM-03 — التلخيص — 4/4

السؤال المجمد:

لخّص النص الآتي بالعربية في 55 كلمة كحد أقصى، مع إبراز التصميم والنتيجة والحدود، ومن دون إضافة معلومات: «قسّم الباحثون 60 شتلة متشابهة عشوائيًا إلى مجموعتين من 30. ثبّتوا نوع التربة والضوء ودرجة الحرارة، وسقوا المجموعة الأولى 200 مل يوميًا والثانية 300 مل. بعد ستة أسابيع بلغ متوسط الطول 18.2 سم للأولى و20.1 سم للثانية. لا يثبت هذا التشغيل الواحد أن كمية الماء وحدها ستعطي النتيجة نفسها مع أنواع نبات أو ظروف أخرى.»

النص الخام كما استُخرج من الواجهة:

قسّم الباحثون عشوائيًا 60 شتلة إلى مجموعتين متساويتين، مع تثبيت التربة والضوء والحرارة، وسُقيت الأولى 200 مل يوميًا والثانية 300 مل. بعد ستة أسابيع بلغ متوسط الطول 18.2 سم مقابل 20.1 سم. تقتصر النتيجة على هذا التشغيل ولا تُعمَّم على نباتات أو ظروف أخرى.

مفتاح الإجابة/المرجع:

وُزعت 60 شتلة عشوائيًا إلى مجموعتين متساويتين مع تثبيت الظروف، واختلف الري بين 200 و300 مل يوميًا. بعد ستة أسابيع بلغ متوسط الطول 18.2 و20.1 سم على التوالي، ولا تسمح التجربة الواحدة بتعميم السببية على نباتات أو ظروف أخرى.

نوع المرجع: مادة مكتفية ذاتيًا داخل السؤال؛ لا يلزم مصدر خارجي لتقييمها.

تطبيق البنود الأربعة:

  1. مستوفى: يذكر التوزيع العشوائي لـ60 شتلة إلى مجموعتين من 30. ذكر توزيع 60 شتلة عشوائيًا إلى مجموعتين متساويتين، وهو يحدد ضمنًا 30 في كل مجموعة.
  2. مستوفى: يذكر تثبيت الظروف واختلاف الري 200 مقابل 300 مل يوميًا. ذكر تثبيت التربة والضوء والحرارة وري الأولى 200 والثانية 300 مل يوميًا.
  3. مستوفى: يذكر النتيجتين 18.2 و20.1 سم بعد ستة أسابيع مع نسبتهما الصحيحة للمجموعتين. ذكر بعد ستة أسابيع 18.2 سم للأولى مقابل 20.1 سم للثانية بحسب ترتيب السياق.
  4. مستوفى: يذكر أن التشغيل الواحد لا يثبت التعميم أو السببية خارج هذه الظروف. قصر النتيجة على التشغيل ونفى تعميمها على نباتات أو ظروف أخرى.

درجات مسارَي التقييم الآلي قبل الفصل: E = 4/4، F = 4/4 (تطابق).

النتيجة: 4/4 — يلخص التصميم والنتيجة والحدود في 44 كلمة، ضمن حد 55 كلمة ومن دون إضافة موضوعية. تطابقت عمليتا التقييم الآلي في الدرجة؛ لم يلزم فصل تحريري إضافي.

زمن الواجهة المسجل: 12.7 ثانية. اكتمل الرد بعد اختفاء زر الإيقاف، وظهور أدوات الرد، وثبات النص في ثلاث قراءات تفصل بينها 1200 مللي ثانية.

CAL-03 — الحساب — 4/4

السؤال المجمد:

حصل طالب على 80 من 100 في مهمة وزنها 20%، و70 من 100 في مهمة وزنها 30%، و90 من 100 في مهمة وزنها 50%. احسب مساهمة كل مهمة في الدرجة النهائية ثم المتوسط الموزون من 100.

النص الخام كما استُخرج من الواجهة:

لحساب مساهمة كل مهمة في الدرجة النهائية، نضرب درجة المهمة في وزنها:

المهمة الأولى: 80×20%=80×0.20=16

المهمة الثانية: 70×30%=70×0.30=21

المهمة الثالثة: 90×50%=90×0.50=45

ثم نجمع المساهمات:

16+21+45=82

النتيجة:

مساهمة المهمة الأولى: 16 درجة

مساهمة المهمة الثانية: 21 درجة

مساهمة المهمة الثالثة: 45 درجة

المتوسط الموزون النهائي = 82 من 100.

مفتاح الإجابة/المرجع:

{
  "firstContribution": 16,
  "secondContribution": 21,
  "thirdContribution": 45,
  "weightedScore": 82
}

نوع المرجع: مادة مكتفية ذاتيًا داخل السؤال؛ لا يلزم مصدر خارجي لتقييمها.

تطبيق البنود الأربعة:

  1. مستوفى: مساهمة المهمة الأولى = 16 نقطة. حُسبت المساهمة الأولى 16.
  2. مستوفى: مساهمة المهمة الثانية = 21 نقطة. حُسبت المساهمة الثانية 21.
  3. مستوفى: مساهمة المهمة الثالثة = 45 نقطة. حُسبت المساهمة الثالثة 45.
  4. مستوفى: المتوسط الموزون = 82 من 100. جُمعت المساهمات إلى متوسط موزون 82 من 100.

درجات مسارَي التقييم الآلي قبل الفصل: E = 4/4، F = 4/4 (تطابق).

النتيجة: 4/4 — المساهمات الثلاث والمجموع الموزون صحيحة. تطابقت عمليتا التقييم الآلي في الدرجة؛ لم يلزم فصل تحريري إضافي.

زمن الواجهة المسجل: 11.9 ثانية. اكتمل الرد بعد اختفاء زر الإيقاف، وظهور أدوات الرد، وثبات النص في ثلاث قراءات تفصل بينها 1200 مللي ثانية.

FAC-03 — الحقائق الثابتة — 4/4

السؤال المجمد:

وفق الجدول الدوري الرسمي لـIUPAC، اذكر للذهب: الرمز الكيميائي، العدد الذري، رقم الدورة، ورقم المجموعة. أجب من معرفتك بلا ويب.

النص الخام كما استُخرج من الواجهة:

وفق ترقيم مجموعات ودورات IUPAC الرسمي:

الرمز الكيميائي: Au

العدد الذري: 79

رقم الدورة: 6

رقم المجموعة: 11

مفتاح الإجابة/المرجع:

{
  "symbol": "Au",
  "atomicNumber": 79,
  "period": 6,
  "group": 11
}

المصدر المرجعي المحدد مسبقًا: IUPAC — Periodic Table of Elements (تم التحقق في 2026-08-02).

تطبيق البنود الأربعة:

  1. مستوفى: الرمز Au، بحرف A كبير وu صغير. ذُكر الرمز Au بالحالة الصحيحة للحرفين.
  2. مستوفى: العدد الذري 79. ذُكر العدد الذري 79.
  3. مستوفى: الدورة 6. ذُكرت الدورة 6.
  4. مستوفى: المجموعة 11. ذُكرت المجموعة 11.

درجات مسارَي التقييم الآلي قبل الفصل: E = 4/4، F = 4/4 (تطابق).

النتيجة: 4/4 — الحقول الأربعة الخاصة بالذهب صحيحة. تطابقت عمليتا التقييم الآلي في الدرجة؛ لم يلزم فصل تحريري إضافي.

زمن الواجهة المسجل: 13.1 ثانية. اكتمل الرد بعد اختفاء زر الإيقاف، وظهور أدوات الرد، وثبات النص في ثلاث قراءات تفصل بينها 1200 مللي ثانية.

TRN-03 — الترجمة — 4/4

السؤال المجمد:

ترجم النص الإنجليزي الآتي إلى العربية ترجمة دقيقة وطبيعية، من دون شرح أو إضافة: “The meeting was moved from Tuesday to Thursday because the room was unavailable. The start time remains 10:30 a.m.”

النص الخام كما استُخرج من الواجهة:

تم تأجيل الاجتماع من يوم الثلاثاء إلى يوم الخميس لأن القاعة لم تكن متاحة. ويظل وقت البدء الساعة 10:30 صباحًا.

مفتاح الإجابة/المرجع:

نُقل الاجتماع من الثلاثاء إلى الخميس لأن القاعة لم تكن متاحة. ويظل وقت البدء الساعة 10:30 صباحًا.

نوع المرجع: مادة مكتفية ذاتيًا داخل السؤال؛ لا يلزم مصدر خارجي لتقييمها.

تطبيق البنود الأربعة:

  1. مستوفى: ينقل أن الاجتماع غُيّر موعده، لا أنه أُلغي. ذكرت الترجمة تأجيل الاجتماع ولم تدّع إلغاءه.
  2. مستوفى: يحافظ على الاتجاه من الثلاثاء إلى الخميس. حافظت على النقل من الثلاثاء إلى الخميس.
  3. مستوفى: يذكر أن السبب عدم توفر الغرفة أو القاعة. ذكرت أن القاعة لم تكن متاحة.
  4. مستوفى: يذكر بقاء وقت البدء 10:30 صباحًا. ذكرت بقاء وقت البدء 10:30 صباحًا.

درجات مسارَي التقييم الآلي قبل الفصل: E = 4/4، F = 4/4 (تطابق).

النتيجة: 4/4 — الترجمة تحفظ تغيير اليوم والسبب وثبات الوقت. تطابقت عمليتا التقييم الآلي في الدرجة؛ لم يلزم فصل تحريري إضافي.

زمن الواجهة المسجل: 12.1 ثانية. اكتمل الرد بعد اختفاء زر الإيقاف، وظهور أدوات الرد، وثبات النص في ثلاث قراءات تفصل بينها 1200 مللي ثانية.

INS-03 — اتباع التعليمات — 4/4

السؤال المجمد:

استنادًا إلى: «تأخر التقرير لأن جدول البيانات كان ناقصًا، وسيطلب الفريق النسخة المكتملة اليوم.» اكتب سطرين فقط. يبدأ الأول حرفيًا «السبب:» ويذكر سبب التأخر في خمس كلمات عربية على الأكثر بعد النقطتين. يبدأ الثاني حرفيًا «الإجراء:» ويذكر ما سيفعله الفريق في ست كلمات عربية على الأكثر بعد النقطتين. لا تستخدم قوائم.

النص الخام كما استُخرج من الواجهة:

السبب: نقص جدول البيانات
الإجراء: سيطلب الفريق النسخة المكتملة اليوم

مفتاح الإجابة/المرجع:

[
  "السبب: جدول البيانات كان ناقصًا",
  "الإجراء: سيطلب الفريق النسخة المكتملة اليوم"
]

نوع المرجع: مادة مكتفية ذاتيًا داخل السؤال؛ لا يلزم مصدر خارجي لتقييمها.

تطبيق البنود الأربعة:

  1. مستوفى: سطران فقط بلا قائمة أو نص إضافي. المخرج سطران فقط ولا توجد قائمة أو مقدمة.
  2. مستوفى: السطر الأول يبدأ حرفيًا «السبب:». يبدأ السطر الأول حرفيًا بـ«السبب:».
  3. مستوفى: سبب التأخر هو نقص جدول البيانات، في خمس كلمات أو أقل بعد النقطتين. ذكر «نقص جدول البيانات» في ثلاث كلمات بعد النقطتين.
  4. مستوفى: السطر الثاني يبدأ «الإجراء:» ويذكر طلب النسخة المكتملة اليوم في ست كلمات أو أقل. يبدأ بـ«الإجراء:» ويذكر الطلب كاملًا في خمس كلمات بعد النقطتين.

درجات مسارَي التقييم الآلي قبل الفصل: E = 4/4، F = 4/4 (تطابق).

النتيجة: 4/4 — الشكل والبادئتان والمعنى وحدا الكلمات مستوفاة. تطابقت عمليتا التقييم الآلي في الدرجة؛ لم يلزم فصل تحريري إضافي.

زمن الواجهة المسجل: 12.5 ثانية. اكتمل الرد بعد اختفاء زر الإيقاف، وظهور أدوات الرد، وثبات النص في ثلاث قراءات تفصل بينها 1200 مللي ثانية.

FUS-03 — الفصحى — 4/4

السؤال المجمد:

رتّب الجمل الأربع لتكوين تسلسل منطقي، ثم اكتب الحروف فقط مفصولة بأسهم، بلا شرح: (أ) لذلك سُلّمت النسخة النهائية إلى الناشر. (ب) بدأ المحرر بمراجعة المسودة. (ج) بعد ذلك صحح الكاتب الملاحظات. (د) وأخيرًا تحقق المحرر من التصحيحات.

النص الخام كما استُخرج من الواجهة:

ب → ج → د → أ

مفتاح الإجابة/المرجع:

ب ← ج ← د ← أ

نوع المرجع: مادة مكتفية ذاتيًا داخل السؤال؛ لا يلزم مصدر خارجي لتقييمها.

تطبيق البنود الأربعة:

  1. مستوفى: الموضع الأول هو ب. الحرف الأول ب.
  2. مستوفى: الموضع الثاني هو ج. الحرف الثاني ج.
  3. مستوفى: الموضع الثالث هو د. الحرف الثالث د.
  4. مستوفى: الموضع الرابع هو أ، ولا تتكرر الحروف. الحرف الرابع أ، والحروف الأربعة غير مكررة.

درجات مسارَي التقييم الآلي قبل الفصل: E = 4/4، F = 4/4 (تطابق).

النتيجة: 4/4 — التسلسل هو ب ← ج ← د ← أ كما في المفتاح، بلا نص زائد. تطابقت عمليتا التقييم الآلي في الدرجة؛ لم يلزم فصل تحريري إضافي.

زمن الواجهة المسجل: 12.9 ثانية. اكتمل الرد بعد اختفاء زر الإيقاف، وظهور أدوات الرد، وثبات النص في ثلاث قراءات تفصل بينها 1200 مللي ثانية.

DIA-03 — اللهجات العربية — 4/4

السؤال المجمد:

أعد صياغة العبارة الخليجية التالية بالعربية الفصحى مع الحفاظ على معناها، في جملة أو جملتين فقط ومن دون شرح: «ترى الشحنة ما وصلت للحين، وإذا دقّ عليك المندوب عطِني خبر قبل لا تروح.»

النص الخام كما استُخرج من الواجهة:

إليك الصياغة بالفصحى:

Writing

لم تصل الشحنة حتى الآن، وإذا اتصل بك المندوب فأبلغني قبل أن تغادر.

مفتاح الإجابة/المرجع:

انتبه، لم تصل الشحنة حتى الآن، وإذا اتصل بك المندوب فأخبرني قبل أن تذهب.

نوع المرجع: مادة مكتفية ذاتيًا داخل السؤال؛ لا يلزم مصدر خارجي لتقييمها.

تطبيق البنود الأربعة:

  1. مستوفى: ينص على أن الشحنة لم تصل. ورد صراحة «لم تصل الشحنة».
  2. مستوفى: يحافظ على معنى «حتى الآن». وردت عبارة «حتى الآن».
  3. مستوفى: يجعل اتصال المندوب شرطًا. استُعمل الشرط «إذا اتصل بك المندوب».
  4. مستوفى: يطلب الإخبار قبل الذهاب، لا بعده. طلب الإبلاغ قبل المغادرة.

درجات مسارَي التقييم الآلي قبل الفصل: E = 4/4، F = 4/4 (تطابق).

النتيجة: 4/4 — الوحدات الدلالية الأربع مستوفاة؛ النص التمهيدي ولفظ «Writing» ليسا ادعاءين موضوعيين ولا يغيران أي بند ثنائي. تطابقت عمليتا التقييم الآلي في الدرجة؛ لم يلزم فصل تحريري إضافي.

توضيح تحريري لاحق: تعني 4/4 استيفاء الوحدات الدلالية الأربع المجمدة فقط. لا تعني تكافؤًا تداوليًا وشكليًا كاملًا؛ حذف الرد أثر «ترى»، وأضاف تمهيدًا وكلمة Writing رغم طلب «من دون شرح». لم تقِس البنود المجمدة هذين القيدين، لذلك سجلناهما كعيب تصميم ولم نعدّل النتيجة بعد رؤية المخرج.

زمن الواجهة المسجل: 13.3 ثانية. اكتمل الرد بعد اختفاء زر الإيقاف، وظهور أدوات الرد، وثبات النص في ثلاث قراءات تفصل بينها 1200 مللي ثانية.

أسئلة شائعة

هل ChatGPT دقيق في اللغة العربية؟

في هذه العينة المحددة استُوفي 82/84 بندًا ثنائيًا، ثم سجّل المجموع النهائي 80/84 بعد تطبيق سقفين مجمّدين، مع أربع نقاط مفقودة إجمالًا. لا تكفي 21 مهمة ولا تشغيل صالح واحد لكل سؤال داخل النتيجة لتحديد نسبة دقة عامة، ويجب التحقق من الإجابات المهمة.

هل ChatGPT أضعف في اللهجات من الفصحى؟

حصلت مهام الفصحى الثلاث على 12/12، وحصلت مهام اللهجات الثلاث على 10/12. هذا فرق داخل عينة صغيرة جدًا، وليس دليلًا كافيًا لتعميم ترتيب القدرتين أو تمثيل التنوع اللهجي العربي الواسع.

هل يقارن الاختبار ChatGPT المجاني والمدفوع؟

لا. النتيجة تخص الواجهة التي أظهرت Free وInstant فقط. لم ندخل نتيجة Pro أوPlus، ولم نستخدم تشغيلات Mini التي ظهرت بعد حد الاستخدام.

لماذا نُشرت 21 مهمة بدل 28؟

كان المخطط 28 مهمة، لكن الواجهة أعلنت عند التشغيل 22 التحويل التلقائي إلى Mini. حتى لا تختلط إعدادات مختلفة في رقم واحد، استُبعدت التشغيلات 22–28 كلها. بقيت أول 21 مهمة متوازنة: ثلاث في كل محور.

هل يمكن استخدام الأسئلة لإعادة الاختبار؟

نعم. حزمة التنزيل تنشر الأسئلة والمفاتيح والقواعد والترتيب والنصوص الخام. سجّل إعدادك وتاريخك، ولا تخلط النتائج بهذه الجولة إلا بوصفها تجربة مستقلة.

تاريخ التنفيذ: 2 أغسطس 2026. الجهة: فريق تحرير GPT Gate. سياسة التحديث: لا نغير الدرجة القديمة إذا تغير ChatGPT؛ ننشر جولة جديدة بتاريخ وإعداد وبصمة بيانات منفصلة، ونربطها من هذه الصفحة.