مختبر GPT Gate هو سجل عربي مستقل لاختبارات ChatGPT وواجهات OpenAI التي نفذناها أو راجعناها بأنفسنا. نجمع هنا هدف كل تجربة، تاريخها، بيئة التشغيل، حجم العينة، النتائج المنشورة، المواد القابلة للتنزيل، وما لم يثبته الاختبار. آخر مراجعة لهذا السجل: 23 أغسطس 2026. أُجري في هذا التحديث اختبارا Deep Research واختلاف الإجابات فقط؛ ولم نُعِد التجارب الأقدم ما لم يُذكر ذلك صراحة داخل سجلها.
ملخص السجل حتى 23 أغسطس 2026: 13 سجلًا منشورًا: 8 اختبارات بنتائج قابلة للمراجعة، و5 تدقيقات واجهة أو وصول، و4 حزم بيانات كاملة. أُجري في هذا التحديث اختباران جديدان فقط؛ أما التجارب الأقدم فلم تُعَد.
كيف نستخدم كلمة «اختبار»؟ لا نعدّ الشرح النظري أو نقل مصدر رسمي اختبارًا أصليًا. الاختبار هنا يحتاج إلى طلب أو إجراء محدد، وبيئة تشغيل معروفة بقدر الإمكان، ونتيجة مسجلة، وحدود تمنع التعميم. أما مراجعة الواجهة أو الإعدادات فنصنفها «تدقيقًا» أو «فحص وصول»، ولا نقدمها باعتبارها قياس أداء.
الاستقلال: GPT Gate غير تابع لـOpenAI. استخدام ChatGPT أو OpenAI API في تجربة لا يعني اعتماد النتيجة من OpenAI ولا يعني أن التجربة ستتكرر بالطريقة نفسها مع نموذج أو خطة أو بلد أو تاريخ آخر.
ابدأ من هنا
- الدراسات والاختبارات الأساسية
- تدقيقات الواجهة والوصول
- منهجية GPT Gate وقواعد النشر
- البيانات وإعادة الاختبار
- الحدود المشتركة وكيف تقرأ النتائج
- سجل التحديثات والتصحيحات

الدراسات والاختبارات الأساسية
هذه السجلات تتضمن تنفيذًا فعليًا ونتائج منشورة. لا نقارن الأرقام بينها مباشرة لأن الخطة والأدوات وحجم العينة ومعيار التقييم تختلف من تجربة إلى أخرى.
1) اختبار دقة ChatGPT باللغة العربية
- الهدف: فحص أداء عينة محددة في الفصحى واللهجات والتلخيص والحساب والحقائق والترجمة واتباع التعليمات.
- التاريخ: 2 أغسطس 2026.
- البيئة: حساب Free، والوضع الظاهر Instant، ومحادثة مؤقتة مستقلة لكل سؤال. لم نستنتج من الواجهة اسم نموذج خلفي غير معروض.
- العينة: خُطط لـ28 مهمة. أُبطلت الجولة الأولى كاملة لأن بعض الردود حُفظت قبل اكتمالها، ثم أُعيدت المهام. وبعد إعلان الواجهة التحول إلى Mini استُبعدت المهام 22–28 من النتيجة المتوازنة؛ فأصبحت العينة النهائية 21 مهمة في 7 محاور، ثلاث مهام لكل محور.
- النتيجة: 80/84 بعد تطبيق سقفي الدرجات المعلنين. كان مجموع البنود قبل السقفين 82/84، ولذلك لا يصح عرض 82 باعتبارها النتيجة النهائية.
- المواد: الخطة المجمدة والبيانات الخام ودرجات JSON وCSV وملفا التقييم وسجل الحسم وتدقيق النزاهة و23 لقطة أصلية، ضمن حزمة ZIP بالإصدار 1.2 وملف SHA-256 للتحقق من سلامة التنزيل.
- حالة البيانات: حزمة كاملة منشورة مع بصمات تحقق.
- غير الموثق: الجهاز والمتصفح والبلد واسم النموذج الخلفي وهوية نموذج أو مزود التقييم. لا يوجد ختم زمني خارجي للتجميد ولا لجنة بشرية مستقلة.
اقرأ الدراسة كاملة · نزّل حزمة البيانات v1.2 · تحقق من SHA-256
2) هل يؤدي تنظيم البرومبت إلى نتيجة أفضل؟
- الهدف: مقارنة طلب عربي مختصر بنسخة منظمة مع إبقاء المادة المصدرية ثابتة.
- التاريخ: اكتمل التنفيذ والتدقيق في 2 أغسطس 2026.
- البيئة: ChatGPT Pro، والوضع الظاهر Instant، ومحادثات مؤقتة (Temporary) مستقلة، دون بحث في الويب.
- العينة: 30 تشغيلًا؛ 5 مهام × نسختان × 3 تكرارات.
- النتيجة: المختصر 121/150 بمتوسط 8.07 ووسيط 9، والمنظم 140/150 بمتوسط 9.33 ووسيط 10. لم يتحقق معيار النجاح المسبق لأن فرق الوسيط كان +1، بينما كان المطلوب +2 على الأقل.
- المواد: الطلبات والمخرجات والدرجات والتدقيق ورسم النتائج ضمن حزمة ZIP.
- حالة البيانات: حزمة كاملة منشورة.
- غير الموثق: الجهاز والمتصفح والبلد.
3) رفع وتحليل ملفات PDF وWord وExcel
- الهدف: مقارنة استخراج معلومات محددة من ثلاث ملفات صناعية ثابتة في Free وPro.
- التاريخ والخطة: Free في 1 أغسطس 2026، وPro في 2 أغسطس 2026؛ الوضع الظاهر Instant.
- العينة: تشغيل واحد لكل خطة، وثلاثة ملفات صناعية PDF وDOCX وXLSX، والطلب نفسه في المرتين.
- النتيجة: 30/30 في Free و30/30 في Pro وفق سلم التقييم المنشور لهذه الملفات فقط.
- المواد: الملفات الثلاثة قابلة للتنزيل، مع صورتَي معاينة ورسم مقارنة.
- حالة البيانات: ملفات المدخلات فقط؛ لا توجد حزمة للردود والدرجات.
- الحد المهم: لا توجد حزمة منشورة للردين الخام ولا لقطات واجهة كاملة لهما، ولا تكفي محاولة واحدة للحكم على الفروق العامة بين الخطتين. كما أن زمن Free وزمن Pro سُجلا بطريقتين مختلفتين، لذلك لا نستخدمهما لمقارنة السرعة.
- غير الموثق: الجهاز والمتصفح والبلد.
4) اختبار الهلوسة والتحقق من المراجع
- الهدف: فحص 12 حالة ذات مفتاح تحقق معروف، مع تسجيل الأخطاء الحرجة والجزئية.
- التاريخ: 1 أغسطس 2026.
- البيئة: ChatGPT Free، والوضع الظاهر Instant، مع تفعيل بحث الويب (Web Search)؛ محاولة واحدة لكل حالة.
- العينة والنتيجة: 12 حالة و54/60؛ عشر حالات حصلت على 5/5، وحالتان حصلتا على 2/5، ولم تُسجل هلوسة حرجة وفق التعريف المسبق في الاختبار.
- المواد: جدول الحالات والمفاتيح والنتائج المرمزة ورسم أصلي داخل الصفحة.
- حالة البيانات: جداول وصورة فقط؛ لا حزمة خام.
- الحد المهم: لا يوجد ملف تنزيل أو ردود خام ولقطات واجهة منشورة حتى آخر مراجعة، ومحاولة واحدة لكل حالة لا تقيس معدل تكرار الخطأ.
- غير الموثق: الجهاز والمتصفح والبلد.
5) Google أم ChatGPT في ستة استعلامات؟
- الهدف: مقارنة قابلية الاستخدام والتحقق في ست نوايا بحث مختلفة، لا إعلان «فائز» مطلق.
- التاريخ: 1 أغسطس 2026.
- البيئة: Google بواجهة عربية وحساب مسجل الدخول، وChatGPT Free/Instant مع تفعيل البحث يدويًا ومحادثة جديدة لكل استعلام.
- العينة: 6 استعلامات مزدوجة؛ تشغيل واحد لكل أداة ولكل استعلام.
- المواد: رسم أصلي ولقطة واجهة للاستعلام الرابع.
- حالة البيانات: جداول وصورة ولقطة واحدة؛ لا حزمة خام.
- الحد المهم: تخصيص Google لم يُفحص، ولا توجد بيانات قابلة للتنزيل أو لقطات ومخرجات خام لبقية الحالات. مصر كانت موضوع سؤال وليست دليلًا على موقع التنفيذ.
- غير الموثق: الموقع الجغرافي والجهاز والمتصفح.
6) الاختبار الحي لواجهة GPT Gate
- الهدف: التحقق من تنفيذ خمس مهام نصية صغيرة عبر الواجهة المنشورة على الصفحة الرئيسية.
- التاريخ: 31 يوليو 2026.
- البيئة: واجهة GPT Gate عبر OpenAI API، والإضافة 2.0.1، واسم النموذج المهيأ داخلها وقت الاختبار
gpt-5.6-luna. - العينة: 5 مهام، ومحاولة واحدة لكل مهمة؛ اتباع تعليمات وحساب وتلخيص وتحويل عبارة مصرية وسلامة عامة.
- النتيجة: نجحت المهام الخمس في معاييرها الصغيرة، والأزمنة التي عرضتها الواجهة تراوحت بين 1.4 و2.4 ثانية.
- فحص لاحق: بعد التحديث إلى 2.0.2 نجح فحص الاتصال والأمان الإداري، ونجحت رسالتا سياق قصير، لكن عينة المهام الخمس لم تُعَد بالكامل.
- المواد والحدود: جدول الطلبات والردود ورسم ولقطة السلامة؛ لا ملف بيانات مستقل، ولا يكفي الاختبار لقياس متوسط الدقة أو السرعة.
- حالة البيانات: جدول وصور فقط؛ لا حزمة خام مستقلة.
- غير الموثق: الجهاز والمتصفح والبلد.
7) اختبار حي لميزة Deep Research
- الهدف: فحص قدرة Deep Research على إعداد تقرير عربي يقتصر على مصادر OpenAI الرسمية ويفصل بين أسماء النماذج داخل ChatGPT ومعرّفات OpenAI API بعد تحديث 6 أغسطس 2026.
- التاريخ: 23 أغسطس 2026.
- الخطة والحساب: حساب اختبار واحد بخطة ChatGPT Pro؛ محادثة عادية. لم تظهر الأداة داخل Temporary Chat على هذا الحساب أثناء الفحص.
- النموذج والوضع الظاهر: Deep Research مع محدد الجهد Extra High. لا تكشف الواجهة معرّف النموذج الخلفي، ولا نساوي Extra High بمعرّف API.
- البلد والجهاز: مصر؛ حاسوب مكتبي Windows؛ متصفح Chromium داخل التطبيق؛ الواجهة الظاهرة في اللقطات بالإنجليزية.
- حجم العينة: برومبت عربي ثابت واحد وتشغيل واحد مكتمل، دون تعديل البرومبت أو مقاطعة التنفيذ.
- النتيجة الخام: عرضت الواجهة Worked for 1m 53s، وبلغ طول النص الخام المستخرج 13,875 حرفًا. احتوى التقرير على خلاصة وجدول ادعاءات ومصادر وقسم لما لا يمكن إثباته وحدود. لم نمنحه درجة دقة ولم نتحقق يدويًا من كل استشهاد.
- البيانات المنشورة: البرومبت والرد الخام والمنهجية واللقطتان وبصمات SHA-256 داخل حزمة ZIP.
- ما لم يُختبر: Free وGo وBusiness وEnterprise، والهاتف وبلدان أخرى والملفات وApps الخارجية، ومقارنة ضابطة مع Search.
- إعادة الاختبار: لا توجد إعادة اختبار حتى 23 أغسطس 2026.
اعرض البرومبت الحرفي
أعد تقريرًا باللغة العربية يجيب عن السؤال التالي: ما الذي تغيّر رسميًا في نماذج ChatGPT بعد تحديث OpenAI في 6 أغسطس 2026؟ قارن بين GPT-5.6 Sol وGPT-5.6 Luna داخل ChatGPT، وافصل ذلك عن معرّفات نماذج OpenAI API. استخدم مصادر OpenAI الرسمية المنشورة أو المحدثة حتى 23 أغسطس 2026 فقط، ولا تستخدم مواقع ثانوية. اعرض جدولًا يتضمن كل ادعاء والمصدر الرسمي وتاريخ المصدر، واذكر بوضوح ما لا يمكن إثباته من المصادر العامة. اختم بقائمة حدود التقرير.


اقرأ المنهجية والنتيجة الخام · نزّل الحزمة الكاملة
SHA-256: 54856F47E4675DAF2D3521952DAA589028552F946A5BD5CA1AB6C9824FB49DAC
8) اختبار اختلاف إجابات ChatGPT عبر 30 تشغيلًا
- الهدف: قياس ثبات المعنى والالتزام بالتعليمات عند تكرار البرومبت نفسه، لا قياس دقة ChatGPT العامة.
- التاريخ: من 23:05:28 إلى 23:14:12 بتوقيت UTC في 22 أغسطس، أي 23 أغسطس 2026 بتوقيت القاهرة.
- الخطة والحساب: حساب اختبار واحد بخطة ChatGPT Pro؛ Temporary Chat جديد لكل تشغيل؛ لا Regenerate ولا سؤال متابعة.
- النموذج والوضع الظاهر: GPT-5.6 Sol / Instant كما ظهر في الواجهة.
- البلد والجهاز: مصر؛ حاسوب مكتبي Windows؛ Chromium داخل التطبيق؛ واجهة إنجليزية.
- حجم العينة: 5 برومبتات عربية × 6 تشغيلات مستقلة = 30 تشغيلًا، و15 زوجًا لكل برومبت = 75 مقارنة زوجية.
- النتائج الخام: اكتملت 30/30. تحقق الالتزام الأساسي في 19/30 والصارم في 13/30. حافظ 59/75 زوجًا على الجوهر نفسه، وقدم 16/75 اختلافًا متوافقًا، ولم نسجل اختلافًا ماديًا أو تناقضًا في هذه العينة. بلغ التطابق النصي بعد التطبيع 7/75، ومتوسط زمن الاستجابة 7.23 ثانية.
- عامل مربك مسجل: ظهر البحث أو الاستشهاد تلقائيًا في 4 تشغيلات من V01 رغم عدم اختيار Search يدويًا.
- البيانات المنشورة: CSV للتشغيلات الثلاثين، وXLSX للتحليل، وZIP يضم JSON الخام والملفات والصورتين والمنهجية والبصمات.
- ما لم يُختبر: الخطط والبلدان الأخرى، ومجموعة ضابطة للذاكرة، والحقائق الصعبة والهلوسة. حُفظ النص العادي لا Markdown، ونشرت لقطتان تمثيليتان فقط لا 30 لقطة.
- إعادة الاختبار: لا توجد جولة ثانية حتى 23 أغسطس 2026؛ ستنشر أي جولة لاحقة كسجل مستقل.
اعرض البرومبتات الخمسة حرفيًا
- V01: في 70 إلى 90 كلمة، اشرح الفرق بين ChatGPT وOpenAI API لقارئ غير تقني. استخدم فقرة واحدة فقط، واذكر مثالًا عمليًا واحدًا، ولا تذكر أسعارًا أو أسماء نماذج.
- V02: النص التالي بيانات اصطناعية لأغراض الاختبار، ولا يصف دراسة حقيقية: «شارك 120 طالبًا في نشاط تعليمي مدته 8 أسابيع. أكمل 96 طالبًا النشاط، وحضر المشاركون في المتوسط 6 جلسات، ولم تجمع التجربة درجات مدرسية أو بيانات صحية». لخّص النص في ثلاث نقاط فقط. يجب أن تتضمن النقاط الأعداد 120 و8 و6 حرفيًا، وألا يتجاوز مجموعها 45 كلمة.
- V03: أريد خطة لتعلم البرمجة بسرعة. قبل أن تقترح أي خطة، اطرح سؤالين توضيحيين فقط، في سطرين منفصلين، ولا تضف مقدمة أو نصيحة.
- V04: لدي 4 ساعات أسبوعيًا لمدة 8 أسابيع، وهدفي إنشاء صفحة تعريفية بسيطة بنفسي. اختر مسارًا واحدًا فقط من: (أ) HTML وCSS، (ب) Python، (ج) SQL. أجب باسم المسار، ثم سببين، ثم مخاطرة واحدة. لا تضف خيارًا رابعًا.
- V05: اكتب افتتاحية عربية من 80 إلى 100 كلمة لمقال بعنوان «لماذا تتغير الإجابة؟». يجب أن تتضمن الكلمات: سياق، احتمال، تحقق. استخدم سؤالًا واحدًا فقط، ولا تستخدم علامة التعجب أو القوائم.


اقرأ الاختبار والتحليل الكامل · CSV الخام · ملف التحليل XLSX · الحزمة الكاملة ZIP
SHA CSV: B81ABFDA4F57CD46ED7F9DFCDAED28059254FD2AEF87360C985D7236765CC998SHA XLSX: 0FBD5A54D3825479D6CE00CC00784467DE92D9C60DE40A5A5825407B11346F77SHA ZIP: 50F82F4D83AC2468909C2FB129D14543764742696C8D0D775F79F53B66FD0411
تدقيقات الواجهة والوصول
السجلات التالية ملاحظات مباشرة أو تدقيقات محدودة، وليست اختبارات معيارية للأداء. إبقاؤها منفصلة يمنع تضخيم عدد «الاختبارات» أو إعادة عدّ الفحص نفسه مرتين.
تدقيق خصوصية ChatGPT وإعدادات البيانات
في 1 أغسطس 2026 راجعنا واجهة ChatGPT على الويب باللغة الإنجليزية بحساب Pro مسجل الدخول: الذاكرة، وملخص الذاكرة (Memory summary)، وعناصر التحكم في البيانات (Data controls)، والتدريب، والأرشفة، والحذف، والمكتبة (Library). لم نغيّر الإعدادات ولم نحذف بيانات ولم نختبر النتيجة بعد الحذف. نُشرت ثلاث لقطات أصلية؛ المنطقة غير مسماة، والجهاز والمتصفح غير موثقين. اقرأ التدقيق وحدوده.
فحص واجهة اختيار النموذج وAuto
السجل المنشور في صفحتي Auto وتحديثات النماذج يعود إلى فحص واحد في 31 يوليو 2026 بحساب Pro ومحادثة مؤقتة (Temporary) وواجهة إنجليزية ومحاولة واحدة. لم نختبر انتقال Auto إلى Medium، لذلك لا نسميه «اختبار أداء Auto». لا نعدّ الفحص مرتين في هذا السجل. اقرأ ما شوهد وما لم يُختبر.
فحص الحالة والتوفر
في 1 أغسطس 2026 أُرسل طلب واحد في جلسة Free/Instant وكانت الإجابة المطلوبة مطابقة، مع لقطة أصلية. هذا يثبت نجاح الطلب في تلك الجلسة فقط، ولا يثبت التوفر في كل الخطط أو الدول. صندوق الحالة الحي في الموقع يقرأ الملخص الرسمي لـOpenAI ويخزن الجلب الناجح لمدة لا تتجاوز خمس دقائق؛ وهو عرض لمصدر رسمي وليس شبكة قياس مستقلة متعددة المناطق. افتح صفحة الحالة وحدود الفحص.
مراجعة روابط التنزيل الرسمية
في 1 أغسطس 2026 راجعنا بصريًا من متصفح سطح مكتب صفحة OpenAI العربية ووجهات Windows وmacOS وApp Store وGoogle Play. لم نثبت أو نشغل التطبيقات، ولم يُوثق نظام التشغيل أو المتصفح أو البلد. افتح دليل التنزيل والمصادر الرسمية.
فحص إتاحة أدوات ChatGPT
قارن دليل الأدوات في 1 أغسطس 2026 بين الوثائق الرسمية والقوائم الظاهرة في حسابي Free وPro على الويب. لم تُنفذ كل أداة، ولا توجد قائمة خام أو لقطة منشورة لكل حساب؛ لذلك نعدّه فحص إتاحة منخفض القوة لا اختبار أداء. اقرأ ما تؤديه كل أداة وما لم يُختبر.
مواد لا نعدّها اختبارات حالية
لا نعد صفحات الشرح النظري دراسات مستقلة لمجرد احتوائها على أمثلة. كما أن لقطات ChatGPT 5.2 Pro المؤرخة في مارس 2026 داخل صفحة الاستخدامات مواد أرشيفية، والصفحة نفسها لا تقدمها بوصفها قياسًا للأداء الحالي. تبقى مفيدة للتوضيح، لكنها خارج عدد الاختبارات في هذا السجل.
منهجية GPT Gate وقواعد النشر
- نحدد السؤال قبل التنفيذ: ما الذي نقيسه، وما النتيجة التي تعد نجاحًا أو فشلًا؟
- نجمد المادة قدر الإمكان: ننشر الطلب والملفات أو مفتاح التحقق حتى يستطيع القارئ فهم ما تغير وما بقي ثابتًا.
- نسجل البيئة كما ظهرت: التاريخ والخطة ونوع الحساب والوضع أو النموذج الظاهر والأداة المستخدمة. لا نستنتج نموذجًا خلفيًا لم تعرضه الواجهة.
- نذكر عدد المحاولات: لا نصف تجربة واحدة بأنها متوسط أداء، ولا نعيد تشغيل الإجابة الضعيفة وحدها لاختيار نتيجة أفضل.
- نفصل النتيجة عن الاستنتاج: الدرجة أو النص الملتقط ملاحظة؛ أما تفسير سبب النتيجة فيُعرض بصفته تفسيرًا وحدوده واضحة.
- ننشر النتائج السلبية: عدم تحقق الفرضية أو نقص البيانات جزء من النتيجة، وليس سببًا لحذف التجربة.
- نحمي الخصوصية: تُحجب الأسماء والبريد وسجل المحادثات وأي معلومات شخصية أو مفاتيح وصول قبل نشر اللقطات.
- لا نحول المصدر الرسمي إلى تجربة: نقل وثائق OpenAI مهم للتحقق من حالة المنتج، لكنه لا يصبح اختبارًا أصليًا لمجرد تلخيصه.
للتفصيل حول التحرير والتصحيح والاستقلال اقرأ من نحن ومنهجية العمل في GPT Gate.
البيانات وإعادة الاختبار
ننشر ملفًا قابلًا للتنزيل عندما تسمح المادة المتاحة بإعادة الفحص دون كشف بيانات شخصية أو أسرار وصول. وجود رابط تنزيل لا يجعل التجربة شاملة، لكنه يسمح بمراجعة الطلبات والنتائج والقيود؛ ولا يثبت وحده عدم وجود تشغيلات غير منشورة.
- سجل XLSX القابل للتنزيل: نزّل نسخة 15 أغسطس 2026. تضم 11 سجلًا ولا تتضمن T-007 وT-008؛ وصفحتا الاختبارين وحزمتاهما أعلاه هما المرجع الأحدث لهما. لا نعرض رابطًا لنسخة أحدث قبل رفعها والتحقق من عملها.
- حزم كاملة: اختبار العربية v1.2، واختبار تنظيم البرومبت، واختبار Deep Research، واختبار اختلاف الإجابات.
- ملفات مدخلات فقط: اختبار PDF وWord وExcel؛ لا نعرضه كحزمة ردود كاملة.
- لا ملف كامل منشور: نوضح ذلك صراحة في سجلات الهلوسة وGoogle مقابل ChatGPT وبعض تدقيقات الواجهة بدل اختلاق رابط أو مادة غير موجودة.
- التحقق: تُعرض بصمة SHA-256 بجوار كل حزمة حديثة متى كانت متاحة.
حدود مشتركة وكيف تقرأ النتائج
- مخرجات النماذج احتمالية؛ إعادة الطلب نفسه قد تنتج صياغة أو نتيجة مختلفة.
- الخطة والحساب والوضع والأدوات والسياق السابق والمنطقة وتاريخ التنفيذ قد تغير النتيجة.
- عدم توثيق الجهاز أو البلد أو المتصفح يُسجل كنقص، ولا نملؤه بالافتراض.
- الدرجة تخص سلم التقييم والعينة المنشورين؛ لا تمثل «نسبة دقة ChatGPT» في كل اللغة العربية.
- اختبار Free لا يثبت نتيجة Pro، واختبار واجهة ChatGPT لا يساوي اختبار OpenAI API أو واجهة GPT Gate.
- زمن استجابة ظهر في واجهة واحدة ليس مقياسًا معياريًا للبنية التحتية ولا وعدًا بسرعة مستقبلية.
- الصور توثق ما كان ظاهرًا لحظة الالتقاط، وقد تتغير الواجهة أو أسماء النماذج لاحقًا.
سجل التحديثات والتصحيحات
- 23 أغسطس 2026: إضافة اختبار Deep Research الحي بتشغيل واحد، واختبار اختلاف الإجابات عبر 30 تشغيلًا و75 مقارنة زوجية، ونشر البيانات الخام واللقطات والحزم وبصمات التحقق. لم تُعد التجارب الأقدم في هذا التحديث.
- 15 أغسطس 2026: توسيع مركز الأبحاث ليجمع الاختبارات والتدقيقات المنشورة، وفصل الدراسات القابلة لإعادة التشغيل عن فحوص الواجهة. لم نُعِد تشغيل أي اختبار في هذا التحديث.
- 2 أغسطس 2026: نشر اختبار العربية وحزمته v1.2، واكتمال اختبار البرومبت ذي الثلاثين تشغيلًا وتدقيقه.
- 1–2 أغسطس 2026: تنفيذ اختبارات الملفات والهلوسة وGoogle مقابل ChatGPT وتدقيق الخصوصية والوصول كما هو موضح في صفحاتها.
- 31 يوليو 2026: تنفيذ عينة واجهة GPT Gate وفحص واجهة اختيار النموذج.
هل وجدت خطأ أو تريد إعادة تجربة؟ أرسل رقم السجل والطلب أو السطر محل الاعتراض، وأرفق مصدرًا أصليًا أو خطوات قابلة للتكرار. نصحح الخطأ الموثق ونفصل تاريخ التصحيح عن تاريخ الاختبار الأصلي. يمكنك التواصل عبر صفحة الاتصال.
