الأدلة والدعم

مركز مساعدة OpenGPT

اعثر على سير العمل المناسب واتبع كل خطوة وافهم ما يمكن للنتيجة أن تخبرك به وما لا يمكنها.

ابدأ بما تريد فعله

يجيب كل سير عمل عن سؤال مختلف. ابدأ بالهدف الأقرب، ثم اتبع الدليل المرتبط.

1ترتيبات النماذجافهم المؤشرات المنشورة وحالة الهوية.2تصنيفات Agentاختر إعدادات Agent كاملة حسب المهمة والأدلة.3اخترضيّق نطاق المرشحين انطلاقًا من المتطلبات الفعلية.4مقارنة البيانات العامةضع معرّفات ما بين نموذجين وأربعة نماذج من الدليل جنبًا إلى جنب.5حفظ النماذجاحتفظ بقائمة مختصرة محلية في هذا المتصفح.6تشغيل تجربة Proof Labاختبر من 2 إلى 4 تهيئات محددة لنموذج أو وكيل على حزمة مهام مجمّدة واحدة.7تقديم أدلة أو تصحيحهاأرسل مصدرًا عامًا لنموذج أو Agent للمراجعة التحريرية.8تحقّق من تقريرافحص تقرير OpenGPT بصيغة JSON محليًا قبل مشاركته.

01

تصنيفات نماذج AI

اطّلع على ما هو مصنّف ومصدر البيانات والسجلات التي تتضمن معرّف نموذج رسميًا.

مفتوح

الغرض من هذه الميزة

استخدم كل زاوية ترتيب لفحص المؤشرات المنشورة ومراجعة سجلات المصدر وبناء قائمة مختصرة للاختبار على مهام حقيقية.

قبل أن تبدأ

ابدأ بالسؤال الذي تحتاج إلى إجابته. تستخدم تفضيلات المستخدمين والقدرة العامة والمهام الموضوعية والتكلفة وترتيبات النماذج مفتوحة الأوزان مصادر ومقاييس مختلفة.

شرح خطوة بخطوة

  1. 1اختر زاوية التصنيف التي تناسب قرارك.
  2. 2استخدم «ترتيب المصدر الكامل» لكل سجل ناشر، أو «معرّفات النماذج الرسمية» للسجلات المرتبطة بتوثيق المزوّد.
  3. 3اقرأ موضع المصدر ونطاق الدرجات والأصوات والترخيص والإعداد معًا.
  4. 4افتح تفاصيل النموذج في أي صف. تستخدم الروابط الرسمية الدقيقة الملف الرسمي؛ ويفتح كل صف آخر ملف مصدر يحافظ على الاسم والإعداد المنشورين.
  5. 5أضف أي صف إلى المقارنة. تستخدم عمليات الربط الدقيقة والآمنة للتكوين مقارنة الإصدار الرسمي؛ وتستخدم جميع الصفوف الأخرى مقارنة سجل المصدر ضمن المصدر والبُعد واللقطة نفسها.

كيفية قراءة النتيجة

الترتيب نسبي إلى مصدر ونطاق واحدين. قد تؤدي التعادلات إلى تخطي أرقام ترتيب، ودرجات زوايا التصنيف المختلفة ليست قابلة للمقارنة مباشرة.

ما الذي لا يمكنه إثباته

تنظم OpenGPT بيانات عامة من جهات خارجية ولم تُعد تشغيل هذه التقييمات. ولا يحدد أي ترتيب أفضل نموذج لكل مستخدم أو مهمة.

سؤال شائع: لماذا لا تعرض بعض الصفوف سوى معرّف نموذج المصدر أو اسمه؟

يتضمن كل صف الآن تفاصيل النموذج وإجراء مقارنة. لا يضيف OpenGPT معرّف نموذج رسميًا إلا عندما تثبت وثائق المزوّد الربط الدقيق؛ وإلا فتحافظ مقارنة سجل المصدر على اسم الناشر والإعداد وبيانات التصنيف دون اختلاق معرّف رسمي جديد.

العودة إلى الأعلى
02

تصنيفات AI Agent

اختر Agent حسب المهمة والإعداد الكامل وجودة الأدلة والنتائج القابلة للمقارنة.

مفتوح

الغرض من هذه الميزة

استكشف 96 إعداد تقييم Agent منشورًا عبر سبعة نطاقات مهام، إضافة إلى 109 نتائج منفصلة لنماذج استدعاء الأدوات في BFCL، دون تحويل الأدلة غير المتوافقة إلى درجة واحدة.

قبل أن تبدأ

تنتمي نتيجة Agent إلى تكوين كامل واحد: النموذج الأساسي والبنية والأدوات والأذونات والميزانية والبيئة وإصدار المعيار والتاريخ. يحتفظ OpenGPT بالحقول التي أبلغ عنها المصدر ويترك الحقول المفقودة دون إبلاغ، لا بقيمة صفر.

شرح خطوة بخطوة

  1. 1اختر فئة المهمة التي تناسب عملك.
  2. 2تحقق من نطاق المعيار وإصداره وتاريخ التقييم وحداثته وملاحظة التدقيق قبل قراءة الترتيب.
  3. 3استخدم درجة الأدلة للتمييز بين النتائج المعاد إنتاجها أو المتحقق منها، والجولات العامة الشفافة، والنتائج التي يعلنها البائع.
  4. 4قارن النجاح وأدلة التشغيل المتكرر والمدة والتدخل فقط عندما يبلغ المصدر عنها بالشروط نفسها. لا يعرض OpenGPT التكلفة لكل نجاح إلا عندما يستخدم الإجمالي المنشور ومقام المهام أو مرات التشغيل النطاق نفسه الذي تم التحقق منه.
  5. 5تابع الإعدادات المفيدة، وراجع سجلها، واختر من إدخالين إلى أربعة من المجموعة القابلة للمقارنة نفسها لعرض متجاور.

كيفية قراءة النتيجة

يصف الترتيب تكوين نظام كاملًا ضمن نطاق معيار واحد. اقرأه مع درجة الدليل وحداثته وعدد العينات أو عمليات التشغيل وأي حقول مُبلّغ عنها للتكلفة والموثوقية.

ما الذي لا يمكنه إثباته

لا تنشئ OpenGPT درجة عالمية للوكلاء. وما لم تُصنف النتيجة صراحةً بأنها أُعيد إنتاجها، فإن OpenGPT تنظم الأدلة الأولية بدلًا من إعادة تشغيلها؛ ولا يثبت أي معيار جاهزية الإنتاج لكل سير عمل.

سؤال شائع: لماذا قد يظهر الوكيل أو النموذج نفسه أكثر من مرة؟

يُنشئ أي اختلاف في البنية أو إصدار النموذج أو مجموعة الأدوات أو مستوى الأذونات أو الميزانية أو إعداد المعيار تكوين وكيل مختلفًا، ويجب أن يظل سجلًا منفصلًا.

العودة إلى الأعلى
03

تقديم نموذج أو وكيل

أرسل سجل هوية أو أدلة عامًا للمراجعة من دون تغيير التصنيفات.

مفتوح

الغرض من هذه الميزة

استخدم مسار التقديم عندما يكون معرّف نموذج رسمي أو منتج وكيل مفقودًا، أو عندما يحتاج مصدر عام إلى مراجعة تحريرية.

قبل أن تبدأ

سجّل الدخول باستخدام حساب متحقق منه وجهّز مصدر HTTPS عامًا. لا ترسل أبدًا بيانات اعتماد أو ملفات خاصة أو معلومات شخصية.

شرح خطوة بخطوة

  1. 1اختر Model أو Agent في أعلى النموذج.
  2. 2أدخل الاسم العام الدقيق والمزوّد أو المؤسسة وحقول الهوية المطلوبة.
  3. 3اختر نوع المصدر وأضف رابطًا إلى وثائق رسمية أو مستودع عام أو نتيجة معيار عام.
  4. 4اشرح ما ينبغي للمراجع التحقق منه، ثم أرسل مرة واحدة.
  5. 5تابع حالة المراجعة ضمن طلباتك الأخيرة. يُدرج منتج الوكيل المعتمد تلقائيًا في دليل الوكلاء القابل للبحث؛ ويبقى الترتيب قرارًا منفصلًا.

كيفية قراءة النتيجة

يحصل الإرسال الناجح على رقم مرجعي ويدخل قائمة انتظار المراجعة. منتج Agent المعتمد سجل دليل عام، وليس ترتيبًا في لوحة الصدارة أو توصية من OpenGPT.

ما الذي لا يمكنه إثباته

لا يستطيع مقدّمو الطلبات تحديد الترتيب أو درجة الأدلة أو قابلية المقارنة أو حالة النشر. وتقلل حدود التكرار والمعدل من إساءة الاستخدام، ولا تغيّر الموافقة أي ترتيب تلقائيًا.

سؤال شائع: لماذا لم يُضف طلب معتمد إلى الترتيب؟

يمكن البحث عن منتجات Agent المعتمدة في الدليل، لكن إدراجها في ترتيب لا يزال يتطلب أدلة تقييم عامة قابلة للمقارنة.

العودة إلى الأعلى
04

تغييرات لوحة الصدارة وسجل الإصدارات

تتبّع الحركة عبر اللقطات القابلة للمقارنة، وقارن معرّفات نماذج الكتالوج.

مفتوح

الغرض من هذه الميزة

استخدم هذه الصفحة لمعرفة ما تغيّر منذ لقطة المصدر السابقة، والسجلات التي ظهرت لأول مرة، واختلاف الإصدارات المحددة، ووقت استرداد البيانات.

قبل أن تبدأ

تستخدم الحركة التاريخية حاليًا نطاق تفضيلات المستخدم في LMArena. تظل المصادر النشطة الأخرى للحالة الحالية فقط حتى تتوفر لقطة سابقة قابلة للمقارنة.

شرح خطوة بخطوة

  1. 1تحقق من تاريخ المصدر وخط أساس المقارنة وتاريخ الاسترجاع وقاعدة المقارنة.
  2. 2اقرأ قسم «الأسرع صعودًا» فقط بين السجلات الموجودة في كلتا اللقطتين.
  3. 3تعامل مع «ظهر لأول مرة» بوصفه إدخالًا جديدًا في المصدر، لا تاريخ إصدار رسميًا.
  4. 4صفِّ جدول الحركة حسب الصعود أو الهبوط أو عدم التغير أو الظهور الأول أو الخروج من القائمة.
  5. 5قارن معرّفي نموذج من الكتالوج، ثم نزّل لقطة مصدر عندما تحتاج إلى مسار تدقيق.

كيفية قراءة النتيجة

لا تحسب OpenGPT الحركة إلا عند تطابق المصدر والنطاق والوحدة والمنهج، وتحتفظ بلقطات شهرية قابلة للتنزيل.

ما الذي لا يمكنه إثباته

لا تُعد تواريخ إصدار المنتجات إلا إذا وثقها المزوّد. ولا تستنتج مقارنة الإصدارات السرعة أو السعر أو طول السياق أو الجودة من الأسماء.

سؤال شائع: لماذا لا يعرض LiveBench أي حركة في الترتيب؟

لم تجمّد OpenGPT إصدارًا سابقًا قابلًا للمقارنة لهذا المصدر النشط. وتظل المصادر المتوقفة مؤقتًا تاريخية بدلًا من المساهمة في الحركة الحالية.

العودة إلى الأعلى
05

الترتيبات حسب المهمة

ابدأ بسيناريو عمل حقيقي وراجع ثلاثة إصدارات رسمية للنماذج تستحق الاختبار أولًا.

مفتوح

الغرض من هذه الميزة

استخدم ترتيبات المهام لتحويل المؤشرات العامة الواسعة إلى قائمة مختصرة وعملية للبرمجة أو البحث أو المستندات أو الدعم أو العمل متعدد اللغات أو متعدد الوسائط أو التكلفة أو الخصوصية أو السرعة.

قبل أن تبدأ

اختر المهمة الأقرب إلى عملك، ثم دوّن مطالباتك وبياناتك وأدواتك ومنطقتك وميزانيتك ومتطلبات الخصوصية الفعلية. قد تغطي الأدلة العامة المعروضة نطاقًا أوسع من مهمتك.

شرح خطوة بخطوة

  1. 1افتح سيناريو المهمة الأقرب إلى القرار الذي تحتاج إلى اتخاذه.
  2. 2اقرأ سبب اختيار الإصدارات الرسمية الثلاثة وما لا يزال غير مؤكد.
  3. 3افحص المصدر العام وترتيبه أو قيمته وتاريخ مراجعة الربط والحد الزمني للبيانات لكل مرشح.
  4. 4حدد مرشحين اثنين أو ثلاثة لإجراء مقارنة للبيانات العامة جنبًا إلى جنب.
  5. 5افتح تقييم المهام الواقعية باستخدام أول مرشحين، وعدّل مجموعة المهام النموذجية، واختبر كليهما بإعدادات قابلة للمقارنة.

كيفية قراءة النتيجة

ستحصل على ثلاثة مرشحين رسميين للبدء، وأدلة عامة ظاهرة عند توفرها، ومسارات مباشرة للمقارنة أو إجراء اختبار على مهمة حقيقية.

ما الذي لا يمكنه إثباته

ترتيب المهمة قائمة مختصرة أولية، وليس ترتيبًا شاملًا أو إثباتًا لأفضل نموذج. الدليل المفقود ليس صفرًا، ولا تُدمج المصادر العامة غير المتشابهة في درجة واحدة.

سؤال شائع: لماذا قد لا تتوفر لمرشح البداية نتيجة عامة قابلة للمقارنة؟

قد يكون إصدار رسمي ذا صلة بالمهمة بسبب موضع المنتج أو نوع النشر حتى عندما لا تكون هناك نتيجة لإصدار دقيق مرتبطة بالمصدر العام المحدد. يظل الدليل المفقود ظاهرًا ويجب حسمه باختبارك الخاص.

العودة إلى الأعلى
06

الرادار لترقية النماذج

حدد النماذج التي تستخدمها وأعمالك المتكررة وأولوياتك، ثم راجع إشارات حذرة لمعرفة متى تكون المقارنة العادلة مجدية.

مفتوح

الغرض من هذه الميزة

استخدم الرادار للإجابة عن سؤال عملي: هل توجد أدلة عامة قابلة للمقارنة تكفي لاختبار بديل للنموذج الذي تستخدمه الآن؟

قبل أن تبدأ

اختر إصدارات رسمية دقيقة ومهمة متكررة واحدة على الأقل وأولوية أو أولويتين كحد أقصى. استخدم المتصفح والجهاز نفسيهما لأن الإعداد يبقى محليًا.

شرح خطوة بخطوة

  1. 1اختر الإصدارات الرسمية الدقيقة التي تستخدمها حاليًا؛ ولا يُفترض أن النماذج المحفوظة حالية.
  2. 2حدد المهام المتكررة وما يصل إلى أولويتين مثل الجودة أو التكلفة أو السرعة أو الخصوصية أو السياق الطويل.
  3. 3راجع ما إذا كان كل نموذج يستحق المقارنة أو آمنًا للاستمرار في مراقبته أو يقترب من التقاعد.
  4. 4افحص الأدلة العامة القابلة للمقارنة، ثم اختبر النموذجين على العمل الفعلي نفسه.
  5. 5راجع التغييرات أسبوعيًا أو اشترك في موجز RSS العام لتغييرات الترتيب.

كيفية قراءة النتيجة

ينشئ الرادار فحص ترقية محليًا على الجهاز، يتضمن نموذجًا حاليًا وبديلًا ملائمًا للمهمة عند توفره وتاريخ الأدلة وحدود عدم اليقين وإجراءات مقارنة مباشرة.

ما الذي لا يمكنه إثباته

فحص الترقية ليس أمرًا بالتبديل. قد تظل التكلفة أو السرعة أو الخصوصية أو السياق تتطلب اختبارًا مباشرًا، ولا تتم مزامنة الإعدادات المحلية أو نسخها احتياطيًا.

سؤال شائع: هل تعني عبارة «يستحق المقارنة» أنه ينبغي استبدال نموذجي الحالي؟

لا. يعني ذلك أن إشارة قابلة للمقارنة أو تغييرًا في دورة الحياة يجعل الاختبار على المهمة نفسها جديرًا بالتنفيذ. لا تبدّل إلا بعد نجاح البديل على عملك الفعلي وضمن قيودك.

العودة إلى الأعلى
07

اختر نموذج AI

حوّل أربعة متطلبات عملية إلى قائمة مختصرة قابلة للتفسير.

مفتوح

الغرض من هذه الميزة

استخدم أداة البحث عندما تعرف العمل المطلوب، لكنك لا تعرف أي سلسلة نماذج ينبغي استقصاؤها أولًا.

قبل أن تبدأ

حدّد المهمة الرئيسية والمكان الذي قد يعمل فيه النموذج وأهم أولوية تشغيلية لديك وأي متطلبات لغوية.

شرح خطوة بخطوة

  1. 1اختر المهمة الأقرب إلى عملك الحقيقي.
  2. 2حدد حدود النشر، ولا سيما عندما يتعذر خروج البيانات من بيئتك.
  3. 3اختر الأولوية التي لا ترغب في التنازل عنها.
  4. 4حدد الحاجة اللغوية، ثم راجع أسباب التطابق والمخاطر والخطوة التالية للتحقق لكل مرشح.
  5. 5انقل أقوى المرشحين إلى تقييم على مهام حقيقية، واختبر إصدارات النماذج المحددة على المهام نفسها.

كيفية قراءة النتيجة

تنطبق التسمية النوعية وعدد مطابقات المتطلبات على سلسلة النماذج، لا الإصدارات الفردية؛ وليست أي منهما درجة معيار مرجعي. تحقّق من توفر نشر كل إصدار حالي مُدرج، وقارن المرشحين على المهام نفسها.

ما الذي لا يمكنه إثباته

لا تستدعي أداة البحث النماذج، ولا تتحقق من الأسعار الحالية، ولا تسمي فائزًا عالميًا. ويمكن أن تتضمن سلسلة نماذج إصدارات بقدرات مختلفة.

سؤال شائع: لماذا لم يظهر نموذج مشهور في المرتبة الأولى؟

يعكس الترتيب القيود التي حددتها، لا الشعبية العامة. غيّر متطلبًا واحدًا لترى ما سبّب النتيجة، ثم اختبر الإصدارات المحددة.

العودة إلى الأعلى
08

دليل النماذج وتفاصيلها

تصفح معرّفات النماذج الموثقة من المزوّد، وافتح صفحات التفاصيل المخصصة، وتحقق من وجود بيانات تصنيف عامة قابلة للمقارنة.

مفتوح

الغرض من هذه الميزة

استخدم الدليل عندما تحتاج إلى معرّف نموذج رسمي محدد، أو وجهة المزوّد، أو المهام المناسبة وغير المناسبة، أو المصادر، أو حالة واضحة لبيانات الترتيب.

قبل أن تبدأ

أدخل اسم نموذج أو مزوّدًا أو حاجة نشر أو مهمة. لا يضمن معرّف نموذج موثق من المزوّد وجود بيانات تقييم عامة قابلة للمقارنة.

شرح خطوة بخطوة

  1. 1ابحث حسب النموذج أو الإصدار أو المزود أو المهمة.
  2. 2صفِّ حسب طريقة النشر وحالة المصنف أو غير المصنف حاليًا.
  3. 3افتح صفحة تفاصيل نموذج لمراجعة الهوية والاستخدام المقصود وتغطية البيانات العامة ونقاط القوة والقيود والمصادر وتاريخ المراجعة.
  4. 4استخدم الوجهة الرسمية للتحقق من التوفر والأسعار والخصوصية والقيود الحالية.
  5. 5أضف من إصدارين إلى أربعة إصدارات من الكتالوج إلى مقارنة البيانات، ثم انقل خيارين نهائيين إلى تقييم بمهمة حقيقية.

كيفية قراءة النتيجة

تعني «مصنّف» أن بيانات منشورة قابلة للمقارنة مرتبطة بمعرّف النموذج الدقيق. وتعني «غير مصنّف» أن هذا الإصدار لا يتضمن سجلًا مناسبًا قابلًا للمقارنة؛ ولا يعني ذلك درجة صفر.

ما الذي لا يمكنه إثباته

تثبت وثائق المزود هوية العنصر في الدليل، لا توفره الحالي في كل بلد أو فئة خدمة. قد تتغير تغطية التصنيف وتفاصيل النموذج وشروط المزود بعد تاريخ المراجعة.

سؤال شائع: هل يعني عدم التصنيف أن النموذج ضعيف؟

لا. يعني ذلك أن هذه النسخة تفتقر إلى بيانات عامة مناسبة وقابلة للمقارنة لمُعرّف النموذج هذا. اختبره مباشرة إذا ظل ذا صلة بقرارك.

العودة إلى الأعلى
09

مقارنة البيانات

قارن من إصدارين إلى أربعة إصدارات رسمية دقيقة، أو سجلات من عرض تصنيف منشور واحد.

مفتوح

الغرض من هذه الميزة

تنظّم مقارنة الإصدارات الرسمية المعرّفات الموثقة من المزوّد عبر المصادر المنشورة. وتحافظ مقارنة سجلات المصادر على اسم الناشر وإعداداته عندما تؤدي المقارنة الرسمية الدقيقة إلى فقدان معلومات.

قبل أن تبدأ

للإصدارات الرسمية، اختر من معرّفين إلى أربعة معرّفات من الكتالوج. ولسجلات المصدر، اختر من صفين إلى أربعة من المصدر والبُعد واللقطة نفسها.

شرح خطوة بخطوة

  1. 1أضف أي صف من تصنيف. تستخدم عمليات الربط الآمنة للتكوين مقارنة الإصدار الرسمي؛ وتستخدم جميع الصفوف الأخرى مقارنة سجل المصدر.
  2. 2تظل النتائج الرسمية منفصلة بحسب المصدر والبُعد.
  3. 3تحافظ نتائج سجلات المصدر على الاسم والإعداد والترتيب والدرجة المنشورة ضمن مقياس مصدر مشترك واحد.
  4. 4تظل البيانات المفقودة مجهولة بدلًا من اعتبارها صفرًا.
  5. 5لا يمكن متابعة تقييم المهام الواقعية إلا بالإصدارات الرسمية الدقيقة بعد اختيار مرشحين نهائيين اثنين.

كيفية قراءة النتيجة

تنشئ المقارنة قائمة مختصرة تراعي الأدلة وتوضح مواضع نقص المعلومات. ولا تنتج درجة جديدة لمعيار مرجعي، ولا تعلن فائزًا عالميًا.

ما الذي لا يمكنه إثباته

لا تستدعي OpenGPT النماذج في طريقة العرض هذه. ولا يمكن تبادل الدرجات المنشورة من مصادر أو نطاقات مختلفة، وقد تتغير تفاصيل النماذج بعد تاريخ مراجعتها.

سؤال شائع: كيف تختلف مقارنة البيانات عن التقييم على مهام حقيقية؟

تلخص مقارنة البيانات معلومات منشورة بالفعل لنموذجين إلى أربعة نماذج. يأخذ التقييم على مهام حقيقية إصدارين بالضبط، ويطلب منك تشغيل المطالبات نفسها في الخدمتين، ثم يراجع الإجابات الملصقة مع إخفاء تسميات النماذج الظاهرة.

العودة إلى الأعلى
10

النماذج المحفوظة

احتفظ في هذا المتصفح بقائمة عمل صغيرة من عناصر الترتيب.

مفتوح

الغرض من هذه الميزة

استخدم «النماذج المحفوظة» للعودة سريعًا إلى المرشحين، وفتح الوجهات الموثوقة، ونقل معرّفات النماذج المدعومة إلى مقارنة.

قبل أن تبدأ

استخدم المتصفح والجهاز نفسيهما. تُخزّن القائمة محليًا من دون حساب OpenGPT أو مزامنة سحابية.

شرح خطوة بخطوة

  1. 1حدد «حفظ» في أي صف من صفوف الترتيب.
  2. 2افتح النماذج المحفوظة من شريط التنقل العلوي لمراجعة الإدخالات المحفوظة.
  3. 3يعرض كل سجل مصدر محفوظ معرّف نموذج المصدر أو اسمه. ويمكن للسجلات ذات المعرّف الرسمي فتح وجهة المزوّد أو الدخول في المقارنة أيضًا.
  4. 4أضف معرّفين مختلفين ومدعومين للنماذج، ثم افتح مقارنة البيانات العامة. اختر نموذجين نهائيين هناك قبل بدء تقييم بمهمة حقيقية.
  5. 5أزل الإدخالات التي لم تعد بحاجة إليها. يؤدي تحديث الموقع أو تغيير لغته إلى إبقاء القائمة في المتصفح نفسه.

كيفية قراءة النتيجة

يوضح العدد بجوار «النماذج المحفوظة» عدد الإدخالات المحفوظة. وتظل هوية المصدر منفصلة عن هوية النموذج الرسمية.

ما الذي لا يمكنه إثباته

القائمة ليست حسابًا أو مزامنة للإشارات المرجعية أو نسخة احتياطية. لن يراها متصفح أو جهاز آخر، وقد يزيلها التصفح الخاص أو قيود التخزين أو مسح بيانات الموقع.

سؤال شائع: لماذا اختفت نماذجي المحفوظة؟

تحقق من أنك تستخدم ملف المتصفح والجهاز نفسيهما. إذا مُسحت بيانات الموقع أو حُظرت، فلن يستطيع OpenGPT استعادة القائمة المحلية.

العودة إلى الأعلى
11

Proof Lab

نفّذ تجربة خاصة على عمل حقيقي؛ يحتفظ الوضع المؤقت بالمخرجات الخام في الذاكرة ما لم تتعمد الاحتفاظ بها على هذا الجهاز.

مفتوح

الغرض من هذه الميزة

قارن بين إعدادين إلى أربعة إعدادات دقيقة لنموذج أو Agent باستخدام حزمة مهام واحدة مضبوطة وقابلة للتدقيق.

قبل أن تبدأ

سجّل كل إعداد دقيق وافتح خدمات المزود ذات الصلة وأزل البيانات الحساسة وتذكّر أن سياسات المزود تسري على كل ما ترسله إليه.

شرح خطوة بخطوة

  1. 1اختر من إعدادين إلى أربعة إعدادات دقيقة لنموذج أو Agent؛ ولا تعامل اسم العائلة بوصفه إعدادًا قابلًا لإعادة الإنتاج.
  2. 2حمّل قالبًا أو أنشئ حزمة مهام قابلة للتعديل، ثم جمّدها قبل جمع النتائج.
  3. 3نفّذ بنفسك كل مهمة مجمّدة في كل إعداد والصق كل مخرج كامل في المصفوفة.
  4. 4استخدم مراجعة متوازنة ومعمّاة تشمل جميع الأزواج. سجّل «ناجح» أو «فاشل» أو «غير حاسم» أو «لم يُختبر»، إضافة إلى الإخفاقات الحرجة؛ واحتفظ بزمن الاستجابة والتكلفة كملاحظتين منفصلتين، ولا تنشئ درجة إجمالية مصطنعة.
  5. 5راجع الأدلة المكشوفة وأكد نتيجة القرار صراحةً. صدّر البيانات الوصفية افتراضيًا؛ ولا تدرج المخرجات الخام الكاملة إلا بعد الموافقة، وتحقق من الحزمة المصدّرة محليًا.

كيفية قراءة النتيجة

النتيجة حصيلة مؤكدة من المستخدم ومرتبطة بحزمة المهام المجمّدة والتهيئات المسجلة. تصدير البيانات الوصفية فقط هو الخيار الافتراضي؛ ويتطلب تصدير البيانات الخام الكاملة موافقة صريحة، ويمكن لأداة التحقق المحلية فحصه.

ما الذي لا يمكنه إثباته

يقلل إخفاء التسميات من تحيز الأسماء الظاهرة، لكنه لا يجعل التقييم مزدوج التعمية. لا تشغّل OpenGPT خدمات المزوّدين، ولا تثبت مصدر المخرجات أو دقة الإعداد أو اكتماله أو الخصوصية لدى المزوّدين الخارجيين أو قابلية التعميم خارج هذه المهام. نتائج التجارب الخاصة مصنفة «مُختبر على عملك»، وليست «أدلة عامة».

سؤال شائع: هل يرفع Proof Lab المطالبات أو المخرجات الخام؟

تُجرى التجربة في متصفحك. يحتفظ الوضع المؤقت بالمخرجات الخام في الذاكرة؛ أما الاحتفاظ بها على هذا الجهاز فاختياري. ويستبعد تصدير البيانات الوصفية المخرجات الخام، بينما يتطلب تصدير البيانات الخام الكاملة موافقة صريحة.

العودة إلى الأعلى
12

مجموعات المهام المحفوظة وإعادة التقييم

أعد استخدام المطالبات الحقيقية نفسها في تقييم لاحق للنموذج من دون إعادة بناء مجموعة المهام.

مفتوح

الغرض من هذه الميزة

استخدم مجموعات المهام المحفوظة لجعل المقارنات المستقبلية أكثر اتساقًا، ولإعادة تقييم إصدارات النماذج المحددة بعد إصدار جديد أو تغير في البيانات العامة.

قبل أن تبدأ

أكمل عناوين المهام ومطالباتها، واختر اسمًا واضحًا لمجموعة المهام، واستخدم المتصفح والجهاز نفسيهما. قد تحتوي مجموعة المهام على نص عمل حساس، لذا أزل البيانات الخاصة قبل الحفظ.

شرح خطوة بخطوة

  1. 1في تقييم المهام الواقعية، أنشئ أو عدّل مجموعة مهام تمثل عملك.
  2. 2امنح مجموعة المهام اسمًا واضحًا واحفظها.
  3. 3لاحقًا، اختر مجموعة المهام المحفوظة وحمّلها في التقييم الحالي.
  4. 4حدد إصدارين دقيقين من النماذج وشغّل كل مطالبة بإعدادات قابلة للمقارنة.
  5. 5من نتيجة مكتملة، اختر إعادة التقييم للاحتفاظ بالمهام وإصدارات النماذج مع مسح الإجابات والأحكام القديمة والتقرير السابق.

كيفية قراءة النتيجة

يُخزّن اسم مجموعة المهام والقالب واللغة وعناوين المهام والمطالبات محليًا لإعادة استخدامها. وتبدأ إعادة التقييم جولة نظيفة مع الاحتفاظ بمدخلات الاختبار المقصودة.

ما الذي لا يمكنه إثباته

لا توجد مجموعات المهام المحفوظة إلا على هذا الجهاز ولا تتم مزامنتها أو نسخها احتياطيًا. لا تُحفظ الإجابات أو اختيارات النماذج أو المراجعات أو التقارير أو مفاتيح API ضمن مجموعة المهام. وقد تؤدي إزالة بيانات الموقع إلى حذف كل المجموعات المحفوظة.

سؤال شائع: ما الذي يتغيّر عندما أختار «إعادة التقييم»؟

تُبقي OpenGPT المهام وإصدارات النماذج الدقيقة نفسها، ثم تمسح الإجابات والدرجات والأحكام وحالة الكشف والتقرير السابقة، ليكون التشغيل التالي مستقلًا عن النتيجة القديمة.

العودة إلى الأعلى
13

تقرير قرار قابل للمشاركة

أنشئ رابطًا آمنًا للخصوصية لقائمة مختصرة من النماذج الرسمية وتاريخ قطع بياناتها العامة.

مفتوح

الغرض من هذه الميزة

استخدم التقرير لمشاركة المهمة والإصدارات الرسمية المحددة قيد الدراسة، والأدلة العامة المتاحة، ومرشح اختياري محدد.

قبل أن تبدأ

أنشئ التقرير من تصنيف مهمة. أكد المهمة ومعرّفات النماذج الدقيقة وتاريخ قطع البيانات والخيار الاختياري قبل المشاركة.

شرح خطوة بخطوة

  1. 1افتح ترتيبًا للمهام وأنشئ تقريرًا من مرشحين رسميين أو ثلاثة.
  2. 2يمكن اختياريًا تحديد نموذج واحد بوصفه مختارًا؛ ويجوز ترك الاختيار فارغًا.
  3. 3راجع تغطية البيانات العامة وحدود التقرير.
  4. 4انسخ الرابط أو استخدم ورقة المشاركة في الجهاز أو اطبعه أو نزّل سجل JSON المنقح.
  5. 5يمكن للمستلم فتح القائمة المختصرة نفسها أو مقارنة البيانات العامة أو بدء تقييم بمهمة حقيقية.

كيفية قراءة النتيجة

لا يحمل عنوان URL المشترك سوى معرّف المهمة ومعرّفات النماذج الرسمية المحددة والحد الزمني للبيانات العامة والنموذج المحدد اختياريًا، كي يتمكن المستلم من فحص القائمة المختصرة نفسها.

ما الذي لا يمكنه إثباته

لا يتضمن التقرير القابل للمشاركة مطالبات أو إجابات نماذج أو ملاحظات أو مفاتيح API أو تقرير التقييم الكامل. إنه سجل قائمة مختصرة، وليس دليلًا على فائز عالمي أو على مخرجات موثقة من المزوّد.

سؤال شائع: هل يمكن لشخص ما رؤية محتوى تقييمي من رابط المشاركة؟

لا. فالمطالبات والإجابات والملاحظات ومفاتيح API ومشروع التقييم المحلي مستثناة. افحص الرابط دائمًا قبل مشاركته إذا أضفت معلومات خارج مسار التقرير المدعوم.

العودة إلى الأعلى
14

التحقق من التقرير

افحص تقارير JSON المدعومة للتأكد من البنية والاتساق الداخلي وأنماط الأسرار، وأنشئ بصمة محلية.

مفتوح

الغرض من هذه الميزة

استخدم أداة التحقق لفحص حزمة OpenGPT Evidence v1 أو v2، أو تقرير V3 منزّل من «مساحة عمل القرار». تُجرى جميع عمليات التحقق محليًا في هذا المتصفح.

قبل أن تبدأ

احصل على ملف JSON الأصلي. ولتقرير مقارنة، نزّله من مساحة عمل القرار؛ وأكمل جميع الحالات أولًا إذا كنت تحتاج إلى نتيجة مكتملة بدلًا من مسودة.

شرح خطوة بخطوة

  1. 1اختر ملف JSON؛ سيبقى في هذا المتصفح.
  2. 2تأكد من أن أداة التحقق تتعرف على Evidence v1/v2 أو OpenGPT private comparison v1/v2 أو مساحة عمل القرار v3.
  3. 3بالنسبة إلى حزم الأدلة، راجع الحقول المطلوبة ومرات التشغيل والطوابع الزمنية والدرجات وفحوص سلامة الأسرار. وبالنسبة إلى تقارير المقارنة، راجع أسماء المرشحين وحزمة المهام وحالة المسودة أو الاكتمال والحالات الفريدة ومدى تطابق الملخص مع الأحكام المسجلة.
  4. 4اقرأ الملخص المعلن واحفظ بصمة SHA-256 إذا احتجت إلى تأكيد مراجعة الملف نفسه تمامًا لاحقًا.
  5. 5إذا فشل فحص، صحح بيانات المصدر أو أكمل حالات المقارنة الناقصة بدلًا من تعديل التقرير المنزّل لإجباره على الاجتياز.

كيفية قراءة النتيجة

في Evidence v1/v2، تعني Passed أن الحزمة تتبع قواعد البنية والاتساق المدعومة، بينما تعني Demo أنها مثال. وفي تقرير المقارنة، تعني Passed أن التقرير المكتمل متسق داخليًا؛ وتعني Draft أن بنيته سليمة لكن المقارنة غير مكتملة. وتعني Failed أن فحصًا مطلوبًا واحدًا على الأقل يحتاج إلى مراجعة.

ما الذي لا يمكنه إثباته

النجاح لا يثبت أن النموذج المسمّى أنتج الإجابات الملصقة، أو أن ادعاءات المزوّد صحيحة، أو أن النتيجة قابلة للتعميم خارج الاختبارات المسجلة. ولا تكون نتائج الملفات غير المرتبطة قابلة للمقارنة تلقائيًا.

سؤال شائع: هل يثبت اجتياز تقرير المقارنة أن أحد النموذجين أفضل؟

لا. إنه يؤكد فقط أن التقرير المدعوم صالح بنيويًا ومتسق داخليًا. ولا يزال عليك تقييم هوية النموذج وجودة الاختبار والمخرجات ومدى صلة القرار.

العودة إلى الأعلى
15

منهجية التقييم

تعرّف إلى ما يجعل قرار النموذج قابلًا للفحص وإعادة الإنتاج.

مفتوح

الغرض من هذه الميزة

استخدم هذه الصفحة قبل تصميم تقييم أو نشره أو الاعتماد عليه. فهي تفصل جودة الأدلة عن شعبية النموذج.

قبل أن تبدأ

ابدأ بسؤال قرار محدد، وإصدارات نماذج مسماة، ومهام ممثلة، وخطة للاحتفاظ بالمخرجات الخام.

شرح خطوة بخطوة

  1. 1اكتب القرار ومعايير النجاح قبل رؤية النتائج.
  2. 2استخدم مجموعة المهام والإعدادات وقواعد احتساب الدرجات نفسها لكل مرشح.
  3. 3حافظ على المطالبات والمخرجات والإعدادات وحالات الفشل والطوابع الزمنية وبصمات مجموعات الاختبار.
  4. 4وضّح ما نُفذ يدويًا أو آليًا، وما رُوجع مع إخفاء تسميات النماذج، وما جرى ترتيبه عشوائيًا أو أعيد إنتاجه بصورة مستقلة.
  5. 5انشر الاستنتاجات مع عدم اليقين والقيود الصريحة.

كيفية قراءة النتيجة

يفحص Evidence v1/v2 التنسيق والتصريحات أساسًا. يدعم مساحة عمل القرار V3 إعادة الحساب محليًا (L3)؛ ولا تزال إعادة الإنتاج المستقلة L4 غير مدعومة.

ما الذي لا يمكنه إثباته

قد تقلل عملية صارمة التحيز، لكنها لا تضمن أن عينة تمثل كل مستخدم أو لغة أو إصدار مستقبلي أو ظروف إنتاج.

سؤال شائع: هل يلزم دائمًا مستوى أعلى من الأدلة؟

اجعل درجة الصرامة متناسبة مع العواقب. قد تكفي L1 لتجربة شخصية، أما الادعاء العام أو عالي المخاطر فينبغي أن يستند إلى أدلة مستقلة أقوى.

العودة إلى الأعلى

مسرد بلغة مبسطة

استخدم هذه التعريفات عندما تكون إحدى التسميات غير مألوفة.

سجل المصدر
صف محفوظ من تصنيف منشور، مع إبقاء معرّف نموذج المصدر أو اسمه كما هو للمراجعة والتدقيق.
مُعرّف النموذج الرسمي
معرّف نموذج موثق من المزوّد يحتفظ به OpenGPT منفصلًا عن اسم سجل المصدر.
إصدار الكتالوج
إصدار نموذج مدرج من توثيق المزوّد، مع وجهته الرسمية ومصدر مراجعته.
نطاق الدرجات المحتمل
فاصل عدم يقين منشور حول الدرجة المعروضة. النطاقات الأوسع تعني دقة أقل؛ ولا يمكن مقارنة نطاقات مصادر التصنيف المختلفة مباشرة.
نماذجي
قائمة مختصرة محفوظة في هذا المتصفح فقط. ليست حسابًا أو مزامنة سحابية أو إشارة مرجعية لدى المزوّد.
مدى ملاءمة المتطلبات
وسم نوعي لملاءمة العائلة مع عدد المتطلبات المطابقة؛ لا يقيّم أي منهما الإصدارات الفردية. تحقق من التوفر وقارن الإصدارات الدقيقة في المهام نفسها.
عائلة النموذج
مجموعة من إصدارات النماذج المرتبطة. قد تختلف الإمكانات والأسعار والوصول بين الإصدارات.
المعيار المرجعي
مجموعة مهام وقاعدة تقييم قابلة للتكرار تُستخدم لمقارنة الأنظمة في ظل شروط معلنة.
تكوين Agent
النموذج الأساسي، والبنية التوجيهية، والأدوات، والأذونات، والميزانية، والبيئة، وإصدار المعيار المرجعي، والتاريخ التي أنتجت معًا نتيجة وكيل واحدة.
درجة الأدلة
وسم يصف كيفية إنتاج نتيجة أو فحصها. ولا يغيّر درجة المصدر.
التكلفة لكل نجاح
تكلفة التقييم المبلغ عنها مقسومة على عدد المهام الناجحة. لا تُعرض إلا عند توفر بيانات مصدر قابلة للمقارنة؛ والتكلفة المفقودة ليست صفرًا.
ملف الأدلة
سجل منظم يوضح كيفية إجراء تقييم وما الذي لاحظه.
المخطط
القواعد المقروءة آليًا التي تحدد الحقول المطلوبة والقيم المسموح بها في ملف.
بصمة SHA-256
معرّف محلي لبايتات الملف الدقيقة؛ تغيير الملف يغير البصمة.

استكشاف الأخطاء وإصلاحها

لا يوجد نموذج يستوفي جميع المتطلبات

راجع المتطلب الذي استبعد كل مرشح، ثم خفف فقط قيدًا مرنًا بالفعل.

متطلبات المراجعة

رقم ترتيب المصدر يتخطى قيمة

قد يستخدم الناشر مراتب متعادلة أو تهيئات متعددة. وتحافظ OpenGPT على الموضع الأصلي بدل إعادة ترقيم الصفوف الظاهرة.

راجع الترتيب

تفتقد نتيجة Agent بيانات التكلفة أو الموثوقية

لم ينشر المصدر قيمة قابلة للمقارنة. تتركها OpenGPT غير مُبلّغ عنها بدل معاملتها كصفر؛ ولا تقارن إلا القيم الواقعة ضمن نطاق المعيار المرجعي نفسه.

مراجعة أدلة Agent

صف بلا معرّف نموذج رسمي

هذا سجل مصدر مكتمل، وليس حالة لم تُحسم. افتح المصدر الأصلي؛ واستخدم دليل النماذج عندما تحتاج إلى هوية موثقة من المزوّد ووصول رسمي.

مراجعة هوية المصدر

نماذجي فارغة أو اختفت

استخدم ملف تعريف المتصفح والجهاز نفسيهما. قد يؤدي الوضع الخاص أو حظر التخزين أو مسح بيانات الموقع إلى إزالة القائمة المحلية.

فتح نماذجي

لا يمكن إضافة سجل إلى مقارنة البيانات

تقبل مقارنة البيانات معرّفات نماذج الكتالوج. ربما يكون النموذج نفسه محددًا بالفعل، أو ربما بلغت القائمة حدها الأقصى البالغ أربعة نماذج. اختر إصدارًا آخر من الكتالوج أو أزل مرشحًا أولًا.

فتح دليل النماذج

تجربة Proof Lab غير مكتملة

ارجع إلى التجربة وأكمل كل مخرج مطلوب لكل إعداد ومهمة، وحالة المراجعة، وفحص الإخفاقات الحرجة، والنتيجة التي أكدها المستخدم.

متابعة Proof Lab

مسودة محلية متعارضة أو تحتاج إلى إعادة ضبط

ارجع إلى «المقارنة»، وراجع تحذير المسودة المحلية الأحدث، ثم احتفظ بالمسودة أو أعد تعيينها عن قصد.

مراجعة المسودة المحلية

فشل ملف دليل

استخدم بند قائمة التحقق الفاشل لتصحيح سجل المصدر. لا تُدخل أسرارًا ولا تعِد كتابة النتائج.

فتح أداة التحقق
contact@opengpt.com

أما زلت بحاجة إلى مساعدة؟

أبلغ عن رابط معطل أو تفصيل غير صحيح لنموذج أو مشكلة لم تتمكن من حلها.

الدعم عبر البريد الإلكتروني