StartupXO
بحث
العربية

Find XO: كيفية بناء نموذج ذكاء اصطناعي يختار إجابة من بين خيارات ثابتة ويضبط مستوى ثقته(nishtahir.com)

لا توجد توصيات بعد startupxo رأي التحرير: 1 / التعليقات: 0

لغة الكتابة: الكوريةعرض بلغة الكتابة

الملخص / قراءة المصدر ↗

- في هذه الطريقة، بدلا من أن يكتب النموذج النص كلمة بكلمة، يُطلب منه اختيار أحد الخيارات المحددة مسبقا من A إلى E في عملية حسابية واحدة. يشرح المصدر الأصلي أن هذا يحدّ من نطاق الإجابات التي يمكن أن ينتجها النموذج. - شغّل المؤلف الأصلي نموذج Qwen3-1.7B على 1,221 سؤالا مختارا عشوائيا من مجموعة بيانات CommonsenseQA، وأفاد بأن الدقة بلغت 0.5938. وبعد تدريب إضافي قصير، ارتفعت الدقة إلى 0.6241 بحسب ما ذُكر. - عامل المؤلف الاحتمالات التي يخرجها النموذج كمستوى ثقة، وذكر أنه في نطاق الثقة من 0.9 إلى 1.0 كانت نسبة الإجابات الصحيحة الفعلية 0.7009، مما يعني أن النموذج يبالغ في الثقة. وبعد تطبيق قيمة الحرارة 3.797، أصبحت الثقة حسب النطاقات ونسبة الإجابات الصحيحة أقرب إلى بعضهما بحسب ما ذُكر.
وجدناه على

Hacker News ↗ / التوصيات: 133 / التعليقات: 30

هل مررت بموقف مشابه؟ أخبرنا في سطر أو سطرين كيف تصرفت. لا تحتاج إلى معرفة المنتج.

سجل الدخول للتعليق

التعليقات: 1

رأي التحريرstartupxo

أول ما يلفت انتباهي هو الفقرة التي تذكر أن نسبة الإجابات الصحيحة لا تتجاوز نحو 70 في المئة حتى ضمن نطاق الثقة 0.9. إذا استخدمت الدرجة مباشرة كخط أساس، فقد يهتز حكمك. ومع ذلك، اختار المؤلف قيمة الحرارة 3.797 لتناسب عينة CommonsenseQA، ولذلك يصعب معرفة من النص وحده ما إذا كانت القيمة نفسها ستنجح مع بيانات أخرى. إذا كنت قد أتمتّ تصنيف الاختيار من متعدد واستخدمت درجات النموذج، فأود أن أعرف كيف تحققت من الدقة حسب نطاق الدرجة.
لغة الكتابة: الكورية

اختصارات لوحة المفاتيح

اختر منشورا بسهمي الأعلى والأسفل ثم اضغط Enter.

↑ / ↓
المنشور السابق / التالي
Enter
فتح ملخص المنشور المحدد وتعليقاته
Tab
انتقل إلى زر النشر أو التعليق ثم اضغط Enter

اكتب كالمعتاد في حقول النص. يظل Tab وEnter متاحين دائما.