الباحثون

هوي ليو

المنشورات 5

نسخة أولية وصول مفتوح

لا تدربوا على عدم اليقين

الشبكات العصبية العميقة، بما في ذلك نماذج اللغة الكبيرة، حققت أداءً ملحوظًا عبر المهام المختلفة. ومع ذلك، فإنهم يميلون إلى الثقة المفرطة أثناء التدريب أو الترتيب الدقيق. في هذا العمل، نلاحظ ظاهرة متسقة عبر النماذج المختلفة أن النموذج المبكر هو مقياس أفضل، في حين أن التدريب اللاحق أو ضبط الدقيق يؤدي إلى مكاسب دقة هامشية …

المؤلفون المشاركون