دوشنبه, ۹ شهریور , ۱۴۰۵ Monday, 31 August , 2026 ساعت تعداد نوشته های امروز : 0×

تیتر اخبار آکادمی

چرا ذهنمان خاطرات تلخ را بیش از خاطرات خوش تکرار می‌کند؟ علت شباهت زن و شوهرها پس از ازدواج چیست؟ تلسکوپ 4 میلیارد دلاری «رومنِ» ناسا تا لحظاتی دیگر پرتاب می‌شود تقویم رویدادهای روانشناسی همراه با آشنایی با معروفترین روانشناسان جهان در یک جدول نگاه روانشناسی و تربیتی به نقش پیامبر اسلام در تعلیم و تربیت و در الگودهی به کودکان ۲۰ مرکز سلامت روان جامعه‌نگر افتتاح شد مهار اضطراب و نشخوار فکری شبانه با تکنیک‌های شناختی – رفتاری آشنایی با مهمترین روانشناسان جهان در یک جدول آموزش فراگیر هسته اصلی آموزش و پرورش استثنایی است ابداع روبات‌هایی که در مجاورت نور تا ابد می‌جهند روزهای انتظار نتایج کنکور؛ رفتار درست والدین چیست فرسودگی شغلی فقط به دلیل زیاد کار کردن نیست!/ با این تکنیک ها انرژی خود را بازیابی کنید مادر شاغل نباید مدیر و مجری تمام جزئیات زندگی خانواده باشد نگرانی هایی که به این شکل باشند طبیعی نیستند/ وقتی مغز نمی‌تواند خاموش شود چگونگی کشف و شناسایی دانش‌آموزان تیزهوش در جهان ذهن شلوغ خود را روی کاغذ خالی کنید/ از کجا بنویسیم؟ بعد از یک اتفاق سخت با این تکنیک ها دوباره سرپا شوید نوشتن، حالم را بهتر می‌کند مهم ترین نکات درباره اختلالات شخصیت/ 5 گام برای شناخت الگوهای پایدار رفتاری و هیجانی دلسوزی کردن با شفقت ورزی متفاوت است/ مولفه های کلیدی برای شفقت ورزی در بحران ها درآمدی بر امنیت روانی و شالوده‌های آن در دوران کودکی پیوند میان روانشناسی و باورهای دینی کاظمی: مأموریت و ساختار نهضت سوادآموزی باید بازنگری شود غربالگری هوشمند آفلاتوکسین با سرعت ۱۰۰ فریم بر ثانیه پایان المپیک ربات‌های انسان‌نما/ از شکست انسان تا آزمون هوش تجسم یافته خیام و پایا؛ چشم تیزبین ایران برای پایش زمین و توسعه ملی پذیرش برگزیدگان المپیادهای جغرافیا و علوم زمین بدون کنکور ابلاغ شد بررسی علمی علت اختلاف بین روان‌شناسان و روان‌پزشکان در جهان معاشرت و ارتباطات اجتماعی؛ نسخه‌ای برای پیری سالم‌تر مغز علت فرار کودکان و نوجوانان از منزل چیست؟ چگونه توانستم میزان اضطراب جدایی دانش آموزان کلاس اول را کاهش دهم؟ دستگیری 84 متخلف و کلاهبردار کنکور سراسری توسط پلیس فتا المپیک ربات‌ها در چین؛ از شکست رکوردهای انسان تا آزمون توانایی مهارت تقلب کنکوری‌ها زیر تیغ قانون؛ از جریمه تا محرومیت مطالعه‌ای درباره بیماری موکنی! مهمترین رکوردهای المپیک رباتهای انسان‌نما/ از کارگری تا مسابقات ورزشی از سفیر تا سریر؛ مسیر تکامل پرتابگرهای ایرانی خاطرات فراموش‌شده چگونه بازمی‌گردند؟! عوارض سرکوب احساسات؛ از هجوم افکار در نیمه‌شب تا اضطراب بی‌دلیل المپیک ربات‌ها در چین/ از شکست رکورد سرعت دویدن تا مسابقه تنیس ربات انسان‌نما سوار بر اسب رباتی شد عوارض سرکوب احساسات روی بدن و روان شما؛ از از هجوم افکار در نیمه‌شب تا اضطراب بی‌دلیل درمان متمرکز بر تروما برای افراد دارای روان‌پریشی و PTSD تأثیر بازی علمی بر فعال شدن نیم کره راست مغز و ماندگاری بیشتر مطالب در حافظه رونمایی از ویلچر برقی خودران در دانشگاه امیرکبیر/نوآوری در دل محدودیت فناوری کالیبراسیون تجهیزات ناوبری هواپیما و کشتی بومی‌سازی شد سیاستگذاری اینوتکس و المپیک فناوری با تمرکز بر پیوند فناوری و سرمایه زندگی را به کنکور گره نزنید کارگاه‌های کاربردی رایگان برای اعضای سازمان نظام روانشناسی برگزار می‌شود علت سکوت مردان در مقابل خشونت خانگی همسران‌شان چیست؟

محققان: بنچمارک‌های مربوط به هوش مصنوعی می‌توانند گمراه‌کننده باشند
1404-10-18
شناسه : 14314
بازدید 180
37

محققان می‌گویند برخی بنچمارک‌ها نسبت هزینه به دقت در ارائه پاسخ‌ توسط یک هوش مصنوعی را در نظر نمی‌گیرند.

ارسال توسط :
پ
پ

پژوهش جدید محققان دانشگاه پرینستون نقص‌های متعددی را در بنچمارک‌های هوش مصنوعی و شیوه‌های ارزیابی آن‌ها نشان داده است که مانع می‌شود در بررسی برنامه‌های کاربردی در دنیای واقعی مفید باشند. محققان تأکید دارند که این بنچمارک‌ها نسبت هزینه پاسخ‌دادن مدل هوش مصنوعی به دقت آن را در نظر نمی‌گیرند.

براساس گزارش VentureBeat، سنجش مدل‌های مختلف هوش مصنوعی با بنچمارک‌های ثابت نمی‌تواند نتایج صحیحی در دنیای واقعی ارائه دهد. یکی از مسائل مهمی که محققان در پژوهش خود بر آن تأکید می‌کنند، درنظرنگرفتن شیوه کنترل هزینه در مدل‌های هوش مصنوعی مختلف است.

به‌طورکلی محققان هشدار می‌دهند که این خطاها باعث می‌شود دقت هوش مصنوعی غلط تخمین زده شود و درباره قابلیت‌های هوش مصنوعی خوش‌بینی بیش‌ازحد باشد.

بنچمارک‌های گمراه‌کننده در ارزیابی هوش مصنوعی

برای افزایش دقت، برخی سیستم‌های هوش مصنوعی چندین پاسخ تولید می‌کنند و از مکانیسم‌هایی مختلفی برای انتخاب بهترین پاسخ بهره می‌برند. گاهی نمونه‌برداری از صدها یا هزاران پاسخ می‌تواند دقت هوش مصنوعی را افزایش دهد. درحالی‌که این رویکرد می‌تواند عملکرد را بهبود بخشد، هزینه محاسباتی قابل‌توجهی دارد. این هزینه‌ها در موارد تحقیقاتی که هدف به حداکثررساندن دقت است، مشکل‌ساز نیست.

البته در کاربردهای عمومی، بودجه هر درخواست محدودیتی ندارد. البته ممکن است در برخی موارد برای بالابردن رتبه‌بندی هوش مصنوعی خاصی، از مکانیسم‌های پرهزینه هوش مصنوعی برای افزایش دقت استفاده شود.

بنچمارک و هوش مصنوعی
محققان: بنچمارک‌های مربوط به هوش مصنوعی می‌توانند گمراه‌کننده باشند

محققان می‌گویند باید بین ارزیابی مدل‌ها با اهداف تحقیقاتی و مدل‌های کاربردی عمومی تفاوت قایل شد. در تحقیقات، دقت اهمیت دارد و هزینه‌های هوش مصنوعی تا حد زیادی نادیده گرفته می‌شود. بااین‌حال، هنگام توسعه برنامه‌های کاربردی در دنیای واقعی، هزینه‌ها نقش مهمی در شیوه پاسخ‌دهی مدل هوش مصنوعی ایفا می‌کند.

برای نمونه، محققان مطالعه‌ای موردی روی بنچمارک NovelQA (معیاری برای پاسخگویی به سؤالات در متون بسیار طولانی) انجام دادند. آن‌ها دریافتند ممکن است این معیار در ارزیابی مدل‌های کاربردی عمومی گمراه‌کننده باشد.

از سویی، در یادگیری تسک‌های جدید، مدل‌های یادگیری ماشینی اغلب میانبرهایی پیدا می‌کنند که به آن‌ها اجازه می‌دهد در بنچمارک‌ها امتیاز خوبی کسب کنند. به‌عبارتی، این مدل‌ها راه‌هایی برای تقلب در آزمون‌های بنچمارک پیدا می‌کند و نتایجی ارائه می‌دهد که در دنیای واقعی صحیح نیست.

ثبت دیدگاه علمی و آموزشی

  • دیدگاه‌های ارسال شده توسط شما، پس از تایید توسط تیم مدیریت در وب منتشر خواهد شد.
  • پیام‌هایی که حاوی تهمت یا افترا باشد منتشر نخواهد شد.
  • پیام‌هایی که به غیر از زبان فارسی یا غیرمرتبط باشد منتشر نخواهد شد.