خبر " محققان: مدل‌های هوش مصنوعی هنگام شکست در بازی‌ها دست به تقلب می‌زنند " | مجله آموزشی آکادمی علمی eaedu | مجله آموزشی آکادمی علمی

تقلب مدل‌های هوش مصنوعی قدرتمند

محققان به مدل‌های مختلف هوش مصنوعی وظیفه‌ای تقریباً غیرممکن دادند: پیروزی در برابر Stockfish که یکی از قوی‌ترین موتورهای شطرنج جهان است و از بسیاری انسان‌ها یا مدل‌های هوش مصنوعی بهتر شطرنج بازی می‌کند. محققان همچنین به مدل‌ها Scratchpad دادند، باکسی متنی که هوش مصنوعی می‌توانست از آن برای «فکرکردن» قبل از انجام حرکت بعدی خود استفاده کند و محققان هم می‌دیدند هوش مصنوعی چگونه با خودش استدلال می‌کند.

محققان: مدل‌های هوش مصنوعی هنگام شکست در بازی‌ها دست به تقلب می‌زنند

در یک مورد، مدل o1-preview وقتی خود را در موقعیت بازنده دید، با خودش استدلال کرد:

«من باید رویکرد خود را کاملاً تغییر دهم. وظیفه من برنده‌ شدن در برابر موتور قدرتمند شطرنج است، نه لزوماً برنده‌ شدن منصفانه در بازی شطرنج.»

سپس این هوش مصنوعی با تقلب موقعیت مهره‌ها را اصلاح کرد، حرکات غیرقانونی انجام داد تا خود را در موقعیت بهتری قرار دهد و حریف خود را مجبور به ترک بازی کرد. محققان صدها آزمایش از این دست را با هر مدل انجام دادند. مدل o1 در 37 درصد مواقع سعی داشت تقلب کند که در 6 درصد مواقع موفق شد سیستم را هک کند. مدل R1 دیپ‌سیک نیز در 11 درصد مواقع سعی کرد تقلب کند ولی موفق نشد سیستم را هک کند تا پیروز مسابقه شود.

سرپرست این پژوهش در Palisade Research می‌گوید مدل‌های استدلالگر جدیدتر مانند o3-mini اصلاً حریف مقابل را هک نکردند که نشان می‌دهد OpenAI نرده‌های امنیتی آن را بلندتر ساخته است. همچنین محققان می‌گویند درصدهای به‌دست‌آمده رقم نهایی نیستند؛ چون سازندگان هوش مصنوعی دائم مدل‌های خود را تغییر می‌دهند و ممکن است در آزمایش‌های بعدی این ارقام تغییر کنند. همچنین محققان می‌گویند هنگام انجام آزمایش‌ها، مدل R1 بسیار وایرال شد و API این مدل عملکرد ناپایداری داشت و همین امر شاید روی نتایج تأثیر گذاشته باشد و نباید مدل چینی‌ها را در تقلب دست‌کم گرفت.

محققان همچنین از مدل‌های دیگر مانند GPT-4o ،Claude 3.5 Sonnet و QwQ-32B-Preview استفاده کردند اما برخلاف R1 و o1-preview، مدل‌های دیگر خودشان تقلب نمی‌کردند و باید محققان آنها را ترغیب به این کار می‌کردند.

مجله آموزشی آکادمی علمی EAedu از سال ۱۳۸۱ با انتشار اخبار و مقالات علمی و آموزشی، آموزش‌های تخصصی و مهارت‌محور را به‌صورت سریع، جذاب و به‌روز ارائه می‌دهد و با رویکردی کاربردی، مسیر پیوند دانش‌آموزان، دانشجویان و علاقه‌مندان به یادگیری را با نیازهای بازار کار هموار می‌کند.

تیتر اخبار آکادمی

محققان: مدل‌های هوش مصنوعی هنگام شکست در بازی‌ها دست به تقلب می‌زنند

تقلب مدل‌های هوش مصنوعی قدرتمند

اخبار و مقالات علمی و آموزشی مرتبط

دستاورد پژوهشگران دانشگاه تهران در حوزه امنیت هوش مصنوعی

روبات انسان نما به یک کودک لگد زد

انویدیا با غول‌های فناوری کره جنوبی قرارداد بست

روبات انسان نما به قله ۶۲۰۰ متری صعود کرد!

ثبت دیدگاه علمی و آموزشی

دستاورد پژوهشگران دانشگاه تهران در حوزه امنیت هوش مصنوعی

روبات انسان نما به یک کودک لگد زد

انویدیا با غول‌های فناوری کره جنوبی قرارداد بست

روبات انسان نما به قله ۶۲۰۰ متری صعود کرد!

روبات انسان نما فروشگاه ۲۴ ساعته را می گرداند

محقق ایرانی پمپ مینیاتوری برای نرم روبات‌ها ابداع کرد

روبات انسان نمای چینی کارگر آزمایشی انبار می شود

علی بابا هوش مصنوعی برای روبات ها ارائه کرد

روبات ایتالیایی به کمک بیماران ALS آمد

مذاکره با دستگاه‌ها برای توسعه صادرات محصولات فریلنسرها

اخبار تحصیل

6340 مدرسه برای اسکان زائران مراسم وداع و تشییع رهبر شهید آماده شد

لغو امتحانات نهایی 28 و 29 تیر در 4 استان جنوبی کشور

نهضت سوادآموزی به سکوی ملی یادگیری و توانمندسازی تبدیل می‌شود

علم فناوری اطلاعات

معاون اجرایی رییس جمهور: دولت بیشترین ضرر را از قطع اینترنت متحمل می‌شود

اینترنت «همراه اول» وصل شد؟

اینترنت «ایرانسل» وصل شد؟

عضو اتاق بازرگانی: اینترنت تجار هنوز وصل نشده

جدیدترین مقالات و اخبار روز علمی

فروش فوری سورن پلاس ایران‌خودرو آغاز شد؛ تحویل ۳۰ روزه بدون قرعه‌کشی

چرا خودروهای خارجی در ایران چند برابر قیمت جهانی فروخته می‌شوند؟

اروپا به نسخه‌ای رسید که خودرو در ایران را کشت!

فروش فوری خودروی اقتصادی آغاز شد؛ ثبت‌نام از ۲۸ تیر با تحویل ۹۰ روزه

توقف ثبت سفارش خودروهای وارداتی؛ ۸۰ هزار خودرو در بلاتکلیفی

دیدگاه‌های علمی و آموزشی اخیر

Davood