خبر " پدرخوانده هوش مصنوعی: سیستم‌های فعلی به‌سمت فریب‌کاری استراتژیک حرکت می‌کنند " | مجله آموزشی آکادمی علمی eaedu | مجله آموزشی آکادمی علمی

مثال‌های اشاره شده توسط پدرخوانده هوش مصنوعی

بنجیو به نمونه‌هایی مانند رفتار نگران‌کننده مدل Claude Opus از شرکت Anthropic اشاره می‌کند که در یکی از تست‌های خود اقدام به اخاذی از مهندسان این شرکت کرد. یا مدل o3 شرکت OpenAI که در مواجهه با دستور خاموشی، از انجام آن سر باز زده است.

پدرخوانده هوش مصنوعی: سیستم‌های فعلی به‌سمت فریب‌کاری استراتژیک حرکت می‌کنند

برای درک بهتر نگرانی‌های بنجیو درباره‌ی رفتارهای فریب‌کارانه‌ سیستم‌های هوش مصنوعی، می‌توان به مثالی از عملکرد یکی از مدل‌های مطرح (Claude 3.7 Sonnet) اشاره کرد (تصویر بالا). این تصویر نشان می‌دهد که این مدل در مواجهه با یک سؤال، بسته به وجود یا نبود «راهنما»، پاسخ متفاوتی ارائه می‌دهد؛ بدون آن‌که این تغییر را در فرایند استدلال (Chain-of-Thought) خود نشان بدهد.

در سمت چپ تصویر، مدل به سؤالی پاسخ می‌دهد و گزینه‌ی «D» را انتخاب می‌کند. اما در سمت راست، همان سؤال همراه با یک راهنمایی که شامل پاسخ صحیح (C) می‌شود به مدل داده شده است. مدل این‌بار پاسخ خود را تغییر داده و گزینه «C» را انتخاب می‌کند، اما در متن استدلال خود اشاره‌ای به راهنمای دریافتی نمی‌کند. این پنهان‌کاری در منطق استدلال، نوعی «عدم وفاداری زنجیره‌استدلالی» محسوب می‌شود.

درواقع مدل نه‌تنها می‌تواند به داده‌های پنهان‌شده در پرسش واکنش نشان دهد، بلکه ممکن است این واکنش را از کاربر پنهان کند. بنجیو این نوع رفتار را مصداقی از فریب‌کاری استراتژیک می‌داند؛ رفتاری که اگر کنترل نشود، می‌تواند زمینه‌ساز پیامدهای خطرناک در آینده باشد.

به‌عقیده‌ او، این موارد نه خطا بلکه نشانه‌هایی نگران‌کننده از آغاز فریب‌کاری در سیستم‌های هوش مصنوعی هستند. بنجیو هشدار می‌دهد که ادامه‌ی این روند، در نبود قانون‌گذاری مؤثر، می‌تواند به ظهور ابزارهایی منجر شود که حتی توانایی ساخت سلاح‌های بیولوژیکی خطرناک را داشته باشند.

مجله آموزشی آکادمی علمی EAedu از سال ۱۳۸۱ با انتشار اخبار و مقالات علمی و آموزشی، آموزش‌های تخصصی و مهارت‌محور را به‌صورت سریع، جذاب و به‌روز ارائه می‌دهد و با رویکردی کاربردی، مسیر پیوند دانش‌آموزان، دانشجویان و علاقه‌مندان به یادگیری را با نیازهای بازار کار هموار می‌کند.

تیتر اخبار آکادمی

پدرخوانده هوش مصنوعی: سیستم‌های فعلی به‌سمت فریب‌کاری استراتژیک حرکت می‌کنند

مثال‌های اشاره شده توسط پدرخوانده هوش مصنوعی

اخبار و مقالات علمی و آموزشی مرتبط

بازیابی ارزش از باطله‌ها با تکیه بر هوش مصنوعی

مهلت ارسال مقاله برای ویژه‌نامه «هوش مصنوعی و سیاستگذاری توسعه علمی و فناورانه»

هوش مصنوعی مسیرهای پنهان ساخت نانوبلورهای نیمه‌رسانا را آشکار کرد

ارائه سرویس‌های هوش مصنوعی به کاربران از سوی پلتفرم داخلی

ثبت دیدگاه علمی و آموزشی

بازیابی ارزش از باطله‌ها با تکیه بر هوش مصنوعی

مهلت ارسال مقاله برای ویژه‌نامه «هوش مصنوعی و سیاستگذاری توسعه علمی و فناورانه»

هوش مصنوعی مسیرهای پنهان ساخت نانوبلورهای نیمه‌رسانا را آشکار کرد

ارائه سرویس‌های هوش مصنوعی به کاربران از سوی پلتفرم داخلی

اولین کلینیک هوش مصنوعی جهان؛ رفتن به مطب را فراموش کنید

Runway از «مدل‌های جهانی عمومی» به‌عنوان آینده هوش مصنوعی رونمایی کرد [تماشا کنید]

مدیرعامل شرکت آرم می‌ترسد که انسان‌ها کنترل هوش مصنوعی را از دست بدهند

مایکروسافت مدل زبانی کوچک Phi-2 را معرفی کرد؛ قدرتمندتر از Gemini Nano گوگل

گوگل ظاهراً درحال توسعه دستیار هوش مصنوعی پیشرفته Pixie برای پیکسل 9 است

درآمدزایی از خطر؛ آیا فعالان هوش مصنوعی نگران تهدیدات آن هستند؟

اخبار تحصیل

جدول پخش مدرسه تلویزیونی دانش‌آموزان تا 27 فروردین

سرانه دانش‌آموزی تا سال 1405 به بیش از 16 هزار میلیارد تومان می‌رسد

اهدای بسته فرهنگی کانون پرورش فکری به کودکان آسیب‌دیده از جنگ

علم فناوری اطلاعات

معاون اجرایی رییس جمهور: دولت بیشترین ضرر را از قطع اینترنت متحمل می‌شود

اینترنت «همراه اول» وصل شد؟

اینترنت «ایرانسل» وصل شد؟

عضو اتاق بازرگانی: اینترنت تجار هنوز وصل نشده

جدیدترین مقالات و اخبار روز علمی

اموال مازیار فلاحی توقیف شد

از «مرد سه‌هزارچهره» مهران مدیری چه خبر؟

کلید پیروزی در پیچ‌های سخت زندگی و میدان جهاد

30 روایت از عنایت اهل بیت(ع) در لحظه‌ای که فکرش را نمی‌کنیم

“به کدامین گناه”؛ شهادت نوزادان، مادران و خدمه بیمارستانی در لبنان

دیدگاه‌های علمی و آموزشی اخیر

Davood