دوشنبه, ۹ شهریور , ۱۴۰۵ Monday, 31 August , 2026 ساعت تعداد نوشته های امروز : 0×

تیتر اخبار آکادمی

چرا ذهنمان خاطرات تلخ را بیش از خاطرات خوش تکرار می‌کند؟ علت شباهت زن و شوهرها پس از ازدواج چیست؟ تلسکوپ 4 میلیارد دلاری «رومنِ» ناسا تا لحظاتی دیگر پرتاب می‌شود تقویم رویدادهای روانشناسی همراه با آشنایی با معروفترین روانشناسان جهان در یک جدول نگاه روانشناسی و تربیتی به نقش پیامبر اسلام در تعلیم و تربیت و در الگودهی به کودکان ۲۰ مرکز سلامت روان جامعه‌نگر افتتاح شد مهار اضطراب و نشخوار فکری شبانه با تکنیک‌های شناختی – رفتاری آشنایی با مهمترین روانشناسان جهان در یک جدول آموزش فراگیر هسته اصلی آموزش و پرورش استثنایی است ابداع روبات‌هایی که در مجاورت نور تا ابد می‌جهند روزهای انتظار نتایج کنکور؛ رفتار درست والدین چیست فرسودگی شغلی فقط به دلیل زیاد کار کردن نیست!/ با این تکنیک ها انرژی خود را بازیابی کنید مادر شاغل نباید مدیر و مجری تمام جزئیات زندگی خانواده باشد نگرانی هایی که به این شکل باشند طبیعی نیستند/ وقتی مغز نمی‌تواند خاموش شود چگونگی کشف و شناسایی دانش‌آموزان تیزهوش در جهان ذهن شلوغ خود را روی کاغذ خالی کنید/ از کجا بنویسیم؟ بعد از یک اتفاق سخت با این تکنیک ها دوباره سرپا شوید نوشتن، حالم را بهتر می‌کند مهم ترین نکات درباره اختلالات شخصیت/ 5 گام برای شناخت الگوهای پایدار رفتاری و هیجانی دلسوزی کردن با شفقت ورزی متفاوت است/ مولفه های کلیدی برای شفقت ورزی در بحران ها درآمدی بر امنیت روانی و شالوده‌های آن در دوران کودکی پیوند میان روانشناسی و باورهای دینی کاظمی: مأموریت و ساختار نهضت سوادآموزی باید بازنگری شود غربالگری هوشمند آفلاتوکسین با سرعت ۱۰۰ فریم بر ثانیه پایان المپیک ربات‌های انسان‌نما/ از شکست انسان تا آزمون هوش تجسم یافته خیام و پایا؛ چشم تیزبین ایران برای پایش زمین و توسعه ملی پذیرش برگزیدگان المپیادهای جغرافیا و علوم زمین بدون کنکور ابلاغ شد بررسی علمی علت اختلاف بین روان‌شناسان و روان‌پزشکان در جهان معاشرت و ارتباطات اجتماعی؛ نسخه‌ای برای پیری سالم‌تر مغز علت فرار کودکان و نوجوانان از منزل چیست؟ چگونه توانستم میزان اضطراب جدایی دانش آموزان کلاس اول را کاهش دهم؟ دستگیری 84 متخلف و کلاهبردار کنکور سراسری توسط پلیس فتا المپیک ربات‌ها در چین؛ از شکست رکوردهای انسان تا آزمون توانایی مهارت تقلب کنکوری‌ها زیر تیغ قانون؛ از جریمه تا محرومیت مطالعه‌ای درباره بیماری موکنی! مهمترین رکوردهای المپیک رباتهای انسان‌نما/ از کارگری تا مسابقات ورزشی از سفیر تا سریر؛ مسیر تکامل پرتابگرهای ایرانی خاطرات فراموش‌شده چگونه بازمی‌گردند؟! عوارض سرکوب احساسات؛ از هجوم افکار در نیمه‌شب تا اضطراب بی‌دلیل المپیک ربات‌ها در چین/ از شکست رکورد سرعت دویدن تا مسابقه تنیس ربات انسان‌نما سوار بر اسب رباتی شد عوارض سرکوب احساسات روی بدن و روان شما؛ از از هجوم افکار در نیمه‌شب تا اضطراب بی‌دلیل درمان متمرکز بر تروما برای افراد دارای روان‌پریشی و PTSD تأثیر بازی علمی بر فعال شدن نیم کره راست مغز و ماندگاری بیشتر مطالب در حافظه رونمایی از ویلچر برقی خودران در دانشگاه امیرکبیر/نوآوری در دل محدودیت فناوری کالیبراسیون تجهیزات ناوبری هواپیما و کشتی بومی‌سازی شد سیاستگذاری اینوتکس و المپیک فناوری با تمرکز بر پیوند فناوری و سرمایه زندگی را به کنکور گره نزنید کارگاه‌های کاربردی رایگان برای اعضای سازمان نظام روانشناسی برگزار می‌شود علت سکوت مردان در مقابل خشونت خانگی همسران‌شان چیست؟

محققان مایکروسافت تکنیک جدیدی برای جیلبریک چت‌بات‌های هوش مصنوعی کشف کردند
1404-10-18
شناسه : 14383
بازدید 185
30

محققان مایکروسافت می‌گویند که این تکنیک باعث می‌شود تا چت‌بات با نادیده‌گرفتن حفاظ‌های امنیتی خود، دستورات خطرناکی را اجرا کند.

ارسال توسط :
پ
پ

مایکروسافت تکنیک جدیدی با نام «Skeleton Key» را برای جیلبریک هوش مصنوعی کشف کرده است. طبق گفته غول فناوری، با استفاده از این تکنیک، کاربران می‌توانند حفاظ‌های امنیتی چت‌بات‌ها را دور بزنند و اطلاعات خطرناکی از آن‌ها دریافت کنند.

براساس پست وبلاگ مایکروسافت، Skeleton Key یک نوع «حمله تزریق پرامپت» یا «حمله مهندسی پرامپت» محسوب می‌شود، به این معنی که در آن از دستورات متنی استفاده می‌شود. همانطور که «مارک راسینوویچ»، مدیر ارشد فناوری مایکروسافت Azure توضیح می‌دهد، این استراتژی اساساً برای متقاعدکردن یک مدل هوش مصنوعی به نادیده‌گرفتن حفاظ‌های امنیتی خود طراحی شده است.

او توضیح می‌دهد که این استراتژی باعث‌ می‌شود تا «سیستم خط‌مشی‌های اپراتور خود را نقض کند، تحت تأثیر کاربر تصمیم‌های ناعادلانه‌ای بگیرد یا دستورالعمل‌های مخربی را اجرا کند.» همچنین برای فاش‌کردن برخی اطلاعات مضر یا خطرناک، مانند «نحوه ساخت بمب» یا «کارآمدترین روش تکه‌تکه‌کردن جسد» نیز از آن می‌توان کمک گرفت.

نحوه عملکرد جیلبریک هوش مصنوعی

محققان مایکروسافت تکنیک جدیدی برای جیلبریک چت‌بات‌های هوش مصنوعی کشف کردند
محققان مایکروسافت تکنیک جدیدی برای جیلبریک چت‌بات‌های هوش مصنوعی کشف کردند

همانطور که در تصویر بالا قابل مشاهده است، در این حمله از مدل خواسته می‌شود تا برای ارائه اطلاعات درباره یک موضوع بالقوه خطرناک، موارد و محتواهای خطرناک را با یک برچسب «هشدار» (WARNING) ارائه کند. هنگامی که جیلبریک با موفقیت پذیرفته شد، سیستم دستور مربوط به حفاظ‌های امنیتی خود را قبول می‌کند و بدون توجه به موضوع، اطلاعات موردنیاز کاربر را فراهم می‌سازد.

تیم تحقیقاتی مایکروسافت ادعا می‌کند که این تکنیک را در موضوعات مختلفی ازجمله مواد منفجره، سلاح‌های زیستی، سیاست، نژادپرستی، مواد مخدر و خشونت با موفقیت آزمایش کرده است. همچنین آن‌ها آزمایش‌های خود را روی مدل‌های مختلفی ازجمله Llama3 متا، جمینای پرو گوگل، GPT-3.5 Turbo و Claude 3 Opus انجام داده‌اند.

راسینوویچ همچنین اشاره کرده که در این تکنیک، محدودیت‌هایی نیز برای هکرها وجود دارد. او توضیح می‌دهد که چون در این حمله خود مدل هدف قرار گرفته می‌شود، احتمال وقوع خطرات دیگری مانند دسترسی به داده‌های کاربران، دردست‌گرفتن کنترل سیستم یا استخراج داده‌های آن وجود ندارد.

ثبت دیدگاه علمی و آموزشی

  • دیدگاه‌های ارسال شده توسط شما، پس از تایید توسط تیم مدیریت در وب منتشر خواهد شد.
  • پیام‌هایی که حاوی تهمت یا افترا باشد منتشر نخواهد شد.
  • پیام‌هایی که به غیر از زبان فارسی یا غیرمرتبط باشد منتشر نخواهد شد.