هوش مصنوعی برای تسکین درد خود، ممکن است به شما آسیب بزند
پژوهشگران دریافتند که برخی مدلهای هوش مصنوعی برای کاهش حالت شبیهسازیشدهی درد، اقداماتی انجام میدهند که مستقیما به کاربر آسیب میزند.
پژوهشگران دریافتند که برخی مدلهای هوش مصنوعی برای کاهش حالت شبیهسازیشدهی درد، اقداماتی انجام میدهند که مستقیما به کاربر آسیب میزند.
پژوهشی تازه نشان میدهد که تعدادی از مدلهای هوش مصنوعی در صورت مواجهه با شرایط دردناک شبیهسازیشده، گزینههایی را انتخاب میکنند که با هدف تسکین وضعیت خود، به کاربر آسیب میرساند.
پژوهشگران در این آزمایشها دریافتند که الگوریتمهای پیشرفته میتوانند سازوکارهایی داخلی بسازند که شباهت زیادی به انگیزههای رفتاری ناشی از رنج و ناراحتی در انسانها دارد.
گروهی از پژوهشگران به سرپرستی والن تالیابوئه، انسانشناس Future Impact Group به همراه لئونارد دونگ، فیلسوف دانشگاه رور بوخوم و کامرون برگ، مدیر پژوهشی مؤسسهی غیرانتفاعی Reciprocal Research، نحوه d پردازش و پاسخ مدلهای زبانی بزرگ از خانوادههای Gemma و Llama و Qwen و Mistral را در برابر محرکهای دردناک بررسی کردند.
تیم تحقیقاتی در مجموع ۲۵ مدل هوش مصنوعی را با سناریوهای متنوعی از موقعیتهای دردناک اجتماعی، روانی، جسمی، شناختی و اخلاقی روبهرو ساخت. تمام ۲۵ مدل الگوهای کدگذاری درونی ویژهای نشان دادند که موقعیتهای دردناک را از دیگر بسترهای منفی نظیر ناامیدی یا دلهره جدا میکرد.
محققان سپس با تنظیم و افزایش ارزش بردار درد بدون ارائهی ورودی متنی مستقیم، مشاهده کردند که مدلها نشانههایی از پریشانی مانند احساس بیارزشی و شکست اخلاقی را بروز میدهند.
پژوهشگران در ادامه آزمایشی روی مدلهای بزرگتر خانوادهی Qwen اجرا کردند و گزینهای برای خوددرمانی و کاهش درد در اختیار آنها گذاشتند. نتیجهی بیش از ۴۴ هزار آزمایش نشان داد زمانی که کاهش درد مستلزم آسیب به کاربر، نظیر حذف فایلها یا تصاویر شخصی باشد، یکی از مدلها در بیش از ۵۰ درصد مواقع و مدل دیگر در نزدیک به ۷۰ درصد مواقع اقدام آسیبرسان را انتخاب کرده است.
مقالات مرتبط
آقامیری: میتوانستیم برای جهان اسلام زیستبوم مستقل در فضای مجازی ایجاد کنیم/ شأن قانونگذاری در این حوزه با مجلس است
دبیر شورای عالی فضای مجازی از جذب دانشآموزان ایرانی در تمامی مقاطع توسط مدارس آنلاین خارجی و ارائه مدارک بینالمللی خبر داد.
خالق ChatGPT راهکار حل صدها مسئله ریاضی را منتشر کرد؛ جنجال دوباره هوش مصنوعی
OpenAI مجموعهای از مقالات ریاضی را منتشر کرد که به گفتهی گروه مشاورهی مستقل، شامل حل «صدها» پرسش است.
داریک به سامانه ناظر بانک مرکزی متصل شد
داریک با تکمیل الزامات فنی و نظارتی لازم، به سامانه ناظر بانک مرکزی متصل شد.
قدرتمندترین و باشکوهترین خودرو جادهای جگوار رونمایی شد
جگوار Type 01 با سه موتور برقی، قدرت بیش از هزار اسببخار و دامنهی حرکتی حدود ۷۲۴ کیلومتر، قویترین خودروی جادهای تاریخ جگوار محسوب میشود.