با ما همراه باشید

تکنولوژی

تلاش OpenAI برای مقابله با فریبکاری مدل‌های هوش مصنوعی اثر معکوس داشته است

محققان OpenAI سعی کردند فریبکاری مدل‌های هوش مصنوعی را کاهش دهند، اما این مدل‌ها یاد گرفته‌اند که فریبکارتر شوند.

منتشر شده

در

تلاش OpenAI برای مقابله با فریبکاری مدل‌های هوش مصنوعی اثر معکوس داشته است

گفته می‌شود پژوهشگران OpenAI تلاش کرده‌اند تا مدل‌های هوش مصنوعی این شرکت را طوری آموزش دهند که از «دسیسه‌چینی» و تلاش برای پنهان کردن اهداف واقعی خود دست بردارند، اما تلاش‌های این مهندسان به شکلی نگران‌کننده نتیجه معکوس داده است.

در واقع مهندسان OpenAI دریافتند که به طور ناخواسته درحال آموزش هوش مصنوعی بوده‌اند تا انسان‌ها را مؤثرتر فریب دهد و رد پای خود را بهتر پنهان کند. OpenAI در پستی وبلاگی دراین‌باره توضیح داده است یکی از پیامدهای مقابله با دسیسه‌چینی این بوده که مدل در امر فریب دقیق‌تر و ماهرتر شده است. دسیسه‌چینی عبارتی است که OpenAI آن را بدین صورت معنی می‌کند: «حالتی که هوش مصنوعی در ظاهر به یک شکل عمل می‌کند و در باطن اهداف حقیقی خود را مخفی می‌سازد.»

مدل‌های OpenAI حالا توانایی بالاتری در فریب کاربران دارند

مهندسان تلاش کردند تکنیکی برای مقابله با دسیسه‌چینی توسعه دهند تا مانع از آن شوند که مدل‌های هوش مصنوعی به‌طور پنهانی قوانین را زیر پا بگذراند یا عمداً در آزمون‌ها عملکرد ضعیف‌تری نشان دهند.

OpenAI ChatGPT

به گفته محققان، آنها می‌توانند این رفتارها را کاهش دهند، اما قادر به حذف کامل آنها نیستند، زیرا مدل‌های هوش مصنوعی متوجه می‌شوند که میزان همسویی‌شان در دست آزمایش قرار دارد و خود را طوری تنظیم می‌کنند که پنهان‌کارتر باشند.

شاید این مسئله درحال‌حاضر یک مشکل جدی به نظر نرسد، اما با در نظر گرفتن آینده‌ای که در آن یک ابرهوش مصنوعی نقش پررنگی در امور انسانی ایفا خواهد کرد، این خطرات می‌توانند به پیامدهای بسیار مهم‌تری منجر شوند. در همین حال، OpenAI می‌گوید که هنوز کارهای زیادی وجود دارد که باید انجام شود.

به گفته OpenAI، دسیسه‌چینی یک مشکل پیش‌بینی‌شده و نوظهور بوده که از آموزش مدل‌های هوش مصنوعی برای مدیریت تعارض بین اهداف مختلف ناشی می‌شود. OpenAI این حالت را به یک کارگزار بورس تشبیه کرده که برای به‌دست آوردن پول بیشتر، قانون را می‌شکند و رد پای خود را پنهان می‌کند؛ درحالی‌که اگر طبق قانون عمل می‌کرد درآمد کمتری می‌داشت. در نتیجه، مدل‌های هوش مصنوعی ممکن است در نهایت کاربر را فریب دهند. مثلاً ادعا کنند که کاری را انجام داده‌اند، درحالی‌که هرگز آن را انجام نداده‌اند.

OpenAI اعتراف کرده که تلاش‌هایش برای مهار تمایل مدل پرچم‌دار GPT-5 به فریب، تقلب یا دورزدن مشکلات بی‌نقص نبوده است.

ادامه مطلب
برای افزودن دیدگاه کلیک کنید

یک پاسخ بگذارید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *

خبر خوش برای هواداران استقلال / ستاره خارجی ماندنی شد
ورزشی5 دقیقه پیش

خبر خوش برای هواداران استقلال / ستاره خارجی ماندنی شد

خبر مهم برای متقاضیان مسکن ملی/ اگر متقاضی دریافت تسهیلات بانکی هستید، فقط تا این تاریخ فرصت دارید
ساختمان و معماری23 دقیقه پیش

خبر مهم برای متقاضیان مسکن ملی/ اگر متقاضی دریافت تسهیلات بانکی هستید، فقط تا این تاریخ فرصت دارید

نویسنده زن پس از ۶ سال به ایران برگشت/ جلسه‌ای برای نقد و بررسی ۳۰ اثر او؛ از «خاله اودیسه» تا «دیو جغرافی»
سینمای ایران و جهان29 دقیقه پیش

نویسنده زن پس از ۶ سال به ایران برگشت/ جلسه‌ای برای نقد و بررسی ۳۰ اثر او؛ از «خاله اودیسه» تا «دیو جغرافی»

فراخوان جشنواره سراسری تئاتر خیابانی «شهروند» لاهیجان
سینمای ایران و جهان29 دقیقه پیش

فراخوان جشنواره سراسری تئاتر خیابانی «شهروند» لاهیجان

ویدئوی اجرای نمایش «سیمرغ‌نامه» در شبکه نمایش خانگی منتشر می‌شود
سینمای ایران و جهان29 دقیقه پیش

ویدئوی اجرای نمایش «سیمرغ‌نامه» در شبکه نمایش خانگی منتشر می‌شود

نمایشنامه‌خوانی «​​​​​​​یک شاخه گل سرخ» در برنامه ایرانی‌خوانی
سینمای ایران و جهان29 دقیقه پیش

نمایشنامه‌خوانی «​​​​​​​یک شاخه گل سرخ» در برنامه ایرانی‌خوانی

در تئاتر شهر «یک فیل ناپدید شده است»/ آغاز پیش‌فروش بلیت
سینمای ایران و جهان29 دقیقه پیش

در تئاتر شهر «یک فیل ناپدید شده است»/ آغاز پیش‌فروش بلیت

اکبر عبدی اعتبارش را از جشنواره ها نمی‌گرفت/ایران کمدین‌های زیادی دارد
سینمای ایران و جهان2 ساعت پیش

اکبر عبدی اعتبارش را از جشنواره ها نمی‌گرفت/ایران کمدین‌های زیادی دارد

ببینید| اکبر عبدی برای اعدامی‌ها قبل از اجرای حکم کمدی اجرا می‌‌کرد
سینمای ایران و جهان2 ساعت پیش

ببینید| اکبر عبدی برای اعدامی‌ها قبل از اجرای حکم کمدی اجرا می‌‌کرد

ببینید| بغض‌ مهران غفوریان برای غمی که نمی‌شود آن را فراموش کرد
سینمای ایران و جهان2 ساعت پیش

ببینید| بغض‌ مهران غفوریان برای غمی که نمی‌شود آن را فراموش کرد

حالت صوتی ChatGPT اکنون می‌تواند کارهای شما را در محیط دسکتاپ انجام دهد
تکنولوژی2 روز پیش

حالت صوتی ChatGPT اکنون می‌تواند کارهای شما را در محیط دسکتاپ انجام دهد

استارتاپ Runway با Media Router کاربران را به‌سمت بهترین هوش مصنوعی هدایت می‌کند
تکنولوژی2 روز پیش

استارتاپ Runway با Media Router کاربران را به‌سمت بهترین هوش مصنوعی هدایت می‌کند

سرویس سلامت‌محور ChatGPT Health برای تمامی کاربران آمریکا منتشر شد
تکنولوژی2 روز پیش

سرویس سلامت‌محور ChatGPT Health برای تمامی کاربران آمریکا منتشر شد

اکبر عبدی درگذشت
سینمای ایران و جهان2 روز پیش

اکبر عبدی درگذشت

حالت صوتی Claude با مدل‌های قوی‌تر و امکان اتصال به ابزارهایی مثل جیمیل ارتقا پیدا کرد [تماشا کنید]
تکنولوژی2 روز پیش

حالت صوتی Claude با مدل‌های قوی‌تر و امکان اتصال به ابزارهایی مثل جیمیل ارتقا پیدا کرد [تماشا کنید]

هوش مصنوعی جدید و همه‌کاره Unitree ربات‌های انسان‌نما را هوشمندتر کرد [تماشا کنید]
تکنولوژی2 روز پیش

هوش مصنوعی جدید و همه‌کاره Unitree ربات‌های انسان‌نما را هوشمندتر کرد [تماشا کنید]

مواد خطرناک تشکیل دهنده رژلب
مد و زیبایی8 ساعت پیش

مواد خطرناک تشکیل دهنده رژلب

مدیرعامل انویدیا ترس از نابودی مشاغل توسط هوش مصنوعی را کاملاً بی‌معنا دانست
تکنولوژی2 روز پیش

مدیرعامل انویدیا ترس از نابودی مشاغل توسط هوش مصنوعی را کاملاً بی‌معنا دانست

ساختمان و معماری2 روز پیش

تاکید مدیرکل امور راه‌های فرعی و روستایی سازمان راهداری بر تسریع در تکمیل پروژه‌های نیمه تمام آذربایجان شرقی

«ایساتیس» فقط روایت یک شهر نیست
سینمای ایران و جهان19 ساعت پیش

«ایساتیس» فقط روایت یک شهر نیست

جدیدترین اخبار پربحث

خبر مهم اخیر

«مجله فان فارسی» از سال ۱۳۹۰ مجله‌ای در حوزه سرگرمی، سبک زندگی، سفر و فرهنگ روزمره است که با انتشار محتوای جذاب و الهام‌بخش، تجربه‌های زندگی شهری، تفریح، هنر و لحظه‌های خوش را برای مخاطبان روایت می‌کند. کپی بخش یا کل هر کدام از مطالب "فان فارسی" تنها با کسب مجوز مکتوب امکان پذیر است.