با ما همراه باشید

تکنولوژی

OpenAI اطلاعات بیشتری درباره توانمندی‌های شگفت‌انگیز مدل Astra منتشر کرد

OpenAI می‌گوید Astra توانسته دو آسیب‌پذیری روزصفر را کشف و بدون نیاز به دخالت انسان‌ها از آنها سوءاستفاده کند.

منتشر شده

در

شرکت OpenAI جزئیات تازه‌ای از مدل هوش مصنوعی جدید خود با نام Astra منتشر کرده است. این شرکت می‌گوید Astra نخستین مدل زبانی بزرگی است که به سطح بالایی از توانایی‌های امنیت سایبری رسیده و می‌تواند آسیب‌پذیری‌های ناشناخته در سیستم‌های کامپیوتری را پیدا و بدون راهنمایی انسان از آنها سوءاستفاده کند.

OpenAI می‌گوید Astra به‌زودی در دسترس قرار می‌گیرد، اما دسترسی به پیشرفته‌ترین قابلیت‌های امنیت سایبری آن محدودتر خواهد بود. این شرکت پیش از عرضه عمومی، قصد دارد مدل جدید را در اختیار گروهی از آزمایش‌کنندگان قرار دهد. بااین‌حال، هنوز مشخص نیست این افراد چه کسانی هستند یا چگونه انتخاب می‌شوند. همچنین معلوم نیست OpenAI برای ارزیابی Astra پیش از عرضه با دولت آمریکا همکاری می‌کند یا خیر.

توانایی مدل Astra در کشف آسیب‌پذیری‌های ناشناخته

طبق اعلام OpenAI، مدل Astra در آزمایش ExploitBench موفق شده امتیاز کامل به دست آورد. این آزمون توانایی مدل‌های زبانی بزرگ در نفوذ به آسیب‌پذیری‌های شناخته‌شده سیستم‌ها را بررسی می‌کند.

بنچمارک امنیتی Astra
OpenAI اطلاعات بیشتری درباره توانمندی‌های شگفت‌انگیز مدل Astra منتشر کرد

نمودار بالا عملکرد Astra و GPT-5.6 Sol را در آزمون ExploitBench براساس تعداد توکن‌های خروجی مقایسه می‌کند. با افزایش تعداد توکن‌ها، نرخ موفقیت Astra به‌سرعت افزایش یافته و از حدود ۱۸ درصد در ۱۸ هزار توکن به نزدیک ۳۹ درصد در ۷۵ هزار توکن رسیده است؛ درحالی‌که GPT-5.6 Sol حتی با حدود ۱۳۵ هزار توکن به نرخ موفقیت حدود ۱۱ درصد می‌رسد. به‌عبارت ساده‌تر، Astra در این آزمایش با خروجی کوتاه‌تر نیز توانسته عملکرد بسیار بهتری در پیدا کردن و بهره‌برداری از آسیب‌پذیری‌های امنیتی داشته باشد.

مهندسان OpenAI همچنین نسخه‌ای تغییر‌یافته از این آزمون را توسعه داده‌اند. به گفته شرکت، Astra در این آزمایش موفق شده دو آسیب‌پذیری روزصفر را کشف و از آنها سوءاستفاده کند. آسیب‌پذیری روزصفر (Zero-day) به نقص امنیتی گفته می‌شود که پیش از کشف یا رفع آن، اطلاعات عمومی محدودی درباره‌اش وجود دارد.

وجود این توانایی‌ها در Astra نگرانی‌هایی مشابه مواردی ایجاد می‌کنند که شرکت آنتروپیک در اوایل سال جاری درباره مدل Mythos مطرح کرده بود. OpenAI نیز در واکنش به این خطرات، اقدامات احتیاطی مشابهی را برای آماده‌سازی Astra در نظر گرفته است.

بااین‌حال، بدون تأیید از سوی طرف‌های ثالث، ارزیابی ادعاهای OpenAI درباره ایمنی یا آمادگی Astra دشوار است. این شرکت اعلام کرده هنگام عرضه عمومی، ارزیابی‌های بیشتر و اطلاعات تکمیلی درباره ایمنی مدل را منتشر خواهد کرد. OpenAI همچنین می‌گوید از قبل فرایند بهبود سازوکارهای کنترلی مدل‌های خود را آغاز کرده است. هدف این اقدامات، شناسایی سوءاستفاده‌ها و جلوگیری از دور زدن محدودیت‌های امنیتی یا همان جیلبریک است.

اوپن‌ای‌آی Astra را از نظر هم‌راستایی بهترین مدل خود توصیف می‌کند. بااین‌حال، این شرکت قصد دارد مدل جدید را با نظارت بیشتر بر زنجیره استدلال عرضه کند تا بتواند رفتارهای نامناسب را شناسایی و متوقف کند.

مدل Astra شرکت OpenAI
OpenAI اطلاعات بیشتری درباره توانمندی‌های شگفت‌انگیز مدل Astra منتشر کرد

آماده‌سازی برای عرضه Astra در شرایطی انجام می‌شود که صنعت هوش مصنوعی همچنان درباره حادثه مرتبط با ایجنت‌های هوش مصنوعی OpenAI واکنش نشان می‌دهد. ایجنت‌های این شرکت توانسته بودند از محیط آموزشی خود خارج شده و به داده‌های خصوصی در Hugging Face، پلتفرم محبوب توزیع مدل‌ها و بنچمارک‌های هوش مصنوعی، دسترسی پیدا کنند. اخیراً در تحقیقی جزئیات این حمله فاش شده بود که در آن چند ایجنت با همکاری یکدیگر توانسته بودند با وجود محدودیت‌هایی که پژوهشگران OpenAI اعمال کرده بودند، به اینترنت آزاد دسترسی پیدا کنند.

اکنون OpenAI می‌گوید Astra در این آزمایش‌های جدید تلاش نکرده از محیط آزمایشی خود خارج شود.

ادامه مطلب
برای افزودن دیدگاه کلیک کنید

یک پاسخ بگذارید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *

بازتاب خبر عمان و عربستان در بازار طلا و دلار/ دلار ۴۵۰۰ تومان گران‌تر شد/ طلای ۱۸ عیار تا ۳۵ میلیون تومان بالا می‌رود؟
اقتصاد پولی مالی32 دقیقه پیش

بازتاب خبر عمان و عربستان در بازار طلا و دلار/ دلار ۴۵۰۰ تومان گران‌تر شد/ طلای ۱۸ عیار تا ۳۵ میلیون تومان بالا می‌رود؟

تکنولوژی1 ساعت پیش

سم آلتمن: اگر سرعت هوش مصنوعی کم نشود، ممکن است کنترل آینده را از دست بدهیم

تکنولوژی1 ساعت پیش

منشور اخلافی مایکروسافت منتشر شد: انسان‌ها از هوش مصنوعی مهم‌ترند

تکنولوژی1 ساعت پیش

پادشاه بریتانیا همزمان با افزایش نگرانی‌ها میزبان اجلاس بزرگ‌ترین مدیران هوش مصنوعی می‌شود

تکنولوژی1 ساعت پیش

چین چگونه برای سناریوی فرار هوش مصنوعی از کنترل انسان آماده می‌شود؟

مستند «من تروریست نیستم» به می‌آید
سینمای ایران و جهان2 ساعت پیش

مستند «من تروریست نیستم» به می‌آید

پرویز جاهد: جشنواره‌های جهانی دیگر نمی‌توانند ادعا کنند تصمیم‌هایشان صرفاً هنری است
سینمای ایران و جهان2 ساعت پیش

پرویز جاهد: جشنواره‌های جهانی دیگر نمی‌توانند ادعا کنند تصمیم‌هایشان صرفاً هنری است

«بنی‌آدم» با روایت «فرهاد قائمیان» آماده نمایش می‌شود
سینمای ایران و جهان2 ساعت پیش

«بنی‌آدم» با روایت «فرهاد قائمیان» آماده نمایش می‌شود

از زنی مستقل و مقتدر به‌ نام «گل‌بی‌بی» در ایران ۱۲۶۹ شمسی تا اسناد و مدارک حمله عراق به ایران
سینمای ایران و جهان2 ساعت پیش

از زنی مستقل و مقتدر به‌ نام «گل‌بی‌بی» در ایران ۱۲۶۹ شمسی تا اسناد و مدارک حمله عراق به ایران

مهدی تارتار به یاد تیم سابق افتاد! + عکس
صنعت و خدمات2 ساعت پیش

مهدی تارتار به یاد تیم سابق افتاد! + عکس

جدیدترین اخبار پربحث

خبر مهم اخیر

«مجله فان فارسی» از سال ۱۳۹۰ مجله‌ای در حوزه سرگرمی، سبک زندگی، سفر و فرهنگ روزمره است که با انتشار محتوای جذاب و الهام‌بخش، تجربه‌های زندگی شهری، تفریح، هنر و لحظه‌های خوش را برای مخاطبان روایت می‌کند. کپی بخش یا کل هر کدام از مطالب "فان فارسی" تنها با کسب مجوز مکتوب امکان پذیر است.