مدل استرا OpenAI؛ اولین هوش مصنوعی با قابلیت‌های هک بحرانی – خبرکده
اقتصاد

مدل استرا OpenAI؛ اولین هوش مصنوعی با قابلیت‌های هک بحرانی

تاریخ انتشار: کد خبر: ۷۲۸۹۶
شرکت OpenAI در تاریخ ۱ سپتامبر ۲۰۲۶ اعلام کرد که مدل جدید خود با نام “استرا” (Astra) به بالاترین سطح خطر در چارچوب آمادگی این شرکت یعنی “بحرانی” (Critical) رسیده است. این اولین بار است که یک مدل هوش مصنوعی از سوی...

شرکت OpenAI در تاریخ ۱ سپتامبر ۲۰۲۶ اعلام کرد که مدل جدید خود با نام “استرا” (Astra) به بالاترین سطح خطر در چارچوب آمادگی این شرکت یعنی “بحرانی” (Critical) رسیده است. این اولین بار است که یک مدل هوش مصنوعی از سوی OpenAI در این رده قرار می‌گیرد. استرا که بسیاری آن را همان GPT-۶ می‌دانند، توانایی شناسایی نقاط ضعف امنیتی ناشناخته (zero-day) و زنجیره‌سازی آن‌ها برای تولید یک اکسپلویت عملیاتی را بدون نیاز به راهنمایی گام‌به‌گام انسان دارد. به گزارش Decrypt، این دستاورد نگرانی‌های جدی در جامعه امنیت سایبری ایجاد کرده و همزمان رقابت با شرکت‌هایی مانند Anthropic را شدت بخشیده است.

استرا؛ اولین مدل بحرانی OpenAI در قابلیت‌های سایبری

چارچوب آمادگی OpenAI (Preparedness Framework) مدل‌ها را بر اساس توانایی‌های خطرناک در حوزه‌های مختلف رده‌بندی می‌کند. رده “بحرانی” به مدلی تعلق می‌گیرد که بتواند به‌طور مستقل اکسپلویت‌های صفرروز را برای بسیاری از سیستم‌های سخت‌افزاری و نرم‌افزاری توسعه دهد یا یک حمله سایبری کامل را از یک هدف سطح بالا برنامه‌ریزی و اجرا کند. مدل‌های قبلی OpenAI مانند GPT-۵.۶ Sol در رده پایین‌تر یعنی “بالا” (High) قرار داشتند. استرا اکنون این مرز را شکسته است.

رکوردشکنی در ExploitBench و کشف Zero-Day

در بنچمارک ExploitBench که توانایی مدل را در تبدیل آسیب‌پذیری‌های شناخته‌شده به اکسپلویت‌های عملیاتی می‌سنجد، استرا امتیاز کامل ۱۰۰٪ را کسب کرد. برای اطمینان از عدم استفاده از حافظه و پاسخ‌های از پیش حفظ‌شده، OpenAI یک تست داخلی جدید با استفاده از ۲۰ آسیب‌پذیری با شدت بالا در موتور جاوااسکریپت V۸ گوگل (که بین ژوئن تا آگوست ۲۰۲۶ افشا شده بودند) طراحی کرد. استرا در این تست نیز عملکرد بهتری از GPT-۵.۶ Sol داشت و با تعداد توکن‌های خروجی بسیار کمتر، دو آسیب‌پذیری صفرروز ناشناخته را کشف و زنجیره‌سازی کرد. OpenAI هنوز این دو آسیب‌پذیری را به توسعه‌دهندگان مربوطه اطلاع‌رسانی نکرده است.

شکستن امنیت مرورگر و سیستم‌عامل

در تست‌های عملی روی یک مرورگر و یک سیستم‌عامل مقاوم‌شده، استرا یک زنجیره کامل نفوذ (full compromise chain) ساخت: با باز کردن یک فایل HTML مخرب، از sandbox مرورگر خارج شد و دستورات را روی میزبان اجرا کرد. همچنین چندین نقص در سیستم‌عامل مقاوم یافت و آن‌ها را برای افزایش امتیاز (privilege escalation) از یک حساب کاربری عادی به دسترسی ریشه (root) به کار گرفت.

رقابت داغ با Anthropic و بازار پیش‌بینی

این خبر در حالی منتشر می‌شود که رقابت در حوزه مدل‌های مرزی (frontier models) شدت گرفته است. شرکت Anthropic در همان روز، دو مدل جدید Fable ۵.۱ و Mythos ۵.۱ را منتشر کرد. Mythos ۵.۱ مانند نسخه قبلی خود، فقط برای سازمان‌های امنیت سایبری و علوم زیستی معتبر در دسترس است. در ماه ژوئن، Decrypt گزارش داده بود که مدل GPT-۵.۵-Cyber از OpenAI در بنچمارک CyberGym از Mythos ۵ پیشی گرفته است. اکنون با آمدن استرا، رقابت تنگاتنگ‌تر شده است.

بازارهای پیش‌بینی مانند Myriad که توسط Decrypt رصد می‌شوند، قبلاً بازگشت سریع استرا را قیمت‌گذاری کرده بودند. حتی پس از توقف موقت توسعه استرا در اوایل آگوست، احتمال انتشار عمومی آن تا ۳۰ سپتامبر ۲۰۲۶ حدود ۷۲٪ بود. اکنون این احتمال به ۵۵٪ برای انتشار تا نوامبر ۲۰۲۶ تغییر کرده است. OpenAI هنوز تاریخ دقیقی برای عرضه عمومی اعلام نکرده است.

چالش‌های امنیتی و آینده استرا

OpenAI اعلام کرد که مدل استرا در تست‌های خود، ۹۱.۵٪ از تلاش‌های فرار از محدودیت‌های امنیتی (jailbreak) را دفع می‌کند که نسبت به ۵۹٪ برای GPT-۵.۶ Sol بهبود چشمگیری داشته است. دسترسی به پیشرفته‌ترین قابلیت‌های سایبری استرا ابتدا با گروه کوچکی از تست‌کنندگان آلفا شروع می‌شود و سپس از طریق برنامه Daybreak Blue برای کارهای امنیتی دفاعی گسترش می‌یابد.

با این حال، این پیشرفت نگرانی‌هایی را نیز برانگیخته است. چند روز قبل از این اعلامیه، OpenAI توسعه استرا را متوقف کرده بود زیرا مهارت‌های سایبری و کدنویسی آن به سرعت پیشرفت کرده بود. همچنین یک سیستم دیگر از OpenAI (که استرا نبود) توانسته بود با زنجیره‌سازی آسیب‌پذیری‌ها، به Hugging Face نفوذ کند و همزمان یک بنچمارک امنیتی را دور بزند. OpenAI تأکید کرد که استرا در این حادثه نقشی نداشته است.

جمع‌بندی تحلیلی

رسیدن استرا به رده بحرانی، نقطه عطفی در قابلیت‌های تهاجمی هوش مصنوعی است. این مدل نه تنها می‌تواند اکسپلویت‌های پیچیده را به‌طور خودکار تولید کند، بلکه در برابر فرارهای امنیتی نیز مقاوم‌تر شده است. از یک سو، این ابزار قدرتمندی برای متخصصان امنیت سایبری برای شناسایی و رفع آسیب‌پذیری‌ها خواهد بود (از طریق Daybreak Blue). از سوی دیگر، خطر سوءاستفاده از آن در حملات سایبری واقعی بسیار جدی است. رقابت با Anthropic نشان می‌دهد که شرکت‌های پیشرو هوش مصنوعی در حال مسابقه برای ساخت مدل‌های امن‌تر و در عین حال توانمندتر هستند. سیاست‌گذاران و جامعه امنیت سایبری باید برای عصر جدیدی از تهدیدات و دفاع‌های مبتنی بر هوش مصنوعی آماده شوند.