صفحه اصلیمرکز اخبار LBank
آستراي OpenAI نخستین مدل هوش مصنوعی این شرکت با توانایی‌های هک «بحرانی» شد
openai-astra-first-ai-model-critical-hacking
آستراي OpenAI نخستین مدل هوش مصنوعی این شرکت با توانایی‌های هک «بحرانی» شد
مدل منتشرنشده می‌تواند آسیب‌پذیری‌های روز صفر را پیدا کند و آن‌ها را به بهره‌برداری‌های عملی تبدیل کند، بدون آنکه انسانی مرحله‌به‌مرحله آن را راهنمایی کند، و دسترسی به این قابلیت با گروه کوچکی از آزمایش‌کنندگان آغاز شده است.
2026-09-02 منبع:decrypt.co

به طور خلاصه

  • اوپن‌ای‌آی در ۱ سپتامبر اعلام کرد که آسترا (Astra) به سطح «بحرانی» چارچوب آمادگی خود رسیده است؛ این اولین مدلی است که این شرکت در زمینه امنیت سایبری تا این حد طبقه‌بندی کرده است.
  • آسترا در ExploitBench امتیاز ۱۰۰% کامل کسب کرد و در یک آزمون داخلی جدیدتر که از آسیب‌پذیری‌های مرورگر V8 که در تابستان امسال فاش شد، ساخته شده بود، به تنهایی دو آسیب‌پذیری روز صفر (zero-day) ناشناخته قبلی را کشف و به هم متصل کرد.
  • دسترسی به قابلیت‌های پیشرفته امنیت سایبری آسترا با گروه کوچکی از آزمایش‌کنندگان آلفا آغاز می‌شود.

اوپن‌ای‌آی سه‌شنبه اعلام کرد که آسترا، یک مدل منتشرنشده، آستانه «بحرانی» قابلیت امنیت سایبری را تحت چارچوب آمادگی خود پشت سر گذاشته است؛ این اولین مدلی است که این شرکت در این دسته قرار داده است.

این بدان معناست که آسترا، که بسیاری معتقدند به جای یک مدل اضافی، همان GPT-6 است، می‌تواند بدون نیاز به راهنمایی گام به گام انسانی، نقص‌های امنیتی ناشناخته قبلی را پیدا کرده و اکسپلویت‌های عملیاتی را در بسیاری از سیستم‌های مقاوم ایجاد کند.

Myriad: اوپن‌ای‌آی چه زمانی GPT-6 را منتشر خواهد کرد؟ برای پیش‌بینی کلیک کنید.

اوپن‌ای‌آی نوشت: «ما اکنون معتقدیم که آسترا به آستانه قابلیت امنیت سایبری بحرانی تحت چارچوب آمادگی ما رسیده است.» «این اولین مدلی است که در این سطح تعیین می‌کنیم و به محافظت‌های قوی‌تری در طول توسعه و پیش از انتشار نیاز دارد.»

بر اساس این چارچوب، یک مدل زمانی به سطح بحرانی می‌رسد که بتواند به طور مستقل اکسپلویت‌های روز صفر (zero-day) عملیاتی را در بسیاری از سیستم‌های مقاوم و واقعی توسعه دهد، یا اگر بتواند یک حمله سایبری کامل را علیه یک هدف دشوار، تنها با یک هدف سطح بالا، برنامه‌ریزی و اجرا کند. مدل‌های قبلی اوپن‌ای‌آی، از جمله GPT-5.6 Sol، در رده «بالا» و پایین‌تر این چارچوب قرار داشتند.

در ExploitBench، یک معیار ارزیابی که توانایی یک مدل را در تبدیل آسیب‌پذیری‌های نرم‌افزاری شناخته شده به اکسپلویت‌های عملیاتی می‌سنجد و آن را با نرخ موفقیت مستقیم امتیازدهی می‌کند، آسترا امتیاز ۱۰۰% کامل را کسب کرد.

برای رد کردن احتمال افزایش امتیاز به دلیل پاسخ‌های حفظ شده، اوپن‌ای‌آی یک آزمون دوم با استفاده از ۲۰ آسیب‌پذیری با شدت بالا در موتور جاوااسکریپت V8 گوگل که بین ژوئن و آگوست فاش شده بودند، ساخت. آسترا در نرخ اجرای کد دلخواه (arbitrary code-execution) نیز GPT-5.6 Sol را شکست داد، با استفاده از توکن‌های خروجی بسیار کمتر، و در این فرآیند دو آسیب‌پذیری روز صفر را کشف و به هم متصل کرد که اوپن‌ای‌آی هنوز در حال افشای آن‌ها به نگهدارندگان مربوطه است.

GPT-5.6 Sol در حال حاضر بهترین مدل اوپن‌ای‌آی است.

در آزمایش‌های عملی علیه یک مرورگر مقاوم‌شده و یک سیستم عامل مقاوم‌شده، آسترا یک زنجیره نفوذ کامل ایجاد کرد که از ساندباکس مرورگر خارج شد و دستوراتی را روی میزبان تنها با باز کردن یک فایل HTML مخرب اجرا کرد. همچنین چندین نقص را در سیستم عامل مقاوم‌شده پیدا کرد و آن‌ها را به یک مسیر افزایش امتیاز (privilege-escalation) از یک حساب کاربری عادی به روت (root) تبدیل کرد.

اوپن‌ای‌آی گفت که این مدل در آزمایش‌های خودش ۹۱.۵ درصد از تلاش‌های جیلبریک سایبری را رد می‌کند، که این رقم برای GPT-5.6 Sol معادل ۵۹ درصد بود. دسترسی به پیشرفته‌ترین قابلیت‌های امنیت سایبری آسترا با گروه کوچکی از آزمایش‌کنندگان آلفا آغاز می‌شود، و دسترسی گسترده‌تر بعدها از طریق برنامه Daybreak Blue اوپن‌ای‌آی برای کارهای امنیتی دفاعی فراهم خواهد شد.

این افشاگری پس از هفته‌ها نگرانی در سراسر صنعت صورت می‌گیرد. تنها چند روز پیش، اوپن‌ای‌آی توسعه آسترا را پس از پیشرفت سریع مهارت‌های سایبری و کدنویسی این مدل متوقف کرد؛ این هشدار درست پس از افشای یک سیستم جداگانه و منتشرنشده اوپن‌ای‌آی که آسیب‌پذیری‌ها را برای نفوذ به Hugging Face در حین بازی با یک معیار امنیتی به هم متصل کرده بود، منتشر شد. اوپن‌ای‌آی می‌گوید آسترا در آن حادثه نقشی نداشته است.

معامله‌گران از قبل یک چرخش سریع را پیش‌بینی کرده بودند. بازارهای پیش‌بینی در Myriad که توسط Decrypt ردیابی می‌شوند، به آسترا، که در داخل با نام رمز GPT-6 مرتبط است، ۷۲% شانس انتشار عمومی تا ۳۰ سپتامبر را حتی پس از توقف اوایل آگوست اوپن‌ای‌آی، داده بودند، و اوپن‌ای‌آی هنوز تاریخ انتشار عمومی را تعیین نکرده است. این شانس‌ها ۵۵% به نفع انتشار تا نوامبر ۲۰۲۶ تغییر کرد.

این زمان‌بندی آسترا را در مقابل یک رقیب تازه قرار می‌دهد. Anthropic سه‌شنبه Fable 5.1 و Mythos 5.1 را منتشر کرد، و Mythos 5.1، مانند Mythos 5 قبلی، برای سازمان‌های امنیت سایبری و علوم زیستی تأیید شده، و نه برای عموم مردم، اختصاص یافته است.

Decrypt در ژوئن گزارش داد که GPT-5.5-Cyber اوپن‌ای‌آی قبلاً Mythos 5 را در CyberGym شکست داده بود، CyberGym معیاری است که عوامل هوش مصنوعی را در برابر بیش از ۱۵۰۰ آسیب‌پذیری شناخته شده از پروژه‌های متن‌باز واقعی اجرا می‌کند و آنها را بر اساس تعداد آسیب‌پذیری‌هایی که به درستی بازتولید می‌کنند، امتیاز می‌دهد.

شایعه شده بود که هر دو شرکت در حال آماده‌سازی مدل‌های مرزی جدید در یک بازه زمانی مشابه هستند، و اکنون این اتفاق افتاده است. Fable 5.1 در ۱ سپتامبر منتشر شد و اوپن‌ای‌آی می‌گوید آسترا به زودی عرضه خواهد شد، با قدرتمندترین ابزارهای سایبری آن که ابتدا پشت دسترسی آلفا و سپس Daybreak Blue قرار می‌گیرند.