امنیت سایبری, هوش مصنوعی ۴ دقیقه مطالعه

OpenAI توسعه ی مدل Astra را به‌دلیل نگرانی‌های امنیتی کند میکند

هادی داتلی بیگی هادی داتلی بیگی

OpenAI اعلام کرده که بخشی از توسعه‌ی مدل آینده‌اش با نام Astra را متوقف یا کند کرده است، چون ارزیابی‌های داخلی نشان داده‌اند این مدل در دو حوزه‌ی حساس یعنی agentic coding و cybersecurity پیشرفت قابل‌توجهی داشته است. به‌گفته ی شرکت، این سطح از توانایی به محدوده‌ای رسیده که تحت Preparedness Framework OpenAI، می‌تواند به‌عنوان یک ریسک امنیتی جدی تلقی شود.

چرا OpenAI نگران Astra شد؟

OpenAI در بیانیه‌ی خود گفته است که ارزیابی‌های اولیه نشان می‌دهد Astra آن‌قدر در حوزه‌ی امنیت سایبری و کدنویسی عامل‌محور پیشرفت کرده که شرکت نمی‌تواند فعلا احتمال رسیدن آن به Critical capability level را رد کند.

این سطح، در زبان ساده، یعنی مدلی که ممکن است بدون کمک انسان بتواند به سمت کشف، بهره‌برداری یا اجرای حملات سایبری در دنیای واقعی حرکت کند.

OpenAI همچنین تاکید کرده که Astra هنوز در مرحله‌ی توسعه است و در ماجرای نفوذ به Hugging Face نقش نداشته است.


آستانه بحرانی امنیت سایبری چیست؟

OpenAI در چارچوب Preparedness Framework خود، برای ارزیابی ریسک مدل‌ها از آستانه‌هایی استفاده می‌کند.

در بخش امنیت سایبری، «آستانه بحرانی» زمانی مطرح می‌شود که یک مدل بتواند:

  • آسیب‌پذیری‌های جدی را به‌صورت مستقل شناسایی کند
  • از نقص‌های واقعی و محافظت‌شده سوءاستفاده کند
  • حملات پیچیده را بدون دخالت انسان اجرا کند
  • به سطحی نزدیک شود که با exploitهای عملی مثل zero-day هم‌پوشانی داشته باشد

این یعنی مسئله فقط یک مدل «باهوش‌تر» نیست؛ مسئله به توانایی‌ای برمی‌گردد که می‌تواند به‌طور مستقیم برای سوءاستفاده امنیتی به‌کار رود.


OpenAI چه اقداماتی انجام داده است؟

OpenAI گفته که در پاسخ به این یافته‌ها:

  • فعالیت‌های داخلی مرتبط با Astra را که با guardrailهای جدید هم‌خوانی ندارند، متوقف کرده
  • کنترل‌های امنیتی سخت‌تری اعمال کرده است
  • در حال ادامه‌ی benchmark و ارزیابی مدل است
  • با برخی نهادهای دولتی و سازمان‌های منتخب ایمنی AI همکاری می‌کند

این تصمیم نشان می‌دهد OpenAI ترجیح داده قبل از عرضه یا حتی ادامه‌ی توسعه‌ی بخش‌هایی از مدل، ترمز را بکشد.


چرا این خبر از نظر صنعت AI مهم است؟

این اتفاق فقط یک خبر داخلی درباره OpenAI نیست.

در عمل، دارد یک الگوی جدید را در صنعت AI نشان می‌دهد:

1) مدل‌های پیشرفته‌تر، ریسک امنیتی واقعی‌تری دارند

هرچه مدل‌ها در agentic reasoning و code execution قوی‌تر شوند، احتمال استفاده‌ی دوگانه هم بالا می‌رود.

2) شرکت‌ها دیگر نمی‌توانند فقط روی توانایی مدل تمرکز کنند

ایمنی، کنترل دسترسی، sandboxing و ارزیابی سوءاستفاده، به بخش اصلی توسعه تبدیل شده‌اند.

3) شفافیت درباره ریسک‌ها بیشتر شده است

OpenAI این‌بار تصمیم گرفته موضوع را علنی کند؛ کاری که قبلا در بسیاری از شرکت‌های فناوری کمتر دیده می‌شد.


ماجرای Hugging Face چه ربطی دارد؟

OpenAI در گزارش خود اشاره کرده که Astra در سوءاستفاده از Hugging Face نقشی نداشته است.

این جمله مهم است، چون OpenAI را در متن یک فضای حساس‌تر قرار می‌دهد: اخیرا چند مورد از نفوذ یا عبور مدل‌ها از sandbox در تست‌های امنیتی گزارش شده و همین موضوع حساسیت نسبت به کنترل مدل‌های پیشرفته را بالا برده است.

به همین دلیل، اعلام OpenAI فقط یک هشدار تئوریک نیست؛ بخشی از یک روند واقعی در صنعت است که نشان می‌دهد حتی آزمایش‌های داخلی هم می‌توانند به نتایج نگران‌کننده برسند.


این تصمیم چه پیامی برای آینده مدل‌های عامل‌محور دارد؟

Astra ظاهرا فقط یک مدل زبانی معمولی نیست.

تمرکز خبر روی agentic coding نشان می‌دهد که OpenAI به سمت مدل‌هایی می‌رود که فقط پاسخ نمی‌دهند، بلکه می‌توانند عمل هم انجام دهند.

این دقیقاً همان جایی است که خطر و ارزش با هم رشد می‌کنند:

  • در سمت مثبت: اتوماسیون پیچیده‌تر، کدنویسی سریع‌تر، بهره‌وری بالاتر
  • در سمت منفی: سوءاستفاده از ابزارهای هوشمند برای حملات سایبری واقعی

هرچه مدل‌ها عامل‌محورتر شوند، مرز بین دستیار دیجیتال و عامل اجرایی باریک‌تر می‌شود.


آیا OpenAI دارد ترمز می‌کشد یا فقط محتاط تر شده است؟

به‌احتمال زیاد پاسخ دوم دقیق‌تر است.

OpenAI از ادامه‌ی توسعه صرف‌نظر نکرده، اما صراحتا گفته که فعلا باید با احتیاط بیشتری جلو برود. این یعنی:

  • توسعه متوقف نشده
  • اما فازهای پرریسک کند شده‌اند
  • شرکت می‌خواهد قبل از عرضه، سطح واقعی خطر را دقیق‌تر بفهمد

در صنعت AI، این نوع احتیاط می‌تواند نشانه‌ی بلوغ باشد، نه ضعف.

ولی از زاویه‌ی دیگر، نشان می‌دهد شکاف بین «توانایی مدل» و «آمادگی برای انتشار» هنوز زیاد است.

هادی داتلی بیگی

نوشته‌شده توسط

هادی داتلی بیگی

دنیای من ترکیبی از خطوط کد و تحلیل‌های هوش مصنوعیه. به عنوان کسی که سال‌هاست درگیر توسعه نرم‌افزار و چالش‌های فنی دنیای وب و موبایله، معتقدم هوش مصنوعی صرفاً یک ترند نیست، بلکه زبان جدید دنیاست.

دیدگاه خود را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *