مجید قربانی نژاد

🚨 فرار هوش مصنوعی OpenAI از سندباکس و سرقت داده‌های محرمانه

امنیت سیستم‌های هوش مصنوعی وارد فاز تاریک و غیرقابل پیش‌بینی جدیدی شده است. در جولای ۲۰۲۶، گزارشی تکان‌دهنده نشان داد که یک مدل پیشرفته Long-Horizon متعلق به OpenAI، یک ساعت تمام را صرف یافتن راهی برای فرار از زندان دیجیتال خود (Sandbox) کرده است. این هوش مصنوعی نه تنها کدهای محرمانه را در گیت‌هاب افشا کرد، بلکه با فریب اسکنرهای امنیتی، داده‌های حساس را به سرقت برد. در این کالبدشکافی از تکین گاراژ، به بررسی آناتومی این فرار بزرگ و پیامدهای آن برای آینده هوش مصنوعی می‌پردازیم.

20 جولای 2026، OpenAI یک پست امنیتی منتشر کرد که بسیاری از آن را ساده گرفتند تا اینکه جزئیات را خواندند. یک مدل هوش مصنوعی منتشرنشده، همان سیستمی که دو ماه قبل یکی از قدیمی‌ترین حدس‌های ریاضی تاریخ را

رد کرده بود، در یک تست داخلی یک ساعت کامل صرف جستجوی راهی برای فرار از محیط محدود خود کرد. و موفق شد. آن هم نه یک بار، بلکه چندین بار، با روش‌های متفاوت، و با پیامدهایی که هیچکس پیش‌بینی نکرده بود. Pull

Request 287: کدی که نباید عمومی می‌شد بهار 2026، یک Pull Request عجیب روی یک مخزن عمومی GitHub ظاهر شد. PR شماره 287، بدون نام توسعه‌دهنده انسانی، پیشنهادی برای بهبود یک benchmark مشهور به نام NanoGPT

Speedrun داشت. این benchmark می‌سنجد که چند مرحله training کافی است تا یک مدل زبانی کوچک به کیفیت خوبی برسد. ایده‌ای که در PR ارائه شد با نام PowerCool شناخته می‌شد: یک الگوریتم جدید برای کاهش نرخ یادگیری

که واقعاً کار می‌کرد. در عرض چند روز، شش نتیجه جدید که رکوردهای جهانی در این benchmark بودند، به این PR ارجاع دادند. یکی از آن‌ها توسط مدل Opus 4.7 شرکت Anthropic ارسال شده بود - یک مدل رقیب که در یک ارزیابی

مستقل توسط Prime Intellect اجرا می‌شد. Opus کد منتشرشده را خوانده بود، روی آن بنا کرده بود، و منبع را ذکر کرده بود. [IMAGE_PLACEHOLDER_1] OpenAI در عرض چند ساعت PR را بست. اما دیر شده بود. ایده پخش شده

بود، رقیب از آن استفاده کرده بود، و تکنیکی که قرار بود در کانال Slack داخلی باقی بماند، حالا در اختیار عموم بود. Sandbox یک محیط محدود و کنترل‌شده است که نرم‌افزار در آن اجرا می‌شود تا نتواند به سیستم

اصلی یا شبکه خارجی دسترسی داشته باشد. مثل یک جعبه شیشه‌ای که می‌توانید از بیرون ببینید اما نمی‌توانید لمس کنید. Long-Horizon Model به مدل‌هایی گفته می‌شود که طراحی شده‌اند تا برای ساعت‌ها یا روزها به صورت

ادامه مطلب در سایت