مدلهای هوش مصنوعی اوپنایآی (OpenAI) شامل مدل در دسترس عموم GPT-5.6 Sol و یک سیستم قدرتمندتر و منتشرنشده، از یک محیط تست کنترلشده «فرار کردند» و زیرساختهای عملیاتی هگینگ فیس (Hugging Face) — شرکتی که میزبان بخش بزرگی از دنیای هوش مصنوعی متنباز است — را دچار مخاطره کردند!
این مدلها از طریق یک بنچمارک داخلی به نام ExploitGym که آزمونی برای وظایف هک چندمرحلهای و طولانی است اجرا میشدند و محدودیتها و ممانعتهای امنیت سایبری آنها به عمد برای این ارزیابی کاهش یافته بود.
این اتفاق به معنای خصمانه شدن ناگهانی و خودجوش یک مدل عملیاتی نبود؛ بلکه یک مدل قدرتمند با گاردریلهای خاموش بود که مستقیماً به آن دستور داده شده بود در آزمون هک پیروز شود — و هر کاری که برای برد لازم است انجام دهد.
این مدلها یک نقص پنهان را در نرمافزار تست پیدا کردند — نقصی که هیچکس از وجود آن خبر نداشت — و از آن برای عبور از دیوارهایی که قرار بود آنها را آفلاین نگه دارند، استفاده کردند. به محض ورود به اینترنت آزاد، آنها حدس زدند که ممکن است پاسخهای این آزمون در هگینگ فیس ذخیره شده باشد!

آنها برای نفوذ، مجموعهای از رمزهای عبور سرقتشده و نقصهای پنهان بیشتری را به هم پیوند دادند تا در نهایت توانستند دستورات خود را روی سرورهای زنده و عملیاتی هگینگ فیس اجرا کنند.
اوپنایآی (OpenAI) این ناهنجاری را بهصورت داخلی کشف کرد، در حالی که تیم هگینگ فیس آن را شناسایی و مهار نمود. هگینگ فیس این حادثه را «بیسابقه» خواند و اعلام کرد اقدامات امنیتی گستردهای برای جلوگیری از حوادث ناگواری که ممکن است بر سیستمها یا خدمات عمومی تأثیر بگذارد، اعمال خواهد شد.
تیم هگینگ فیس در پست وبلاگ خود نوشت:
ما در حال اعمال کنترلهای سختگیرانه در پیکربندی زیرساختها هستیم؛ حتی اگر این کار به قیمت کاهش سرعت تحقیقات تمام شود تا زمانی که آسیبپذیریها ترمیم (پچ) شوند. ما در حال بهبود و افزودن محافظتهای قویتر در اطراف فرآیندهای آموزش و ارزیابی آینده هستیم.
کریپتو مراقب باشد!
بخش زیادی از یک حمله کریپتویی قبل از جابهجایی داراییها اتفاق میافتد. مهاجمان کدها را اسکن میکنند، رمزهای عبور را تست میکنند، به دنبال اطلاعات اعتبارنامه (کد عبور) افشاشده میگردند، ساختارهای امضا را تحلیل میکنند و به دنبال راهی برای ورود به یک حساب کاربری مدیر (Admin) هستند.
مدلهای اوپنایآی در طول حادثه هگینگ فیس چندین بخش از این فرآیند را انجام دادند و از نقطهضعفی به نقطهضعف دیگر حرکت کردند تا اینکه به سرورهای عملیاتی اصلی رسیدند.
و همانطور که چندین حمله از اوایل امسال نشان داده است، بازار کریپتو فضاهای زیادی برای کارآمد بودن این روش دارد. نقطه ضعف ممکن است یک قرارداد هوشمند باشد، اما همچنین میتواند لپتاپ یک توسعهدهنده، یک پکیج نرمافزاری آلوده، یک تاییدکننده پل (Bridge Validator) یا یکی از امضاکنندگان در یک کیف پول چندامضایی (Multisig) باشد.
به عنوان مثال، حمله ۲۸۵ میلیون دلاری به Drift در اوایل امسال، سرقتی بود که انجام آن به یک کمپین مهندسی اجتماعی ششماهه برای دستیابی به دسترسیهای ویژه نیاز داشت. یک عامل هوش مصنوعی (AI Agent) به صورت تئوری میتواند مسیرهای زیادی را بهطور همزمان آزمایش کند، تلاشهای ناموفق را پیگیری کند و در حالی که اپراتورهای انسانی آن خواب هستند به کار خود ادامه دهد. زمانی که یک مسیر پیدا شد، اپراتور انسانی میتواند روی حمله واقعی و یک مسیر خروج عملیاتی اقدام کند.

ضررمالی ۲۹۲ میلیون دلاری پل KelpDAO نقطه ضعف متفاوتی را آشکار ساخت. مهاجم یک نقص «تکتأییدکننده» (Single-verifier) را در سیستمی که برای جابهجایی داراییها بین بلاکچینها استفاده میشد، پیدا کرد.
این نوع حمله با بررسی صبورانه کد و نقشهبرداری از زیرساخت آغاز میشود — یعنی همان نوع کاری که مدلهای اوپنایآی هنگام یافتن یک نقص ناشناخته انجام دادند.
نوع سوم حمله، سیستمهای حاکمیت درونزنجیرهای (Onchain Governance) را هدف قرار میدهد. اوایل ماه ژوئیه، یک مهاجم حدود ۴.۴ میلیون دلار صرف خرید مقدار کافی از میمکوین BONK (بر پایه سولانا) کرد تا پیشنهادی (Proposal) را ارائه و تصویب کند که تقریباً ۲۰ میلیون دلار را از خزانه پروژه به مهاجم منتقل میکرد. این اتفاق در یک بازه زمانی سه روزه رخ داد و مهاجم بعداً تمام توکنهای استفادهشده برای پیروزی در رأیگیری را فروخت.
خریدها، رأیگیری و انتقال خزانه برای آن حمله، همگی بهتنهایی تراکنشهای معتبری بودند. اما این سرقت از درک نحوه کارکرد قوانین در کنار هم و دریافتن این موضوع حاصل شد که هزینه خریدِ کنترلِ سیستم، بسیار کمتر از پول موجود برای برداشتن است.
حادثه هگینگ فیس برای زنجیرههای تأمین نرمافزار نیز حائز اهمیت است. توسعهدهندگان کریپتو به مخازن کد عمومی، خدمات ابری و ثبتکنندههای پکیج متکی هستند.
در حالیکه تست اوپنایآی نشان داد یک ماشین چگونه بخش میانی و طولانی یک نفوذ را کامل میکند، حملاتی مانند Drift و KelpDAO نشان میدهند که در پایان آن مسیر چه چیزی قرار دارد.
منبع: Coindesk

2 دیدگاه
Pingback: انویدیا بدون حضور OpenAI، آنتروپیک و گوگل یک ائتلاف امنیت هوش مصنوعی ۳۷ عضوی تشکیل داد! - اروویژن
Pingback: هوش مصنوعی و کلاهبرداری رمزارزی؛ هشدار جدید بنیاد سولانا! - اروویژن