هوش مصنوعی رقیب به پژوهشگران برای نفوذ به زیرساختهای OpenAI کمک کرد

سه پژوهشگر امنیت سایبری با کمک مدل هوش مصنوعی Claude متعلق به شرکت Anthropic، زنجیرهای از آسیبپذیریها را شناسایی کردند که در کمتر از ۷۲ ساعت آنها را به حسابهای کارکنان OpenAI و در نهایت مخزن کد داخلی این شرکت رساند؛ آزمایشی که با گزارش مسئولانه آسیبپذیری و پرداخت جایزه ۶۵۰۰ دلاری از سوی OpenAI پایان یافت.
نفوذ از یک انجمن عمومی آغاز شد
پژوهشگران شرکت امنیت سایبری Hacktron بررسی خود را از انجمن عمومی OpenAI آغاز کردند. این انجمن از نرمافزار Discourse استفاده میکند و زنجیره آسیبپذیریهای کشفشده در نهایت امکان اجرای کد از راه دور و دسترسی فراتر از محیط اولیه را فراهم کرد.
یکی از نقاط کلیدی این زنجیره، آسیبپذیری موجود در کتابخانه libheif برای پردازش تصاویر HEIF و HEIC بود. پژوهشگران با استفاده از این نقص توانستند به محیط انجمن دسترسی پیدا کنند و سپس از یک ضعف در سامانه ورود یکپارچه OpenAI برای گسترش سطح دسترسی استفاده کردند.
Claude در ساخت اکسپلویت نقش داشت
آنچه این آزمایش را از یک بررسی امنیتی معمولی متمایز کرد، استفاده گسترده پژوهشگران از مدلهای هوش مصنوعی Anthropic بود. طبق گزارش Hacktron، نسخههای قبلی Claude در تولید یک اکسپلویت قابل اتکا با مشکل مواجه شده بودند، اما پس از استفاده از Claude Opus 5، پژوهشگران توانستند در مدت کوتاهی به اجرای موفق کد دست پیدا کنند.
کل مسیر از آغاز بررسی تا رسیدن به مخزن داخلی OpenAI کمتر از ۷۲ ساعت طول کشید و هزینه استفاده از توکنهای مدل در این فعالیت کمتر از ۳ هزار دلار اعلام شده است.
دسترسی به حساب کارکنان و مخزن داخلی
پس از عبور از مراحل اولیه، پژوهشگران توانستند به حسابهای ChatGPT و Codex برخی کارکنان OpenAI دسترسی پیدا کنند. یکی از این حسابها به سازمان GitHub شرکت متصل بود و همین ارتباط امکان دسترسی به مخزن داخلی کد را فراهم کرد.
پژوهشگران برای اثبات دسترسی، بدون مطالعه کدهای محرمانه، از حساب Codex یکی از کارکنان برای ایجاد یک Pull Request بیخطر در مخزن داخلی OpenAI استفاده کردند و پس از آن آزمایش را متوقف کردند. بنابراین، شواهد منتشرشده نشاندهنده توانایی ایجاد تغییر در مخزن بوده است، نه اینکه پژوهشگران کد داخلی را بررسی یا سرقت کرده باشند.
OpenAI آسیبپذیریها را برطرف کرد
Hacktron بلافاصله یافتههای خود را به OpenAI گزارش کرد. بر اساس گزارش منتشرشده از سوی پژوهشگران، OpenAI حدود ۱۴ ساعت پس از دریافت گزارش، بخش مربوط به زیرساخت خود را اصلاح کرد و در اول سپتامبر نیز ۶۵۰۰ دلار جایزه باگبانتی به تیم پرداخت. Discourse نیز برای آسیبپذیری مربوط به پردازش تصاویر، اصلاحات امنیتی منتشر کرد.
OpenAI همچنین تأکید کرده است که جایزه پرداختشده مربوط به آسیبپذیری سمت این شرکت بوده و آزمایش روی زیرساخت Discourse در محدوده برنامه باگبانتی OpenAI قرار نداشته است.
اهمیت ماجرا برای امنیت هوش مصنوعی
این آزمایش نشان میدهد مدلهای هوش مصنوعی میتوانند بخشی از فعالیتهای پیچیده امنیت سایبری را برای پژوهشگران سریعتر کنند؛ از بررسی آسیبپذیریها و تحلیل نتایج گرفته تا کمک به توسعه ابزارهای آزمایشی.
با این حال، این اتفاق به معنای هک مستقل OpenAI توسط یک مدل هوش مصنوعی نیست. سه پژوهشگر Hacktron در تمام مراحل نقش مستقیم داشتند و Claude بهعنوان ابزاری در فرایند تحقیق و توسعه اکسپلویت مورد استفاده قرار گرفت.
اهمیت اصلی این پرونده در کنار هم قرار گرفتن چند ضعف مختلف است؛ نقص موجود در پردازش تصاویر، تنظیمات احراز هویت و اتصال میان سرویسهای مختلف سازمانی در نهایت زنجیرهای ایجاد کردند که فاصله میان یک سرویس عمومی و یک مخزن داخلی حساس را بسیار کوتاه کرد.



