فناوری

هوش مصنوعی رقیب به پژوهشگران برای نفوذ به زیرساخت‌های OpenAI کمک کرد

سه پژوهشگر امنیت سایبری با کمک مدل هوش مصنوعی Claude متعلق به شرکت Anthropic، زنجیره‌ای از آسیب‌پذیری‌ها را شناسایی کردند که در کمتر از ۷۲ ساعت آنها را به حساب‌های کارکنان OpenAI و در نهایت مخزن کد داخلی این شرکت رساند؛ آزمایشی که با گزارش مسئولانه آسیب‌پذیری و پرداخت جایزه ۶۵۰۰ دلاری از سوی OpenAI پایان یافت.

نفوذ از یک انجمن عمومی آغاز شد

پژوهشگران شرکت امنیت سایبری Hacktron بررسی خود را از انجمن عمومی OpenAI آغاز کردند. این انجمن از نرم‌افزار Discourse استفاده می‌کند و زنجیره آسیب‌پذیری‌های کشف‌شده در نهایت امکان اجرای کد از راه دور و دسترسی فراتر از محیط اولیه را فراهم کرد.

یکی از نقاط کلیدی این زنجیره، آسیب‌پذیری موجود در کتابخانه libheif برای پردازش تصاویر HEIF و HEIC بود. پژوهشگران با استفاده از این نقص توانستند به محیط انجمن دسترسی پیدا کنند و سپس از یک ضعف در سامانه ورود یکپارچه OpenAI برای گسترش سطح دسترسی استفاده کردند.

Claude در ساخت اکسپلویت نقش داشت

آنچه این آزمایش را از یک بررسی امنیتی معمولی متمایز کرد، استفاده گسترده پژوهشگران از مدل‌های هوش مصنوعی Anthropic بود. طبق گزارش Hacktron، نسخه‌های قبلی Claude در تولید یک اکسپلویت قابل اتکا با مشکل مواجه شده بودند، اما پس از استفاده از Claude Opus 5، پژوهشگران توانستند در مدت کوتاهی به اجرای موفق کد دست پیدا کنند.

کل مسیر از آغاز بررسی تا رسیدن به مخزن داخلی OpenAI کمتر از ۷۲ ساعت طول کشید و هزینه استفاده از توکن‌های مدل در این فعالیت کمتر از ۳ هزار دلار اعلام شده است.

دسترسی به حساب کارکنان و مخزن داخلی

پس از عبور از مراحل اولیه، پژوهشگران توانستند به حساب‌های ChatGPT و Codex برخی کارکنان OpenAI دسترسی پیدا کنند. یکی از این حساب‌ها به سازمان GitHub شرکت متصل بود و همین ارتباط امکان دسترسی به مخزن داخلی کد را فراهم کرد.

پژوهشگران برای اثبات دسترسی، بدون مطالعه کدهای محرمانه، از حساب Codex یکی از کارکنان برای ایجاد یک Pull Request بی‌خطر در مخزن داخلی OpenAI استفاده کردند و پس از آن آزمایش را متوقف کردند. بنابراین، شواهد منتشرشده نشان‌دهنده توانایی ایجاد تغییر در مخزن بوده است، نه اینکه پژوهشگران کد داخلی را بررسی یا سرقت کرده باشند.

OpenAI آسیب‌پذیری‌ها را برطرف کرد

Hacktron بلافاصله یافته‌های خود را به OpenAI گزارش کرد. بر اساس گزارش منتشرشده از سوی پژوهشگران، OpenAI حدود ۱۴ ساعت پس از دریافت گزارش، بخش مربوط به زیرساخت خود را اصلاح کرد و در اول سپتامبر نیز ۶۵۰۰ دلار جایزه باگ‌بانتی به تیم پرداخت. Discourse نیز برای آسیب‌پذیری مربوط به پردازش تصاویر، اصلاحات امنیتی منتشر کرد.

OpenAI همچنین تأکید کرده است که جایزه پرداخت‌شده مربوط به آسیب‌پذیری سمت این شرکت بوده و آزمایش روی زیرساخت Discourse در محدوده برنامه باگ‌بانتی OpenAI قرار نداشته است.

اهمیت ماجرا برای امنیت هوش مصنوعی

این آزمایش نشان می‌دهد مدل‌های هوش مصنوعی می‌توانند بخشی از فعالیت‌های پیچیده امنیت سایبری را برای پژوهشگران سریع‌تر کنند؛ از بررسی آسیب‌پذیری‌ها و تحلیل نتایج گرفته تا کمک به توسعه ابزارهای آزمایشی.

با این حال، این اتفاق به معنای هک مستقل OpenAI توسط یک مدل هوش مصنوعی نیست. سه پژوهشگر Hacktron در تمام مراحل نقش مستقیم داشتند و Claude به‌عنوان ابزاری در فرایند تحقیق و توسعه اکسپلویت مورد استفاده قرار گرفت.

اهمیت اصلی این پرونده در کنار هم قرار گرفتن چند ضعف مختلف است؛ نقص موجود در پردازش تصاویر، تنظیمات احراز هویت و اتصال میان سرویس‌های مختلف سازمانی در نهایت زنجیره‌ای ایجاد کردند که فاصله میان یک سرویس عمومی و یک مخزن داخلی حساس را بسیار کوتاه کرد.

برای شما

نوشته های مشابه

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *