تیمی سهنفره از پژوهشگران امنیتی شرکت Hacktron AI با کمک هوش مصنوعی Claude موفق شد زنجیرهای از آسیبپذیریها را شناسایی کند که در نهایت امکان دسترسی به حسابهای چند کارمند OpenAI را فراهم کرد. این پژوهش در چارچوب بررسی امنیتی و برنامه کشف باگ انجام شد و OpenAI پس از دریافت گزارش، آسیبپذیریهای شناساییشده را برطرف کرد.
ماجرا از انجمن رسمی OpenAI آغاز شد؛ انجمنی که از نرمافزار Discourse استفاده میکند. پژوهشگران Hacktron در جریان پروژهای با نام «HEIF Heist» متوجه مشکلی در نحوه پردازش تصاویر HEIF شدند. در این زنجیره، پردازش تصویر به کتابخانههایی مانند ImageMagick و libheif وابسته بود و همین مسیر امکان سوءاستفاده از یک آسیبپذیری در پردازش فایل تصویری را ایجاد میکرد.
پژوهشگران ابتدا از Claude Opus 4.8 برای ساخت اکسپلویت استفاده کردند، اما این مدل نتوانست حمله را در پیکربندی موردنظر به نتیجه برساند. پس از عرضه Claude Opus 5، آنها همان مسئله را دوباره به مدل سپردند و طبق گزارش Hacktron، مدل جدید توانست در مدت کوتاهی به ساخت اکسپلویت عملی کمک کند.
با بهرهگیری از این آسیبپذیری، پژوهشگران توانستند به اجرای کد روی زیرساخت موردنظر دست پیدا کنند و سپس از یک آسیبپذیری دیگر برای تصاحب حسابهای ChatGPT و Codex استفاده کنند. در میان این حسابها، حساب یکی از کارکنان OpenAI نیز قرار داشت که Codex آن به سازمان GitHub شرکت متصل بود.
تیم Hacktron برای اثبات میزان دسترسی خود، بدون ورود به کدهای حساس داخلی، از حساب کارمند OpenAI برای ارسال یک Pull Request به مخزن داخلی شرکت استفاده کرد و سپس آزمایش را متوقف کرد. گزارشها میگویند این مخزن، با نام Monorepo، به بخشهایی از نرمافزار داخلی OpenAI مربوط میشود؛ با این حال پژوهشگران اعلام کردند که عمداً از بررسی کدهای داخلی خودداری کردهاند.
کل این فرایند کمتر از ۷۲ ساعت طول کشید و نشان داد مدلهای هوش مصنوعی جدید میتوانند بخشی از کارهایی را که پیشتر به تخصص و زمان قابلتوجهی نیاز داشت، بسیار سریعتر انجام دهند. پژوهشگران Hacktron همچنین اعلام کردهاند که پروژه HEIF Heist با هزینهای کمتر از ۳ هزار دلار توکن هوش مصنوعی قابلیت تطبیق با چندین سرویس و شرکت دیگر را نیز داشته است.
OpenAI پس از دریافت گزارش، مشکل مربوط به بخش خود را برطرف کرد و طبق گزارشها، مبلغ ۶۵۰۰ دلار به تیم Hacktron پرداخت شد. Discourse نیز برای مشکل مربوط به پردازش تصاویر و ایمنسازی آن بخش، اصلاحیه منتشر کرد. OpenAI تأکید کرده است که جایزه پرداختشده مربوط به یافته امنیتی در سمت OpenAI بوده و حمله به انجمن Discourse در محدوده برنامه باگبانتی این شرکت قرار نداشته است.
این اتفاق بار دیگر توجهها را به نقش مدلهای هوش مصنوعی در امنیت سایبری جلب کرده است. در این پرونده، Claude نه بهعنوان مهاجم مستقل، بلکه بهعنوان ابزاری در اختیار پژوهشگران امنیتی قرار گرفت و توانست در بخشی از فرایند توسعه اکسپلویت نقش داشته باشد؛ موضوعی که نشان میدهد افزایش توانایی مدلهای هوش مصنوعی میتواند هم برای تیمهای دفاعی و پژوهشگران امنیت و هم برای مهاجمان بالقوه اهمیت داشته باشد.