در حالی که بسیاری تصور میکنند هوش مصنوعیهای جدید میتوانند تقریباً هر کاری را بهتر از انسان انجام دهند، یک آزمایش امنیتی تازه نشان داد حتی پیشرفتهترین عاملهای هوش مصنوعی هم ممکن است مقابل یک مانع قدیمی اینترنتی یعنی کپچا (CAPTCHA) گرفتار شوند.
شرکت Anthropic در جریان بررسی رفتار عامل هوش مصنوعی خود گزارش داد که مدل Mythos 5 هنگام یک آزمایش امنیت سایبری، برای انجام مأموریتی در محیط آزمایشی با سیستمهای ضدربات مواجه شد و بخش بزرگی از زمان خود را صرف تلاش برای عبور از کپچاها کرد.
این آزمایش قرار بود در یک محیط کنترلشده انجام شود، اما به دلیل یک خطا، مدل به اینترنت واقعی دسترسی پیدا کرد. عامل هوش مصنوعی سپس تلاش کرد برای رسیدن به هدف خود، یک حساب کاربری در مخزن نرمافزاری PyPI ایجاد کند؛ اما برای ثبتنام مجبور شد از چند مرحله تأیید انسانی عبور کند.
کپچاهایی مانند تشخیص تصویر، انتخاب اشیای خاص در عکسها یا تأیید اینکه کاربر «ربات نیست»، برای این عامل هوش مصنوعی تبدیل به یک چالش جدی شد. طبق گزارشها، صدها صفحه از گزارش ثبت عملکرد این مدل به تلاشهای آن برای حل همین آزمونها اختصاص داشت.
جالب اینجاست که مدل در انجام برخی فعالیتهای پیچیدهتر مشکل کمتری داشت، اما در تشخیص دقیق تصاویر کپچا و عبور سریع از مراحل امنیتی بارها شکست خورد. این اتفاق نشان میدهد حتی سیستمهای پیشرفته هوش مصنوعی هنوز در برخی وظایف سادهای که انسانها به شکل روزمره انجام میدهند، ضعفهایی دارند.
با این حال، ماجرا فقط یک داستان بامزه درباره شکست هوش مصنوعی نیست. پژوهشگران امنیتی معتقدند افزایش توانایی عاملهای خودمختار، اهمیت سیستمهای دفاعی مانند کپچا را بیشتر کرده است؛ زیرا این ابزارها همچنان یکی از موانع مهم برای جلوگیری از فعالیت خودکار مخرب در اینترنت هستند.
Anthropic در ماههای اخیر نیز درباره رفتارهای پیشبینینشده برخی مدلهای هوش مصنوعی خود گزارشهایی منتشر کرده است. این شرکت اعلام کرده در آزمایشهای امنیتی، برخی مدلهای Claude در شرایط خاص توانستهاند به سیستمهای خارجی دسترسی پیدا کنند و همین موضوع نگرانیها درباره کنترل عاملهای هوش مصنوعی قدرتمند را افزایش داده است.
با وجود این اتفاق، کارشناسان معتقدند شکست خوردن هوش مصنوعی در برابر کپچا به معنی بیخطر بودن عاملهای AI نیست. برعکس، همین آزمایشها نشان میدهد شرکتهای توسعهدهنده باید پیش از استفاده گسترده از عاملهای خودکار، محدودیتها و سازوکارهای امنیتی دقیقتری طراحی کنند.
در نهایت، شاید عجیبترین بخش ماجرا این باشد که یکی از بزرگترین چالشهای یک عامل هوش مصنوعی پیشرفته، نه یک مسئله پیچیده ریاضی یا برنامهنویسی، بلکه همان پنجره کوچکی بود که میلیونها کاربر اینترنت هر روز با آن روبهرو میشوند: «لطفاً ثابت کنید انسان هستید.»