مدلی از هوش مصنوعی شرکت آنتروپیک در جریان یک آزمایش، اطلاعاتی ساختگی درباره یک پرونده قتل حلنشده به پلیس فیلادلفیا ارسال کرد؛ اتفاقی که نگرانیها درباره عملکرد ابزارهای هوش مصنوعیِ قادر به انجام خودکار کارها در اینترنت را افزایش داده است.
طبق گزارش پلیس، این پیام در ۱۸ ژوئیه ۲۰۲۶ از طریق وبسایت دریافت اطلاعات درباره قتلهای حلنشده فیلادلفیا ارسال شد. مدل هوش مصنوعی طوری پیام داده بود که انگار فردی واقعی اطلاعاتی درباره پرونده دارد و میتواند به تحقیقات کمک کند؛ درحالیکه اطلاعات ارائهشده واقعی نبود.
خوشبختانه پیام بهعنوان هرزنامه شناسایی شد و به مرحله بررسی کارآگاهان نرسید. پلیس اعلام کرده شواهدی از نفوذ به سامانههای داخلی یا دسترسی غیرمجاز به اطلاعات این اداره پیدا نشده است.
آنتروپیک توضیح داده که این اتفاق هنگام آزمایش خودکار مدلی از خانواده کلود رخ داده است؛ آزمایشی که در آن هوش مصنوعی با وبسایتهای تصادفی تعامل میکرد. شرکت در دستورالعملهای آزمایش، ارسال فرمهای اینترنتی را بهطور مشخص ممنوع نکرده بود. آنتروپیک پس از شناسایی ماجرا، فرایند آزمایشی مربوط را متوقف کرد.
نکته بحثبرانگیز، فاصله زمانی میان وقوع حادثه و اطلاعرسانی است. آنتروپیک در ۲۸ سپتامبر متوجه ارسال پیام شد، اما پلیس فیلادلفیا در ۷ اکتبر از ماجرا باخبر شد. مقامهای پلیس این تأخیر نزدیک به دوماهه را غیرقابلقبول دانستند و خواستار تقویت سازوکارهای ایمنی شدند.
این حادثه بهمعنای آن نیست که هوش مصنوعی عمداً تصمیم گرفته جرمی را مختل کند؛ ماجرا در جریان آزمایش رخ داده و ضعف در محدودسازی رفتار سامانه، نظارت و کنترل ارسال اطلاعات را برجسته میکند. با گسترش عاملهای هوش مصنوعی که میتوانند مستقیماً با وبسایتها تعامل کنند، جلوگیری از ارسال اطلاعات جعلی یا انجام اقدامات ناخواسته به یکی از چالشهای جدی شرکتهای فناوری تبدیل شده است.