شرکت Anthropic در گزارشی تازه درباره آینده هوش مصنوعی، از پیشرفت سریع سیستمهای این شرکت در انجام مستقل بخشهایی از فرایند توسعه مدلهای هوش مصنوعی خبر داده است. این شرکت میگوید سهم فزایندهای از کارهایی که پیشتر توسط مهندسان انجام میشد، اکنون به سیستمهای هوش مصنوعی سپرده شده است.
مفهوم اصلی این گزارش «خودبهبودی بازگشتی» (Recursive Self-Improvement) است؛ وضعیتی که در آن یک سیستم هوش مصنوعی بتواند نهتنها در انجام وظایف مختلف بهتر شود، بلکه مدلهای بعدی خود را طراحی، توسعه و آموزش دهد. Anthropic تأکید میکند که هنوز به چنین مرحلهای نرسیدهایم، اما این اتفاق ممکن است زودتر از آنچه بسیاری از سازمانها برای آن آماده هستند رخ دهد.
یکی از مهمترین دادههای منتشرشده این است که تا ماه مه ۲۰۲۶، بیش از ۸۰ درصد کدی که در پایگاه کد Anthropic ادغام شده، توسط Claude نوشته شده است. این رقم در سالهای گذشته بسیار پایینتر بود و رشد آن نشان میدهد مدلهای هوش مصنوعی در چرخه توسعه نرمافزار نقش بسیار پررنگتری پیدا کردهاند.
Anthropic همچنین اعلام کرده است که در سهماهه دوم سال ۲۰۲۶، یک مهندس معمولی این شرکت به کمک ابزارهای هوش مصنوعی میتوانسته حدود ۸ برابر بیشتر از سال ۲۰۲۴ کد در روز تولید کند. البته خود شرکت هشدار داده که تعداد خطوط کد معیار کاملی برای سنجش بهرهوری نیست، اما روند کلی نشاندهنده افزایش قابل توجه توانایی سیستمهای هوش مصنوعی است.
Claude در برخی آزمایشها حتی توانسته است بخشهایی از فرایند تحقیقاتی را به شکل نسبتاً مستقل انجام دهد. در یک پروژه تحقیقاتی، عاملهای مجهز به Claude توانستند یک مسئله باز در حوزه ایمنی هوش مصنوعی را بررسی کنند، فرضیه ارائه دهند، آزمایش انجام دهند، نتایج را با عاملهای دیگر به اشتراک بگذارند و آزمایشهای بعدی را طراحی کنند.
در یکی از این آزمایشها، عاملهای هوش مصنوعی توانستند حدود ۹۷ درصد از فاصله عملکردی یک مسئله تحقیقاتی را پوشش دهند؛ در حالی که دو پژوهشگر انسانی در مدت حدود یک هفته نزدیک به ۲۳ درصد از این فاصله را پوشش داده بودند. با این حال، Anthropic تأکید کرده که انسانها همچنان مسئله و معیار ارزیابی را تعیین کرده بودند و نتیجه آزمایش محدودیتهایی دارد.
یکی دیگر از یافتههای قابل توجه به توانایی Claude در بهینهسازی کدهای مربوط به آموزش مدلهای هوش مصنوعی مربوط میشود. طبق دادههای Anthropic، Claude در یک آزمایش توانسته میانگین سرعت اجرای کد را از حدود سه برابر در سال ۲۰۲۵ به حدود ۵۲ برابر در سال ۲۰۲۶ برساند؛ در حالی که یک پژوهشگر انسانی ماهر برای رسیدن به بهبود حدود چهاربرابری به چند ساعت زمان نیاز داشت.
با وجود این پیشرفتها، Anthropic هنوز نمیگوید هوش مصنوعی به مرحله خودبهبودی بازگشتی کامل رسیده است. سناریوی نهایی زمانی محقق میشود که سیستمهای هوش مصنوعی بتوانند بهطور مستقل مدلهای جدید را طراحی و آموزش دهند و سپس همان مدلهای جدید نیز در توسعه نسل بعدی مشارکت کنند؛ در چنین شرایطی، سرعت پیشرفت هوش مصنوعی میتواند تا حد زیادی از کنترل مستقیم انسان خارج شود.
این موضوع علاوه بر فرصتهای بزرگ علمی و فناورانه، نگرانیهای جدی درباره کنترل، ایمنی و نظارت بر سیستمهای هوش مصنوعی ایجاد میکند. Anthropic معتقد است اگر سیستمها روزی بتوانند بهطور کامل نسل بعدی خود را توسعه دهند، نحوه نظارت، ارزیابی و ایمنسازی آنها اهمیت بسیار بیشتری پیدا خواهد کرد.
در همین راستا، Anthropic اعلام کرده است که قصد دارد در ماههای آینده با پژوهشگران، سیاستگذاران، جامعه مدنی و شرکتهای دیگر درباره پیامدهای خودبهبودی بازگشتی و راههای هماهنگی برای مدیریت این فناوری گفتوگو کند. بنابراین، اگرچه «هوش مصنوعی که خودش را میسازد» هنوز واقعیت نیست، دادههای جدید نشان میدهند بخشهایی از مسیر رسیدن به چنین سناریویی در حال شکلگیری است.
خودبهبودی بازگشتی هوش مصنوعی چیست؟
به شرایطی گفته میشود که یک سیستم AI بتواند خودش را بهبود دهد و حتی نسلهای بعدی مدلهای هوش مصنوعی را طراحی و توسعه دهد.
آیا هوش مصنوعی اکنون میتواند خودش را بهطور کامل بهبود دهد؟
خیر. Anthropic صراحتاً میگوید خودبهبودی بازگشتی کامل هنوز محقق نشده است.
Claude چه مقدار از کد Anthropic را مینویسد؟
طبق گزارش Anthropic، تا مه ۲۰۲۶ بیش از ۸۰ درصد کدی که در پایگاه کد این شرکت ادغام شده توسط Claude نوشته شده است.
آیا این پیشرفت برای انسان خطرناک است؟
خودبهبودی بازگشتی کامل میتواند چالشهای مهمی برای کنترل و ایمنی ایجاد کند، اما رسیدن به آن هنوز قطعی نیست و Anthropic نیز آن را یک سناریوی احتمالی آینده میداند، نه یک واقعیت فعلی.
آیا AI میتواند جای پژوهشگران هوش مصنوعی را بگیرد؟
در برخی وظایف مشخص، سیستمهای AI اکنون میتوانند ایدهپردازی، اجرای آزمایش و تحلیل نتایج را انجام دهند؛ با این حال، تعیین اهداف و قضاوتهای سطح بالاتر همچنان به انسان وابسته است.