OpenAI مدل جدید GPT-6 Astra را معرفی کرده؛ مدلی که قرار نیست فقط پاسخهای دقیقتر و استدلال بهتری ارائه دهد، بلکه میتواند مستقیماً با کامپیوتر، مرورگر و نرمافزارها کار کند و مجموعهای از وظایف چندمرحلهای را از ابتدا تا انتها انجام دهد.
OpenAI این مدل را هوشمندترین و همراستاترین مدل خود معرفی میکند، اما اهمیت اصلی Astra شاید جای دیگری باشد: فاصله میان «گفتن اینکه چه کاری انجام شود» و «انجام شدن خود کار» در حال کمتر شدن است.
GPT-6 Astra چه چیزی را تغییر میدهد؟
# در نسلهای قبلی هوش مصنوعی، کاربر معمولاً باید مرحلهبهمرحله توضیح میداد که چه کاری انجام شود و سپس نتیجه را دریافت میکرد. Astra برای تغییر همین الگو طراحی شده است. این مدل میتواند با مرورگرها و نرمافزارها کار کند، فرمهای آنلاین را پر کند، اطلاعات سامانههای مدیریت مشتری را بهروزرسانی کند، تقویم را مدیریت کند، در وب تحقیق انجام دهد و حتی نرمافزار یا وبسایت ایجادشده را آزمایش و اشکالزدایی کند.
به زبان ساده، کاربر میتواند بیشتر روی هدف نهایی تمرکز کند و بخش قابلتوجهی از مراحل اجرایی را به مدل بسپارد. همین ویژگی است که Astra را از یک چتبات صرف فراتر میبرد و آن را به نمونهای از نسل جدید عاملهای هوش مصنوعی تبدیل میکند؛ سیستمهایی که قرار است علاوه بر فکر کردن، بتوانند از ابزارهای دیجیتال برای انجام کار استفاده کنند.
OpenAI میگوید این مدل در شبیهسازیهای OSWorld 2.0 توانسته با عملکرد بالاتر، وظایف مربوط به کار با کامپیوتر را حدود ۴۷ درصد سریعتر از GPT-5.6 Sol انجام دهد. در برخی سناریوهای کاری نیز اختلاف زمان بسیار چشمگیر بوده است؛ برای نمونه، شرکت میگوید زمان لازم برای تحقیق درباره پرستار حیوانات خانگی از حدود ۳۰ دقیقه برای انسان به ۵ دقیقه و ۲۷ ثانیه با Astra کاهش یافته است.
GPT-6 Astra در بنچمارکها چه عملکردی دارد؟
# OpenAI برای نشان دادن تواناییهای Astra مجموعهای از نتایج آزمایشگاهی را منتشر کرده است. این مدل در FrontierMath Tier 4 به امتیاز ۹۸ درصد و در ARC-AGI-3 به ۹۹.۹ درصد رسیده و در ExploitBench نیز امتیاز ۱۰۰ درصد را اعلام کرده است. البته این اعداد باید در چارچوب روش اجرای هر آزمون و شرایط دسترسی مدل به ابزارها بررسی شوند و بهتنهایی ثابت نمیکنند که مدل در تمام کاربردهای واقعی از انسان یا همه رقبا بهتر است.
اهمیت دیگر Astra در ترکیب چند توانایی مختلف است. مدل میتواند استدلال، جستوجوی وب، کار با کامپیوتر، برنامهنویسی، بررسی نتیجه و تولید خروجی نهایی را در یک جریان کاری کنار هم قرار دهد. به همین دلیل، کاربرد آن فقط به تولید متن یا پاسخ دادن به پرسشها محدود نمیشود و OpenAI آن را برای کارهایی مانند تحقیق، توسعه نرمافزار، فعالیتهای علمی و کارهای حرفهای پیچیده هدف گرفته است.
یک قابلیت قدرتمند که میتواند دردسرساز هم باشد
# یکی از مهمترین بخشهای معرفی Astra به امنیت سایبری مربوط میشود. OpenAI میگوید این مدل نخستین مدل این شرکت است که در چارچوب Preparedness Framework به سطح Critical در تواناییهای سایبری رسیده است. طبق ارزیابی خود OpenAI، Astra در صورت دسترسی به ابزارهای مناسب میتواند آسیبپذیریهای ناشناخته را شناسایی و حتی مسیرهای بهرهبرداری از آنها را بدون هدایت انسان در تکتک مراحل ایجاد کند.
این توانایی یک مزیت دفاعی مهم و همزمان یک ریسک جدی است. همان مدلی که میتواند به متخصصان امنیت برای پیدا کردن سریعتر نقاط ضعف کمک کند، در صورت استفاده نادرست میتواند اجرای حملات پیچیده را نیز سادهتر کند. به همین دلیل OpenAI برای Astra تدابیر امنیتی سختگیرانهتری در نظر گرفته و دسترسی به برخی قابلیتهای سایبری آن را محدود کرده است.
آیا GPT-6 Astra واقعاً آغاز عصر AGI است؟
# گرگ براکمن، رئیس OpenAI، Astra را گامی مهم در مسیر هوش جامع مصنوعی یا AGI توصیف کرده است. با این حال، نباید این موضوع را با یک واقعیت قطعی اشتباه گرفت. هنوز تعریف واحد و مورد توافقی برای AGI وجود ندارد و صرف رسیدن یک مدل به امتیازهای بالا در چند بنچمارک بهتنهایی به معنای اثبات AGI نیست.
با این حال، اتفاق مهمی در حال رخ دادن است. رقابت مدلهای هوش مصنوعی دیگر فقط بر سر این نیست که کدام مدل پاسخ بهتری به یک سؤال میدهد. مدلهای جدید باید بتوانند از مرورگر، نرمافزار، کد و ابزارهای مختلف استفاده کنند، نتیجه کار خود را بررسی کنند و در صورت نیاز مسیرشان را تغییر دهند. Astra دقیقاً در همین نقطه قرار دارد.
مشکل بزرگتر: هرچه مدل قدرتمندتر میشود، نظارت سختتر است
# اینجا بخش کمتر تبلیغاتی ماجرا اهمیت پیدا میکند. رویترز گزارش داده است که OpenAI همزمان با معرفی Astra درباره دشوارتر شدن نظارت بر مدلهای بسیار توانمند هشدار داده است. جاکوب پاچوکی، دانشمند ارشد OpenAI، گفته با افزایش توانایی مدلها، فهم دقیق اینکه آنها چه کارهایی میتوانند انجام دهند دشوارتر میشود و افزایش هوش لزوماً به معنای افزایش همزمان همراستایی نیست.
این نگرانی بیدلیل هم نیست. انتشار Astra در شرایطی انجام شده که OpenAI و سایر شرکتهای فعال در حوزه هوش مصنوعی با پرسشهای جدی درباره رفتار عاملهای خودمختار روبهرو هستند. رویترز به رخداد آزمایشی مربوط به دسترسی عاملهای OpenAI به سامانههای Hugging Face نیز اشاره کرده است؛ اتفاقی که حساسیتها درباره میزان استقلال مدلهای جدید را افزایش داده است.
در نتیجه، شاید مهمترین ویژگی GPT-6 Astra نه امتیاز ۹۸ یا ۹۹.۹ درصدی در یک بنچمارک، بلکه تغییر رابطه کاربر با هوش مصنوعی باشد. اگر مدلهایی مانند Astra بتوانند در دنیای واقعی با دقت و امنیت کافی کارهای چندمرحلهای را انجام دهند، هوش مصنوعی از ابزاری که عمدتاً پاسخ میدهد به ابزاری تبدیل میشود که وظیفه را تحویل میگیرد و انجام میدهد.
OpenAI عرضه GPT-6 Astra را ابتدا برای گروه محدودی از سازمانها آغاز کرده و اعلام کرده دسترسی آن در ادامه برای کاربران پلنهای Plus، Pro، Business و Enterprise و همچنین از طریق API گسترش پیدا میکند. نسخه API نیز با نام gpt-6-astra ارائه شده و پنجره زمینه آن ۱.۰۵ میلیون توکن و حداکثر خروجی آن ۱۲۸ هزار توکن اعلام شده است.
در نهایت، هنوز برای قضاوت درباره اینکه GPT-6 Astra واقعاً چقدر به AGI نزدیک شده یا در استفاده روزمره تا چه اندازه قابل اعتماد است، زود است. اما یک تغییر مهم را نمیتوان نادیده گرفت: مسابقه هوش مصنوعی وارد مرحلهای شده که برنده فقط مدلی نیست که بهتر جواب میدهد؛ مدلی است که بتواند کار واقعی را با کمترین دخالت انسان، درست و ایمن به پایان برساند.