گوگل هوش مصنوعی Gemini را به داخل تراشه Frozen v2 می‌برد

شهر سخت افزار
نویسنده: جواد نیک قلم
چهارشنبه 31 تیر 1405
گوگل هوش مصنوعی Gemini را به داخل تراشه Frozen v2 می‌برد
گوگل در حال توسعه یک تراشه اختصاصی با نام Frozen v2 است که بخشی از معماری مدل هوش مصنوعی Gemini را مستقیماً داخل سیلیکون خود جای می‌دهد. ظاهراً این تراشه می‌تواند در مقایسه با جدیدترین نسل شتاب‌دهنده‌های گوگل، بین 6 تا 10 برابر سریع‌تر عمل کند.

گوگل در حال توسعه یک تراشه اختصاصی با نام Frozen v2 است که بخشی از معماری مدل هوش مصنوعی Gemini را مستقیماً داخل سیلیکون خود جای می‌دهد. ظاهراً این تراشه می‌تواند در مقایسه با جدیدترین نسل شتاب‌دهنده‌های گوگل، بین 6 تا 10 برابر سریع‌تر عمل کند.

بر اساس گزارش tomshardware گوگل قصد دارد Frozen v2 را احتمالا تا سال 2028 وارد بازار کند. منابع آگاه اعلام کرده‌اند که یکی از دلایل توسعه این تراشه، کمبود شدید ظرفیت پردازشی هوش مصنوعی است؛ تا جایی که Google Cloud در برخی موارد مجبور شده درخواست‌های برخی مشتریان برای استفاده از منابع محاسباتی را رد کند.

تراشه‌های فعلی مانند TPUهای گوگل یا پردازنده‌های گرافیکی GPU می‌توانند مدل‌های مختلف هوش مصنوعی را اجرا کنند و بخش زیادی از تصمیم‌گیری‌های مربوط به اجرای مدل در زمان پردازش انجام می‌شود. اما Frozen v2 قرار است برخی از این مراحل را از قبل در سطح ترانزیستورهای تراشه پیاده‌سازی کند.

این رویکرد باعث کاهش تعداد عملیات موردنیاز برای اجرای مدل Gemini و کاهش جابه‌جایی داده‌ها بین بخش‌های مختلف تراشه می‌شود. نتیجه این تغییر می‌تواند کاهش قابل توجه تأخیر پاسخ‌دهی و سریع‌تر شدن مدل‌های هوش مصنوعی باشد.

البته نسخه اولیه پروژه Frozen حتی جاه‌طلبانه‌تر بود و قرار بود وزن‌های مدل Gemini نیز به‌صورت دائمی داخل تراشه قرار بگیرند. با این حال گوگل این ایده را کنار گذاشت، زیرا تراشه‌ای که فقط برای یک نسخه خاص از یک مدل هوش مصنوعی طراحی شود، عمر مفید کوتاهی خواهد داشت.

پیاده‌سازی معماری هوش مصنوعی Gemini روی تراشه Frozen v2

در Frozen v2، گوگل ظاهراً قصد دارد تنها معماری مدل را در سخت‌افزار ثابت کند و وزن‌های مدل همچنان قابل به‌روزرسانی باقی بمانند. به این ترتیب، تراشه می‌تواند با نسخه‌های جدید Gemini نیز کار کند؛ البته تا زمانی که گوگل از معماری مشابهی در نسل‌های آینده مدل خود استفاده کند.

گوگل برنامه‌ای برای تولید گسترده Frozen v2 ندارد و این پروژه بیشتر به‌عنوان آزمایشی برای نسل آینده تراشه‌های تخصصی هوش مصنوعی در نظر گرفته شده است. این تراشه در کنار خانواده TPU قرار خواهد گرفت و جایگزین آن نمی‌شود.

این اقدام در حالی انجام می‌شود که گوگل اخیراً نسل هشتم TPUهای خود را معرفی کرده و معماری این شتاب‌دهنده‌ها را به دو بخش جداگانه برای آموزش مدل‌های هوش مصنوعی (Training) و اجرای مدل‌ها (Inference) تقسیم کرده است.

ایده ساخت تراشه‌هایی که مدل هوش مصنوعی به‌صورت سخت‌افزاری داخل آن‌ها تعبیه شده باشد، پیش از این نیز توسط شرکت‌های دیگری دنبال شده است. برای مثال شرکت کانادایی Taalas تراشه HC1 را معرفی کرده که مدل Llama 3.1 8B را به‌صورت دائمی درون خود جای داده است.

نظرات کاربرانکپی متنکپی لینک