گوگل در حال توسعه یک تراشه اختصاصی با نام Frozen v2 است که بخشی از معماری مدل هوش مصنوعی Gemini را مستقیماً داخل سیلیکون خود جای میدهد. ظاهراً این تراشه میتواند در مقایسه با جدیدترین نسل شتابدهندههای گوگل، بین 6 تا 10 برابر سریعتر عمل کند.
بر اساس گزارش tomshardware گوگل قصد دارد Frozen v2 را احتمالا تا سال 2028 وارد بازار کند. منابع آگاه اعلام کردهاند که یکی از دلایل توسعه این تراشه، کمبود شدید ظرفیت پردازشی هوش مصنوعی است؛ تا جایی که Google Cloud در برخی موارد مجبور شده درخواستهای برخی مشتریان برای استفاده از منابع محاسباتی را رد کند.
تراشههای فعلی مانند TPUهای گوگل یا پردازندههای گرافیکی GPU میتوانند مدلهای مختلف هوش مصنوعی را اجرا کنند و بخش زیادی از تصمیمگیریهای مربوط به اجرای مدل در زمان پردازش انجام میشود. اما Frozen v2 قرار است برخی از این مراحل را از قبل در سطح ترانزیستورهای تراشه پیادهسازی کند.
این رویکرد باعث کاهش تعداد عملیات موردنیاز برای اجرای مدل Gemini و کاهش جابهجایی دادهها بین بخشهای مختلف تراشه میشود. نتیجه این تغییر میتواند کاهش قابل توجه تأخیر پاسخدهی و سریعتر شدن مدلهای هوش مصنوعی باشد.
البته نسخه اولیه پروژه Frozen حتی جاهطلبانهتر بود و قرار بود وزنهای مدل Gemini نیز بهصورت دائمی داخل تراشه قرار بگیرند. با این حال گوگل این ایده را کنار گذاشت، زیرا تراشهای که فقط برای یک نسخه خاص از یک مدل هوش مصنوعی طراحی شود، عمر مفید کوتاهی خواهد داشت.
پیادهسازی معماری هوش مصنوعی Gemini روی تراشه Frozen v2
# در Frozen v2، گوگل ظاهراً قصد دارد تنها معماری مدل را در سختافزار ثابت کند و وزنهای مدل همچنان قابل بهروزرسانی باقی بمانند. به این ترتیب، تراشه میتواند با نسخههای جدید Gemini نیز کار کند؛ البته تا زمانی که گوگل از معماری مشابهی در نسلهای آینده مدل خود استفاده کند.
گوگل برنامهای برای تولید گسترده Frozen v2 ندارد و این پروژه بیشتر بهعنوان آزمایشی برای نسل آینده تراشههای تخصصی هوش مصنوعی در نظر گرفته شده است. این تراشه در کنار خانواده TPU قرار خواهد گرفت و جایگزین آن نمیشود.
این اقدام در حالی انجام میشود که گوگل اخیراً نسل هشتم TPUهای خود را معرفی کرده و معماری این شتابدهندهها را به دو بخش جداگانه برای آموزش مدلهای هوش مصنوعی (Training) و اجرای مدلها (Inference) تقسیم کرده است.
ایده ساخت تراشههایی که مدل هوش مصنوعی بهصورت سختافزاری داخل آنها تعبیه شده باشد، پیش از این نیز توسط شرکتهای دیگری دنبال شده است. برای مثال شرکت کانادایی Taalas تراشه HC1 را معرفی کرده که مدل Llama 3.1 8B را بهصورت دائمی درون خود جای داده است.