گوگل به‌دنبال اجرای مستقیم Gemini روی تراشه‌های اختصاصی

گوگل در حال توسعه نسل تازه‌ای از تراشه‌های سرور است که می‌تواند نحوه اجرای مدل‌های هوش مصنوعی Gemini را به‌طور قابل‌توجهی تغییر دهد. بر اساس گزارش رویترز به نقل از نشریه The Information، این پروژه با نام غیررسمی Frozen v2 شناخته می‌شود و قرار است بخش‌هایی از ساختار مدل Gemini را مستقیماً درون سخت‌افزار قرار دهد. 

در معماری‌های معمول، تراشه و مدل هوش مصنوعی دو بخش نسبتاً مستقل هستند؛ مدل روی سخت‌افزار بارگذاری شده و سپس پردازش می‌شود. اما در پروژه جدید گوگل، بخشی از اطلاعات و ساختار موردنیاز Gemini می‌تواند از ابتدا در طراحی تراشه جای بگیرد. این روش احتمالاً سرعت اجرای مدل را افزایش داده و مصرف انرژی مراکز داده را کاهش می‌دهد.

بهره‌وری احتمالی ۶ تا ۱۰ برابر بیشتر

گزارش‌ها نشان می‌دهند Frozen v2 ممکن است بر اساس معیار تعداد توکن پردازش‌شده به‌ازای هر واحد انرژی، ۶ تا ۱۰ برابر کارآمدتر از جدیدترین تراشه‌های سفارشی هوش مصنوعی گوگل باشد. البته این اعداد هنوز نهایی نیستند و طراحی تراشه همچنان در دست توسعه قرار دارد. 

افزایش بهره‌وری در این مقیاس می‌تواند اهمیت زیادی داشته باشد. اجرای مدل‌های بزرگ هوش مصنوعی به سرورهای قدرتمند، برق فراوان و سیستم‌های خنک‌کننده گسترده نیاز دارد. هرچه تعداد کاربران و درخواست‌های Gemini افزایش پیدا کند، هزینه تأمین این زیرساخت نیز بیشتر خواهد شد.

قرار دادن بخشی از مدل درون سخت‌افزار می‌تواند به گوگل کمک کند پاسخ‌های Gemini را با مصرف انرژی و هزینه پایین‌تری در اختیار کاربران قرار دهد.

آیا Frozen v2 جایگزین TPUهای گوگل می‌شود؟

طبق اطلاعات منتشرشده، پروژه Frozen قرار نیست جایگزین تراشه‌های TPU گوگل شود. این تراشه‌ها به‌عنوان یک خانواده سخت‌افزاری جداگانه در کنار TPUها فعالیت خواهند کرد و احتمالاً برای اجرای سریع‌تر و تخصصی‌تر مدل‌های مشخص Gemini مورد استفاده قرار می‌گیرند. 

گوگل سال‌هاست تراشه‌های TPU را برای آموزش و اجرای مدل‌های یادگیری ماشین طراحی می‌کند. Frozen v2 نشان می‌دهد این شرکت ممکن است یک قدم جلوتر برود و سخت‌افزاری بسازد که تنها برای هوش مصنوعی طراحی نشده، بلکه مستقیماً برای اجرای یک خانواده مشخص از مدل‌ها بهینه شده باشد.

عرضه احتمالی از سال ۲۰۲۸

گوگل ممکن است استفاده از این تراشه را از سال ۲۰۲۸ آغاز کند، اما مهندسان هنوز در حال نهایی‌کردن طراحی آن و مشخص‌کردن میزان اطلاعاتی هستند که باید مستقیماً داخل سخت‌افزار قرار بگیرد. بنابراین زمان عرضه، مشخصات فنی و میزان واقعی افزایش بهره‌وری ممکن است تغییر کند. 

گوگل نیز عرضه رسمی این تراشه را تأیید نکرده است. سخنگوی Google Cloud تنها اعلام کرده که تیم‌های این شرکت همواره در حال تحقیق و آزمایش نوآوری‌های تازه‌اند و گوگل با طراحی هم‌زمان نرم‌افزار و سخت‌افزار، تلاش می‌کند سیستم‌های خود را یکپارچه‌تر و بهینه‌تر کند. 

آغاز رقابت تازه در بازار تراشه‌های هوش مصنوعی

در صورت موفقیت Frozen v2، رقابت شرکت‌های هوش مصنوعی دیگر فقط بر سر ساخت مدل‌های قدرتمندتر نخواهد بود. شرکت‌هایی که بتوانند مدل، نرم‌افزار، سرور و تراشه اختصاصی خود را به‌صورت یکپارچه طراحی کنند، احتمالاً مدل‌هایشان را با سرعت بالاتر و هزینه کمتری در اختیار کاربران قرار خواهند داد.

انتشار این گزارش واکنش مثبتی نیز در بازار داشت و سهام شرکت مادر گوگل، Alphabet، در معاملات اولیه پس از انتشار خبر حدود ۳.۳ درصد افزایش یافت. بااین‌حال، تا زمان انتشار اطلاعات رسمی از سوی گوگل، Frozen v2 را باید یک پروژه در حال توسعه دانست، نه محصولی آماده عرضه.