ترندز تک

گوگل روی تراشه هوش مصنوعی جدیدی با معماری مدل‌های جمینای کار می‌کند

گوگل روی تراشه هوش مصنوعی جدیدی با معماری مدل‌های جمینای کار می‌کند
بازدید 4
0

طبق گزارشی که اخیراً توسط نشریه The Information و به نقل از دو شخص مطلع منتشر شده، گوگل درحال توسعه یک تراشه سرور با نام غیررسمی «Frozen v2» است که بخشی از معماری مدل جمینای را مستقیماً روی سیلیکون حک می‌کند. مهندسان این پروژه پیش‌بینی کرده‌اند که این تراشه می‌تواند به ازای هر وات مصرف انرژی، بین ۶ تا ۱۰ برابر بیشتر از جدیدترین نسل واحدهای پردازش تنسور (TPU) گوگل، توکن پردازش کند و زمان‌بندی عرضه آن برای سال ۲۰۲۸ هدف‌گذاری شده است. دو منبع آگاه اظهار داشتند که این پروژه واکنشی به کمبود شدید پردازش‌های هوش مصنوعی است؛ به طوری که گوگل کلود حتی مجبور شده است قرارداد با مشتریان خارجی را رد کند.

یک TPU، درست مانند پردازشگرهای گرافیکی (GPU)، هر مدلی را که روی آن بارگذاری شود اجرا می‌کند؛ به این معنا که سخت‌افزار هنگام تعامل با مدل، تصمیمات زمان‌بری را در حین اجرا (Runtime) اتخاذ می‌کند. تراشه Frozen v2 برخی از تصمیمات مربوط به جمینای را به‌طور ثابت در ترانزیستورها تعبیه کرده و بدین ترتیب تعداد مراحل انجام‌شده توسط تراشه و حجم داده‌های جابه‌جا شده در هر درخواست را کاهش می‌دهد. یکی از منابع آگاه گفته این ویژگی می‌تواند تأخیر پاسخگویی را به اندازه کافی کاهش دهد تا کاربردهای جدیدی امکان‌پذیر شوند.

طراحی تراشه‌ای هماهنگ با معماری مدل‌های هوش مصنوعی جمینای گوگل

طرح اولیه Frozen که توسط «جف دین»، دانشمند ارشد گوگل دیپ‌مایند، رهبری می‌شد، فراتر می‌رفت و قصد داشت حتی وزن‌های خود مدل جمینای را نیز درون تراشه تعبیه کند. طبق گزارش مذکور، گوگل آن پیشنهاد را کنار گذاشت زیرا سیلیکونی که تنها به یک نسخه از مدل گره خورده باشد، چرخه عمر بسیار کوتاهی خواهد داشت. تراشه Frozen v2 به جای وزن‌ها، معماری را در بر می‌گیرد و وزن‌ها را قابل به‌روزرسانی نگه می‌دارد، به طوری که تراشه در نسخه‌های مختلف جمینای قابل استفاده باقی بماند؛ البته مشروط بر اینکه گوگل آن‌ها را بر اساس همان معماری قبلی بسازد.

گوگل روی تراشه هوش مصنوعی جدیدی با معماری مدل‌های جمینای کار می‌کند

گوگل برنامه‌ای برای تولید تراشه Frozen v2 در حجمی مشابه TPUها ندارد و این نسل را تا حدی به عنوان یک پروسه آزمایشی برای سیلیکون‌های تخصصی‌تر همزمان با ثبات طراحی مدل‌ها می‌داند. این تراشه در کنار خط تولید TPU قرار می‌گیرد و جایگزین آن نخواهد شد؛ خط تولیدی که با معرفی نسل هشتم خود در رویداد Cloud Next در ماه آوریل، به مدل‌های مجزای آموزش و استنتاج تقسیم شد. هدف‌گذاری سال ۲۰۲۸ برای عرضه این تراشه همچنین مصادف با سالی است که گفته شده گوگل قرارداد بسته‌بندی بیش از ۳ میلیون تراشه TPU را با اینتل منعقد کرده است.

گوگل روی تراشه هوش مصنوعی جدیدی با معماری مدل‌های جمینای کار می‌کند
READ  آشنایی با موبایل های هوشمند هواوی در طرح عیدِ دیدنی

استنتاج سخت‌افزاری در سطح مدل پیش از این نیز در نمونه‌های نمایشی وجود داشته است. شرکت نوپای «Taalas» مستقر در تورنتو که بیش از ۲۰۰ میلیون دلار سرمایه جذب کرده، در ماه فوریه تراشه HC1 خود را با مدل Llama 3.1 8B راه‌اندازی کرد. این شرکت ادعا می‌کند که تراشه‌اش سرعت اجرای ۱۷,۰۰۰ توکن بر ثانیه را بدون داشتن حافظه HBM روی پکیج ارائه می‌دهد. در همین حال، انویدیا در ماه دسامبر قراردادی ۲۰ میلیارد دلاری برای دریافت لایسنس فناوری از شرکت Groq منعقد کرد.

گوگل هنوز این پروژه را تأیید نکرده است و سخنگوی این شرکت به The Information گفته که همه پروژه‌ها وارد چرخه تولید نمی‌شوند.

اشتراک گذاری

نظرات کاربران

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *

3 × چهار =