ترندز تک

تراشه 5 نانومتری علی‌بابا اکنون مدل Qwen-3.8 را به صورت بومی اجرا می‌کند

تصویر پیدا نشد !
بازدید 4
0

به‌نظر می‌رسد علی‌بابا با ارائه پشتیبانی روز صفر از مدل هوش مصنوعی فوق‌العاده توانمند Qwen-3.8 27B روی تراشه اختصاصی RISC-V خود به نام XuanTie C950، درحال الگوبرداری از استراتژی انویدیا است.

علی‌بابا از تراشه XuanTie C950 در مارس ۲۰۲۶ رونمایی کرد و آن را به عنوان محصولی بر پایه معماری RISC-V برای هوش مصنوعی لبه بازاریابی نمود. برخلاف تراشه‌های ASIC معمول، XuanTie C950 برای پردازش‌های هوش مصنوعی متکی به کارت‌های گرافیک نیست. در عوض، این تراشه اساساً یک پردازنده ۶۴ بیتی RISC-V در سطح سرور است که از ۶۴ هسته پردازشی روی یک تکه سیلیکون بهره می‌برد، فرکانس کاری آن تا ۳.۲۰ گیگاهرتز قابل ارتقا است و خوشه‌های متعدد آن یعنی ۸ هسته در هر خوشه به‌صورت بومی با استفاده از بستر ارتباطی پرسرعت AMBA CHI به یکدیگر متصل شده‌اند. علاوه‌براین، برای مدیریت پردازش‌های سنگین هوش مصنوعی، موتورهای شتاب‌دهنده ماتریسی و برداری مستقیماً درون تراشه تعبیه شده‌اند که نیاز به کارت‌های گرافیک مجزا را برطرف می‌کند.

تراشه 5 نانومتری علی‌بابا اکنون مدل Qwen-3.8 را به صورت بومی اجرا می‌کند

تراشه XuanTie C950 علی‌بابا دارای حافظه‌های کش سطح اول (L1) استاندارد و کش سطح دوم (L2) انعطاف‌پذیر با قابلیت پیکربندی بالا است و از یک کش سطح سوم (L3) اشتراکی اختیاری برای جلوگیری از گلوگاه‌های ارتباطی بین هسته‌ها پشتیبانی می‌کند. این تراشه همچنین از الگوریتم‌های پیش‌فراخوانی هوشمند داده در سطح سخت‌افزار استفاده می‌کند تا رشته‌های حافظه را زودتر بارگذاری کند.

این موضوع ما را به هسته اصلی بحث امروز می‌رساند. علی‌بابا اکنون پشتیبانی روز صفر را برای جدیدترین مدل Qwen-3.8 27B خود به تراشه XuanTie C950 آورده است که سرعت رمزگشایی ۳۰ توکن در ثانیه و زمان دریافت اولین توکن (TTFT) تنها ۱.۹ ثانیه ارائه می‌دهد.

برای اطلاع کسانی که ممکن است آگاه نباشند، Qwen-3.8 27B یک مدل هوش مصنوعی ۲۷ میلیارد پارامتری با وزن‌های باز است که قابلیت‌های کدنویسی مشابه Opus 4.5 ارائه می‌دهد و در عین حال می‌تواند روی یک مک‌بوک اجرا شود.

علی‌بابا با ارائه پشتیبانی روز صفر از این مدل روی XuanTie C950، نه تنها سعی دارد مشتریان را درون اکوسیستم خود حفظ کند، بلکه اختیارات خود را در زمینه زیرساخت‌های پردازشی به طور قابل توجهی گسترش می‌دهد. در نهایت، علی‌بابا می‌تواند به‌راحتی تراشه C950 را با سایر شتاب‌دهنده‌های هوش مصنوعی درون مراکز داده خود جفت کند تا پردازش‌های مربوط به استنتاج را به شکلی کارآمد مدیریت نماید.

ازجمله دیگر ویژگی‌های تراشه XuanTie C950 می‌توان به موارد زیر اشاره کرد:

  • این تراشه بر پایه معماری مجموعه دستورالعمل (ISA) متن‌باز RISC-V ساخته شده است؛ امری که به علی‌بابا اجازه می‌دهد هزینه‌های لایسنس مرتبط با معماری x86 یا طراحی‌های ARM را دور بزند و به قابلیت سفارشی‌سازی بیشتری دست یابد.
  • این تراشه از پهنای رمزگشایی ۸ دستورالعملی استفاده می‌کند که به هسته اجازه می‌دهد حجم بزرگی از دستورات را به طور هم‌زمان بخواند و پردازش کند.
  • این تراشه دارای یک خط لوله (Pipeline) ۱۶ مرحله‌ای است که با تقسیم هر دستورالعمل به ۱۶ بخش، میان حفظ سرعت ساعت بالا و اجرای کارآمد پردازش‌های پیچیده سرور و هوش مصنوعی تعادل برقرار می‌سازد.
  • برخلاف کارت‌های گرافیک، تراشه XuanTie C950 یک رشته استنتاج منفرد را به ازای هر سوکت اجرا می‌کند که آن را برای استقرار در محیط‌های لبه و استنتاج خصوصی مناسب‌تر از APIهای عمومی با هم‌زمانی بالا می‌سازد.
  • ترکیب خط لوله سفارشی و موتورهای شتاب‌دهنده یکپارچه، XuanTie C950 را به نخستین پردازنده RISC-V تبدیل می‌کند که برای اجرای کاملاً بومی مدل‌های زبانی بزرگ (LLM) چند میلیارد پارامتری و بدون نیاز به لایه‌های شبیه‌سازی یا ترجمه طراحی شده است؛ واحدهای سخت‌افزاری و افزونه‌های مجموعه دستورالعمل برای اجرای مستقیم عملیات اصلی مورد نیاز مدل‌های هوش مصنوعی کوچک و متوسط طراحی شده‌اند.
  • به‌نظر می‌رسد که XuanTie C950 توسط شرکت TSMC و روی لیتوگرافی ۵ نانومتری آن ساخته شده است، اگرچه علی‌بابا هیچ تأیید مستقیمی دراین‌باره ارائه نکرده است.

اشتراک گذاری

نظرات کاربران

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *

3 × یک =