انویدیا پلتفرم وِرا روبین را وارد تولید انبوه کرد؛ تراشهای که به ادعای این شرکت هزینهٔ هوش مصنوعی را...
انویدیا پلتفرم «وِرا روبین» را وارد تولید انبوه کرد؛ موتوری تازه که قرار است هوش مصنوعی را سریعتر، ارزانتر و همهجا حاضر کند.

لیست مطالب
۱) روبین چیست و چرا همین حالا مهم شده است؟
«وِرا روبین» (Vera Rubin) نام پلتفرم تازهٔ انویدیا و جانشین رسمی معماری پرسروصدای بلکول است؛ سکویی که نامش را از ویرا روبین، اخترشناس آمریکایی و کاشف شواهد مادهٔ تاریک، گرفته است. انویدیا نخستین تصویر از این پلتفرم را ابتدای سال ۲۰۲۶ در نمایشگاه CES رونمایی کرد، جزئیات فنی آن را در رویداد GTC تایپه در اواخر بهار تکمیل کرد و حالا در تابستان ۲۰۲۶ خبر مهمتری رسیده است: روبین از مرحلهٔ نمونه و آزمایش عبور کرده و وارد تولید انبوه شده است.
چرا این خبر تا این اندازه اهمیت دارد؟ چون تقریباً هر ابزار هوش مصنوعی که امروز میشناسیم—از چتجیپیتی و جمینای گرفته تا کلود و گراک—روی سختافزار انویدیا آموزش میبیند و اجرا میشود. هر جهش بزرگ در این تراشهها مستقیماً روی سرعت، هزینه و کیفیت پاسخهایی که هر روز از دستیارهای هوش مصنوعی میگیریم اثر میگذارد. به همین دلیل رونمایی از هر نسل جدید، بیش از یک خبر سختافزاری ساده است؛ نقشهٔ راه یک سال آیندهٔ کل صنعت را ترسیم میکند.
اگر میخواهید جریان کامل رویدادهای این حوزه را دنبال کنید، بخش اخبار هوش مصنوعی در سایت Mr ChatGPT هر روز بهروزرسانی میشود. اما در این گزارش تمرکز ما فقط روی یک پرسش است: روبین چه چیزی را تغییر میدهد؟
۲) شش تراشه که با هم یک ابرکامپیوتر میسازند
روبین صرفاً یک کارت گرافیک نیست؛ مجموعهای از شش تراشهٔ تازه است که با هم یک ماشین یکپارچه میسازند. این شش قطعه عبارتاند از: پردازندهٔ مرکزی «وِرا»، پردازندهٔ گرافیکی «روبین»، سوییچ NVLink نسل ششم، کارت شبکهٔ ConnectX-9، پردازندهٔ داده BlueField-4 و سوییچ اترنت Spectrum-6. انویدیا این رویکرد را «طراحی در مقیاس مرکز داده» مینامد؛ یعنی بهجای یک تراشهٔ منفرد، کل معماری از پردازنده تا شبکه بهصورت هماهنگ بهینه شده است.
ثمرهٔ این هماهنگی، سیستمی به نام «وِرا روبین NVL72» است. این پیکربندی رکمقیاس، ۷۲ پردازندهٔ گرافیکی روبین را در کنار ۳۶ پردازندهٔ مرکزی وِرا مینشاند و همه را چنان به هم متصل میکند که از بیرون مثل یک پردازندهٔ گرافیکی غولپیکر رفتار کنند. برای مدلهای بزرگ زبانی که باید حجم عظیمی از محاسبات را بهصورت موازی انجام دهند، همین یکپارچگی تفاوت میان «ممکن» و «غیرممکن» است.
۳) قدرت خام: ۳۳۶ میلیارد ترانزیستور و حافظهٔ HBM4
قلب این پلتفرم، پردازندهٔ گرافیکی روبین است. این تراشه بر پایهٔ فرایند ۳ نانومتری شرکت TSMC ساخته میشود و حدود ۳۳۶ میلیارد ترانزیستور را در خود جای داده است. به گفتهٔ انویدیا، هر پردازنده تا ۵۰ پتافلاپس توان استنتاج در قالب عددی تازهٔ NVFP4 ارائه میدهد؛ عددی که برای درک بهتر، معادل قدرت محاسباتی یک اتاق پر از سرورهای چند سال پیش است.
حافظه؛ گلوگاه واقعی هوش مصنوعی
اما نقطهٔ قوت اصلی روبین در حافظه است. هر پردازنده به ۲۸۸ گیگابایت حافظهٔ پرسرعت HBM4 مجهز شده و پهنای گذرگاه حافظه از ۱۰۲۴ بیت در نسل قبل به ۲۰۴۸ بیت افزایش یافته است. نتیجه، پهنای باندی نزدیک به ۲۲ ترابایت بر ثانیه برای هر تراشه است—تقریباً سه برابر حدود ۸ ترابایت بر ثانیهٔ بلکول. در دنیای مدلهای زبانی، سرعت جابهجایی داده اغلب مهمتر از توان خام پردازش است، چون گلوگاه واقعی معمولاً رساندن داده به هستهٔ پردازنده است، نه خودِ محاسبه.
در کنار اینها، فناوری اتصال NVLink نسل ششم پهنای باند ارتباط میان پردازندهها را به ۳٫۶ ترابایت بر ثانیه برای هر تراشه میرساند و در کل یک رک NVL72 به رقم خیرهکنندهٔ ۲۶۰ ترابایت بر ثانیه میرسد. همین شبکهٔ داخلی پرسرعت است که به ۷۲ پردازنده اجازه میدهد مثل یک واحد واحد کار کنند.
۴) وعدهٔ اصلی: استنتاج تا ۱۰ برابر ارزانتر
مهمترین ادعای انویدیا دربارهٔ روبین، نه سرعت خام، بلکه اقتصاد است. به گفتهٔ این شرکت، سیستم وِرا روبین NVL72 در مقایسه با نسل گریسبلکول تا ۱۰ برابر «توان عبور عاملی» بیشتر، ۱۰ برابر بازده بهتر بهازای هر وات، و از همه مهمتر، کاهش ۱۰ برابری هزینهٔ تولید هر میلیون توکن را ارائه میدهد. انویدیا همچنین میگوید برای آموزش مدلهای «ترکیبی از متخصصها» (MoE) به یکچهارم تعداد پردازندههای قبلی نیاز است.
این ارقام برای کسبوکارها معنای مستقیم دارند. هزینهٔ هر پاسخ هوش مصنوعی در نهایت به قیمت توکن گره خورده است؛ وقتی این هزینه ده برابر پایین میآید، سرویسهایی که تا دیروز از نظر اقتصادی توجیه نداشتند، ناگهان ممکن میشوند. اگر میخواهید بدانید چرا این تحول برای شرکتها حیاتی است، مطلب اهمیت هوش مصنوعی در کسبوکار تصویر روشنی از این موضوع میدهد.
البته باید توجه داشت که این اعداد، ارقام رسمی خودِ انویدیا در بهترین شرایط آزمایشگاهیاند و عملکرد واقعی به نوع مدل و بار کاری بستگی دارد. با این حال، حتی اگر بخشی از این وعده محقق شود، باز هم یک جهش بزرگ در اقتصاد هوش مصنوعی رقم میخورد.

۵) چه کسانی زودتر از همه روبین را تحویل میگیرند؟
طبق گزارشها، نخستین محمولههای روبین در ماههای تابستان ۲۰۲۶ به بزرگترین مشتریان آمریکای شمالی تحویل داده میشود؛ نامهایی مانند مایکروسافت، گوگل، آمازون، متا و اوراکل. این همان شرکتهایی هستند که زیرساخت ابری پشت محبوبترین سرویسهای هوش مصنوعی جهان را در اختیار دارند. برای مثال، مدلهای اوپنایآی عمدتاً روی زیرساخت مایکروسافت، اوراکل و شرکای ابری دیگر اجرا میشوند.
نکتهٔ جالب، شیوهٔ عرضهٔ روبین است. برخلاف نسلهای گذشته که بهصورت پلکانی و با فاصله به مشتریان میرسیدند، اینبار انویدیا از عرضهٔ همزمان روبین از طریق هشت شریک ابری خبر داده است: AWS، گوگل کلاود، مایکروسافت آژور، اوراکل کلاود، کوروویو (CoreWeave)، لامبدا، نبیوس و اِناسکیل. این هماهنگی نشان میدهد تقاضا برای توان محاسباتی هوش مصنوعی چقدر شدید است و همه میخواهند همزمان به خط مقدم برسند.
۶) روبین و طلوع عصر «هوش مصنوعی عاملی»
انویدیا بارها تأکید کرده که روبین برای موج تازهای از هوش مصنوعی طراحی شده است؛ چیزی که به آن «هوش مصنوعی عاملی» (Agentic AI) میگویند. در این الگوی جدید، مدلها دیگر فقط به یک پرسش پاسخ نمیدهند، بلکه زنجیرهای از وظایف را بهصورت خودکار برنامهریزی و اجرا میکنند: جستوجو میکنند، کد مینویسند، خطا را اصلاح میکنند و نتیجه را تحویل میدهند. این کار بهمراتب توان محاسباتی بیشتری نسبت به یک پرسشوپاسخ ساده میطلبد.
جنسن هوانگ، مدیرعامل انویدیا، در توصیف این پلتفرم گفته است: «هوش مصنوعی عاملی گونهٔ تازهای از بار کاری است… وِرا روبین دقیقاً برای همین لحظه ساخته شده؛ موتور کارخانهٔ هوشی که هوشمندی را در مقیاس عرضه میکند.» این نگاه با روندی که در دنیای توسعهٔ نرمافزار میبینیم همخوانی دارد؛ موضوعی که در تحلیل توهم هوش مصنوعی؛ توسعهدهندهٔ تنها در برابر مهندس واقعی به آن پرداختهایم.
۷) روبین برای کاربر عادی چه فرقی ایجاد میکند؟
ممکن است بپرسید همهٔ این اعداد و معماریهای پیچیده چه ربطی به من دارد که فقط از چتجیپیتی یا جمینای استفاده میکنم؟ پاسخ ساده است: ارزانتر و سریعتر شدن سختافزار، دیر یا زود به تجربهٔ کاربری شما میرسد. وقتی هزینهٔ اجرای مدلها پایین میآید، شرکتها میتوانند پاسخهای سریعتر بدهند، محدودیت پیامها را کم کنند، پنجرهٔ زمینهٔ بزرگتری در اختیار بگذارند و حتی قیمت اشتراکها را رقابتیتر کنند.
از سوی دیگر، توان بیشتر به معنای مدلهای باهوشتر است. همان قابلیتهایی که امروز فقط در نسخههای گرانقیمت در دسترساند، با ارزان شدن محاسبات به دست کاربران بیشتری میرسند. اگر میخواهید از همین حالا حداکثر استفاده را از این ابزارها ببرید، مجموعهٔ آموزشهای چتجیپیتی و راهنمای نوشتن پرامپت نقطهٔ شروع خوبی هستند. با این حال، مهم است که انتظارمان واقعبینانه بماند؛ مقالهٔ توان و محدودیتهای واقعی هوش مصنوعی کمک میکند مرز میان وعده و واقعیت را بهتر ببینید.
۸) چالشها: عرضهٔ محدود، قیمت نجومی و رقابت داغ
روبین بدون مانع نیست. نخستین چالش، عرضه است. تقاضا چنان بالاست که به گفتهٔ منابع، بخش عمدهٔ ظرفیت روبین دستکم تا سال ۲۰۲۷ در اختیار غولهای ابری باقی میماند و شرکتهای کوچکتر باید در صف بمانند. چالش دوم، قیمت است؛ هزینهٔ هر رک وِرا روبین حدود ۱۸۰ میلیون دلار تخمین زده شده است. همین رقم نشان میدهد چرا رقابت هوش مصنوعی بیش از آنکه نبرد الگوریتمها باشد، به جنگ سرمایه و سختافزار تبدیل شده است.
در جبههٔ رقابت هم خبرهایی هست. AMD با معماری MI450X میکوشد سهمی از این بازار بردارد، هرچند روبین از نظر ظرفیت حافظه حدود ۵۰ درصد جلوتر است. گوگل نیز با تراشههای اختصاصی TPU مسیر خودش را میرود. این رقابت چندجانبه در نهایت به سود کاربر تمام میشود، درست مثل رقابتی که میان خودِ مدلها جریان دارد؛ نمونهٔ آن را در مطلب نبرد چتجیپیتی و دیپسیک دیدهایم. هرچه این رقابت داغتر شود، سرعت پیشرفت و فشار برای پایین آوردن قیمتها هم بیشتر میشود.
۹) پرسشوپاسخ کوتاه (FAQ)
روبین کِی بهصورت گسترده در دسترس قرار میگیرد؟
نخستین محمولهها در تابستان ۲۰۲۶ به مشتریان بزرگ رسیده و عرضهٔ گسترده از پاییز همان سال آغاز میشود. اما به دلیل تقاضای بالا، دسترسی گستردهٔ سازمانهای کوچکتر احتمالاً تا سال ۲۰۲۷ طول میکشد.
روبین دقیقاً چقدر از بلکول قدرتمندتر است؟
به ادعای انویدیا، سیستم NVL72 روبین تا ۱۰ برابر توان عبور بیشتر و کاهش ۱۰ برابری هزینهٔ هر میلیون توکن نسبت به نسل گریسبلکول دارد. این ارقام رسمی شرکتاند و عملکرد واقعی به بار کاری بستگی دارد.
آیا روبین قیمت اشتراک چتجیپیتی را کم میکند؟
بهطور مستقیم و فوری نه، اما با ارزانتر شدن هزینهٔ اجرای مدلها، شرکتها فضای بیشتری برای کاهش قیمت، افزایش سقف استفاده یا ارائهٔ قابلیتهای تازه پیدا میکنند. اثر آن معمولاً با تأخیر چند ماهه به کاربر میرسد.
تفاوت روبین با تراشههای گوگل و AMD چیست؟
روبین یک پلتفرم عمومی است که تقریباً همهٔ شرکتها میتوانند از آن استفاده کنند، در حالی که TPUهای گوگل عمدتاً داخلیاند. AMD نیز با MI450X رقابت میکند اما روبین فعلاً از نظر حافظه و اکوسیستم نرمافزاری پیشتاز است.
نسخهٔ فوری این مطلب در تلگرام: اینجا بخوانید