صنعت کامپیوترهای شخصی در حال تجربه بزرگ‌ترین تغییر معماری خود در یک دهه‌ی اخیر است؛ غیر از این که  سیستم‌های پردازشی سنتی به کامپیوترهای مبتنی بر هوش مصنوعی یا اصطلاحاً AI PC. با ورود مدل‌های زبانی محلی و ابزارهای پردازش تصویر به هسته اصلی سیستم‌عامل‌ها، قطعه‌ای جدید به نام واحد پردازش عصبی (NPU) به قلب مادربردها و پردازنده‌ها اضافه شده است. در این مقاله، از نظر مهندسی سخت‌افزار بررسی می‌کنیم که چرا پردازنده‌های مرکزی (CPU) و کارت‌های گرافیک (GPU) دیگر برای آینده کافی نیستند و چرا معماری NPU یک ضرورت قطعی برای ارتقای سیستم‌های نسل بعد محسوب می‌شود.

در این مقاله می‌خوانیم:

تراشه NPU

معماری پردازش ماتریسی؛ چرا CPU و GPU تسلیم شدند؟

تا پیش از این، بار تمام پردازش‌های سیستم بر دوش پردازنده مرکزی (CPU) و کارت گرافیک (GPU) بود. پردازنده‌های مرکزی دارای معماری «اسکالر» (Scalar) هستند؛ به این معنی که دستورات را به صورت خطی، متوالی و با فرکانس بسیار بالا اجرا می‌کنند. این معماری برای اجرای کدهای شرطی و مدیریت سیستم‌عامل عالی است، اما در برابر حجم عظیم داده‌های همزمان فلج می‌شود. از سوی دیگر، کارت‌های گرافیک معماری «برداری» (Vector) دارند و می‌توانند هزاران محاسبه‌ی ساده‌تر را به صورت موازی انجام دهند.

اما هوش مصنوعی و شبکه‌های عصبی عمیق، زبان متفاوتی دارند. این مدل‌ها نیازمند ریاضیات تانسوری یا انجام میلیون‌ها عملیات ضرب و جمع همزمان (MAC Operations) هستند. اگرچه GPU می‌تواند این کار را با قدرت انجام دهد، اما یک مشکل اصلی وجود دارد: مصرف انرژی و تاخیر در انتقال داده. روشن نگه‌داشتن یک کارت گرافیک 200 واتی برای اجرای یک مدل هوش مصنوعی در پس‌زمینه (مثلاً برای تار کردن پس‌زمینه در یک تماس تصویری، تصحیح نویز صدا، یا پردازش کدهای برنامه‌نویسی)، باعث تولید گرمای شدید، چرخش مداوم فن‌ها و اتمام سریع باتری لپ‌تاپ می‌شود.

اینجاست که NPU (Neural Processing Unit) وارد میدان می‌شود. این تراشه سیلیکونی اختصاصی، منطق سخت‌افزاری خود را صرفاً برای محاسبات ماتریسی بهینه‌سازی کرده است و فاقد کش‌های پیچیده یا واحدهای کنترل خطیِ CPU است. در نتیجه، می‌تواند پردازش‌های استنتاجیِ هوش مصنوعی را با یک‌دهمِ مصرف برق انجام دهد و نیازی به درگیر کردن مداوم گذرگاه‌های اصلی مادربرد نداشته باشد.

استقلال پردازشی؛ نجات VRAM و آزادسازی محیط‌های توسعه

برای مهندسان نرم‌افزار، طراحان و کاربرانی که به صورت حرفه‌ای با سیستم‌های خود کار می‌کنند، مدیریت منابع سخت‌افزاری، مرزِ بین یک سیستم پایدار و یک سیستم کُند است. در آینده‌ای بسیار نزدیک، سیستم‌عامل‌ها میزبان ابزارهای هوش مصنوعی همیشه روشن خواهند بود. اجرای محلیِ این ابزارها مانند دستیارهای برنامه‌نویسی که در لحظه کدهای شما را تحلیل می‌کنند، اسکریپت‌های اتوماسیون پیچیده، یا ابزارهای ادیت تصویر در سیستم‌های فاقد NPU، مستقیماً حافظه گرافیکی (VRAM) شما رو اشغال میکند!

اشغال شدن VRAM توسط مدل‌های زبانی باعث ایجاد گلوگاه‌های پردازشی سنگینی می‌شود. وقتی شما در حال اجرای یک محیط توسعه‌ی سنگین، رندر گرفتن از یک پروژه گرافیکی یا اجرای یک بازی نسل نهم هستید، سیستم دیگر فضای کافی برای مدیریت پردازش‌های پس‌زمینه‌ی AI ندارد و دچار افت فریم، لگ یا حتی کرش می‌شود.

معماری جدید AI PC ها این مشکل حیاتی را از طریق استقلال پردازشی حل می‌کند. با انتقال بارِ محاسباتیِ مدل‌های زبانی به NPU، کارت گرافیک و VRAM گران‌قیمتِ آن به طور کامل برای وظایف اصلی خود آزاد می‌مانند. این تفکیک وظایف سخت‌افزاری در سطح سیلیکون باعث می‌شود تا سیستم در اوج فشار کاری نیز پایداری خود را حفظ کند و کاربر هیچ‌گونه تاخیر ورودی را احساس نکند.

VRAM GPU

استاندارد 40 TOPS؛ خط قرمز سیستم‌عامل‌های نسل بعد

شرکت‌های توسعه‌دهنده نرم‌افزار، با سرعتی بی‌سابقه در حال ارتقای پیش‌نیازهای سیستمی هستند و سخت‌افزارهای قدیمی را از رده خارج می‌کنند. مایکروسافت با معرفی استاندارد سخت‌گیرانه‌ی Copilot+ PC، یک خط قرمز مشخص در صنعت کامپیوتر رسم کرده است: کامپیوترهای نسل جدید برای اجرای بومی و محلیِ هوش مصنوعی روی ویندوز (بدون نیاز به اینترنت ابری)، باید حداقل توان پردازشی 40 TOPS (معادل 40 تریلیون عملیات در ثانیه) را منحصراً از طریق NPU ارائه دهند.

این عدد تصادفی انتخاب نشده است؛ 40 TOPS حداقل توان لازم برای اجرای یک مدل زبانی کوچک (SLM) با سرعت پاسخ‌گویی قابل قبول است تا محیط ویندوز فریز نشود. به همین دلیل است که غول‌های سخت‌افزاری تمام خطوط تولید و معماری تراشه‌های خود را بازطراحی کرده‌اند. پردازنده‌های سری Intel Core Ultra، معماری جدید AMD Ryzen AI 300 و تراشه‌های مبتنی بر ARM مانند Snapdragon X Elite، همگی بخش بزرگی از مساحتِ دای (Die Area) خود را از هسته‌های سنتی گرفته و به NPU اختصاص داده‌اند.

این یک هشدار جدی برای خریداران است: سیستمی که امروز نتواند این استاندارد 40 TOPS را برآورده کند، صرف‌نظر از اینکه پردازنده مرکزی (CPU) آن چقدر قدرتمند است، در آینده‌ای نزدیک از دریافت آپدیت‌های کلیدی سیستم‌عامل، قابلیت‌های امنیتی مبتنی بر AI و اجرای محلیِ نرم‌افزارهای پیشرفته محروم خواهد شد و عملاً تکنولوژی‌های نسل بعد در دسترس نخواهد بود.

پایان وابستگی به سرورهای ابری؛ حریم خصوصی و امنیت مطلق داده‌ها

یکی از بزرگ‌ترین موانع در پیاده‌سازی استراتژی‌های هوش مصنوعی، به‌ویژه در محیط‌های شرکتی و سازمانی، امنیت داده‌هاست. ارسال اطلاعات حساس، سورس‌کدهای محرمانه یا اسناد مالی به سرورهای ابری (مثل OpenAI یا سرورهای مایکروسافت) همواره یک ریسک امنیتی بزرگ محسوب می‌شود. حضور NPU این معادله را کاملاً تغییر می‌دهد.

با داشتن این پردازنده روی مادربرد، مدل‌های زبانی کوچک (SLM) به صورت کاملاً آفلاین و ایزوله روی سیستم کاربر اجرا می‌شوند. این یعنی شما می‌توانید تمام اسناد محلی خود را پردازش کنید، کدهایتان را دیباگ کنید و از دستیار هوش مصنوعی سوال بپرسید، بدون اینکه حتی یک بایت از اطلاعات شما وارد شبکه اینترنت شود. NPUها رویای هوش مصنوعی آفلاین و امن را به واقعیت تبدیل کرده‌اند.

npu ai

نبرد اکوسیستم‌ها؛ نرم‌افزارها چگونه با NPU صحبت می‌کنند؟

صرفِ داشتن یک سخت‌افزار قدرتمند کافی نیست؛ نرم‌افزارها باید زبان صحبت با این قطعه جدید را بلد باشند. در حال حاضر، رقابت سنگینی بین غول‌های تکنولوژی برای ایجاد یک رابط نرم‌افزاری (API) استاندارد در جریان است. مایکروسافت با توسعه DirectML تلاش می‌کند تا برنامه‌های ویندوزی را مستقیماً به NPU متصل کند. همزمان، اینتل با پلتفرم OpenVINO و انویدیا با TensorRT در حال ارائه ابزارهایی به توسعه‌دهندگان هستند تا کدهایشان را برای این معماری جدید کامپایل کنند.

سیستم‌عاملی در آینده برنده خواهد بود که بتواند پیچیدگی این لایه‌های نرم‌افزاری را از دید کاربر پنهان کرده و یکپارچه‌ترین تجربه را برای هدایت پردازش‌ها به سمت NPU ارائه دهد.

نتیجه‌گیری؛ آیا ارتقای سیستم الزامی است؟

انقلاب AI PC صرفاً یک ترفند بازاریابی نیست، بلکه یک تغییر بنیادین در معماری کامپیوتر است که به زودی به استاندارد پیش‌فرض صنعت تبدیل می‌شود. خرید یک لپ‌تاپ یا جمع‌کردن یک سیستم رومیزی قدرتمند در سال‌های پیش‌رو، بدون در نظر گرفتن ظرفیت NPU، به معنای سرمایه‌گذاری روی سخت‌افزاری است که در اجرای برنامه‌های نسل بعد فلج خواهد شد. NPUها همان نقشی را امروز برای هوش مصنوعی ایفا می‌کنند که کارت‌های گرافیک سه‌بعدی در دهه 90 میلادی برای صنعت گیمینگ ایفا کردند؛ یک جهش سخت‌افزاری غیرقابل بازگشت.