
اینتل در اوایل سال جاری میلادی «مرکز بهینهسازی» (Optimization Zone) را به عنوان طرحی تازه معرفی کرد که هدف آن فراهمکردن مکانی متمرکز برای گردآوری تمام منابع این شرکت در زمینه بیشینهسازی کارایی و تنظیم دقیق نرمافزار روی بسترهای سختافزاری اینتل است. این شرکت توسعه این منابع را ادامه داده و روز گذشته نسخه ۱.۲ این مرکز را همراه با راهنماهای تنظیم دقیق بیشتر و بهترین شیوههای عملی برای دستیابی به کارایی بهینه روی سختافزار اینتل منتشر کرد.
مستندات تازه NUMA و بهینهسازی بارهای کاری ابری
در نسخه بهروزشده مرکز بهینهسازی اینتل، مستندات تازهای درباره معماری دسترسی نامتقارن به حافظه (NUMA) افزوده شده است. این مستندات شامل بهترین شیوهها برای نمونههای ابری پردازنده زئون ۶ (Xeon 6) در سرویسهای آمازون وب سرویس (AWS) و گوگل کلود (Google Cloud)، جایگذاری آگاه از NUMA برای پادهای (Pods) کوبرنتیز (Kubernetes) و یک مطالعه موردی از پیادهسازی سمت سرور زبان جاوا است.
راهنماهای تازه برای هوش مصنوعی و یادگیری ماشین
بخش قابل توجهی از محتوای تازه این نسخه به بارهای کاری هوش مصنوعی اختصاص دارد. راهنمای بهینهسازی vLLM، بهترین شیوههای شناختهشده برای استقرار و تنظیم دقیق این ابزار جهت استنتاج (Inference) روی پردازنده (CPU) در تراشههای زئون اینتل را ارائه میکند و شامل یک مهارت عامل (Agent Skill) برای استقرار، تنظیم دقیق و سنجش کارایی است.
همچنین راهنمای بهینهسازی استنتاج تقویت گرادیانی (Gradient Boosting Inference) منتشر شده که به تسریع استنتاج کتابخانههای XGBoost، LightGBM و CatBoost با استفاده از oneDAL روی پردازندههای اینتل میپردازد. در همین زمینه، راهنمای آغاز به کار قابلیت توربوی هسته اولویتدار اینتل (Intel Priority Core Turbo یا PCT) برای استنتاج هوش مصنوعی شتابیافته با واحد پردازش گرافیکی (GPU) نیز در دسترس قرار گرفته است.
بهینهسازی کتابخانهها و سرویسهای نرمافزاری
فهرست راهنماهای تازه این نسخه شامل موارد زیر است:
- راهنمای بهینهسازی NumPy: بهترین شیوهها برای دستیابی به کارایی بهینه این کتابخانه با کتابخانه ریاضی هسته یکAPI اینتل (Intel oneAPI Math Kernel Library یا oneMKL)
- راهنمای بهینهسازی زبان R: بهترین شیوهها برای کارایی بهینه در گردشکارهای آمادهسازی داده، برازش مدل و ارائه مدل در زبان R
- سرور Nginx با فناوری QuickAssist اینتل (Intel QAT): فشردهسازی شتابیافته با سختافزار و واگذاری (Offload) فرایند دستدهی TLS
- کنترلهای پیشواکشی سختافزاری (Hardware Prefetch Controls): مستندات مربوط به هستههای کممصرف E-Core اینتل
توصیههای عمومی پیکربندی سیستم
بخشی دیگر از توصیههای افزودهشده به مقادیر سوگیری کارایی انرژی (Energy Performance Bias یا EPB) و ترجیح کارایی انرژی (Energy Performance Preference یا EPP) مربوط میشود. علاوه بر این، مباحثی همچون مقیاسبندی فرکانس پردازنده (CPU Frequency Scaling)، فناوری چندرشتهای همزمان (Hyper-Threading) و نحوه مدیریت هستههای کممصرف و کارآمد (Low Power Efficient Cores یا LPE Cores) اینتل نیز در این مستندات پوشش داده شده است.
علاقهمندان میتوانند مستندات بهروزشده مرکز بهینهسازی اینتل را در نشانی intel.github.io مشاهده کنند.