يُعرض النص الكامل باللغة الإنجليزية؛ وقد تمت ترجمة العنوان والملخص.
ما هو
CUDA is the parallel computing platform and programming model introduced by NVIDIA in 2007 that lets developers use GPUs for general-purpose computing. It provides language extensions, a compiler, and acceleration libraries such as cuDNN and cuBLAS. It addresses efficiently mapping highly parallel computation such as neural-network training and inference onto GPUs.
لماذا يستحق التذكّر
It has been the practical programming interface for AI compute for over a decade; the libraries and tools built around it form NVIDIA’s deepest ecosystem moat.
المواصفات الأساسية
- First release
- 2007
- Positioning
- GPU general-purpose parallel computing platform and programming model
- Companion libraries
- cuDNN, cuBLAS and others
المفاهيم ذات الصلة
البنية التحتية للتدريب والاستدلال
تحدد الذاكرة حجم النموذج القابل للتدريب، ويحدد الاتصال المدة التي يستغرقها — ونادرًا ما تكون الحوسبة الخام هي عنق الزجاجة
تحسين الاستدلال وتقديم الخدمة
يحدث التدريب مرة واحدة، أما الاستدلال فمليارات المرات يوميًا — وسرعة التوكن الأول والإنتاجية تتعارضان غالبًا