| عنوان رسمی قطعه | AMD Instinct MI100 PCIe Accelerator (معماری پردازشی Arcturus) |
|---|
| کاربری سختافزار | کارت گرافیک محاسباتی، سوپرکامپیوترهای علمی (HPC)، شبیهسازیهای اخترفیزیک و یادگیری عمیق |
|---|
| معماری هسته | AMD CDNA Architecture (فناوری ساخت ۷ نانومتری فینفت TSMC) |
|---|
| واحدهای پردازشی | ۱۲۰ واحد محاسباتی CU (شامل ۷۶۸۰ هسته Stream Processors) |
|---|
| مشخصات حافظه (VRAM) | 32GB HBM2 Stacked Memory with ECC |
|---|
| پهنای باند حافظه | 1.23TB/s با رابط ارتباطی فوقعریض ۴۰۹۶ بیتی |
|---|
| عملکرد محاسباتی علمی | FP64 تا ۱۱.۵ ترافلاپس | FP32 Matrix تا ۴۶.۱ ترافلاپس | Bfloat16 تا ۹۲.۳ ترافلاپس | INT8 تا ۱۸۴.۶ تاپس |
|---|
| اینترفیس ارتباطی مادربرد | PCIe 4.0 x16 |
|---|
| پیوند بین کارتی | ۳ لینک مستقیم AMD Infinity Fabric با نرخ انتقال ۲۷۶ گیگابایت بر ثانیه |
|---|
| فرم فاکتور و کولینگ | Full-Height Dual-Slot با هیتسینک صنعتی پسیو بدون فن چرخان (هماهنگ با ایرفلو سرور) |
|---|
| توان طراحی حرارتی (TDP) | ۳۰۰ وات (تغذیه از دو کابل ۸ پین استاندارد سروری) |
|---|
| سرورهای مقصد | انواع سرورهای رکمونت 2U و 4U شرکتهای HP (ProLiant Gen10/Gen10 Plus)، Dell PowerEdge و Supermicro |
|---|
شکستن رکورد محاسبات ریاضی و شبیهسازی با کارت گرافیک AMD Instinct MI100
کارت گرافیک صنعتی و دیتاسنتری AMD Instinct MI100 به عنوان نخستین پردازنده گرافیکی خالص محاسباتی معماری CDNA، تحولی بزرگ در قلمرو ابررایانهها پدید آورد. این محصول با حذف موتورهای خروجی تصویر و متمرکز ساختن تمام فضای تراشه بر روی واحدهای محاسباتی موازی، به نخستین شتابدهنده جهان با توان فراتر از ۱۱.۵ ترافلاپس در محاسبات ممیز شناور با دقت مضاعف (FP64) بدل گردید. پژوهشگران و دانشمندان در حوزههای هواشناسی، انرژی هستهای و ساخت واکسن با استفاده از این کارت گرافیک میتوانند شبیهسازیهای پیچیده فیزیکی را در کمترین زمان ممکن پردازش نمایند.
هستههای نوین Matrix Core و پردازش ماتریسی در بارهای یادگیری ماشین
علاوه بر محاسبات سنتی HPC، این کارت گرافیک با بهرهمندی از هستههای تحسینشده Matrix Core شتاب چشمگیری به الگوریتمهای هوش مصنوعی میبخشد. پشتیبانی بومی از فرمتهای ماتریسی FP32، FP16 و Bfloat16 به همراه پهنای باند استثنایی ۱.۲۳ ترابایت بر ثانیهای حافظه پشتهای HBM2، امکان آموزش پرسرعت شبکههای عصبی را با بهینهترین مصرف انرژی و بدون ایجاد گلوگاههای حافظه مقدور میسازد.
توسعه نرمافزاری آسان با پلتفرم باز AMD ROCm
اتکای این کارت گرافیک به اکوسیستم نرمافزاری متنباز AMD ROCm، موانع کدهای انحصاری را محو نموده است. مهندسان میتوانند به سادگی و از طریق ابزارهای کامپایلر HIP، پروژههای خود را از سایر فریمورکها به این بستر منتقل ساخته و از پایداری ۲۴ ساعته این شتابدهنده صنعتی در سرورهای ابری سازمانی بهرهمند شوند.
Reviews
There are no reviews yet.