پلتفرم AMD Instinct Coder با ۸ گرافیک MI325X معرفی شد؛ ادعای کاهش ۷۰ درصدی هزینههای توکن AI
شرکتهای AMD، Spectro Cloud و Supermicro به صورت مشترک از پلتفرم سازمانی جدیدی با نام AMD Instinct Coder رونمایی کردند. این زیرساخت اعتبارسنجیشده، به طور ویژه برای پردازشهای استنتاجی در حوزه تولید و توسعه کد توسط هوش مصنوعی طراحی شده است. این راهکار با ترکیب شتابدهندههای گرافیکی AMD Instinct، زیرساختهای سرور Supermicro و پلتفرم نرمافزاری PaletteAI امکان استقرار محیطهای هوش مصنوعی خصوصی و هیبریدی را به شکلی یکپارچه فراهم میکند.
- کاهش چشمگیر هزینهها: پتانسیل کاهش ۷۰ درصدی هزینههای توکن و بازگشت سرمایه در کمتر از ۶ ماه.
- مسیریابی هوشمند: هدایت خودکار کدهای روتین به مدلهای محلی و ارسال کدهای پیچیده به مدلهای ابری پیشرفته نظیر GPT و Claude.
- قدرت پردازشی بالا: استفاده از ۸ شتابدهنده قدرتمند AMD Instinct MI325X در یک سرور سازمانی.
- حفظ حریم خصوصی: نگهداری کدهای حساس و دادههای سازمانی در داخل زیرساختهای کنترلشده محلی.
معماری ترکیبی؛ تعادل میان پردازش محلی و مدلهای ابری
این معماری برای سازمانها، ارائهدهندگان خدمات ابری و اپراتورهای هوش مصنوعی حاکمیتی طراحی شده است که نیاز دارند تعادلی دقیق میان پردازشهای محلی، دسترسی به مدلهای پیشگام، حاکمیت عملیاتی و میزان مصرف توکن ایجاد کنند. پلتفرم AMD Instinct Coder به جای ارسال تمام درخواستهای تولید کد به مدلهای زبانی بزرگ خارجی، از سیستم مسیریابی مبتنی بر سیاست استفاده میکند.
این سیستم به صورت هوشمند تشخیص میدهد که آیا یک درخواست میتواند توسط مدل مستقر در شبکه محلی پردازش شود یا نیازمند ارسال به یک مدل پیشرفته خارجی است. کارهای روتین مانند تولید کدهای پایه، خلاصهسازی و خطایابیهای ساده به صورت محلی انجام میشوند، در حالی که استدلالهای پیچیده به مدلهای ابری سپرده خواهند شد. شرکای این پروژه ادعا میکنند که این استراتژی میتواند هزینههای توکنهای برنامهنویسی با هوش مصنوعی را تا ۷۰ درصد کاهش دهد.
بحران هزینههای توکن و پیشبینیهای گارتنر
معرفی این پلتفرم در زمانی اتفاق میافتد که سازمانها در حال مقیاسپذیری ابزارهای برنامهنویسی هوش مصنوعی در بین تیمهای توسعه خود هستند. موسسه تحقیقاتی گارتنر در گزارش ژوئن ۲۰۲۶ خود هشدار داده بود که در صورت عدم وجود یک مدل عملیاتی ساختاریافته، افزایش تصاعدی مصرف توکنها میتواند به نقطهای برسد که هزینه توکنهای هوش مصنوعی از میانگین حقوق یک برنامهنویس در سال ۲۰۲۸ فراتر رود.
پلتفرم AMD Instinct Coder مستقیماً این نگرانی را از طریق قابلیتهایی نظیر مسیریابی مدل، اندازهگیری دقیق مصرف، تعیین سهمیه برای کاربران و اعمال سیاستهای کاری برطرف میکند.
مشخصات سختافزاری و نرمافزاری سیستم مرجع
پیکربندی اولیه این سیستم بر پایه پردازندههای گرافیکی AMD Instinct MI325X بنا شده است. هر شتابدهنده MI325X دارای ۲۵۶ گیگابایت حافظه HBM3E بوده و پهنای باند حافظه آن به ۶ ترابایت بر ثانیه میرسد که برای پردازشهای سنگین هوش مصنوعی مولد کاملاً ایدهآل است. پردازشهای محلی روی مدل GLM-5.2 که از طریق میکروسرویسهای استنتاجی AMD بهینهسازی شده، اجرا میشوند.
| بخش | مشخصات مرجع پلتفرم AMD Instinct Coder |
|---|---|
| سرور پایه | Supermicro AS-8126GS-TNMR |
| پردازنده اصلی | 2 x AMD EPYC 9575F, 64 cores, 3.3GHz |
| کارت گرافیک | 8 x AMD Instinct MI325X |
| حافظه رم | 3TB (24 x 128GB) DDR5 RDIMM 6400 ECC |
| فضای ذخیرهسازی داده | 8 x 7.68TB PCIe Gen5 TLC U.2 SSD |
| تجهیزات شبکه | 2 x AMD Pensando Pollara 400 HHHL PCIe NIC, 400GbE |
| منبع تغذیه (پاور) | 6 x 5250W (3+3 Redundant) Titanium-level |
| نرمافزار پلتفرم | Spectro Cloud PaletteAI Inference Launchpad |
| مدلهای پشتیبانیشده | Local: GLM-5.2 | Frontier: Claude, GPT, Gemini |
| ابزارهای توسعه | Claude Code, Cursor, Visual Studio Code |
| ظرفیت پشتیبانی | Up to 50 developers (30 concurrent) per node |
نقش استراتژیک Supermicro و Spectro Cloud
شرکت Supermicro زیرساختهای فیزیکی این پلتفرم را تامین میکند. سیستمهای تاییدشده این شرکت شامل پلتفرمهای مجهز به ۸ گرافیک با پشتیبانی از سیستمهای خنککننده بادی و مایع است. از سوی دیگر، نرمافزار PaletteAI Inference Launchpad از شرکت Spectro Cloud لایه عملیاتی را تشکیل میدهد. این لایه امکان جداسازی محیطها برای تیمها، تعیین محدودیت مصرف توکن و حفظ اتصال بازگشتی به مدلهای ابری را مدیریت میکند.
نتیجه این همکاری، ایجاد یک معماری استنتاجی لایهبندیشده است. دن مکنامارا، مدیر ارشد بخش هوش مصنوعی سازمانی در AMD، این تغییر را انتقال فرآیند برنامهنویسی با هوش مصنوعی از یک ابزار فردی توسعهدهنده به یک تصمیم پلتفرمی در سطح سازمان توصیف کرده است.
تحلیل اختصاصی آلفاتک: شیفت استراتژیک از سرورهای ابری به زیرساختهای محلی
تا پیش از این، اکثر سازمانها برای استفاده از دستیارهای برنامهنویسی هوشمند کاملاً به رابطهای برنامهنویسی شرکتهایی نظیر OpenAI و Anthropic وابسته بودند. این وابستگی دو مشکل اساسی ایجاد میکرد: اول، خروج کدهای حساس و اختصاصی از شبکههای امن سازمانی و دوم، هزینههای سرسامآور توکنها برای پردازش کدهای بسیار ساده و تکراری.
معرفی پلتفرم AMD Instinct Coder نشان میدهد که بازار در حال حرکت به سمت مدلهای ترکیبی است. با اختصاص دادن گرافیکهای قدرتمندی نظیر MI325X به سرورهای داخلی، سازمانها میتوانند حجم عظیمی از پردازشهای روزمره برنامهنویسان خود را بدون پرداخت هزینه اضافی برای هر توکن، در داخل شبکه خود مدیریت کنند و تنها برای سوالات بسیار پیچیده معماری نرمافزار، به مدلهای گرانقیمت ابری متوسل شوند. این رویکرد، بازگشت سرمایه در تجهیزات سختافزاری را در زمان بسیار کوتاهی تضمین میکند.


