صفحه اصلی > اخبار : پلتفرم AMD Instinct Coder با ۸ گرافیک MI325X معرفی شد؛ ادعای کاهش ۷۰ درصدی هزینه‌های توکن AI

پلتفرم AMD Instinct Coder با ۸ گرافیک MI325X معرفی شد؛ ادعای کاهش ۷۰ درصدی هزینه‌های توکن AI

پلتفرم AMD Instinct Coder با ۸ گرافیک MI325X معرفی شد؛ ادعای کاهش ۷۰ درصدی هزینه‌های توکن AI

شرکت‌های AMD، Spectro Cloud و Supermicro به صورت مشترک از پلتفرم سازمانی جدیدی با نام AMD Instinct Coder رونمایی کردند. این زیرساخت اعتبارسنجی‌شده، به طور ویژه برای پردازش‌های استنتاجی در حوزه تولید و توسعه کد توسط هوش مصنوعی طراحی شده است. این راهکار با ترکیب شتاب‌دهنده‌های گرافیکی AMD Instinct، زیرساخت‌های سرور Supermicro و پلتفرم نرم‌افزاری PaletteAI امکان استقرار محیط‌های هوش مصنوعی خصوصی و هیبریدی را به شکلی یکپارچه فراهم می‌کند.

معماری ترکیبی؛ تعادل میان پردازش محلی و مدل‌های ابری

این معماری برای سازمان‌ها، ارائه‌دهندگان خدمات ابری و اپراتورهای هوش مصنوعی حاکمیتی طراحی شده است که نیاز دارند تعادلی دقیق میان پردازش‌های محلی، دسترسی به مدل‌های پیشگام، حاکمیت عملیاتی و میزان مصرف توکن ایجاد کنند. پلتفرم AMD Instinct Coder به جای ارسال تمام درخواست‌های تولید کد به مدل‌های زبانی بزرگ خارجی، از سیستم مسیریابی مبتنی بر سیاست استفاده می‌کند.

این سیستم به صورت هوشمند تشخیص می‌دهد که آیا یک درخواست می‌تواند توسط مدل مستقر در شبکه محلی پردازش شود یا نیازمند ارسال به یک مدل پیشرفته خارجی است. کارهای روتین مانند تولید کدهای پایه، خلاصه‌سازی و خطایابی‌های ساده به صورت محلی انجام می‌شوند، در حالی که استدلال‌های پیچیده به مدل‌های ابری سپرده خواهند شد. شرکای این پروژه ادعا می‌کنند که این استراتژی می‌تواند هزینه‌های توکن‌های برنامه‌نویسی با هوش مصنوعی را تا ۷۰ درصد کاهش دهد.

بحران هزینه‌های توکن و پیش‌بینی‌های گارتنر

معرفی این پلتفرم در زمانی اتفاق می‌افتد که سازمان‌ها در حال مقیاس‌پذیری ابزارهای برنامه‌نویسی هوش مصنوعی در بین تیم‌های توسعه خود هستند. موسسه تحقیقاتی گارتنر در گزارش ژوئن ۲۰۲۶ خود هشدار داده بود که در صورت عدم وجود یک مدل عملیاتی ساختاریافته، افزایش تصاعدی مصرف توکن‌ها می‌تواند به نقطه‌ای برسد که هزینه توکن‌های هوش مصنوعی از میانگین حقوق یک برنامه‌نویس در سال ۲۰۲۸ فراتر رود.

پلتفرم AMD Instinct Coder مستقیماً این نگرانی را از طریق قابلیت‌هایی نظیر مسیریابی مدل، اندازه‌گیری دقیق مصرف، تعیین سهمیه برای کاربران و اعمال سیاست‌های کاری برطرف می‌کند.

مشخصات سخت‌افزاری و نرم‌افزاری سیستم مرجع

پیکربندی اولیه این سیستم بر پایه پردازنده‌های گرافیکی AMD Instinct MI325X بنا شده است. هر شتاب‌دهنده MI325X دارای ۲۵۶ گیگابایت حافظه HBM3E بوده و پهنای باند حافظه آن به ۶ ترابایت بر ثانیه می‌رسد که برای پردازش‌های سنگین هوش مصنوعی مولد کاملاً ایده‌آل است. پردازش‌های محلی روی مدل GLM-5.2 که از طریق میکروسرویس‌های استنتاجی AMD بهینه‌سازی شده، اجرا می‌شوند.

بخشمشخصات مرجع پلتفرم AMD Instinct Coder
سرور پایهSupermicro AS-8126GS-TNMR
پردازنده اصلی2 x AMD EPYC 9575F, 64 cores, 3.3GHz
کارت گرافیک8 x AMD Instinct MI325X
حافظه رم3TB (24 x 128GB) DDR5 RDIMM 6400 ECC
فضای ذخیره‌سازی داده8 x 7.68TB PCIe Gen5 TLC U.2 SSD
تجهیزات شبکه2 x AMD Pensando Pollara 400 HHHL PCIe NIC, 400GbE
منبع تغذیه (پاور)6 x 5250W (3+3 Redundant) Titanium-level
نرم‌افزار پلتفرمSpectro Cloud PaletteAI Inference Launchpad
مدل‌های پشتیبانی‌شدهLocal: GLM-5.2 | Frontier: Claude, GPT, Gemini
ابزارهای توسعهClaude Code, Cursor, Visual Studio Code
ظرفیت پشتیبانیUp to 50 developers (30 concurrent) per node

نقش استراتژیک Supermicro و Spectro Cloud

شرکت Supermicro زیرساخت‌های فیزیکی این پلتفرم را تامین می‌کند. سیستم‌های تاییدشده این شرکت شامل پلتفرم‌های مجهز به ۸ گرافیک با پشتیبانی از سیستم‌های خنک‌کننده بادی و مایع است. از سوی دیگر، نرم‌افزار PaletteAI Inference Launchpad از شرکت Spectro Cloud لایه عملیاتی را تشکیل می‌دهد. این لایه امکان جداسازی محیط‌ها برای تیم‌ها، تعیین محدودیت مصرف توکن و حفظ اتصال بازگشتی به مدل‌های ابری را مدیریت می‌کند.

نتیجه این همکاری، ایجاد یک معماری استنتاجی لایه‌بندی‌شده است. دن مک‌نامارا، مدیر ارشد بخش هوش مصنوعی سازمانی در AMD، این تغییر را انتقال فرآیند برنامه‌نویسی با هوش مصنوعی از یک ابزار فردی توسعه‌دهنده به یک تصمیم پلتفرمی در سطح سازمان توصیف کرده است.

تحلیل اختصاصی آلفاتک: شیفت استراتژیک از سرورهای ابری به زیرساخت‌های محلی

تا پیش از این، اکثر سازمان‌ها برای استفاده از دستیارهای برنامه‌نویسی هوشمند کاملاً به رابط‌های برنامه‌نویسی شرکت‌هایی نظیر OpenAI و Anthropic وابسته بودند. این وابستگی دو مشکل اساسی ایجاد می‌کرد: اول، خروج کدهای حساس و اختصاصی از شبکه‌های امن سازمانی و دوم، هزینه‌های سرسام‌آور توکن‌ها برای پردازش کدهای بسیار ساده و تکراری.

معرفی پلتفرم AMD Instinct Coder نشان می‌دهد که بازار در حال حرکت به سمت مدل‌های ترکیبی است. با اختصاص دادن گرافیک‌های قدرتمندی نظیر MI325X به سرورهای داخلی، سازمان‌ها می‌توانند حجم عظیمی از پردازش‌های روزمره برنامه‌نویسان خود را بدون پرداخت هزینه اضافی برای هر توکن، در داخل شبکه خود مدیریت کنند و تنها برای سوالات بسیار پیچیده معماری نرم‌افزار، به مدل‌های گران‌قیمت ابری متوسل شوند. این رویکرد، بازگشت سرمایه در تجهیزات سخت‌افزاری را در زمان بسیار کوتاهی تضمین می‌کند.

سوالات متداول

پلتفرم AMD Instinct Coder دقیقاً چیست؟
یک پلتفرم سخت‌افزاری و نرم‌افزاری یکپارچه است که به سازمان‌ها اجازه می‌دهد مدل‌های هوش مصنوعی تولید کد را در سرورهای محلی خود اجرا کرده و وابستگی به مدل‌های پولی ابری را کاهش دهند.
مسیریابی مبتنی بر سیاست در این پلتفرم چگونه کار می‌کند؟
این سیستم نرم‌افزاری سوالات برنامه‌نویسان را تحلیل می‌کند؛ اگر سوال ساده یا کدهای روتین باشد، آن را به مدل رایگان نصب‌شده روی سرور محلی می‌فرستد. اما اگر سوال به استدلال پیچیده نیاز داشته باشد، آن را به مدل‌های ابری پیشرفته ارجاع می‌دهد.
هر گره پردازشی از این سرور چه تعداد برنامه‌نویس را پشتیبانی می‌کند؟
بر اساس مشخصات اعلام شده، یک سرور مجهز به ۸ گرافیک MI325X می‌تواند تا ۵۰ توسعه‌دهنده را پوشش دهد که ۳۰ نفر از آن‌ها می‌توانند به صورت همزمان از هوش مصنوعی تقاضای تولید کد داشته باشند.
تولید محتوا برای من فقط نوشتن نیست؛ ترجمه دنیای پیچیده فناوری به زبانی روشن، دقیق و قابل فهم است.به‌عنوان کارشناس تولید محتوا در حوزه فناوری اطلاعات و تکنولوژی، تمرکزم بر خلق محتوایی است که هم از نظر فنی معتبر باشد و هم برای مخاطب ارزش واقعی ایجاد کند. از مفاهیم تخصصی IT و زیرساخت‌های شبکه گرفته تا هوش مصنوعی، امنیت سایبری و تحولات دیجیتال، تلاش می‌کنم هر موضوع را با نگاهی تحلیلی و ساختاریافته ارائه دهم.
مقالات مرتبط

سقوط ۲۰ درصدی عرضه پردازنده‌های دسکتاپ؛ رکوردشکنی تاریخی AMD در بازار

سقوط ۲۰ درصدی عرضه پردازنده‌های دسکتاپ؛ رکوردشکنی تاریخی AMD در بازار سه…

شهریور 1, 1405

مایکروسافت نرم‌افزارهای نورپردازی قطعات را مقصر کرش کردن ویندوز ۱۱ معرفی کرد

مایکروسافت نرم‌افزارهای نورپردازی قطعات را مقصر کرش کردن ویندوز ۱۱ معرفی کرد…

شهریور 1, 1405

بازتولید نوارهای کاست مکسل دهه ۱۹۷۰؛ پیوند نوستالژی و فناوری کلاسیک

بازتولید نوارهای کاست مکسل دهه ۱۹۷۰؛ پیوند نوستالژی و فناوری کلاسیک شرکت…

شهریور 1, 1405

دیدگاهتان را بنویسید