AMD Instinct Coder combina ocho GPU con inferencia híbrida para programación empresarial
PaletteAI distribuye cargas entre modelos locales y externos según políticas. | Créditos: AMD

AMD Instinct Coder combina ocho GPU con inferencia híbrida para programación empresarial

AMD, Super Micro Computer y Spectro Cloud presentaron AMD Instinct Coder, una solución integrada para escalar el desarrollo de software empresarial asistido por IA. La propuesta adopta un esquema híbrido con prioridad local para controlar el procesamiento del código fuente, los modelos utilizados y el costo de inferencia.

AMD y Corea del Sur impulsan un ecosistema de IA soberana
La alianza incorporará chips, software abierto, investigación y formación para fortalecer la infraestructura nacional de inteligencia artificial local

La configuración incorpora dos EPYC 9575F, ocho MI325X y almacenamiento PCIe Gen5

El nodo utiliza el servidor Supermicro AS-8126GS-TNMR con dos procesadores AMD EPYC 9575F de 64 núcleos y 3,3 GHz cada uno, además de ocho GPU AMD Instinct MI325X. La memoria del sistema alcanza 3 TB mediante 24 módulos DDR5 RDIMM 6400 ECC de 128 GB.

El almacenamiento se distribuye entre dos unidades NVMe PCIe Gen4 V6 M.2 de 960 GB y ocho SSD PCIe Gen5 TLC U.2 de 7,68 TB. Para la conectividad, la configuración incorpora dos AMD Pensando Pollara 400 HHHL PCIe NIC, 400 GbE.

El servidor incluye seis fuentes de alimentación redundantes de 5.250 W, organizadas en una configuración 3+3 y con eficiencia de nivel Titanium. Supermicro proporciona tres años de soporte en terreno para el hardware al siguiente día hábil.

AMD y Cerebras Systems anunciaron una alianza técnica para desarrollar una plataforma desagregada de inferencia de IA
La alianza separará el procesamiento de prompts y la generación de tokens para ofrecer inferencia de baja latencia a través de Cerebras Cloud en 2026

PaletteAI enruta las solicitudes entre GLM-5.2 local y modelos de frontera

Spectro Cloud PaletteAI Inference Launchpad administra el ciclo de vida de la IA, la gobernanza y la visibilidad del uso y los costos. El software enruta cada solicitud según las políticas empresariales, la complejidad de la carga, la capacidad del modelo, la disponibilidad de infraestructura y el costo.

La configuración local incorpora el modelo GLM-5.2 optimizado mediante AMD Inference Microservices. Cuando una solicitud requiere capacidades adicionales, PaletteAI puede derivarla a modelos de Anthropic Claude, OpenAI GPT o Google Gemini.

El entorno admite Claude Code, Cursor y Visual Studio Code, mientras cada nodo soporta hasta 50 desarrolladores y 30 usuarios simultáneos. Spectro Cloud entrega soporte integral para la capa de software.

MSI presenta servidores con AMD EPYC de sexta generación
La gama integra sistemas GPU, multinodo y empresariales con diseños SP7 y SP8, refrigeración por aire o líquida y formatos de alta densidad escalables

Dan McNamara, VP sénior y gerente general de Compute & Enterprise AI en AMD, señaló que el despliegue corporativo de asistentes de programación requiere decisiones específicas sobre la infraestructura y el consumo de los modelos.

“Las organizaciones necesitan controlar dónde se procesa el código, qué modelos se utilizan y cuánto cuesta ese uso […]”.

AMD informa, sobre la base de cifras aportadas por Spectro Cloud y no verificadas de forma independiente, un ahorro de tokens hasta un 70% superior frente al uso exclusivo de modelos de frontera y una recuperación estimada de la inversión cercana a seis meses. También consigna hasta un 95% del rendimiento de esos modelos en pruebas de referencia, aunque advierte que los resultados dependen de distintas variables y pueden no ser representativos.