AMD, Super Micro Computer y Spectro Cloud presentaron AMD Instinct Coder, una solución integrada para escalar el desarrollo de software empresarial asistido por IA. La propuesta adopta un esquema híbrido con prioridad local para controlar el procesamiento del código fuente, los modelos utilizados y el costo de inferencia.

La configuración incorpora dos EPYC 9575F, ocho MI325X y almacenamiento PCIe Gen5
El nodo utiliza el servidor Supermicro AS-8126GS-TNMR con dos procesadores AMD EPYC 9575F de 64 núcleos y 3,3 GHz cada uno, además de ocho GPU AMD Instinct MI325X. La memoria del sistema alcanza 3 TB mediante 24 módulos DDR5 RDIMM 6400 ECC de 128 GB.
El almacenamiento se distribuye entre dos unidades NVMe PCIe Gen4 V6 M.2 de 960 GB y ocho SSD PCIe Gen5 TLC U.2 de 7,68 TB. Para la conectividad, la configuración incorpora dos AMD Pensando Pollara 400 HHHL PCIe NIC, 400 GbE.
El servidor incluye seis fuentes de alimentación redundantes de 5.250 W, organizadas en una configuración 3+3 y con eficiencia de nivel Titanium. Supermicro proporciona tres años de soporte en terreno para el hardware al siguiente día hábil.

PaletteAI enruta las solicitudes entre GLM-5.2 local y modelos de frontera
Spectro Cloud PaletteAI Inference Launchpad administra el ciclo de vida de la IA, la gobernanza y la visibilidad del uso y los costos. El software enruta cada solicitud según las políticas empresariales, la complejidad de la carga, la capacidad del modelo, la disponibilidad de infraestructura y el costo.
La configuración local incorpora el modelo GLM-5.2 optimizado mediante AMD Inference Microservices. Cuando una solicitud requiere capacidades adicionales, PaletteAI puede derivarla a modelos de Anthropic Claude, OpenAI GPT o Google Gemini.
El entorno admite Claude Code, Cursor y Visual Studio Code, mientras cada nodo soporta hasta 50 desarrolladores y 30 usuarios simultáneos. Spectro Cloud entrega soporte integral para la capa de software.

Dan McNamara, VP sénior y gerente general de Compute & Enterprise AI en AMD, señaló que el despliegue corporativo de asistentes de programación requiere decisiones específicas sobre la infraestructura y el consumo de los modelos.
“Las organizaciones necesitan controlar dónde se procesa el código, qué modelos se utilizan y cuánto cuesta ese uso […]”.
AMD informa, sobre la base de cifras aportadas por Spectro Cloud y no verificadas de forma independiente, un ahorro de tokens hasta un 70% superior frente al uso exclusivo de modelos de frontera y una recuperación estimada de la inversión cercana a seis meses. También consigna hasta un 95% del rendimiento de esos modelos en pruebas de referencia, aunque advierte que los resultados dependen de distintas variables y pueden no ser representativos.


