- AMD y Cerebras dividirán la suposición en dos máquinas, con bastidores Helios manejando el procesamiento rápido y motores a escala de oblea generando tokens, disponibles a través de la nube de Cerebras en el segundo semestre de 2026.
- Nvidia está haciendo algo similar al otorgar la licencia de la tecnología de decodificación SRAM de la startup de chips de inteligencia artificial Groq por 20 mil millones de dólares.
- Este movimiento hace que AMD y Cerebras reclamen 5 veces más tokens por vatio en comparación con una configuración independiente de Cerebras WSE.
AMD y Cerebrus Systems han anunciado una asociación tecnológica que combina el sistema Helios de escala en rack del primero con el motor de escala de oblea del segundo en lo que ambas compañías llaman una solución de inferencia discreta.
La medida permitió que una configuración combinada de AMD Helios y Cerebras WSE entregara hasta cinco veces los tokens por vatio por segundo (TPS/W) en pruebas internas realizadas por ambos diseñadores de chips.
La medida tiene como objetivo abordar el desafío de eficiencia de Cerebrus WSE al descargar el procesamiento rápido a la oferta de escala de rack de AMD.
Último vídeo deTecnologíaRadar
¿Un juego centrado en la ganancia de habilidades?
Tanto AMD como Cerebras Systems están presentando la noticia como una victoria, y es muy posible que lo sea, dada la destreza de este último en el juego y la capacidad del primero para obtener acceso a la tecnología de decodificación SRAM sin gastar los 20 mil millones de dólares que Nvidia desembolsó por un acuerdo no exclusivo a fines del año pasado.
Sin embargo, debe tenerse en cuenta que las afirmaciones de eficiencia de 5 tokens por vatio por segundo se comparan con un Cerebrus WSE (motor a escala de oblea) existente cuando se ejecuta el modelo de código abierto Kimi 2.6 1T, lo que los hace impresionantes, pero sin una comparación directa con las estadísticas cuando una Nvidia carece de contexto, especialmente métricas de contexto.
El concepto en sí está bien establecido y establecido en la industria, donde WSE sabe cómo abordar la parte de ‘precarga’ de la ecuación mientras maneja relativamente bien el segmento de ‘decodificación’, esencialmente reemplazando el hardware de AMD donde el equipo de Cerebra se queda corto.
La elección del km 2,6, sin embargo, merece una segunda mirada. El modelo de Moonshot AI, lanzado el 20 de abril de 2026, es un diseño de mezcla experto con un billón de parámetros totales pero solo 32 mil millones de activos por token, y se envía de forma nativa a INT4. En INT4, todo el conjunto de pesos es de aproximadamente 500 GB. Una sola oblea Cerebras tiene capacidad para 44 GB. Incluso antes de la caché KV, sostener el modelo requería solo una docena de obleas al norte del centro de Cerebras, mientras que un bastidor Helios podía contener unas sesenta veces más.
Esta asimetría significa que la cifra quíntuple se mide en un modelo que sólo es mínimamente favorable a la configuración del WSE. Un modelo más denso, lo suficientemente pequeño como para que sus ocupantes quepan en un puñado de obleas, podría favorecer aún más a Cerebras. Nada de esto hace que el número sea incorrecto, pero justifica la necesidad de pruebas adicionales para demostrar tanto sus fortalezas como sus debilidades para diferentes modelos.
Una asociación sin números, por ahora
Más importante aún, la ausencia de datos financieros podría ser la historia del futuro, especialmente en un momento en que las preocupaciones sobre el ‘financiamiento circular’ están creciendo en una industria donde la reciente decisión de Nvidia de respaldar las compras de centros de datos de OpenAI es vista como un resultado neto negativo por Wall Street, que ya está preocupado por los costos de la IA y la sostenibilidad de tales transacciones.
AMD también ha vinculado en el pasado (y más recientemente con Anthropic) sus propias compras de hardware a inversiones o asociaciones en empresas de inteligencia artificial, que el mercado ha acogido con agrado anteriormente, pero que últimamente puede ver con un poco más de hostilidad.
El anuncio llega en un momento en el que Cerebra puede necesitar más que AMD: Cerebra cotizó en el Nasdaq en mayo, con un precio de 185 dólares, abrió en 350 dólares y cerró en 311,07 dólares en su primer día antes de volver a caer a alrededor de 227 dólares a finales de junio de 2026.
Por otro lado, las acciones de AMD han subido un 121,48% en lo que va del año (YTD), ya que los inversores continúan apostando fuertemente por su nuevo procesador Instinct AI y la asociación con Cerebrus le permite consolidar aún más sus ganancias, lo que podría verse como otro voto de confianza en la dirección actual de uno de sus clientes potenciales.
Siga TechRadar en Google News Y Agréguenos como fuente preferida Recibe noticias, reseñas y opiniones de nuestros expertos en tu feed.