AMD une Helios con Cerebras WSE para lograr hasta 5x más tokens por segundo por vatio
AMD integrará Helios con Cerebras Wafer-Scale Engine, combinando su plataforma de inteligencia artificial a escala de rack con un procesador construido sobre una oblea completa. La propuesta promete hasta 5x más tokens por segundo por vatio, además de menor latencia durante la generación de respuestas en modelos avanzados. La colaboración aplicará inferencia desagregada, separando el … AMD une Helios con Cerebras WSE para lograr hasta 5x más tokens por segundo por vatio









