AMD adquirió Taalas, una startup de Toronto que graba los pesos de modelos de IA directamente en el silicio de sus chips. El primer prototipo sirvió Llama 3.1 8B a 16.960 tokens por segundo, y AMD planea combinarlo con sus GPU Instinct en despliegues de inferencia a gran escala.