O kernel Linux 7.4 traz o AMD PerfOpt, recurso que reduz o overhead do IOMMU no acesso direto à memória e pode melhorar o desempenho de iGPUs AMD. Em testes, os ganhos em inferência de LLMs chegaram a 23%, o que pode tornar a execução local de modelos mais interessante em máquinas sem GPU dedicada.
Já no lado verde da força, a NVIDIA lançou o CUDA Python 1.0, transformando o Python em uma linguagem de primeira classe para programação em GPU. A grande relevância desse marco é o versionamento semântico, que garante estabilidade de código para os desenvolvedores. Com a nova fundação unificada (cuda.core), grandes bibliotecas como PyTorch e CuPy agora conversam diretamente, eliminando erros de compatibilidade e acelerando a criação de soluções em IA.