ASICs para LLMs e chips de inferência especializados (por que eles importam)
ASICs e silício personalizado impulsionam a velocidade e a eficiência da inferência de LLMs
O futuro da IA não se trata apenas de modelos mais inteligentes. Trata-se também de silício que corresponda à maneira como esses modelos são realmente servidos. O hardware especializado para inferência de LLM segue um caminho reminiscente da transição do mineração de Bitcoin de GPUs para ASICs de propósito específico, mas com restrições mais difíceis, pois os modelos e as receitas de precisão continuam a evoluir.