AI Operations and Reliability

Inference Optimization Engineer (Engenheiro de Eficiência de Inferência)

Um Inference Optimization Engineer reduz custo e latência de inferência: quantização, batching, estratégias de KV-cache, kernels custom.

Salário mediano

$200,000 USD

Crescimento

very high

Disrupção IA

15/10

Ver guia completo em inglês →