AI Operations and Reliability

Inference Optimization Engineer (Ingeniero de Eficiencia de Inferencia)

Un Inference Optimization Engineer reduce costo y latencia de inferencia: cuantización, batching, estrategias de KV-cache, kernels custom.

Salario mediano

$200,000 USD

Crecimiento

very high

Disrupción IA

15/10

Ver guía completa en inglés →