Ir al contenido

Machine Learning Engineer | Python | PyTorch | Distributed Training | GPU | Hybrid

¿Es esta oferta para usted?

Cree su CV y descubra su porcentaje de coincidencia con este puesto — y con todos los demás.

Crear mi CV

El puesto

Productize and optimize models from research into reliable, performant, and cost-efficient services with clear SLOs.
Scale training across nodes/GPUs (DDP/FSDP/ZeRO, pipeline/tensor parallelism) and own throughput/time-to-train via profiling and optimization.
Implement model-efficiency techniques (quantization, distillation, pruning, KV-cache, Flash Attention) for training and inference without materially degrading quality.
Build and maintain model-serving systems (vLLM/Triton/ONNX/TensorRT/AITemplate) with batching, streaming, caching, and memory management.
Integrate with vector/feature stores and data pipelines (FAISS/Milvus/Pinecone/pgvector; Parquet/Delta) as needed for production.
Define and track performance and cost KPIs; run continuous improvement loops and capacity planning; partner with ML Ops and scientists on handoffs and evaluations.

Ver la oferta completa

Funciones, perfil, competencias y ventajas — crea tu cuenta gratis.

6 caracteres como mínimo. Cuanto más largo, más seguro.
o

¿Ya tiene una cuenta?

Ofertas similares

Otros puestos que podrían encajar.

Ver todo →

Su ubicación

Las ofertas y empresas se filtrarán por este país.

Sugeridos

Todos los países 66