Ir al contenido

Research Scientist Intern - Post-Training (RLHF)

¿Es esta oferta para usted?

Cree su CV y descubra su porcentaje de coincidencia con este puesto — y con todos los demás.

Crear mi CV

El puesto

This six-month internship focuses on designing and applying RLHF methods to diffusion-based text-to-image models. You will conduct literature reviews, implement RLHF/DPO techniques, and participate in large-scale model fine-tuning. Design rigorous ablations, establish evaluation metrics, and analyze model performance. Document findings, prepare technical reports, and contribute to an ambitious open-source project and community. Collaborate with researchers across ML, CV, and NLP; opportunities to publish results. Paris-based with hybrid flexibility; on-site work required as necessary; strong background in Python and DL frameworks essential, with preference for PhD or MSc candidates and prior RLHF experience.

Ver la oferta completa

Funciones, perfil, competencias y ventajas — crea tu cuenta gratis.

6 caracteres como mínimo. Cuanto más largo, más seguro.
o

¿Ya tiene una cuenta?

Ofertas similares

Otros puestos que podrían encajar.

Ver todo →

Su ubicación

Las ofertas y empresas se filtrarán por este país.

Sugeridos

Todos los países 66