Zum Inhalt springen

Senior Research Scientist, Reward Models

Ist diese Stelle etwas für Sie?

Erstellen Sie Ihren Lebenslauf und entdecken Sie Ihre Übereinstimmung mit dieser Stelle — und mit allen anderen.

Lebenslauf erstellen

Die Stelle

Lead cutting-edge research on reward model architectures and RLHF training for large language models.
Develop rubric-based grading and evaluation methods to improve interpretability and consistency.
Study reward hacking, specification gaming, and robust alignment strategies.
Design large-scale experiments to assess generalization, robustness, and failure modes.
Collaborate with Finetuning and Alignment Science teams to translate insights into production improvements.
Mentor researchers, publish findings, and grow institutional knowledge around reward modeling.

Die vollständige Anzeige sehen

Aufgaben, Anforderungen, Kompetenzen und Vorteile — mit Ihrem kostenlosen Konto.

Mindestens 6 Zeichen. Je länger, desto sicherer.

Bereits ein Konto? Anmelden

Ähnliche Stellen

Weitere Positionen, die passen könnten.

Alle ansehen →

Ihr Ort

Stellen und Unternehmen werden nach diesem Land gefiltert.

Vorschläge

Alle Länder 66