视频生成算法工程师 (Reward Model)
- ShengShu
- Shanghai, Beijing +1 more, China
- CNY 400,000 – CNY 800,000
北京、深圳、上海全职研发 - 算法
职位描述
负责视频生成 reward model、benchmark 和评测、迭代体系建设,把主观视频质量拆解成可训练、可评测、可追踪的多维信号:
- 与数据团队合作,制定和把控视频生成打分标准。
- 对音视频理解专家模型进行质量评估、bad case 收集和持续迭代,如ASR、说话人、音色、语种、音效、音画同步等音频专家模型,以及OCR、目标检测、动作识别、切镜点检测、镜头运动估计等视觉专家模型。
- 训练多维 reward model,包括视觉 RM、音视频 RM、语义遵循 RM、美学 RM、崩坏判定模型等。
- 建立 benchmark 和自动评测 pipeline,结合人工评测、专家模型交叉验证 RM 准确度。
- 发现 benchmark 被 hack、RM 偏置和评测失真问题,持续优化评测可信度。
- 为后训练、数据清洗、模型选型和交付版本提供依据,并结合评测反馈、用户数据,持续迭代 RM。
职位要求
- 熟悉 VLM、多模态理解、视频质量评估与 reward model 设计。
- 有视频评测体系设计、reward model 训练经验优先。
- 具备较强的标准制定和 case 分析能力,能把“观感问题”拆成可执行评测维度。
投递
Skills
- VLM
- Multimodal Understanding
- Video Quality Assessment
- Reward Model Design
- Reward Model Training
- Benchmark design
- Case analysis






