HirePortal

视频生成算法工程师 (Reward Model)

  • ShengShu
  • Shanghai, Beijing +1 more, China
  • CNY 400,000 – CNY 800,000

北京、深圳、上海全职研发 - 算法

职位描述

负责视频生成 reward model、benchmark 和评测、迭代体系建设,把主观视频质量拆解成可训练、可评测、可追踪的多维信号:

  1. 与数据团队合作,制定和把控视频生成打分标准。
  2. 对音视频理解专家模型进行质量评估、bad case 收集和持续迭代,如ASR、说话人、音色、语种、音效、音画同步等音频专家模型,以及OCR、目标检测、动作识别、切镜点检测、镜头运动估计等视觉专家模型。
  3. 训练多维 reward model,包括视觉 RM、音视频 RM、语义遵循 RM、美学 RM、崩坏判定模型等。
  4. 建立 benchmark 和自动评测 pipeline,结合人工评测、专家模型交叉验证 RM 准确度。
  5. 发现 benchmark 被 hack、RM 偏置和评测失真问题,持续优化评测可信度。
  6. 为后训练、数据清洗、模型选型和交付版本提供依据,并结合评测反馈、用户数据,持续迭代 RM。

职位要求

  1. 熟悉 VLM、多模态理解、视频质量评估与 reward model 设计。
  2. 有视频评测体系设计、reward model 训练经验优先。
  3. 具备较强的标准制定和 case 分析能力,能把“观感问题”拆成可执行评测维度。

投递

Skills

  • VLM
  • Multimodal Understanding
  • Video Quality Assessment
  • Reward Model Design
  • Reward Model Training
  • Benchmark design
  • Case analysis

Related jobs

ShengShuApply for this job