HirePortal

AIGC算法工程师

长沙、深圳社招全职互联网 / 电子 / 网游

职位描述

面向AIGC领域,研发前沿的视频生成与处理算法,结合短视频、电商、品牌创意等具体业务场景,进行系统性算法设计,推动自动化剪辑、视频生成、动作迁移、语义驱动等能力落地; 针对当前大模型视频生成中的痛点(如帧一致性、时空建模、长视频连贯性、跨模态对齐等),优化扩散/生成架构、设计稀疏高效推理策略,提高生成质量和响应速度; 开发用于视频创作的底层算法与工具链,包括视频分镜生成、关键帧补全、文本驱动编辑(text-driven editing)、镜头分割与结构化剪辑等能力模块; 持续追踪业界前沿(如Sora、Runway、Kling、Veo等),快速完成benchmark与迁移落地; 深度理解视频内容生产到多渠道分发的完整链路,与产品、运营、创意团队协同,构建适配业务的AI视频引擎与应用原型。

职位要求

计算机视觉、人工智能、多模态生成或相关专业硕士及以上学历,具备视频、图像、三维方向的研究或实战经验;有电商、广告、品牌内容等业务背景者优先; 精通扩散模型(Diffusion)、Transformers(ViT、TimeSformer)、Temporal U-Net、Conditioned Video Generation 等框架;熟悉Motion Module、Video Composer、Latent Consistency Models、Flow-guided Generation、ControlNet等新一代技术模块; 具备以下至少两个方向的经验优先: 文本转视频(Text-to-Video)生成与控制 图像序列生成与视频补全(inpainting, extrapolation) 视频风格迁移/风格保持(Style Transfer / Identity Preservation) 多模态驱动编辑(音频/动作/语义控制) 长视频建模与镜头结构生成 熟悉主流AI视频工具链,如Diffusers、ComfyUI插件体系,掌握FFmpeg、OpenCV、PyTorch等开源工具与部署环境;具备工程化建模与高性能推理经验(如CUDA优化、TensorRT加速、多线程分布式部署); 熟悉视频内容生产流程,了解不同业务场景(如短视频种草、品牌TVC、电商展示、KOC内容)的创意逻辑与交付需求,具备跨团队协作能力与业务理解力; 强烈的自驱力、好奇心和技术热情,愿意持续探索视频生成的边界,追求工程与算法的高融合与高价值交付。

投递

Skills

  • Diffusion Models
  • PyTorch
  • Computer Vision
  • Video Generation
  • Model Optimization
  • CUDA
  • FFmpeg

Related jobs

Anker InnovationsApply for this job