返回所有职位列表
【社会招聘】 强化学习算法工程师(游戏AI玩家方向)
工作地点: 广州市
招聘人数: 1 人
职位描述:
1. 负责游戏AI玩家/智能对手/NPC的算法研发与落地,覆盖对战、陪练、剧情交互等场景;
2. 基于深度强化学习(PPO/DQN/MARL)+模仿学习+规则,构建高拟人、强对抗、多样化的AI策略;
3. 设计并实现状态表征、动作空间、奖励函数、课程学习,提升AI学习效率与对战体验;
4. 负责模型训练、调优、仿真验证、线上部署与监控,保障AI稳定、高性能运行;
5. 跟踪前沿技术(多智能体、Self-play、LLM+RL、分布式训练),推动技术创新与复用;
6. 与策划、客户端、服务端协作,理解游戏规则与数值,迭代AI难度与风格。
任职要求:
1. 计算机/人工智能/数学/自动化等相关专业,硕士及以上学历;
2. 扎实的强化学习理论与实践,精通 PPO、DQN、SAC、MARL、Self-play;
3. 熟练使用PyTorch/TensorFlow,有游戏AI玩家/NPC上线实战经验;
4. 热爱游戏,熟悉至少一类游戏(MOBA/射击/卡牌/棋牌)的对战逻辑与策略;
5. 具备良好的工程能力,能独立完成算法设计、训练、部署与迭代。

加分项
- 有非完全信息博弈、多智能体对抗、自我对弈项目经验;
- 有LLM+强化学习融合做决策/对话型AI经验;
- 有大规模分布式训练、模型压缩、推理优化经验;
- 顶会论文(ICML/NeurIPS/AAAI)或知名开源项目贡献;
- 游戏开发/策划背景,深刻理解游戏数值与玩家体验。

投递信息

强化学习算法工程师(游戏AI玩家方向)

*3个月内允许投递2次,投递后不支持修改,请谨慎选择

主动投递后三个月内将无法再被员工内推,如果你有在三七互娱工作的朋友,请优先选择内推
完善简历 确认投递
 
用 户 登 录

还没有帐号?立即注册忘记密码?

用 户 注 册
请使用邮箱注册,它将用于登录和找回密码
6-20位,必须包含字母和数字,区分大小写
请再输入一次密码

已有帐号?直接登录