研发

豆包大模型算法工程师(互动娱乐)-火山方舟

负责大模型算法优化,包括Character-LLM、Agent及语音S2S

字节跳动北京薪资未标注
研发大模型RLGRPOPPODAPOC/C++PythonNeurIPSICMLICLRCVPRICCVACLKDDACMICPC
查看来源页最近更新:05/06 15:41

职位描述

1、负责参与Character-LLM迭代优化,包括但不限于数据合成、数据筛选、数据分析、Posttraining等任务;

2、负责参与游戏Agent和CodeAgent任务的设计,环境的构建、Reward的设计以及保障RL的正确训练;

3、负责语音S2S在通用任务上基础能力的优化,支持类似FC、RAG等场景;负责语音S2S在角色扮演及真人对话上拟人能力的提升;

4、对RM、RL、Agent有技术探索的热情。

职位要求

1、计算机相关专业本科及以上学历,一年及以上大模型算法工作经验,有相关方向技术和研究背景的候选人优先;

2、有RL训练经验,熟悉如GRPO、PPO、DAPO,有较强的RL分析和改进经验;

3、优秀的代码能力、数据结构和基础算法功底,C/C++或Python熟练;

4、有领域顶级会议文章(NeurIPS、ICML、ICLR、CVPR、ICCV、ACL、KDD等)、有编程/AI比赛获奖(ACM/ICPC、NOI/IOI、Top Coder、Kaggle等)优先;

5、熟悉大模型相关的算法和技术,在相关领域有过良好研究记录者优先,熟悉业界前沿评估方法者优先;

6、在大模型领域,主导参与过大影响力的项目或论文者优先;出色的独立分析和解决问题的能力,能深入解决大模型评估优化和应用存在的问题;良好自驱力和沟通协作能力,能和团队一起探索新技术,推进技术进步。

岗位信息

经验要求1-3年
学历要求本科
岗位类型研发
来源企业官网
发布日期2025-08-05
链接状态检测有效性

相关岗位