研发

豆包大模型Agent算法工程师-火山方舟

负责豆包大模型Agent算法优化与AI应用开发

字节跳动北京薪资未标注
研发Agentic RLPost-TrainingSFTRLPythonLangGraphLlamaIndexLinux
查看来源页最近更新:05/06 15:41

职位描述

1、Agent的设计与效果优化,训练优化Agent的Driver模型,通过Agent架构优化(工具、上下文管理、编排等)和模型优化(Agentic RL等具体任务的Post-Training),产出效果领先的Agent;

2、设计和开发领先AI应用和解决方案原型,验证产品概念和需求,构建应用评估并优化Agent效果,为火山方舟平台的AI应用提供领先的Agent解决方案;

3、探索Agent Architectures/Structures的上限,在Agent应用研究中最大程度释放模型的能力,以Agent的形式突破现有方法和模型无法解决的问题,做出如AlphaEvolve、Multi-Agent Research System等有影响力的创新工作,识别模型能力缺陷,与Seed深度合作从应用探索反哺基础模型迭代。

职位要求

1、熟悉Agentic RL的方法,了解Agentic RL Infra(例如CodeRL,Reward System),熟悉模型的Post-Training训练技术,能针对特定模型能力问题进行SFT、RL训练优化;

2、精通Python的编程技能,并有构建生产应用程序的经验,具备在Linux开发环境下的开发能力,熟悉至少一种主流大模型应用框架(如LangGraph、LlamaIndex、OpenAI AgentsSDK、GoogleADK等);

3、对大模型和Agent有较深入的理解,熟悉常见的LLM实施模式、提示工程、评估框架、检索框架等,了解Agent Architectures/Structures(Multi-Agent、Context Engineering/Management、ReAct/PlanAct/CodeAct),了解Agent相关的交互协议(MCP、A2A、FunctionCall);

4、具备强大的技术沟通能力,能够创建可扩展的内容(文档、教程、示例代码),同时有较强的项目管理能力和多团队协同能力;熟悉大模型服务,有AI算法相关领域技术背景、AI产品工作经验的优先。

岗位信息

经验要求不限
学历要求不限
岗位类型研发
来源企业官网
发布日期2026-02-01
链接状态检测有效性

相关岗位