校招

大语言模型算法研究员(数据智能)-火山引擎

优化大语言模型数据合成算法,支持模型训练与应用落地

字节跳动北京薪资未标注
校招大语言模型数据增强预训练SFTRLHFCode-LLM逻辑推理NL2Code复杂推理链LLM Test-Time ComputeParameter-Efficient FinetuningRAGQA机器人数据洞察AI CodingScaling LawPyTorchHuggingfaceEmbedding
查看来源页最近更新:05/06 15:41

职位描述

1、数据增强算法优化,优化预训练/SFT/RLHF阶段的数据合成算法,提升训练数据的准确性、多样性和领域适配性;

2、支持大模型研发,参与Code-LLM与逻辑推理大模型的训练创新,攻克NL2Code、复杂推理链生成等技术难点,推进LLMTest-TimeCompute、Parameter-EfficientFinetuning等技术落地实践;

3、推动大模型应用落地,探索包括RAG-QA机器人、数据洞察机器人、 AICoding等在真实场景的应用价值,并基于评估体系实现应用效果的持续迭代;

4、跟进开源SOTA大模型,探索大模型ScalingLaw并实践开源大模型在数据智能领域的Post-Training,沉淀技术专利。

职位要求

1、硕士及以上学位,计算机科学/人工智能/应用数学等相关专业,顶会(ACL/NeurIPS/ICML/EMNLP/ICLR)论文或竞赛获奖者优先;

2、扎实的深度学习技术基础,熟悉深度学习训练框架(PyTorch/Huggingface)等,了解常见大语言模型、Embedding架构和训练方法优先;

3、优秀的问题分析解决能力,以及良好的沟通协作能力,能和团队一起探索新技术。

岗位信息

经验要求不限
学历要求硕士
岗位类型校招
来源企业官网
发布日期2025-08-21
链接状态检测有效性

相关岗位