logo
登录 / 注册

大语言模型强化学习算法研究工程师

头像
邓云芬
06-01 · CEO&猎头专家
需求:多人 地点:北京/上海 年龄:90后 职级:P8-P10 关键词RLHF、 Reward Model方向,强化学习RLHF、奖励模型Reward Model 职位描述 1、擅长发现优化大模型的简单、普适的创意,并应用到各个规模的模型中提升效果; 2、探索超大规模模型边界,并进行深度系统优化,提升模型性能和效率; 3、推进数据建设、指令微调、偏好对齐、模型优化方面的工作,提高模型质量和适应性; 4、相关应用落地,包括生成创作、逻辑推理、代码生成等; 5、深入研究和探索模型在未来生活中的更多使用场景,拓展模型的应用范围。 职位要求 1、优秀的代码能力、数据结构和基础算法功底,熟练C/C++或Python; 2、熟悉NLP、CV相关的算法和技术,在相关领域有过良好研究记录者优先,熟悉大模型训练、RL算法者优先; 3、在大模型领域,主导过有影响力的项目或论文者优先; 4、出色的问题分析和解决能力,能深入解决大模型训练和应用存在的问题; 5、良好的沟通协作能力,能和团队一起探索新技术,推进技术进步。
大语言模型强化学习算法研究工程师脉脉
阅读 1
声明:本文内容由脉脉用户自发贡献,部分内容可能整编自互联网,版权归原作者所有,脉脉不拥有其著作权,亦不承担相应法律责任。如果您发现有涉嫌抄袭的内容,请发邮件至maimai@taou.com,一经查实,将立刻删除涉嫌侵权内容。
相关推荐
最新发布
大家都在看
热门人脉圈
    头像
    我来说几句...