base北京、深圳
核心亮点:深度参与万亿级文心大模型进化|Data-Centric核心实践|万卡集群+PB级数据实战|
AI前沿赛道高成长空间
【工作职责】
·深入挖掘万亿级预训练/对齐数据规律,共同探索数据分布与模型Scaling Law的关联,支撑模
型核心迭代。
·参与设计SFT/RLHF阶段数据筛选与增强策略,支持LLM-as-a-Judge相关方案的落地,提升
模型对齐质量。
·协同搭建工业级数据治理流水线,优化大规模数据处理流程,支撑万卡集群的高效并行训练。
·支持研发Auto-Eval评测框架与基准,助力模型从训练到评估的全闭环落地。
【任职要求】
·在读硕士及以上学历,计算机/数学/统计等相关专业。
·编程功底扎实,精通 Python,熟悉C++/Go其一者优先。
·了解Transformer架构,对LLM预训练、SFT、RLHF流程有基本认知,拥有极强的自驱力与
学习热情。
·具备基础NLP知识,有大规模分布式数据处理(Spark/Flink/Ray等)相关实践或学习经历者优
先。
·关注AI前沿动向,面对复杂且充满挑战的大模型工程问题,能高效配合团队完成目标拆解与落
地。
【加分项】
·在ACL、EMNLP、NeurlPS等AI相关顶会发表过论文,或有高水平开源项目贡献。
·有RAG(检索增强生成)、Agent 智能体相关学习与实际项目经验。
·在Kaggle、天池等知名数据/算法竞赛中获得过优异成绩。