LLM 算法研究员(后训练方向)
全职北京
领域模型后训练与落地:SFT / RLHF / DPO、数据配比、评测,以及 RAG / Agent 检索编排。论文与生产同频。
- 计算机或相关方向硕士及以上,博士优先
- 3 年以上 NLP/LLM 研究;精通 Python / PyTorch
- 独立跑通过 SFT / RLHF / DPO 全流程
- ACL / EMNLP / NeurIPS / ICLR 一作或同等开源影响力
加入我们
办公地点
全球总部 · 新加坡
市中心 CapitaGreen 24 层,面向国际客户与合作伙伴。新加坡团队在扩。


中国总部 · 北京
朝阳公园南路,地铁 14 号线朝阳公园站步行可达。研发主场。
为什么加入
代码跑在省级政务与大型客户环境里。
LLM、RAG、Agent——跟论文与产品一起迭代。
决策快,对结果负责,不堆层级。
开放职位
领域模型后训练与落地:SFT / RLHF / DPO、数据配比、评测,以及 RAG / Agent 检索编排。论文与生产同频。
一条产品线的架构与政企交付:React/Next.js + Python/FastAPI + PostgreSQL,多为私有化上线。
文档智能与合同自动化产品线:对接医院、高校与政企决策层,把需求落到可验收方案。
政企客户拓展与成单:需求、演示、谈判、签约后衔接交付。对方常是信息中心与技术负责人。