美国创业公司招大模型数据工程师(可远程)

Kevin 2026-09-04 12:10 1

美国创业公司招大模型数据工程师,具体要求如下,感兴趣的请私信我邮箱和简历


职位描述:


你将端到端负责从RL数据的任务与环境设计、轨迹生成、rubric/verifier/reward 构建,到质量管理、eval分析和客户交付。


岗位职责:




  1. 设计 coding / agentic 场景的 SFT 与 RL 训练数据:任务构造、难度分层、轨迹采集、评分标准与奖励设计




  2. 深度使用 Claude Code / Codex 等 coding agent,系统性拆解其能力边界与失败模式,转化为数据任务设计




  3. 搭建可复现的执行环境:依赖安装、容器隔离、自动化测试、超时与资源限制、批量 rollout,人工抽检,去重等等




  4. 围绕主流 coding benchmark(Terminal-Bench, NL2Repo, DeepSWE, long horizon coding benchmark等)做分析设计;识别数据污染和验证器被钻空子的情况




  5. 搭建数据质量体系:自动化校验、可执行验证、去重、人工抽检流程




  6. 直接对接客户,把模糊的能力目标翻译成任务规范和验收标准




任职要求:




  1. 熟练使用至少一种 coding agent,有大量实操而非浅尝(面试会聊你踩过的具体坑)




  2. 扎实的基本代码工程能力,能独立搭建容器化 / sandbox 执行与评测环境




  3. 理解 SFT / RLHF / RLVR / rejection sampling / reward model 基本原理




  4. 英语可作为工作语言,能直接参会和写技术文档




加分项:




  1. LLM research 方向在读或已毕业博士




  2. 有 benchmark 建设、agent 评测、合成数据 pipeline 落地经验




  3. 有相关开源贡献或论文




每月薪资:50k~70k,能力强可以更多,额外给期权


职位福利:五险一金,可远程工作,支持参加顶会等


工作时间地点自由,可远程办公

最新回复 (5)
  • NONONO 09-04 12:33
    1楼

    英语不好咋弄,就是做数据呗简单来说

  • Kevin 楼主 09-04 12:35
    2楼

    简单说是的,但是其实很难的,现在要设计fable 5.1做不出来的题目可不简单,你要是有信心可以私信我,我们有笔试和面试的

  • 魔力鸽 09-04 12:39
    3楼

    相当于基于甲方要求设计RLHF数据标注系统,主要是对接国外的客户吗?

  • Kevin 楼主 09-04 12:39
    4楼

    不是标注系统,而是RL数据本身,佬要是感兴趣可以私信我

  • Samuel 10-02 21:51
    5楼

    嗨 Kevin,我看到了你发布的编码智能体 SFT 和强化学习数据工程师招聘帖,也注意到你提到你们做的是强化学习数据本身。我目前没有应聘的打算,想请教一下:你们公司是否也会考虑采购或授权外部开发者已有的编码智能体训练数据或完整轨迹(例如 Codex 或 Claude Code 的真实使用记录)?还是目前主要根据客户需求设计新任务并采集轨迹?

    如果方便的话,能否帮忙问问团队是否对这类现成数据有需求?如果有兴趣,欢迎私信我,我们可以进一步聊聊。谢谢!

* 帖子来源Linux.do
返回