• 外包信息请发到 /go/outsourcing 节点。
• 不要把相同的信息发到不同的节点
yjpeminem0604
V2EX  ›  酷工作

招聘: LLM 后训练工程师 (角色扮演对话模型类型)

  •  
  •   yjpeminem0604 · 1 day ago · 729 views
    在 V2 已经招到 5 个以上全职远程的小伙伴了,目前都已经稳定在职,团队还在继续扩充

    目前的缺口有 LLM 后训练的算法工程师岗位,AIGC 创作的内容运营岗位,AI 伴侣产品岗位

    美国主体公司,有自己的 GPU 集群,支持远程全职,欢迎投递

    岗位薪资标准:20-40k/月

    ## 岗位职责

    - 负责大语言模型的 SFT 、偏好优化及相关后训练工作;
    - 建设训练数据的采集、清洗、去重、标注和质量评估流程;
    - 设计模型评测集和评价指标,分析训练前后的能力变化;
    - 组织候选回答生成、人工评审和高质量训练样本生产;
    - 优化训练参数、数据配比、上下文长度和 Chat Template ;
    - 完成模型训练、推理部署、版本管理和线上效果跟踪;
    - 根据产品反馈定位模型、数据、Prompt 或推理环节的问题。

    ## 任职要求

    - 熟悉 Python 、PyTorch 、Transformers 等技术栈;
    - 有大语言模型 SFT 、LoRA/QLoRA 或偏好优化实战经验;
    - 理解生成模型的数据格式、损失计算、上下文截断和训练流程;
    - 能够独立完成数据处理、训练实验、效果评测和问题分析;
    - 具备良好的实验设计能力,重视数据隔离、可复现性和评测可信度;
    - 对语言质量、指令遵循、多轮对话和长上下文能力有判断力;
    - 具备较强的工程能力和跨团队沟通能力。

    ## 加分项

    - 有对话模型、角色扮演、互动叙事或创意写作模型经验;
    - 熟悉 TRL 、PEFT 、vLLM 、DeepSpeed 或同类工具;
    - 有 DPO 、KTO 、奖励模型或人工反馈数据经验;
    - 有模型评测、数据标注平台或线上模型迭代经验;
    - 有可展示的模型、数据集、代码或实验报告。

    符合的同学欢迎投递简历至以下渠道(投递默认为可以接受小型任务测试):

    联系邮箱( Base64 ):cGVhY2hsYW5kYWlAZ21haWwuY29t

    联系 TG ( Base64 ):QGN6YWs5
    2 replies    2026-08-27 20:49:45 +08:00
    amoia50
        1
    amoia50  
       21h 38m ago via iPhone
    背景符合,薪资是美金吗,人民币有点低
    youyang
        2
    youyang  
       16h 3m ago
    还缺后端吗
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Solana   ·   3451 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 31ms · UTC 04:53 · PVG 12:53 · LAX 21:53 · JFK 00:53
    ♥ Do have faith in what you're doing.