大模型对话偏好标注项目(自由职业、远程)
按照平台 RLHF 标注规范,对大模型生成的两个回答进行偏好选择并进行多维度评分。评估内容涵盖有用性、安全性与事实性,并参与指令跟随与对话偏好对齐相关的判定工作。对生成回答进行有害性与偏见性审查,输出文字备注以支持模型对齐优化与质检通过。• 偏好选择与多维度评分(有用性/安全性/事实性) • 指令跟随(Instruction Following)评估 • 有害性/偏见性审查与备注撰写 • 日均200+条标注并保持高准确率
Hire this AI Trainer
Sign in or create an account to invite AI Trainers to your job.
中文文本数据采集与清洗(兼职、远程). Core strengths include Other and Outlier AI. Education includes Associate Degree, Anhui Chuzhou Vocational and Technical College (2024). AI-training focus includes data types such as Text and labeling workflows including Prompt + Response Writing (SFT) and RLHF.
按照平台 RLHF 标注规范,对大模型生成的两个回答进行偏好选择并进行多维度评分。评估内容涵盖有用性、安全性与事实性,并参与指令跟随与对话偏好对齐相关的判定工作。对生成回答进行有害性与偏见性审查,输出文字备注以支持模型对齐优化与质检通过。• 偏好选择与多维度评分(有用性/安全性/事实性) • 指令跟随(Instruction Following)评估 • 有害性/偏见性审查与备注撰写 • 日均200+条标注并保持高准确率
根据需求文档编写高质量中文指令-回答对,覆盖知识问答、角色扮演与代码解释等类别,并按 SFT 格式交付给客户。对原始爬取文本进行清洗与标注,去除重复、低质与违规内容。完成实体识别与关系抽取标注,确保交付准确并通过验收与复核要求。• 指令-回答对生成与SFT格式规范执行 • 中文文本清洗与质量控制 • 实体识别与关系抽取标注 • 按schema要求交付与验收达标
Associate Degree, General Studies
销售主管