For employers

Hire this AI Trainer

Sign in or create an account to invite AI Trainers to your job.

Invite to Job
天天的鸟蛋蛋

天天的鸟蛋蛋

多模型性能评估与成本优化体系(万象绘卷)

China flagN/A, China

Key Skills

Software

Other

Top Subject Matter

多模型文学生成评测/AI Agent提示词工程
Llm提示词工程与智能体调教(openclaw) Domain Expertise

Top Data Types

TextText

Top Task Types

Prompt + Response Writing (SFT)Prompt + Response Writing (SFT)

Freelancer Overview

多模型性能评估与成本优化体系(万象绘卷). Brings 7+ years of professional experience across complex professional workflows, research, and quality-focused execution. Core strengths include Other, Internal, and Proprietary Tooling. AI-training focus includes data types such as Text and labeling workflows including Evaluation, Rating, and Prompt + Response Writing (SFT).

Labeling Experience

提示词工程:从驯化到博弈(智能体调教与评估)

TextTextPrompt + Response Writing (SFT)Prompt + Response Writing (SFT)

深度调教OpenClaw智能体,围绕提示词工程体系进行文本生成行为塑形与状态诊断。通过独创“显筛/暗筛”评估模型与“特征码”诊断法,对生成过程进行筛选、校验与质量控制。该过程将提示词、规则约束与评测反馈闭环用于系统落地与博弈式优化。• 关注思维链状态诊断(正向/反向爆炸)以提升输出稳定性。• 编写并维护智能体所需的指令材料与世界设定(如SOUL.md与世界书)。• 使用评估模型对生成文本进行质量判断与迭代改进。• 将理论体系(TCREI)转化为可执行的提示词与流程框架。

2026 - 2026

多模型性能评估与成本优化体系(万象绘卷)

OtherTextText

基于Arena.ai构建“万象绘卷”评测体系,完成多轮双盲文学对决与质量验证。通过统一战斗模板对GLM、GPT、Gemini等模型进行文科写作能力横向评测,输出多维度评分与模型选型建议。该工作强调以规则与评估指标约束生成质量并迭代系统表现。• 数据主要来自提示词驱动的文学/角色扮演文本生成结果。• 采用双盲对决与评分报告的方式进行结果评估。• 产出明确的对比结论与选型建议,支持后续系统调优。• 与成本优化结合,使用缓存与模板降低重复评测开销。

2026 - 2026

Work History

I

Independent

Evaluation Architect (LLM Performance and Cost Optimization)

N/A
2020 - Present
I

Independent

Independent Researcher and Lecturer

N/A
2020 - Present