加入 Project Spearmint:一项多语言的人工智能回复评估计划,旨在对不同语言中的大型语言模型(LLM)输出进行评审,重点关注“语气”或“流畅度”。你必须是目标语言的母语水平使用者,并且具备良好的英语理解能力。
作为评估者,你将审阅短小、已预先分段的数据集,并根据特定的质量标准对模型生成的回复进行评分。你的工作将有助于验证评估框架,并为未来模型改进建立基准质量指标。
主要职责:
– 以你的母语对模型回复进行评估,重点关注“语气”或“流畅度”。
– 判断每条回复的整体质量、准确性与自然程度。
– 阅读用户提示以及两个模型的回复,并分别为每条回复在五分制量表上打分。
– 对任何评分异常偏高或偏低的情况,提供简要说明。
项目概述:
第 1 批——语气:判断回复是否有帮助、是否有洞见、是否引人入胜、是否公平。标记诸如不恰当的正式程度、居高临下、偏见或其他语气问题。
第 2 批——流畅度:检查语法是否正确、表达是否清晰、内容是否连贯,以及回复的自然流畅程度。
这是通过 CrowdGen 提供的项目制机会。如你被选中,CrowdGen 会通过你申请时使用的邮箱向你发送注册账户的指引。你需要登录、重置密码、完成设置要求,然后再继续提交该岗位申请。
帮助塑造 AI 的未来——立即申请,并足不出户参与贡献。
每小时 $3.70–$3.70
Apply info ->
To apply for this job, please visit the application page
