Únete a Project Spearmint, una iniciativa multilingüe de evaluación de respuestas de IA que revisa las salidas de modelos de lenguaje grandes (LLM) en distintos idiomas, con un enfoque en el Tono o en la Fluidez. Debes tener fluidez a nivel nativo en el idioma objetivo y una comprensión sólida del inglés.
Como evaluador/a, revisarás conjuntos de datos breves y pre-segmentados y evaluarás las respuestas generadas por el modelo según criterios de calidad específicos. Tu trabajo ayudará a validar marcos de evaluación y a establecer puntos de referencia de calidad para futuras mejoras de los modelos.
Responsabilidades clave:
– Evaluar las respuestas del modelo en tu idioma nativo, enfocándote en el Tono o en la Fluidez.
– Evaluar la calidad general, la precisión y la naturalidad de cada respuesta.
– Leer la solicitud del usuario y dos respuestas del modelo, y luego calificar cada una usando una escala de cinco puntos.
– Proporcionar explicaciones breves para cualquier calificación extrema.
Descripción del proyecto:
Lote 1 – Tono: Comprueba si las respuestas son útiles, perspicaces, atractivas y justas. Identifica problemas como formalidad desajustada, condescendencia, sesgos u otros problemas de tono.
Lote 2 – Fluidez: Revisa la corrección gramatical, la claridad, la coherencia y el flujo natural.
Esta es una oportunidad basada en proyectos a través de CrowdGen, donde te unirás a la Comunidad de CrowdGen como Contratista Independiente. Si resultas seleccionado/a, CrowdGen te enviará un correo electrónico con instrucciones para crear una cuenta usando tu dirección de correo electrónico de solicitud. Necesitarás iniciar sesión, restablecer tu contraseña, completar los requisitos de configuración y continuar con tu solicitud para el puesto.
Ayuda a dar forma al futuro de la IA: postúlate hoy y contribuye desde casa.
$3.70–$3.70 por hora
To apply for this job, please visit the application page
