AI Evaluation Engineer — Shape Real-World Coding Benchmarks (Italia)

AI Evaluation Engineer — Shape Real-World Coding Benchmarks (Italia)

10 ago
|
Mindrift
|
Italia

10 ago

Mindrift

Italia

Mindrift is building a dataset to evaluate AI coding agents by creating challenging tasks and robust evaluation criteria within realistic environments.
Possiede le competenze, l'esperienza e la determinazione necessarie per avere successo in questo ruolo? Lo scopra qui sotto.
You will craft prompts, define success criteria, and assemble tests that accept multiple valid solutions while rejecting incorrect ones. xysqume

This project-based role seeks experienced developers to design tasks, implement tests, and iterate based on QA feedback, contributing to fair, robust evaluation methodologies for AI agents.

#J-18808-Ljbffr

📌 AI Evaluation Engineer — Shape Real-World Coding Benchmarks (Italia)
🏢 Mindrift
📍 Italia

Candidati a questo annuncio

Mostra le tue capacità professionali all'azienda, compila il form e lascia un tocco personale nella lettera di presentazione, aiuterà il recruiter nella scelta del candidato.

Iscriviti a questa job alert:

Ricevi via email le nuove offerte di lavoro per: ai evaluation engineer — shape real-world coding benchmarks (italia) / italia

Iscriviti a questa job alert:

Ricevi via email le nuove offerte di lavoro per: ai evaluation engineer — shape real-world coding benchmarks (italia) / italia