Мы ищем высококвалифицированного инженера-программиста (уровень SR+) , который поможет оценить качество взаимодействия с современными агентами кодирования, такими как OpenAI Codex и Claude Code. Это не традиционная инженерная роль
Задачи
Старший оценщик взаимодействия с ИИ (Codex / Claude Code)
Посмотрите это видео Loom для получения дополнительной информации!
Вы не будете писать производственный код
Вам предстоит оценивать нечто более сложное: насколько модель думает как отличный инженер
Что на самом деле представляет собой эта роль Вы будете оценивать, как агенты ИИ для кодирования ведут себя в реальных сценариях — с акцентом на: Соответствует ли ответ здравому смыслу
Полезны ли вступление и рассуждения
Отражает ли результат сильное инженерное суждение
Чувствуется ли взаимодействие правильным для опытного разработчика
Эта роль связана с инженерным вкусом — а не с правильностью синтаксиса
Оценивать взаимодействия с кодом, сгенерированные ИИ, от начала до конца
Судить, являются ли результаты: Полезными
Корректными (на высоком уровне)
Соответствующими тому, как думает сильный инженер
Оценивать качество объяснений и рассуждений , а не только код
Различать уровни качества ответа (например, что отличает оценку 2 от 4 )
Предоставлять чёткую, аргументированную обратную связь по: Что сработало Что не сработало
Что показалось «неправильным» или вводящим в заблуждение
Помогать определить, как выглядит отличное взаимодействие с такими инструментами, как Cursor Что мы понимаем под «вкусом» Мы ищем инженеров, которые могут ответить на вопросы типа: Кажется ли это тем, что сказал бы сильный инженер?
Полезно ли это объяснение или оно просто технически корректно?
Направляет ли модель пользователя правильно или просто выдаёт результат?
Укрепит ли это взаимодействие доверие или подорвет его?
Комфортно давать прямую, аргументированную обратную связь
Требования
Вы должны быть готовы делать субъективные, но обоснованные суждения
Кто вы Инженер уровня Staff / Principal (или эквивалентный опыт)
Сильный опыт в одной из следующих областей: TypeScript / JavaScript Python Практический опыт использования: OpenAI Codex Claude Code Cursor Глубокое знакомство с современными рабочими процессами разработки с поддержкой ИИ Способность оценивать код без необходимости полностью запускать или глубоко проверять каждую строку
Опыт работы с инструментами типа Cursor или аналогичными IDE с приоритетом на ИИ Предыдущий опыт в проектировании подсказок или оценочных рабочих процессах
Опыт наставничества старших инженеров или определения инженерных стандартов
Детали сотрудничества
Будет плюсом
Высокие стандарты того, что такое «хорошее инженерное дело» Желательно иметь
Условия
Ставка: $100–$200/час
Часы: примерно 10–20 часов в неделю
Продолжительность: до начала мая (с возможным продлением)
Начало: как можно скорее
Процесс: Домашнее задание для оценки
Одно поведенческое интервью
Паспорт вакансии
История публикации
Появилась в Вакандии27 дней
Перепубликациинетпубликовалась один раз
Проверяли на источникеВидели 27 дней назад
Среди похожихНет данных274 из 30 · у похожих вакансий почти одинаковый возраст — сравнивать нечего
Откуда что взялось
Отмечено то, что вывели мы. Без пометки — значение назвал работодатель.
ГрейдSeniorвычитано из текста вакансии
Формат работыУдалённо
Географияне указана
Зарплата100 USD — 200 USD в месяцвычитано из текста вакансии
Почему на этом месте в выдаче
Порядок выдачи объявлен контрактом: свежесть решает между днями, полнота и зарплата — внутри дня.
Полнота карточки753 из 4 полей: грейд, формат, география, зарплата
Зарплата названа100вилку назвал источник
Проверка Вакандии
Источники и свежесть
Тип источника
Карьерный сайт работодателя
Найдено публикаций
1
Посмотреть публикации и даты
hcareersОсновная публикация · 2026-08-14
G
Работодатель
G2i
6 активных вакансий · вилка работодателя указана в 100%