Мы ищем высококвалифицированного инженера-программиста (уровень SR+) , который поможет оценивать качество взаимодействия с современными агентами программирования, такими как OpenAI Codex и Claude Code. Это не традиционная инженерная роль
Задачи
Старший оценщик взаимодействия с ИИ (Codex / Claude Code)
Посмотрите это видео на Loom для получения дополнительной информации!
Вы не будете писать код для продакшена
Вам предстоит оценивать нечто более сложное: насколько модель думает как отличный инженер
Что на самом деле представляет собой эта роль Вы будете оценивать, как агенты ИИ для программирования ведут себя в реальных сценариях — с акцентом на: Соответствует ли ответ здравому смыслу
Полезны ли вступление и рассуждения
Отражает ли результат сильное инженерное суждение
Чувствуется ли взаимодействие правильным для опытного разработчика
Эта роль связана с инженерным вкусом , а не с правильностью синтаксиса
Оценивать взаимодействия с кодом, сгенерированные ИИ, от начала до конца
Судить, являются ли результаты: Полезными
Корректными (на высоком уровне)
Соответствующими тому, как думает сильный инженер
Оценивать качество объяснений и рассуждений , а не только код
Различать уровни качества ответа (например, что отличает оценку 2 от 4 )
Предоставлять чёткую, аргументированную обратную связь по: Что сработало Что не сработало
Что показалось «неправильным» или вводящим в заблуждение
Помогать определить, как выглядит отличное взаимодействие с такими инструментами, как Cursor Что мы понимаем под «вкусом» Мы ищем инженеров, которые могут ответить на вопросы типа: Кажется ли это тем, что сильный инженер действительно сказал бы?
Полезно ли это объяснение или оно просто технически корректно?
Направляет ли модель пользователя хорошо или просто выдаёт результат?
Создаст ли это взаимодействие доверие или подорвет его?
Комфортно давать прямую, аргументированную обратную связь
Требования
Вы должны быть готовы делать субъективные, но обоснованные суждения
Кто вы Инженер уровня Staff / Principal (или эквивалентный опыт)
Сильный опыт в одной из следующих областей: TypeScript / JavaScript Python Практический опыт использования: OpenAI Codex Claude Code Cursor Глубокое знакомство с современными рабочими процессами разработки с поддержкой ИИ Способность оценивать код без необходимости полностью запускать или глубоко проверять каждую строку
Опыт работы с инструментами типа Cursor или аналогичными ИИ-ориентированными IDE Предыдущий опыт в проектировании подсказок или оценочных рабочих процессах
Опыт наставничества старших инженеров или определения инженерных стандартов
Детали сотрудничества
Будет плюсом
Высокие стандарты того, что такое «хорошее инженерное дело» Желательно иметь
Условия
Ставка: $100–$200/час
Часы: около 10–20 часов в неделю
Продолжительность: до начала мая (с возможным продлением)
Начало: как можно скорее
Процесс: Домашнее задание для оценки
Одно поведенческое интервью
Паспорт вакансии
История публикации
Появилась в Вакандии29 днейв источнике с 14.08.2026
Перепубликациинетпубликовалась один раз
Проверяли на источникеВидели 25 дней назад
Среди похожихНет данныху карточки не хватает полей, чтобы найти похожие
Откуда что взялось
Отмечено то, что вывели мы. Без пометки — значение назвал работодатель.
ГрейдSeniorвычитано из текста вакансии
Формат работыУдалённо
Географияне указана
Зарплата100 — 200 USD в месяцвычитано из текста вакансии
Почему на этом месте в выдаче
Порядок выдачи объявлен контрактом: свежесть решает между днями, полнота и зарплата — внутри дня.
Полнота карточки753 из 4 полей: грейд, формат, география, зарплата
Зарплата названа100вилку назвал источник
Проверка Вакандии
Источники и свежесть
Тип источника
Карьерный сайт работодателя
Найдено публикаций
1
Посмотреть публикации и даты
hcareersОсновная публикация · 2026-08-14
G
Работодатель
G2i
6 активных вакансий · вилка работодателя указана в 100%