Мы ищем высококвалифицированного инженера-программиста (уровень SR+) , который поможет оценить качество взаимодействия с современными агентами кодирования, такими как OpenAI Codex и Claude Code. Это не традиционная инженерная роль
Задачи
Старший оценщик взаимодействия с ИИ (Codex / Claude Code)
Посмотрите это видео на Loom для получения дополнительной информации!
Вы не будете писать производственный код
Вам предстоит оценивать нечто более сложное: насколько модель думает как отличный инженер
Что на самом деле представляет собой эта роль Вы будете оценивать, как агенты ИИ для кодирования ведут себя в реальных сценариях — с акцентом на: Соответствует ли ответ здравому смыслу
Полезны ли вступление и рассуждения
Отражает ли результат сильное инженерное суждение
Чувствуется ли взаимодействие правильным для опытного разработчика
Эта роль связана с инженерным вкусом — а не с правильностью синтаксиса
Оценивать взаимодействия с кодом, сгенерированные ИИ, от начала до конца
Судить, являются ли результаты: Полезными
Корректными (на высоком уровне)
Соответствующими тому, как думает сильный инженер
Оценивать качество объяснений и рассуждений , а не только код
Различать уровни качества ответа (например, что отличает оценку 2 от 4 )
Предоставлять чёткую, аргументированную обратную связь по: Что сработало Что не сработало
Что показалось «неправильным» или вводящим в заблуждение
Помогать определить, как выглядит отличное взаимодействие с такими инструментами, как Cursor Что мы понимаем под «вкусом» Мы ищем инженеров, которые могут ответить на вопросы типа: Кажется ли это тем, что сильный инженер действительно сказал бы?
Полезно ли это объяснение или оно просто технически корректно?
Направляет ли модель пользователя правильно или просто выдаёт результат?
Создаст ли это взаимодействие доверие или подорвет его?
Требования
Вы должны быть готовы делать субъективные, но строгие суждения
Кто вы Инженер уровня Staff / Principal (или эквивалентный опыт)
Сильный опыт в одной из следующих областей: TypeScript / JavaScript Python Практический опыт использования: OpenAI Codex Claude Code Cursor Глубокое знакомство с современными рабочими процессами разработки с поддержкой ИИ Способность оценивать код без необходимости полностью выполнять или глубоко проверять каждую строку
Комфортно даёте прямую, аргументированную обратную связь
Опыт работы с инструментами типа Cursor или аналогичными IDE с приоритетом на ИИ Предыдущий опыт проектирования подсказок или оценки рабочих процессов
Опыт наставничества старших инженеров или определения инженерных стандартов
Детали сотрудничества
Будет плюсом
Высокие стандарты того, что такое «хорошее инженерное дело» Желательно иметь
Условия
Ставка: $100–$200/час
Часы: примерно 10–20 часов в неделю
Продолжительность: до начала мая (с возможным продлением)
Начало: как можно скорее
Процесс: Домашнее задание для оценки
Одно поведенческое интервью
Паспорт вакансии
История публикации
Появилась в Вакандии28 днейв источнике с 14.08.2026
Перепубликациинетпубликовалась один раз
Проверяли на источникеВидели 25 дней назад
Среди похожихНет данных20 из 30 · похожих вакансий слишком мало для сравнения
Откуда что взялось
Отмечено то, что вывели мы. Без пометки — значение назвал работодатель.
ГрейдSeniorвычитано из текста вакансии
Формат работыУдалённо
Географияне указана
Зарплата100 — 200 USD в месяцвычитано из текста вакансии
Почему на этом месте в выдаче
Порядок выдачи объявлен контрактом: свежесть решает между днями, полнота и зарплата — внутри дня.
Полнота карточки753 из 4 полей: грейд, формат, география, зарплата
Зарплата названа100вилку назвал источник
Проверка Вакандии
Источники и свежесть
Тип источника
Агрегатор вакансий
Найдено публикаций
1
Посмотреть публикации и даты
hcareersОсновная публикация · 2026-08-14
G
Работодатель
G2i
6 активных вакансий · вилка работодателя указана в 100%