Research Engineer (Safety and Alignment), Post-Training

Job expired!

Присоединитесь к авангарду развития искусственного интеллекта в Character.AI и внесите свой вклад в разработку безопасных и согласованных технологий искусственного интеллекта. Наша растущая команда пост-тренинга ищет талантливого инженера-исследователя в области безопасности и согласованности для совершенствования наших передовых моделей ИИ. Эта роль предоставляет уникальную возможность формировать приложения ИИ, которые ежедневно интегрируются в жизнь людей, обеспечивая их безопасность и согласованность с человеческими ценностями.

В рамках нашей динамичной команды пост-тренинга вы будете играть ключевую роль в развитии наших передовых предварительно обученных языковых моделей в полностью оптимизированные цифровые продукты. Эта роль требует активного подхода к межфункциональному сотрудничеству, улучшению производительности модели и прямому влиянию на опыт взаимодействия пользователей, влияющему на миллионы людей ежедневно.

К обязанностям относятся:

  • Разработка алгоритмов для выравнивания предпочтений модели.
  • Создание классификаторов для обнаружения и устранения сбоев и неправильного использования модели.
  • Сотрудничество с аннотаторами и членами красной команды для уточнения наборов данных для выравнивания.
  • Разработка инновационных стратегий для направления поведения ИИ.

Мы ищем кандидата, который может писать как код для производства, так и для тренировки с ясностью и эффективностью. Идеальный кандидат будет иметь:

  • Доказанный опыт работы с GPU для тренировки, обслуживания и отладки моделей.
  • Экспертизу в управлении данными и инфраструктурой.
  • Хорошее понимание современных методов машинного обучения, включая обучение с подкреплением и трансформеры.
  • Историю исключительных исследований или инновационных прикладных проектов в области машинного обучения.

Будет плюсом:

  • Опыт разработки систем безопасности для платформ с пользовательским контентом.
  • Опыт работы с выравниванием LLM.
  • Вклад в академические журналы или крупные конференции по машинному обучению или системам рекомендаций.

Запущенный в 2021 году визионерами в области искусственного интеллекта Ноамом Шазиром и Даниэлем Де Фрейтас