logo

NLP Engineer (Middle/Middle+)

Откликнуться

Holyweb – сервисная IT-компания. Уже 6 лет мы создаем корпоративные системы и сервисы для IT-холдингов, ритейла, финтеха и логистических компаний.

Разрушаем мифы об аутстаффинге и заботимся о своих сотрудниках: мэтчим интересные проекты с заинтересованными разработчиками, делимся экспертизой внутри компании, поддерживаем комфортную рабочую атмосферу.

Сейчас мы ищем NLP Engineer's на проект GenAI Innovation.

Обязанности

  • Проектировать и развивать RAG-пайплайны: ingestion, извлечение текста и метаданных, chunking, embeddings, hybrid search, reranking и формирование контекста для LLM;
  • Готовить и поддерживать датасеты для поиска, классификации, извлечения сущностей, суммаризации и оценки качества ответов на русскоязычных корпоративных данных;
  • Подбирать и оценивать open-weight и корпоративные модели для embeddings, reranking, NER, классификации и генерации с учетом точности, задержки и стоимости inference;
  • Разрабатывать методики offline и online evaluation: golden datasets, метрики retrieval и answer quality, error taxonomy, A/B-проверки и мониторинг деградаций;
  • Работать с доменными словарями, таксономиями, сущностями и связями для семантического/контекстного слоя и knowledge graph;
  • Участвовать в создании безопасных agentic-сценариев: структурированные ответы, проверка фактов по источникам, ограничение контекста и прозрачные ссылки на основания ответа;
  • Взаимодействовать с экспертами предметных областей, системными аналитиками и разработчиками для разметки данных, проработки use cases и внедрения компонентов в продукт.
     

Требования

  • Опыт разработки NLP/ML-решений от 2 лет и уверенное владение Python;
  • Практический опыт с transformers, sentence-transformers, Hugging Face, embeddings и векторным поиском;
  • Понимание архитектуры RAG: parsing, chunking, metadata filtering, hybrid retrieval, reranking, context compression и citations;
  • Опыт работы с SQL, pandas, Jupyter и подготовкой датасетов; понимание контроля качества и версионирования данных;
  • Умение рассчитывать и интерпретировать метрики качества поиска и NLP-моделей: Recall@k, MRR, nDCG, precision/recall/F1;
  • Знание принципов работы LLM, prompt engineering, structured outputs, tool calling и ограничений генеративных моделей;
  • Опыт работы с русскоязычными текстами, документами и терминологией; способность объяснять качество модели бизнес-заказчику.

    Будет плюсом:
  • Опыт с LlamaIndex, Haystack, LangChain или аналогичными retrieval-фреймворками;
  • Опыт с Elasticsearch/OpenSearch, Qdrant, pgvector, Milvus или аналогичными поисковыми системами;
  • Знание GraphRAG, knowledge graph, entity linking и онтологического моделирования;
  • Опыт с MLflow, DVC, Ragas, Phoenix, Langfuse или другими средствами evals и observability;
  • Опыт с технической, производственной, ремонтной или нормативной документацией крупной промышленной компании.

Условия

  • Неизбежное развитие профессиональных навыков;
  • Работу над высоконагруженными активно развивающимся сервисами с ветвистой бизнес-логикой и множеством инженерных вызовов;
  • Возможность предложить и реализовать свою идею, как улучшить сервис, или новую функциональность;
  • Возможность работы в крупных именитых компаниях на проектах с современным стеком;
  • Формат сотрудничества по договору с ИП или трудоустройство по ТК РФ;
  • Возможность работать удаленно;
  • Работа в аккредитованной IT-компании;
  • Бонусная программа HolyRelax;
  • Конкурентоспособная ЗП.
Расскажите об этой вакансии в соцсетях

Отклик на вакансию:

Я даю согласие на обработку перс. данных в соответствии с политикой конфиденциальности Holyweb