Обязанности: разметка дополнительных примеров по инструкции BIO, контроль качества аннотаций (inter-annotator agreement), подготовка аннотационных гайдлайнов для команды. Навыки: понимание NER задачи, внимательность, базовый Python для проверки разметки.
Открытые роли
6 ролей ждут участников
Обязанности: скачивание и структурирование датасета, написание Dataset-класса PyTorch, реализация train/val/test split со стратификацией, data augmentation пайплайн. Навыки: Python, PyTorch Dataset, torchvision, pandas.
Computer Vision-инженер
Классификатор изображений с Transfer LearningОбязанности: fine-tuning EfficientNet-B0 (timm) на датасете Flowers Recognition, настройка аугментаций (albumentations), анализ confusion matrix, экспорт модели в ONNX, базовая Grad-CAM визуализация. Навыки: Python, PyTorch, timm, albumentations, ONNX.
Обязанности: загрузка и настройка модели ruT5 (IlyaGusev/rut5_base_sum_gazeta), эксперименты с параметрами генерации (beam search, temperature, top-k/p), оценка качества через ROUGE-1/2/L метрики. Навыки: Python, HuggingFace Transformers, seq2seq, ROUGE.
Технический писатель
Классификатор тональности отзывовОбязанности: написание README с инструкцией по запуску, Jupyter ноутбук с EDA и объяснением архитектуры модели, документация API через Swagger/OpenAPI. Навыки: Markdown, Jupyter, техническое письмо, базовый Python.
Обязанности: обучение ruBERT через HuggingFace Transformers, настройка датапайплайна, подбор гиперпараметров, оценка F1/confusion matrix, экспорт модели. Навыки: Python, PyTorch, HuggingFace, pandas, sklearn.