Обязанности: fine-tune bert-base-multilingual-cased через HuggingFace Trainer на NER задачу с BIO разметкой, вычисление seqeval метрик (precision/recall/F1 per entity), анализ ошибок модели. Навыки: Python, HuggingFace Transformers, token classification, seqeval.
Открытые роли
7 ролей ждут участников
Обязанности: мульти-стадийный Dockerfile для оптимизации размера образа, GitHub Actions (flake8, pytest, docker build), версионирование модели через DVC или HuggingFace Hub. Навыки: Docker, GitHub Actions, DVC, bash.
Обязанности: загрузка и настройка модели ruT5 (IlyaGusev/rut5_base_sum_gazeta), эксперименты с параметрами генерации (beam search, temperature, top-k/p), оценка качества через ROUGE-1/2/L метрики. Навыки: Python, HuggingFace Transformers, seq2seq, ROUGE.
Frontend-разработчик (Gradio)
Детектор токсичных комментариевОбязанности: разработка Gradio-интерфейса для демо-режима модели, создание примеров для тестирования, обёртка модели в удобный UI, базовая стилизация. Навыки: Python, Gradio, базовый HTML/CSS.
Обязанности: fine-tuning BERT/ruDistilBERT на бинарную классификацию токсичности, работа с дисбалансом классов (oversampling, class_weight), оценка F1-macro, ROC-AUC, анализ ошибок модели. Навыки: Python, HuggingFace Transformers, sklearn, imbalanced-learn.
Технический писатель
Классификатор тональности отзывовОбязанности: написание README с инструкцией по запуску, Jupyter ноутбук с EDA и объяснением архитектуры модели, документация API через Swagger/OpenAPI. Навыки: Markdown, Jupyter, техническое письмо, базовый Python.
Обязанности: обучение ruBERT через HuggingFace Transformers, настройка датапайплайна, подбор гиперпараметров, оценка F1/confusion matrix, экспорт модели. Навыки: Python, PyTorch, HuggingFace, pandas, sklearn.