Обязанности: Dockerfile, GitHub Actions (lint, pytest, docker build), кэширование весов модели в образе, health-check endpoint, мониторинг latency. Навыки: Docker, GitHub Actions, bash, CI/CD.
Открытые роли
7 ролей ждут участников
Обязанности: EDA датасета MovieLens 100K, анализ распределения рейтингов, топ фильмы и жанры, визуализация user-item матрицы, исследование cold-start проблемы, Jupyter ноутбук с выводами. Навыки: Python, pandas, matplotlib, seaborn, Jupyter.
Обязанности: реализация SVD коллаборативной фильтрации через библиотеку Surprise, TF-IDF контентной фильтрации, оценка RMSE/MAE/Precision@K, анализ cold-start проблемы и стратегий решения. Навыки: Python, Surprise, scikit-learn, pandas, numpy.
Обязанности: скачивание и структурирование датасета, написание Dataset-класса PyTorch, реализация train/val/test split со стратификацией, data augmentation пайплайн. Навыки: Python, PyTorch Dataset, torchvision, pandas.
Обязанности: Dockerfile с кэшированием весов модели при сборке, GitHub Actions пайплайн (lint, test, build), оптимизация холодного старта приложения. Навыки: Docker, GitHub Actions, bash, Python.
Data Scientist
Детектор токсичных комментариевОбязанности: EDA датасета Russian Toxic Comments, предобработка текста (очистка, нормализация), аугментация (back-translation, synonym replacement), визуализация распределений. Навыки: Python, pandas, matplotlib, seaborn, nltk.
Обязанности: написание Dockerfile для ML-сервиса, настройка GitHub Actions (lint, test, docker build & push), оркестрация деплоя, мониторинг latency и error rate. Навыки: Docker, GitHub Actions, CI/CD, bash scripting.