Промышленная data science, или Собираем вместе большие датасеты, батчи, пайплайны и модели

8 подписчиков

12+
12+

2 просмотра

13 дней назад

ПожаловатьсяНарушение авторских прав

8 подписчиков

12+
12+

2 просмотра

13 дней назад

ПожаловатьсяНарушение авторских прав
12+
12+

2 просмотра

13 дней назад

Почти все уже устали от того, что препроцессинг данных превращается в простыни малопонятного кода. Большой датасет мало того что не вмещается в память, так ещё и обрабатывается три дня, потому что код не распараллелен. А для перехода к промышленной эксплуатации вообще приходится переписывать все «с нуля». Мы расскажем, как сразу писать удобный и понятный код, который параллелится и позволяет строить гибкие пайплайны для препроцессинга данных и обучения моделей. Роман Худорожков, Департамент информационных технологий Москвы

Название:

Промышленная data science, или Собираем вместе большие датасеты, батчи, пайплайны и модели

Категория:

Разное