Показ дописів із міткою MOOC. Показати всі дописи
Показ дописів із міткою MOOC. Показати всі дописи

понеділок, 30 січня 2017 р.

Не такі страшні перших 80% створення онлайн курсу, як останніх 80%

Станом на сьогодні на курс "Аналіз даних та статистичне виведення на мові R"  на Prometheus записалося вже 10032 слухачі (~ 2000 після закінчення активної фази курсу) і нарешті є час описати процес створення курсу.

Наприкінці 2015 зі мною сконтактував Олексій Молчановський і запропонував зробити курс з статистики. Ми домовились про наступні кроки: в січні базовий перелік тем, в лютому детальний, весна - розробка лекцій і запис лекцій. Літо - лабораторні роботи та тести. Виглядало цілком поєднуваним з сім"єю та роботою.

Що хотілося досягнути?

  • Показати практичне застосування статистики
  • Дати початкові знання та показати, де можна вивчати статистику крім українських вузів
  • Зробити внесок в українську освіту :)

Початковий план виглядав так:





План та матеріали третього тижня допомагала робити Олена Медвєдєва.  Однак, з кінця квітня в гру вступила реальність. Практично подальша підготовка курсу тривала до релізу.
На початок травня були презентації по трьох лекціях. Які дуже відрізнялись від теперішніх :) Далі ми почали узгоджувати та планувати запис. Фактично розробка презентацій останніх тижнів + різні варіанти запису (в студії, скрінкасти)  + покращення існуючих тривали майже все літо.
Лише запис скрінкастів прийнятної (не ідеальної) якості тривав більше місяця (запис щодня по дві години).
Як ви могли помітити, Prometheus ставить на меті робити курси кращої якості ніж edX та Coursera, що вимагає від автора більше зусиль. В останній тиждень перед запуском я зрозуміла, що треба робити детальні конспекти (початковий план включав лише основні формули). Конспект + завдання лабораторної роботи – це 20-30 сторінок тексту щотижня. Не дивлячись на те, що це вимагало значно більше часу, вважаю що дуже покращило курс.
Після запуску курсу та першого тижня, стало зрозуміло, що серед слухачів є люди з зовсім іншим способом мислення, які розуміють завдання інакше. Тому завдання наступних тижнів допомагали тестувати Олена Мєдведєва, Таня Кодлюк, Олег Суховірський та Саша Руппельт. Саша ще допомагав з підтримкою форуму. Відповіді на форумі, навіть з моїм кількарічним досвідом роботи в саппорті, були найбільш тяжким випробуванням :) Тут морально допомагала моя сім'я.

Трохи статистики:

  • станом на сьогодні 10032 зареєстровані слухачі
  • більше 80% мають ступінь бакалавра або вище
  • відсоток тих, хто отримав сертифікат 7.42% (середній відсоток закінчення для Coursera, EdX, Udacity ~ 2%)
  • середній вік слухачів 29 років
  • загалом від моменту домовленості про створення курсу до завершення активної фази пройшло 11 місяців
  • протягом цього року було змінено три роботи :)

Висновки та поради тим,  хто думає над створенням свого курсу:

Цільова аудиторія: при створенні курсу вважала, що цільова аудиторія це студенти ВУЗів. Насправді 80% слухачів вже мало вищу освітою (також серед слухачів були й викладачі ВУЗів, які хотіли закрити для себе питання застосування статистики).
Різниця між "живим" виступом і онлайн-курсом: при "живому" виступу є фідбек від аудиторії і є можливість на це зреагувати та щось на ходу змінити, в онлайн-відео все зразу має бути ідеально.
Оцінка часу: час підготовки однієї хорошої презентації на кількість тижнів курсу. Запис відео - як мінімум, стільки ж (реалістичніше 2x)
Деталі: конспекти, лабораторні, тести. Приблизно половина часу підготовки презентацій. Вимагають тестування.
Тестування: - хороший варіант прочитати курс кілька разів для невеликих груп перед запуском.
Команда: можливо кращий варіант розділити курс на окремі частини між кількома особами. Це можуть бути модулі або підготовка однотипного матеріалу(презентації, озвучення презентацій, конспекти, завдання і т. д.). Однак, тут треба зводити все до спільного знаменника та координувати роботу всіх залучених.





вівторок, 29 вересня 2015 р.

Data Manipulation at Scale: Systems and Algorithms

Якщо раніше проблемою було знайти інформацію для навчання, то зараз тяжко зорієнтуватись у величезній кількості онлайн курсів та спеціалізацій. Настала осінь і ресурсів  для навчання стало ще більше.
Якщо ви хочете зрозуміти як працюють алгоритми  data science та зрозуміти, як їх можна застосовувати для великих об'ємів даних,  то спеціалізація Data Manipulation at Scale: Systems and Algorithms   від Вашингтонського університету - хороший вибір. Спеціалізація побудована на основі курсу, який пропонувався в 2013 році.
За мету автори ставлять навчити студентів:

  1. Describe common patterns, challenges, and approaches associated with data science projects, and what makes them different from projects in related fields. 
  2. Identify and use the programming models associated with scalable data manipulation, including relational algebra, mapreduce, and other data flow models. 
  3. Use database technology adapted for large-scale analytics, including the concepts driving parallel databases, parallel query processing, and in-database analytics 
  4. Evaluate key-value stores and NoSQL systems, describe their tradeoffs with comparable systems, the details of important examples in the space, and future trends. 
  5. “Think” in MapReduce to effectively write algorithms for systems including Hadoop and Spark. You will understand their limitations, design details, their relationship to databases, and their associated ecosystem of algorithms, extensions, and languages. write programs in Spark 
  6. Describe the landscape of specialized Big Data systems for graphs, arrays, and streams

Перший курс спеціалізації почався вчора.

понеділок, 9 червня 2014 р.

Introduction to Data Science повертається.

З 30 червня буде повтор курсу Introduction to Data Science на Coursera. Вже можна переглянути лекції. Не пропустіть :)
Враження від попередньої сесії:

пʼятниця, 11 квітня 2014 р.

Data Science спеціалізація від Coursera

Як ви вже могли помітити,  Coursera запустила спеціалізації. Кожна спеціалізація - набір пов'язаних курсів + фінальний проект. Одна з таких спеціалізацій - Data Science. Сюди входить 9 курсів:

  1. The Data Science Toolbox
  2. R Programming
  3. Getting and Cleaning Data
  4. Exploratory Data Analysis
  5. Reproducible Research
  6. Statistical Inference
  7. Regression Models
  8. Practical Machine Learning
  9. Developing Data Products
Перші 3 розпочались 7 квітня, наступні 3 стартують 5 травня, ну і решта - 2 червня. Тривалість кожного курсу - 1 місяць. Підписка на спеціалізацію коштує $499 і передбачає видачу єдиного підтвердженого сертифіката  по спеціалізації. В той же час, кожен курс можна проходити незалежно і безкоштовно.