Статистика и большие данные

Вопросы и ответы для людей, интересующихся статистикой, машинным обучением, анализом данных, интеллектуальным анализом данных и визуализацией данных

2
Пошаговая регрессия в R - Как это работает?
Я пытаюсь понять основную разницу между ступенчатой ​​и обратной регрессией в R, используя функцию шага. Для ступенчатой ​​регрессии я использовал следующую команду step(lm(mpg~wt+drat+disp+qsec,data=mtcars),direction="both") Я получил следующий вывод для приведенного выше кода. Для выбора обратной переменной я использовал следующую команду step(lm(mpg~wt+drat+disp+qsec,data=mtcars),direction="backward") И я получил ниже вывод для обратной Насколько я понял, …
15 r  regression 

3
Нужно ли включать «все соответствующие предикторы»?
Основное предположение об использовании регрессионных моделей для вывода заключается в том, что «все соответствующие предикторы» были включены в уравнение прогнозирования. Обоснование состоит в том, что отказ от включения важного фактического фактора приводит к смещенным коэффициентам и, следовательно, к неточным выводам (т. Е. Пропускается переменное смещение). Но в исследовательской практике я …

3
Логистическая регрессия: Scikit Learn против glmnet
Я пытаюсь продублировать результаты из sklearnбиблиотеки логистической регрессии, используя glmnetпакет в R. Из sklearnрегрессионной логистической документации , она пытается свести к минимуму функцию стоимости при l2 казни minw,c12wTw+C∑i=1Nlog(exp(−yi(XTiw+c))+1)minw,c12wTw+C∑i=1Nlog⁡(exp⁡(−yi(XiTw+c))+1)\min_{w,c} \frac12 w^Tw + C\sum_{i=1}^N \log(\exp(-y_i(X_i^Tw+c)) + 1) Из виньеток из glmnetего реализация минимизирует несколько иной стоимость функции минβ, β0- [ 1NΣя = …

5
Проблемы сингулярности в модели гауссовой смеси
В главе 9 книги «Распознавание образов и машинное обучение» описана модель гауссовой смеси: Честно говоря, я не очень понимаю, почему это создаст особенность. Кто-нибудь может мне это объяснить? Извините, но я всего лишь студент и новичок в машинном обучении, поэтому мой вопрос может показаться немного глупым, но, пожалуйста, помогите мне. …

2
2 Пример Колмогорова-Смирнова против Андерсона-Дарлинга против Крамера-фон-Мизеса
Мне было интересно, каковы критерии использования Колмогорова-Смирнова, Крамера-фон-Мизеса и Андерсона-Дарлинга при сравнении 2 ECDFS. Я знаю математику того, как они различаются, но если у меня есть некоторые данные ECDF, как я узнаю, какой тест подходит для использования?

3
Для линейных классификаторов, большие коэффициенты подразумевают более важные особенности?
Я инженер-программист, работающий над машинным обучением. Насколько я понимаю, линейная регрессия (например, OLS) и линейная классификация (например, логистическая регрессия и SVM) делают прогноз на основе внутреннего произведения между обучаемыми коэффициентами и характеристическими переменными :вес⃗ вес→\vec{w}Икс⃗ Икс→\vec{x} Y^= ф( ш⃗ ⋅ х⃗ ) = f( ∑явесяИкся)Y^знак равное(вес→⋅Икс→)знак равное(ΣявесяИкся) \hat{y} = f(\vec{w} …

1
Сумма или среднее градиентов в (мини) пакетном градиенте приличное?
Когда я реализовал мини-пакетный градиент приличный, я просто усреднил градиенты всех примеров в обучающей партии. Тем не менее, я заметил, что сейчас оптимальная скорость обучения намного выше, чем для приличного онлайн градиента. Моя интуиция заключается в том, что это происходит из-за того, что усредненный градиент менее шумный и, таким образом, …

2
Высокая дисперсия перекрестной проверки по принципу «один-один-один»
Я читал снова и снова, что перекрестная проверка «Оставить один» имеет высокую дисперсию из-за большого перекрытия тренировочных сгибов. Однако я не понимаю, почему это так: не должны ли результаты перекрестной проверки быть очень стабильными (низкая дисперсия) именно потому, что тренировочные наборы практически идентичны? Или я неправильно понимаю понятие «дисперсия»? Я …

2
Понимание расчетов корреляции расстояний
Насколько я понял, дистанционная корреляция - это надежный и универсальный способ проверить, существует ли связь между двумя числовыми переменными. Например, если у нас есть набор пар чисел: (x1, y1) (x2, y2) ... (xn, yn) мы можем использовать корреляцию расстояний, чтобы проверить, существует ли какая-либо (не обязательно линейная) связь между двумя …

3
Может ли модель для неотрицательных данных со сгущением в нули (Tweedie GLM, нулевое раздувание GLM и т. Д.) Предсказать точные нули?
Распределение Твиди может моделировать искаженные данные с точечной массой в нуле, когда параметр (показатель степени в отношении средней дисперсии) находится между 1 и 2.pпp Точно так же модель с нулевой раздувкой (будь то непрерывная или дискретная) может иметь большое количество нулей. У меня возникают проблемы с пониманием, почему, когда я …

2
Какая связь между цепью Маркова и цепью Маркова Монте-Карло
Я пытаюсь понять цепи Маркова, используя SAS. Я понимаю, что марковский процесс - это процесс, в котором будущее состояние зависит только от текущего состояния, а не от прошлого, и существует матрица перехода, которая фиксирует вероятность перехода из одного состояния в другое. Но тут я наткнулся на этот термин: цепь Маркова …

2
Какую меру ошибки обучения сообщать для случайных лесов?
В настоящее время я подгоняю случайные леса для задачи классификации, используя randomForestпакет в R, и не уверен, как сообщить об ошибке обучения для этих моделей. Моя ошибка обучения близка к 0%, когда я вычисляю ее, используя прогнозы, которые я получаю с помощью команды: predict(model, data=X_train) где X_trainданные обучения. В ответ …

5
Ядро SVM: я хочу, чтобы интуитивное понимание отображения на пространство пространственных объектов было более многомерным, и как это делает возможным линейное разделение
Я пытаюсь понять интуицию ядра SVM. Теперь я понимаю, как работает линейный SVM, благодаря чему создается линия принятия решений, которая разбивает данные как можно лучше. Я также понимаю принцип, лежащий в основе переноса данных в многомерное пространство, и то, как это может облегчить нахождение линейной линии принятия решений в этом …

1
Значимость различия между двумя пунктами
Есть ли способ определить, отличается ли разница между количеством дорожно-транспортных происшествий в момент времени 1 от количества в момент времени 2? Я нашел разные методы для определения различий между группами наблюдений в разное время (например, сравнение средних Пуассона), но не для сравнения только двух отсчетов. Или это даже неверно пытаться? …

1
У меня есть линия наилучшего соответствия. Мне нужны данные, которые не изменят мою линию наилучшего соответствия
Я делаю презентацию о примерочных линиях. У меня есть простая линейная функция, . Я пытаюсь получить разбросанные точки данных, которые я могу поместить в график рассеяния, чтобы моя линия лучше соответствовала тому же уравнению.y=1x+by=1x+by=1x+b Я хотел бы изучить эту технику в R или Excel - в зависимости от того, что …

Используя наш сайт, вы подтверждаете, что прочитали и поняли нашу Политику в отношении файлов cookie и Политику конфиденциальности.
Licensed under cc by-sa 3.0 with attribution required.