Статистика и большие данные

Вопросы и ответы для людей, интересующихся статистикой, машинным обучением, анализом данных, интеллектуальным анализом данных и визуализацией данных

2
Средняя абсолютная процентная ошибка (MAPE) в Scikit-learn [закрыто]
Закрыто. Этот вопрос не по теме . В настоящее время не принимает ответы. Хотите улучшить этот вопрос? Обновите вопрос, чтобы он соответствовал теме перекрестной проверки. Закрыто 2 года назад . Как мы можем рассчитать среднюю абсолютную процентную ошибку (MAPE) наших прогнозов, используя Python и scikit-learn? Из документов у нас есть …

3
Карта возможностей для ядра Гаусса
В SVM ядро ​​Гаусса определяется как: где . Я не знаю явного уравнения \ phi . Я хочу это знать.K(x,y)=exp(−∥x−y∥222σ2)=ϕ(x)Tϕ(y)K(x,y)=exp⁡(−‖x−y‖222σ2)=ϕ(x)Tϕ(y)K(x,y)=\exp\left({-\frac{\|x-y\|_2^2}{2\sigma^2}}\right)=\phi(x)^T\phi(y)x,y∈Rnx,y∈Rnx, y\in \mathbb{R^n}ϕϕ\phi Я также хочу знать ∑iciϕ(xi)=ϕ(∑icixi)∑iciϕ(xi)=ϕ(∑icixi)\sum_ic_i\phi(x_i)=\phi \left(\sum_ic_ix_i \right) , где ci∈Rci∈Rc_i\in \mathbb R . Теперь я думаю, что это не равно, потому что использование ядра обрабатывает ситуацию, когда линейный …

4
Как определить квантили (изолинии?) Многомерного нормального распределения
Меня интересует, как можно рассчитать квантиль многомерного распределения. На рисунках я нарисовал квантили 5% и 95% данного одномерного нормального распределения (слева). Для правильного многомерного нормального распределения я представляю, что аналогом будет изолиния, которая окружает основу функции плотности. Ниже приведен пример моей попытки рассчитать это с помощью пакета, mvtnormно безуспешно. Я …

5
Модуль Python для анализа точек изменения
Я ищу модуль Python, который выполняет анализ точек изменения во временных рядах. Существует ряд различных алгоритмов, и я хотел бы изучить эффективность некоторых из них, не прибегая к ручному раскручиванию каждого из алгоритмов. В идеале я хотел бы, чтобы некоторые модули, такие как bcp (Bayesian Change Point) или strucchange пакетов …

6
Введение в моделирование структурных уравнений
Коллеги просят меня помочь в этом вопросе, которого я действительно не знаю. Они выдвинули гипотезу о роли некоторых скрытых переменных в одном исследовании, и один из судей попросил их формализовать это в SEM. Поскольку то, что им нужно, не кажется слишком сложным, я думаю, что я попробую ... пока, я …

3
Post hoc тест после ANOVA с повторными измерениями с использованием R
Я выполнил повторные измерения ANOVA в R следующим образом: aov_velocity = aov(Velocity ~ Material + Error(Subject/(Material)), data=scrd) summary(aov_velocity) Какой синтаксис в R можно использовать для выполнения пост-специального теста после ANOVA с повторными измерениями? Подойдет ли тест Тьюки с коррекцией Бонферрони? Если так, как это можно сделать в R?

2
Можете ли вы объяснить оценку плотности окна (ядра) Parzen с точки зрения непрофессионала?
Оценка плотности окна Парцена описывается как p(x)=1n∑i=1n1h2ϕ(xi−xh)p(x)=1n∑i=1n1h2ϕ(xi−xh) p(x)=\frac{1}{n}\sum_{i=1}^{n} \frac{1}{h^2} \phi \left(\frac{x_i - x}{h} \right) где - количество элементов в векторе, - вектор, - плотность вероятности , - размерность окна Парзена, а - оконная функция.x p ( x ) x h ϕnnnxxxp(x)p(x)p(x)xxxhhhϕϕ\phi Мои вопросы: В чем основное отличие оконной функции Парцена …

3
Что такое «псевдонимы»?
При построении регрессионной модели в R ( lm) я часто получаю это сообщение "there are aliased coefficients in the model" Что именно это значит? Кроме того, из-за этого predict()также дает предупреждение. Хотя это всего лишь предупреждение, я хочу знать, как мы можем обнаружить / удалить псевдонимы перед построением модели. Кроме …
24 r  regression 

3
Почему логистическая регрессия является линейной моделью?
Я хочу знать, почему логистическая регрессия называется линейной моделью. Он использует сигмовидную функцию, которая не является линейной. Так почему же логистическая регрессия является линейной моделью?

1
Колмогоров-Смирнов с дискретными данными: Как правильно использовать dgof :: ks.test в R?
Вопросы для начинающих: Я хочу проверить, поступают ли два дискретных набора данных из одного распределения. Мне предложили пробу Колмогорова-Смирнова. Коновер ( Практическая непараметрическая статистика , 3d), кажется, говорит, что для этой цели можно использовать тест Колмогорова-Смирнова, но его поведение «консервативно» с дискретными распределениями, и я не уверен, что это значит …

1
F1 / Dice-Score против IoU
Я был озадачен различием между показателем F1, значением Dice и IoU (пересечение по объединению). К настоящему времени я обнаружил, что F1 и Dice означают одно и то же (верно?), И у IoU есть формула, очень похожая на две другие. F1 / Dice: 2TP2TP+FP+FN2TP2TP+FP+FN\frac{2TP}{2TP+FP+FN} IoU / Jaccard: TPTP+FP+FNTPTP+FP+FN\frac{TP}{TP+FP+FN} Существуют ли какие-либо …

2
Почему лямбда «в пределах одной стандартной ошибки от минимума» является рекомендованным значением для лямбда в упругой чистой регрессии?
Я понимаю, какую роль играет лямбда в регрессии эластичной сети. И я могу понять, почему можно выбрать lambda.min, значение лямбды, которое минимизирует перекрестную проверку. Мой вопрос: где в статистической литературе рекомендуется использовать lambda.1se, то есть значение lambda, которое минимизирует ошибку CV плюс одну стандартную ошибку ? Кажется, я не могу …

2
В чем разница между удалением и отключением соединения?
В чем разница между удалением и отключением соединения? AFAIK, выпадение случайным образом сбрасывает скрытые узлы во время обучения, но держит их в тестировании, и отбрасывает соединения сбрасывает соединения Но не является ли удаление соединений эквивалентным удалению скрытых узлов? Разве узлы (или соединения) не являются просто набором весов?

2
Как инициализировать элементы матрицы фильтра?
Я пытаюсь лучше понять сверточные нейронные сети, написав код Python, который не зависит от библиотек (например, Convnet или TensorFlow), и я застрял в литературе о том, как выбирать значения для матрицы ядра, когда выполнение свертки на изображении. Я пытаюсь понять детали реализации в шаге между картами объектов на изображении ниже, …

3
Какова вероятность того, что из 25 случайных чисел от 1 до 100 самое высокое появляется более одного раза?
Во многих онлайн-играх, когда игроки выполняют сложное задание, иногда дается специальная награда, которую может использовать каждый, кто выполнил задание. обычно это верховое животное (способ транспортировки) или другой предмет тщеславия (предметы, которые не улучшают характеристики персонажа и в основном используются для настройки внешнего вида). Когда такая награда дается, наиболее распространенный способ …

Используя наш сайт, вы подтверждаете, что прочитали и поняли нашу Политику в отношении файлов cookie и Политику конфиденциальности.
Licensed under cc by-sa 3.0 with attribution required.