Статистика и большие данные

Вопросы и ответы для людей, интересующихся статистикой, машинным обучением, анализом данных, интеллектуальным анализом данных и визуализацией данных

1
Ожидаемое значение максимального отношения нормальных переменных
Пусть Икс1, . , , , XNX1,...,XnX_1,...,X_n являются IID из N( μ , σ2)N(μ,σ2)N(\mu,\sigma^2) , и пусть Икс( я )X(i)X_{(i)} обозначим яii «й наименьший элемент из Икс1, . , , , XNX1,...,XnX_1,...,X_n . Как можно было бы оценить верхний предел ожидаемого максимума отношения между двумя последовательными элементами в Икс( я …


1
Почему значения p меняются по значимости при изменении порядка ковариат в модели aov?
У меня есть набор данных 482 наблюдений. data=Populationfull Я собираюсь сделать анализ ассоциации генотипа для 3 SNP. Я пытаюсь построить модель для моего анализа, и я использую AOV (у ~ х, данные = ...). Для одной черты у меня есть несколько фиксированных эффектов и ковариат, которые я включил в модель, …
10 r  anova 

2
Использование LASSO только для выбора функций
В моем классе машинного обучения мы узнали о том, как регрессия LASSO очень хороша при выполнении выбора функций, поскольку она использует регуляризацию.L1L1l_1 Мой вопрос: люди обычно используют модель LASSO только для выбора функций (а затем переходят к сбросу этих функций в другую модель машинного обучения), или они обычно используют LASSO …

1
Показать оценку сходится к процентили через статистику заказа
Пусть X1,X2,…,X3nX1,X2,…,X3nX_1, X_2, \ldots, X_{3n} - последовательность случайных величин iid, взятых из альфа-стабильного распределения , с параметрами α=1.5,β=0,c=1.0,μ=1.0α=1.5,β=0,c=1.0,μ=1.0\alpha = 1.5, \; \beta = 0, \; c = 1.0, \; \mu = 1.0 . Теперь рассмотрим последовательность Y1,Y2, ...,YNY1,Y2,…,YNY_1, Y_2, \ldots, Y_{n} , где YJ + 1= Х3 Дж + 1Икс3 …

3
Можно ли обучить нейронную сеть рисовать картинку в определенном стиле?
Можно ли научить нейронную сеть рисовать картинку в определенном стиле? (Таким образом, он берет изображение и перерисовывает его в стиле, для которого он был обучен.) Есть ли одобренная технология для такого рода вещей? Я знаю об алгоритме DeepArt. Хорошо заполнить основное изображение определенным рисунком (например, vangoghify image), но я ищу …

6
Как мы можем узнать дисперсию населения?
При проверке гипотез, общий вопрос - что такое популяционная дисперсия? Мой вопрос: как мы можем узнать разницу населения? Если бы мы знали все распределение, мы могли бы также знать среднее значение для всего населения. Тогда какой смысл в проверке гипотез?

2
Дивергенция Кульбака-Лейблера для двух образцов
Я попытался реализовать численную оценку дивергенции Кульбака-Лейблера для двух выборок. Для отладки реализации возьмем образцы из двух нормальных распределений N(0,1)N(0,1)\mathcal N (0,1) и N(1,2)N(1,2)\mathcal N (1,2) . Для простой оценки я сгенерировал две гистограммы и попытался численно аппроксимировать интеграл. Я застрял с обработкой тех частей гистограммы, где ячейки одной из …

5
Как проверить эффект взаимодействия с помощью непараметрического теста (например, тест перестановки)?
У меня есть две категориальные / номинальные переменные. Каждое из них может принимать только два разных значения (итого, у меня всего 4 комбинации). Каждая комбинация значений поставляется с набором числовых значений. Итак, у меня есть 4 набора чисел. Чтобы сделать его более конкретным, допустим, что у меня есть male / …


2
Регресс: почему тест нормальность общих остатков, а остатки обусловливающие
Я понимаю, что в линейной регрессии ошибки предполагаются нормально распределенными при условии прогнозируемого значения y. Затем мы смотрим на остатки как своего рода прокси для ошибок. Это часто рекомендуется для создания вывода , как это: . Однако я не понимаю, в чем смысл получения остатка для каждой точки данных и …

2
Является ли смещение свойством оценщика или конкретных оценок?
В качестве примера я часто встречаю студентов, которые знают, что Observed является предвзятой оценкой численности населения R 2 . Затем, при написании своих отчетов, они говорят что-то вроде:р2р2R^2R2R2R^2 «Я рассчитал Observed и Скорректированный R 2 , и они были довольно похожи, предполагая лишь небольшое смещение в полученном нами значении Observed …

1
Обычно нейронным сетям требуется время, чтобы «включиться» во время тренировки?
Я пытаюсь обучить глубокую нейронную сеть для классификации, используя обратное распространение. В частности, я использую сверточную нейронную сеть для классификации изображений, используя библиотеку Tensor Flow. Во время тренировок я испытываю какое-то странное поведение, и мне просто интересно, типично ли это, или я что-то делаю не так. Итак, моя сверточная нейронная …

2
распределение жирных пальцев
Краткий вопрос: есть ли раздача жира? Я уверен, что если он существует, то у него другое имя. Я не знаю, как сформулировать это как аналитическую функцию. Можете ли вы помочь мне найти существующую версию или начать формулировку чего-то более чистого, чем гигантский симулятор? Это распределение чисел, которые фактически попадают, когда …

2
Обратная ковариационная матрица против ковариационной матрицы в PCA
В PCA, имеет ли значение, если мы выбираем главные компоненты обратной ковариационной матрицы ИЛИ, если мы отбрасываем собственные векторы ковариационной матрицы, соответствующие большим собственным значениям? Это связано с обсуждением в этом посте .

Используя наш сайт, вы подтверждаете, что прочитали и поняли нашу Политику в отношении файлов cookie и Политику конфиденциальности.
Licensed under cc by-sa 3.0 with attribution required.