Статистика и большие данные

Вопросы и ответы для людей, интересующихся статистикой, машинным обучением, анализом данных, интеллектуальным анализом данных и визуализацией данных

1
Как получить стандартные ошибки из регрессии данных подсчета с нулевым раздувом? [закрыто]
Закрыто. Этот вопрос не по теме . В настоящее время он не принимает ответы. Хотите улучшить этот вопрос? Обновите вопрос, чтобы он соответствовал теме перекрестной проверки. Закрыто 2 года назад . Следующий код PredictNew <- predict (glm.fit, newdata = Predict, X1 =X1, Y1= Y1, type = "response", se.fit = TRUE) …

2
Как я могу оценить 95% доверительные интервалы, используя профилирование для параметров, оцениваемых путем максимизации логарифмической функции правдоподобия с использованием optim в R?
Как я могу оценить 95% доверительные интервалы, используя профилирование для параметров, оцениваемых путем максимизации логарифмической функции правдоподобия с использованием optim в R? Я знаю, что могу асимптотически оценить ковариационную матрицу, инвертировав гессиан , но я обеспокоен тем, что мои данные не соответствуют предположениям, необходимым для того, чтобы этот метод был …

2
Путаница в отношении кригинга
Я читал эту статью в Википедии, связанную с кригингом. Я не понял той части, когда говорится, что Кригинг вычисляет наилучшую линейную несмещенную оценку, , для , так что дисперсия кригинга сводится к минимуму с условием несмещенности. Я не получил вывод, а также как минимизировать дисперсию. Какие-либо предложения?Z^(x0)Z^(x0)\hat Z (x_0)Z(x0)Z(x0)Z(x_0) Специально, …

1
Имитация распределений
Я работаю над заданием по планированию производственных мощностей и прочитал несколько книг. Это конкретно о дистрибутивах. Я использую R. Каков рекомендуемый подход для определения моего распределения данных? Существуют ли статистические методы для его идентификации? У меня есть эта схема. Какие методы моделирования доступны с использованием R? Здесь я хочу генерировать …

2
Корреляция значима в каждой группе, но незначительна для всех?
Предположим , мы тестируем корреляции Пирсона между переменной и у в группах А и В . Возможно ли, чтобы ( x , y ) корреляция была значимой в каждом из A и B , но незначительной, когда данные из обеих групп объединены? В этом случае, не могли бы вы дать …

1
Ожидаемое значение логарифма нецентрального экспоненциального распределения
Предположим, что нецентрально экспоненциально распределен с местоположением и скоростью . Тогда что такое .ИксИксXλ E ( log ( X ) )ККkλλ\lambdaЕ( журнал( Х) )Е(журнал⁡(Икс))E(\log(X)) Я знаю, что для ответ где - постоянная Эйлера-Маскерони. А когда ?- log ( λ ) - γ γ k > 0к = 0Кзнак равно0k=0- журнал( …

1
Существует ли метод оценки параметров распределения только по квантилям?
Есть ли способ соответствовать указанному распределению, если вам дают только несколько квантилей? Например, если я скажу вам, что у меня есть набор данных с гамма-распределением, а эмпирические квантили 20%, 30%, 50% и 90% соответственно: 20% 30% 50% 90% 0.3936833 0.4890963 0.6751703 1.3404074 Как бы я пошел и оценить параметры? Есть …

3
Как проверить, отличается ли среднее значение подгруппы от общей группы, в которую входит подгруппа?
Как я могу проверить, отличается ли среднее значение (например, артериальное давление) подгруппы (например, тех, кто умер) от всей группы (например, всех, у кого было заболевание, включая тех, кто умер)? Ясно, что первый является подгруппой второго. Какой тест гипотезы я должен использовать?

1
Расчетное распределение собственных значений для данных iid (однородных или нормальных)
Предполагая, что у меня есть набор данных с измерениями (например, d = 20 ), чтобы каждое измерение было iid X i ∼ U [ 0 ; 1 ] (альтернативно, каждое измерение X i ∼ N [ 0 ; 1 ] ) и не зависит друг от друга.dddd= 20d=20d=20Икся∼ U[ 0 …

1
Как количественно оценить статистическую незначимость?
Я относительно новичок в статистике и понимаю, что мой вопрос может быть полностью неверным. Я проверяю свой алгоритм против другого. Хотя результаты не идентичны, я хочу показать, что различия «статистически незначимы». Как я могу измерить это, чтобы выразить свою точку зрения?

3
Смещение, зависящее от распределения ответов при случайной регрессии леса
Я использую пакет randomForest в R (R версия 2.13.1, randomForest версия 4.6-2) для регрессии и заметил значительный сдвиг в моих результатах: ошибка прогнозирования зависит от значения переменной отклика. Высокие значения недооценены, а низкие значения переоценены. Сначала я подозревал, что это было следствием моих данных, но следующий простой пример предполагает, что …

2
Параметрический, полупараметрический и непараметрический бутстрап для смешанных моделей
Следующие прививки взяты из этой статьи . Я новичок в начальной загрузке и пытаюсь реализовать параметрическую, полупараметрическую и непараметрическую загрузку начальной загрузки для линейной смешанной модели с R bootпакетом. Код R Вот мой Rкод: library(SASmixed) library(lme4) library(boot) fm1Cult <- lmer(drywt ~ Inoc + Cult + (1|Block) + (1|Cult), data=Cultivation) fixef(fm1Cult) …
9 r  mixed-model  bootstrap  central-limit-theorem  stable-distribution  time-series  hypothesis-testing  markov-process  r  correlation  categorical-data  association-measure  meta-analysis  r  anova  confidence-interval  lm  r  bayesian  multilevel-analysis  logit  regression  logistic  least-squares  eda  regression  notation  distributions  random-variable  expected-value  distributions  markov-process  hidden-markov-model  r  variance  group-differences  microarray  r  descriptive-statistics  machine-learning  references  r  regression  r  categorical-data  random-forest  data-transformation  data-visualization  interactive-visualization  binomial  beta-distribution  time-series  forecasting  logistic  arima  beta-regression  r  time-series  seasonality  large-data  unevenly-spaced-time-series  correlation  statistical-significance  normalization  population  group-differences  demography 

3
Ожидаемая наилучшая производительность возможна для набора данных
Скажем, у меня есть простая проблема машинного обучения, такая как классификация. С некоторыми показателями в зрении или распознавании звука я, как человек, являюсь очень хорошим классификатором. Поэтому у меня есть интуиция о том, насколько хорошим может стать классификатор. Но с большим количеством данных одна вещь в том, что я не …

1
Как измерить корреляцию между категориальной переменной? [Дубликат]
На этот вопрос уже есть ответ здесь : корреляция между категориальными переменными (1 ответ) Закрыто 6 месяцев назад . Я знаю, что мы можем использовать Спирмена для измерения корреляции между числовыми переменными. Но как измерить корреляцию между категориальными переменными?

1
Множественная регрессия с отсутствующей переменной-предиктором
Предположим, нам дан набор данных в форме и . Нам дана задача прогнозирования на основе значений . Мы оцениваем две регрессии, где: ( y , x 1 , x 2 , ⋯ , x n - 1 ) y x y( у, х1, х2, ⋯ , хN)(Y,Икс1,Икс2,⋯,ИксN)(y,x_{1},x_{2},\cdots, x_{n})( у, х1, …

Используя наш сайт, вы подтверждаете, что прочитали и поняли нашу Политику в отношении файлов cookie и Политику конфиденциальности.
Licensed under cc by-sa 3.0 with attribution required.