Статистика и большие данные

Вопросы и ответы для людей, интересующихся статистикой, машинным обучением, анализом данных, интеллектуальным анализом данных и визуализацией данных

2
Как проверить, модерируется ли коэффициент регрессии переменной группировки?
У меня есть регрессия, проведенная в двух группах выборки на основе модерирующей переменной (скажем, пола). Я делаю простой тест на смягчающий эффект, проверяя, потеряна ли значимость регрессии в одном наборе, а в другом. Q1: приведенный выше метод действителен, не так ли? Q2: уровень достоверности моего исследования установлен на уровне 95%. …


1
Многомерная ортогональная полиномиальная регрессия?
В качестве средства мотивации вопроса рассмотрим проблему повторного сопоставления, в которой мы пытаемся оценить используя наблюдаемые переменные { a , b }YYY{ а , б }{a,b}\{ a, b \} Делая многомерную полиномиальную регрессию, я стараюсь найти оптимальную парамитизацию функции е( у) = с1а + с2б + с3a2+ с4а б + …

1
Нужно ли корректировать нулевой отсчет для проверки отношения правдоподобия пуассоново-логлинейных моделей?
Если в таблице сопряженности есть 0, и мы подгоняем вложенные модели Пуассона / логлинеарности (используя glmфункцию R ) для теста отношения правдоподобия, нужно ли корректировать данные до подбора моделей glm (например, добавить 1/2 ко всем на счет)? Очевидно, что некоторые параметры не могут быть оценены без некоторой корректировки, но как …

3
Показатели приемки для Метрополис-Гастингс с равномерным распределением кандидатов
При использовании алгоритма Метрополис-Гастингс с равномерным распределением кандидатов, какова причина того, что показатели приемлемости составляют около 20%? Мое мышление таково: если истинные (или близкие к истинным) значения параметров обнаружены, то новый набор значений параметров-кандидатов из одного и того же равномерного интервала не увеличит значение функции правдоподобия. Поэтому, чем больше итераций …

2
Как смоделировать сумму случайных величин Бернулли для зависимых данных?
У меня есть почти такие же вопросы, как этот: Как я могу эффективно моделировать сумму случайных величин Бернулли? Но настройка совсем другая: P ( X i = 1 ) = p i N p iS= ∑я = 1 , NИксяSзнак равноΣязнак равно1,NИксяS=\sum_{i=1,N}{X_i} , , ~ 20, ~ 0,1п( Хя= 1 …

2
Плотностная пространственная кластеризация приложений с кластеризацией шума (DBSCAN) в R
Этот вопрос начинался как « Кластеризация пространственных данных в R », а теперь перешел к вопросу DBSCAN. Поскольку ответы на первый вопрос подсказали, я искал информацию о DBSCAN и прочитал несколько документов о. Новые вопросы возникли. DBSCAN требует некоторых параметров, одним из которых является «расстояние». Как мои данные являются трехмерными, …
9 r  clustering  spatial 

2
Модель Тобит с R
Кто-нибудь знает, где можно найти хорошие приложения и примеры (помимо руководства и книги по применению эконометрики с R) с использованием модели тобита с пакетами AER? редактировать Я ищу команду для вычисления предельных эффектов для y (не для скрытой переменной y *). Кажется, это , где - это кумулятивная функция распределения …


6
Тестирование на стабильность во временных рядах
Существует ли стандартный (или лучший) метод для тестирования, когда данный временной ряд стабилизировался? Некоторая мотивация У меня есть стохастическая динамическая система, которая выводит значение на каждом временном шаге . Эта система имеет некоторое переходное поведение до временного шага и затем стабилизируется вокруг некоторого среднего значения с некоторой ошибкой. Ни одно …


3
Как изменить имена столбцов в кадре данных в R? [закрыто]
Закрыто. Этот вопрос не по теме . В настоящее время он не принимает ответы. Хотите улучшить этот вопрос? Обновите вопрос, чтобы он соответствовал теме перекрестной проверки. Закрыто 6 лет назад . names(mydat)[c(name)]<-c("newname") Исходя из этого, я знаю, что имя столбца / переменной «имя» фрейма данных mydat заменяется на «новое имя». …
9 r 


4
Имеет ли значение переменный порядок в линейной регрессии
Я исследую взаимодействие между двумя переменными ( и ). Между этими переменными существует значительная линейная корреляция с . Исходя из природы проблемы, я не могу ничего сказать о причинно-следственной связи ( вызывает ли или наоборот). Я хотел бы изучить отклонения от линии регрессии, чтобы обнаружить выбросы. Чтобы сделать это, я …

1
Как рассчитать стандартную ошибку коэффициентов шансов?
У меня есть два набора данных из общих исследований генома ассоциации. Единственная доступная информация - это отношение шансов и значение p для первого набора данных. Для второго набора данных у меня есть отношение шансов, р-значение и частоты аллелей (AFD = болезнь, AFC = контроль) (например, 0,321). Я пытаюсь выполнить мета-анализ …

Используя наш сайт, вы подтверждаете, что прочитали и поняли нашу Политику в отношении файлов cookie и Политику конфиденциальности.
Licensed under cc by-sa 3.0 with attribution required.