Статистика и большие данные

Вопросы и ответы для людей, интересующихся статистикой, машинным обучением, анализом данных, интеллектуальным анализом данных и визуализацией данных

2
Объяснение модели тобита
У нас 100 участников в двух группах, п = 50Nзнак равно50n=50в каждой группе. Мы использовали оценку способности базового функционирования в 4 момента времени. Оценка состоит из 6 вопросов, каждый из которых набрал 0–5 баллов. У нас нет индивидуальных баллов по каждому вопросу, только общие баллы от 0 до 30. Более …

4
Где найти необработанные данные о клинических испытаниях? [закрыто]
Закрыто. Этот вопрос не по теме . В настоящее время он не принимает ответы. Хотите улучшить этот вопрос? Обновите вопрос, чтобы он соответствовал теме перекрестной проверки. Закрыто 2 года назад . Я хочу использовать необработанные данные о клинических испытаниях для сдачи экзаменов в магистратуру на конец года. Эти данные могут …

3
Обычная регрессия против регрессии, когда переменные различаются
Я просто пытаюсь понять, какова связь между обычной множественной / простой регрессией и множественной / простой регрессией, когда переменные различаются. Например, я анализирую соотношение между депозитным балансом ( ) и рыночными ставками ( ). Если я использую простую линейную регрессию, корреляция будет отрицательной и довольно значительной (около -.74). Однако, если …

3
Как мне сравнить загрузочные наклоны регрессии?
Предположим, у меня есть два набора данных с n наблюдениями пар данных независимой переменной x и зависимой переменной y каждый. Предположим далее, что я хочу сгенерировать распределение наклонов регрессии для каждого набора данных путем начальной загрузки наблюдений (с заменой) N раз и вычисления регрессии y = a + bxкаждый раз. …

2
Использование теста статистической значимости для проверки результатов кластерного анализа
Я изучаю использование статистической значимости (SST) для проверки результатов кластерного анализа. Я нашел несколько статей по этой теме, таких как « Статистическая значимость кластеризации для данных большого размера с малым размером выборки », Liu, Yufeng et al. (2008) « О некоторых тестах значимости в кластерном анализе », Бок (1985) Но …

3
Выбор модели: логистическая регрессия
Предположим, у нас есть ковариат x 1 , … , x n и двоичная переменная результата y . Некоторые из этих ковариат являются категориальными с несколькими уровнями. Другие непрерывны. Как бы вы выбрали «лучшую» модель? Другими словами, как вы выбираете, какие ковариаты включить в модель?nnnx1,…,xnx1,…,xnx_1, \dots, x_nyyy Будете ли вы …

2
Могу ли я сделать PCA по повторным мерам по сокращению данных?
У меня есть 3 испытания каждого на 87 животных в каждом из 2 контекстов (некоторые отсутствующие данные; отсутствие отсутствующих данных = 64 животных). В контексте, у меня есть много конкретных мер в (время , чтобы войти, число раз возвращаюсь в убежище, и т.д.), поэтому я хочу , чтобы разработать 2 …

2
Оценка моделей логистической регрессии
Этот вопрос возникает из-за моей путаницы в том, как решить, достаточно ли хороша логистическая модель. У меня есть модели, которые используют состояние пар индивидуальный проект через два года после их формирования в качестве зависимой переменной. Результат успешен (1) или нет (0). У меня есть независимые переменные, измеренные во время формирования …

1
Расчет ошибки прогноза с перекрестной проверкой временных рядов
У меня есть модель прогнозирования для временного ряда, и я хочу вычислить ошибку прогнозирования вне выборки. На данный момент стратегия, которой я придерживаюсь, - это стратегия, предложенная в блоге Роба Хиндмана (в нижней части страницы), которая выглядит следующим образом (предполагается, что временной ряд и тренировочный набор размера )Y1, ... , …

2
Как вы предсказываете категорию ответа на основе порядковой модели логистической регрессии?
Я хочу предсказать проблему со здоровьем. У меня есть 3 категории результатов: «нормальный», «мягкий» и «тяжелый». Я хочу предсказать это из двух переменных предиктора, результата теста (непрерывный, интервальный ковариат) и семейной истории с этой проблемой (да или нет). В моей выборке вероятности составляют 55% (нормально), 35% (слабо) и 10% (тяжело). …

1
Тест на значимость разности коэффициента корреляции Спирмена
(Большое спасибо за быстрые ответы! Я плохо задал вопрос, поэтому позвольте мне повторить.) Я не знаю, как выяснить, является ли разница между двумя корреляциями Спирмена статистически значимой. Я хотел бы знать, как это выяснить. Причина, которую я хотел выяснить, заключается в том, что в следующей статье: Основанная на Википедии семантическая …

3
Можно ли динамически увеличивать размер выборки, если это указано априори?
Я собираюсь сделать исследование о достоинствах одного стимула по сравнению с другим с внутри-предметным дизайном. У меня есть схема перестановок, предназначенная для уменьшения влияния порядка в некоторых частях исследования (порядок типов задач, порядок стимулов, порядок набора задач). Схема перестановки диктует, что размер выборки делится на 8. Чтобы определить размер выборки, …

2
Как экономисты определяют количество операций на черном рынке?
Я проводил много исследований по организованной преступности в Восточной Азии для проекта в пользу моего друга-автора, и я заметил, что были известные экономисты и журналисты, которые вместе оценивают ценность операций на черном рынке во всем мире. , Какова методология для этого? Как эти цифры объединяются? Эти цифры отражены в традиционных …

3
Как обосновать погрешность термина в факториальном ANOVA?
Вероятно, очень простой вопрос о многофакторной ANOVA. Предположим, что существует двусторонняя схема, в которой мы тестируем как основные эффекты A, B, так и взаимодействие A: B. При тестировании основного эффекта для A с SS типа I эффект SS рассчитывается как разность , где R S S ( 1 ) - …

2
Без многоуровневого моделирования, как справиться с репликацией внутри исследования в метаанализе, где исследование является единицей репликации?
Описание исследования: Я наблюдал распространенную ошибку среди метаанализов в отношении обработки репликации в рамках исследования. Мне не ясно, если ошибка делает недействительными исследования, когда высказываются предположения. Однако, насколько я понимаю, эти предположения нарушают основную статистическую предпосылку. В качестве примера, исследование проверяет влияние химического на ответ Y .XXXYYY Анализ проводят по …

Используя наш сайт, вы подтверждаете, что прочитали и поняли нашу Политику в отношении файлов cookie и Политику конфиденциальности.
Licensed under cc by-sa 3.0 with attribution required.