Вопросы с тегом «r»

Используйте этот тег для любого * по теме * вопроса, который (a) включает `R` либо в качестве критической части вопроса, либо в ожидаемом ответе, & (b) не * просто * о том, как использовать` R`.

5
Как анализировать тренд в непериодических временных рядах
Предположим, у меня есть следующие непериодические временные ряды. Очевидно, что тенденция уменьшается, и я хотел бы доказать это с помощью некоторого теста (с p-значением ). Я не могу использовать классическую линейную регрессию из-за сильной временной (последовательной) автокорреляции между значениями. library(forecast) my.ts <- ts(c(10,11,11.5,10,10.1,9,11,10,8,9,9, 6,5,5,4,3,3,2,1,2,4,4,2,1,1,0.5,1), start = 1, end = 27,frequency …
12 r  time-series 

4
Получение правильных начальных значений для модели NLS в R
Я пытаюсь приспособить простую модель степенного закона к набору данных, который выглядит следующим образом: mydf: rev weeks 17906.4 1 5303.72 2 2700.58 3 1696.77 4 947.53 5 362.03 6 Цель состоит в том, чтобы пропустить линию электропередачи и использовать ее для прогнозирования revзначений на будущие недели. Куча исследований привела меня …

2
Алгоритмы машинного обучения для панельных данных
В этом вопросе. Существует ли метод построения деревьев решений, который учитывает структурированные / иерархические / многоуровневые предикторы? - они упоминают метод данных панели для деревьев. Существуют ли специальные методы данных панели для поддержки векторных машин и нейронных сетей? Если да, не могли бы вы привести несколько статей для алгоритмов и …

1
Проверка большого набора данных на нормальность - как и насколько это надежно?
Я изучаю часть моего набора данных, содержащую 46840 двойных значений в диапазоне от 1 до 1690, сгруппированных в две группы. Чтобы проанализировать различия между этими группами, я начал с изучения распределения значений, чтобы выбрать правильный тест. Следуя руководству по тестированию на нормальность, я сделал qqplot, гистограмму и boxplot. Это не …

1
Точный критерий Фишера и гипергеометрическое распределение
Я хотел лучше понять точный критерий Фишера, поэтому я разработал следующий пример игрушки, где f и m соответствуют мужской и женской части, а n и y соответствуют «потреблению соды», например: > soda_gender f m n 0 5 y 5 0 Очевидно, это резкое упрощение, но я не хотел, чтобы контекст …

1
Требуется ли предварительная обработка перед прогнозированием с использованием FinalModel из RandomForest с пакетом Caret?
Я использую пакет caret для обучения объекта randomForest с 10x10CV. library(caret) tc <- trainControl("repeatedcv", number=10, repeats=10, classProbs=TRUE, savePred=T) RFFit <- train(Defect ~., data=trainingSet, method="rf", trControl=tc, preProc=c("center", "scale")) После этого я тестирую randomForest на testSet (новые данные) RF.testSet$Prediction <- predict(RFFit, newdata=testSet) Матрица путаницы показывает мне, что модель не так уж и …

2
Почему значение Морана I не равно «-1» в идеально распределенной точке
Википедия не так ... или я не понимаю? Википедия: Белые и черные квадраты («шахматный рисунок») отлично рассеяны, поэтому у Морана я буду -1. Если бы белые квадраты были сложены на одной половине доски, а черные - на другой, значение Морана I было бы близко к +1. Случайное расположение квадратных цветов …

1
Динамический факторный анализ и модель пространства состояний
Пакет MARSS в R предлагает функцию для динамического факторного анализа. В этом пакете динамическая факторная модель написана как особая форма модели пространства состояний, и они предполагают, что общие тенденции следуют процессу AR (1). Поскольку я не очень знаком с этими двумя методами, я задаю два вопроса: Является ли динамический факторный …

1
Манипулирование моделью логистической регрессии
Я хотел бы понять, что делает следующий код. Человек, который написал код, больше не работает здесь, и он почти полностью без документов. Меня попросили исследовать это кто-то, кто думает, что это "модель байесовской логистической регрессии " bglm <- function(Y,X) { # Y is a vector of binary responses # X …

2
Интерпретация результата кластеризации k-средних в R
Я использовал kmeansинструкцию R для выполнения алгоритма k-средних в наборе данных радужной оболочки глаза Андерсона. У меня есть вопрос о некоторых параметрах, которые я получил. Результаты: Cluster means: Sepal.Length Sepal.Width Petal.Length Petal.Width 1 5.006000 3.428000 1.462000 0.246000 В этом случае, что означает «Кластер означает»? Это среднее расстояние всех объектов в …

1
Прогнозирование заказанного логита в R
Я пытаюсь сделать упорядоченную регрессию логита. Я управляю моделью вот так (просто глупая маленькая модель, оценивающая количество фирм на рынке по показателям дохода и населения). Мой вопрос о прогнозах. nfirm.opr<-polr(y~pop0+inc0, Hess = TRUE) pr_out<-predict(nfirm.opr) Когда я запускаю прогнозирование (которое я пытаюсь использовать для получения прогнозируемого значения y), выходные значения равны …

1
Как мне подогнать нелинейную модель смешанных эффектов для данных повторных измерений, используя nlmer ()?
Я пытаюсь проанализировать данные повторных измерений и пытаюсь заставить их работать R. Мои данные по существу следующие, у меня есть две группы лечения. Каждый субъект в каждой группе тестируется каждый день и получает оценку (процент правильных на тесте). Данные в длинном формате: Time Percent Subject Group 1 0 GK11 Ethanol …

4
Бутстрап, Монте-Карло
Мне задали следующий вопрос в рамках домашней работы: Разработайте и внедрите имитационное исследование, чтобы изучить производительность начальной загрузки для получения 95% доверительных интервалов по среднему значению однофакторной выборки данных. Ваша реализация может быть в R или SAS. Аспектами эффективности, которые вы, возможно, захотите рассмотреть, являются покрытие доверительного интервала (т. Е. …

3
Как выполнить повторную выборку в R, не повторяя перестановок?
Если в R установить set.seed (), а затем использовать функцию примера для рандомизации списка, могу ли я гарантировать, что не сгенерирую такую ​​же перестановку? то есть ... set.seed(25) limit <- 3 myindex <- seq(0,limit) for (x in seq(1,factorial(limit))) { permutations <- sample(myindex) print(permutations) } Это производит [1] 1 2 0 …

5
Как получить область эллипса из двумерных нормальных распределенных данных?
У меня есть данные, которые выглядят так: Я попытался применить нормальное распределение (оценка плотности ядра работает лучше, но мне не нужна такая большая точность), и это работает довольно хорошо. Плотность графика составляет эллипс. Мне нужно получить эту функцию эллипса, чтобы решить, находится ли точка в области эллипса или нет. Как …
12 r  regression  pdf  bivariate 

Используя наш сайт, вы подтверждаете, что прочитали и поняли нашу Политику в отношении файлов cookie и Политику конфиденциальности.
Licensed under cc by-sa 3.0 with attribution required.