Вопросы с тегом «r»

Используйте этот тег для любого * по теме * вопроса, который (a) включает `R` либо в качестве критической части вопроса, либо в ожидаемом ответе, & (b) не * просто * о том, как использовать` R`.

2
Нахождение известного числа центров окружностей, которые максимизируют количество точек на фиксированном расстоянии
У меня есть набор двумерных данных, где я хочу найти центры с указанным количеством центров окружностей ( ), которые максимизируют общее количество точек на указанном расстоянии ( ).RNNNрRR например, у меня есть 10000 точек данных и я хочу найти центры из окружностей, которые захватывают как можно больше точек в радиусе …
10 r  clustering  distance 

1
Модели дискретного времени опасности (cloglog) в R
survivalПакет вR появляешься , чтобы сосредоточиться на непрерывные моделях выживания времени. Я заинтересован в оценке версии пропорциональной модели риска с дискретным временем, дополнительной модели log-log. У меня довольно простая модель выживания с простой правильной цензурой. Я знаю, что одним из способов оценки этой модели является создание набора данных, который имеет …
10 r  survival 

1
Как извлечь / вычислить кредитное плечо и расстояния Кука для моделей с линейными смешанными эффектами
Кто-нибудь знает, как вычислить (или извлечь) рычаги и расстояния Кука для merобъекта класса (полученного через lme4пакет)? Я хотел бы построить их для анализа остатков.

4
Как проверить, хороша ли моя регрессионная модель
Один из способов найти точность модели логистической регрессии с использованием «glm» - это найти график AUC. Как проверить то же самое для регрессионной модели, найденной с переменной непрерывного ответа (family = 'gaussian')? Какие методы используются для проверки соответствия моей регрессионной модели данным?

1
Интерпретация графиков условной плотности
Я хотел бы знать, как правильно интерпретировать графики условной плотности. Я вставил две ниже, которые я создал в R с cdplot. Например, равна ли вероятность того, что Result равен 1, когда Var 1 равен 150 приблизительно 80%? Темно-серая область - это то, что является условной вероятностью того, что Resultона равна …


2
В чем разница между логит-трансформированной линейной регрессией, логистической регрессией и логистической смешанной моделью?
Предположим, у меня есть 10 учеников, каждый из которых пытается решить 20 математических задач. Задачи оцениваются правильно или неправильно (в длинных данных), и результаты каждого учащегося можно суммировать с помощью показателя точности (в подчиненных данных). Модели 1, 2 и 4 ниже дают разные результаты, но я понимаю, что они делают …

3
Построить дерево вероятностей пути для поездок через веб-сайт
В настоящее время я делаю анализ на веб-сайте, который требует, чтобы я создал схему дерева решений, показывающую вероятный маршрут, по которому люди идут, когда они приходят на веб-сайт. Я имею дело с a, data.frameкоторый показывает пути всех клиентов к сайту, начиная с домашней страницы. Например, клиент может выбрать следующий путь: …

2
Графики в регрессионном разрыве дизайна в «Stata» или «R»
Lee и Lemieux (стр. 31, 2009) предлагают исследователю представить графики при выполнении анализа разрыва непрерывности регрессии (RDD). Они предлагают следующую процедуру: «... для некоторой полосы пропускания и для некоторого числа бинов и слева и справа от значения отсечки, соответственно, идея состоит в том, чтобы построить бины ( , ], для …

3
Выбор количества основных компонентов для сохранения
Один из методов, который мне предложили, - это посмотреть на график осыпей и проверить наличие «локтя», чтобы определить правильное количество ПК для использования. Но если график не ясен, есть ли у R расчет для определения числа? fit <- princomp(mydata, cor=TRUE)
10 r  pca 

1
R и EViews различия в оценках AR (1)
Основная проблема : я не могу получить аналогичные оценки параметров с EViews и R. По причинам, которые я сам не знаю, мне нужно оценить параметры для определенных данных, используя EViews. Это делается путем выбора опции NLS (нелинейные наименьшие квадраты) и использования следующей формулы:indep_var c dep_var ar(1) EViews утверждает, что они …

1
Как интерпретировать коэффициенты многомерной смешанной модели в lme4 без общего перехвата?
Я пытаюсь вписать многомерную (то есть множественную реакцию) смешанную модель R. Помимо ASReml-rи SabreRпакетов (которые требуют внешнего программного обеспечения), то кажется , что это возможно только в MCMCglmm. В документе, который сопровождает MCMCglmmпакет (стр. 6), Джаррод Хэдфилд описывает процесс подгонки такой модели, например, преобразования нескольких переменных ответа в одну переменную …

1
Почему Anova () и drop1 () предоставили разные ответы для GLMM?
У меня есть GLMM формы: lmer(present? ~ factor1 + factor2 + continuous + factor1*continuous + (1 | factor3), family=binomial) Когда я использую drop1(model, test="Chi"), я получаю другие результаты, чем если бы я использовал Anova(model, type="III")из пакета автомобиля или summary(model). Последние два дают одинаковые ответы. Используя кучу сфабрикованных данных, я обнаружил, …
10 r  anova  glmm  r  mixed-model  bootstrap  sample-size  cross-validation  roc  auc  sampling  stratification  random-allocation  logistic  stata  interpretation  proportion  r  regression  multiple-regression  linear-model  lm  r  cross-validation  cart  rpart  logistic  generalized-linear-model  econometrics  experiment-design  causality  instrumental-variables  random-allocation  predictive-models  data-mining  estimation  contingency-tables  epidemiology  standard-deviation  mean  ancova  psychology  statistical-significance  cross-validation  synthetic-data  poisson-distribution  negative-binomial  bioinformatics  sequence-analysis  distributions  binomial  classification  k-means  distance  unsupervised-learning  euclidean  correlation  chi-squared  spearman-rho  forecasting  excel  exponential-smoothing  binomial  sample-size  r  change-point  wilcoxon-signed-rank  ranks  clustering  matlab  covariance  covariance-matrix  normal-distribution  simulation  random-generation  bivariate  standardization  confounding  z-statistic  forecasting  arima  minitab  poisson-distribution  negative-binomial  poisson-regression  overdispersion  probability  self-study  markov-process  estimation  maximum-likelihood  classification  pca  group-differences  chi-squared  survival  missing-data  contingency-tables  anova  proportion 

1
randomForest и ошибка важности переменной?
Я не получаю разницу между rfobject$importanceи importance(rfobject)в столбце MeanDecreaseAccuracy. Пример: > data("iris") > fit <- randomForest(Species~., data=iris, importance=TRUE) > fit$importance setosa versicolor virginica MeanDecreaseAccuracy MeanDecreaseGini Sepal.Length 0.027078501 0.019418330 0.040497602 0.02898837 9.173648 Sepal.Width 0.008553449 0.001962036 0.006951771 0.00575489 2.472105 Petal.Length 0.313303381 0.291818815 0.280981959 0.29216790 41.284869 Petal.Width 0.349686983 0.318527008 0.270975757 0.31054451 46.323415 > …

1
Вопросы об определении линейных смешанных моделей в R для данных повторных измерений с дополнительной структурой вложенности
Структура данных > str(data) 'data.frame': 6138 obs. of 10 variables: $ RT : int 484 391 422 516 563 531 406 500 516 578 ... $ ASCORE : num 5.1 4 3.8 2.6 2.7 6.5 4.9 2.9 2.6 7.2 ... $ HSCORE : num 6 2.1 7.9 1 6.9 8.9 …

Используя наш сайт, вы подтверждаете, что прочитали и поняли нашу Политику в отношении файлов cookie и Политику конфиденциальности.
Licensed under cc by-sa 3.0 with attribution required.