Вопросы с тегом «r»

Используйте этот тег для любого * по теме * вопроса, который (a) включает `R` либо в качестве критической части вопроса, либо в ожидаемом ответе, & (b) не * просто * о том, как использовать` R`.

3
Пакет R для объединения уровней факторов для обработки данных?
Хотите знать, сталкивался ли кто-нибудь с пакетом / функцией в R, которая объединит уровни фактора, доля всех уровней которого меньше некоторого порога? В частности, одним из первых шагов в подготовке данных, которые я выполняю, является объединение разреженных уровней факторов вместе (скажем, в уровень, называемый «Другой»), которые не составляют, по крайней …

1
В R «glmnet» соответствует перехвату?
Я подгоняю линейную модель в R, используя glmnet. Исходная (не регуляризованная) модель была подогнана с использованием lmи не имела постоянного члена (т.е. она была в форме lm(y~0+x1+x2,data)). glmnetберет матрицу предикторов и вектор ответов. Я читал glmnetдокументацию и не могу найти упоминания о постоянном термине. Итак, есть ли способ попросить glmnetфорсировать …
10 r  regression  lasso 

1
Перевести R на C ++ (в конце концов с Rcpp) [закрыто]
Закрыто. Этот вопрос не по теме . В настоящее время он не принимает ответы. Хотите улучшить этот вопрос? Обновите вопрос, чтобы он соответствовал теме перекрестной проверки. Закрыто 2 года назад . Я хотел бы научиться использовать Rcpp . Я просмотрел документы на веб-сайте пакета CRAN, но я чувствую, что работа …
10 r  c++ 

2
Когда использовать (не) параметрический критерий предположения о гомоскедастичности?
Если проверяется предположение о гомоскедастичности, то доступны параметрический (критерий Бартлетта однородности отклонений bartlett.test) и непараметрический (критерий Фигнера-Киллина однородности отклонений fligner.test). Как сказать, какой использовать? Должно ли это зависеть, например, от нормальности данных?

4
Как искать долины на графике?
Я изучаю некоторые данные о геномном покрытии, которые в основном представляют собой длинный список (несколько миллионов значений) целых чисел, каждый из которых говорит о том, насколько хорошо (или «глубоко») охвачена эта позиция в геноме. Я хотел бы найти «долины» в этих данных, то есть регионы, которые значительно «ниже», чем их …

2
Можно ли напрямую читать столбцы CSV как категориальные данные?
Мне нужно проанализировать с помощью R данные медицинского обследования (с более 100 кодированными столбцами), которое приходит в CSV. Я буду использовать погремушку для некоторого начального анализа, но за кадром это все еще R. Если я читаю файл .csv () , столбцы с числовыми кодами рассматриваются как числовые данные. Я знаю, …

2
K-ближайший сосед с непрерывными и двоичными переменными
У меня есть набор данных с колонками a b c(3 атрибута). aявляется числовым и непрерывным в то время как bи cявляются категориальными каждый с двумя уровнями. Я использую метод K-Nearest Neighbours для классификации aи bдалее c. Таким образом, чтобы иметь возможность измерять расстояния, я преобразовываю свой набор данных, удаляя bи …

1
Почему вы прогнозируете по модели смешанного эффекта, не включая случайные эффекты для прогноза?
Это скорее концептуальный вопрос, но по мере использования Rя буду ссылаться на пакеты в R. Если цель состоит в том, чтобы подогнать линейную модель для целей прогнозирования, а затем делать прогнозы в тех случаях, когда случайные эффекты могут быть недоступны, есть ли польза от использования модели смешанных эффектов или вместо …

1
Является ли стандартизированные остатки v / s стандартизированных остатков в модели ЛМ
Являются ли «изученные остатки» и «стандартизированные остатки» одинаковыми в регрессионных моделях? Я построил модель линейной регрессии в R и хотел построить график Studentized Остатки v / s, подобранные значения, но не нашел автоматизированный способ сделать это в R. Предположим, у меня есть модель library(MASS) lm.fit <- lm(Boston$medv~(Boston$lstat)) затем использование plot(lm.fit)не …

2
Как доказать сотрудничество из поведенческих последовательностей
Ситуация: две птицы (самец и самка) защищают свои яйца в гнезде от злоумышленника. Каждая птица может использовать для защиты либо атаку, либо угрозу, а также присутствовать или отсутствовать. Из данных возникает закономерность, что поведение может быть взаимодополняющим - атаки мужчин, в то время как женщины используют отображение угроз, и наоборот. …

1
Как нарисовать подобранный график и реальный график распределения гаммы на одном графике?
Загрузите пакет, необходимый. library(ggplot2) library(MASS) Генерация 10000 номеров, приспособленных к гамма-распределению. x <- round(rgamma(100000,shape = 2,rate = 0.2),1) x <- x[which(x>0)] Нарисуйте функцию плотности вероятности, предположим, что мы не знаем, к какому распределению x подходит. t1 <- as.data.frame(table(x)) names(t1) <- c("x","y") t1 <- transform(t1,x=as.numeric(as.character(x))) t1$y <- t1$y/sum(t1[,2]) ggplot() + geom_point(data …

2
Точно, как R coxph () обрабатывает повторные измерения?
контекст Я пытаюсь понять, как R coxph () принимает и обрабатывает повторяющиеся записи для субъектов (или пациента / клиента, если вы предпочитаете). Некоторые называют это длинным форматом, другие называют это «повторными измерениями». Посмотрите, например, набор данных, который включает столбец идентификатора в разделе Ответы по адресу: Лучшие пакеты для моделей Кокса …

1
Точна ли эта интерпретация редкости?
Согласно документации removeSparseTermsфункции из tmпакета, это то, что влечет за собой редкость: A term-document matrix where those terms from x are removed which have at least a sparse percentage of empty (i.e., terms occurring 0 times in a document) elements. I.e., the resulting matrix contains only terms with a sparse …

1
Перекрестная проверка регрессии лассо в R
Функция R cv.glm (library: boot) вычисляет предполагаемую K-кратную ошибку прогнозирования перекрестной проверки для обобщенных линейных моделей и возвращает дельту. Имеет ли смысл использовать эту функцию для регрессии лассо (library: glmnet) и, если да, то как ее можно выполнить? Библиотека glmnet использует перекрестную проверку для получения лучшего параметра поворота, но я …

1
О чем сообщает lsmeans для обобщенной линейной модели, такой как смешанная модель Пуассона (в соответствии с блеском)?
Я анализирую данные отслеживания глаз из разработанного эксперимента. Упрощенная версия моих данных выглядит следующим образом (Вы можете получить данные dput () здесь ), head(lookDATA) participant fixationImage fixationCount 1 9 Automobile 81 2 9 Bird 63 3 9 Chair 82 4 9 Dog 64 5 9 Face 90 6 9 Plant …

Используя наш сайт, вы подтверждаете, что прочитали и поняли нашу Политику в отношении файлов cookie и Политику конфиденциальности.
Licensed under cc by-sa 3.0 with attribution required.