Статистика и большие данные

Вопросы и ответы для людей, интересующихся статистикой, машинным обучением, анализом данных, интеллектуальным анализом данных и визуализацией данных

3
Может ли нейронная сеть (например, сверточная нейронная сеть) иметь отрицательные веса?
Можно ли иметь отрицательные веса (после достаточного количества эпох) для глубоких сверточных нейронных сетей, когда мы используем ReLU для всех уровней активации?

1
Интерпретация пропорций, суммирующих единицу, как независимых переменных в линейной регрессии
Я знаком с понятием категориальных переменных и соответствующим фиктивным кодированием переменных, которое позволяет нам соответствовать одному уровню в качестве базовой линии, чтобы избежать коллинеарности. Я также знаком с тем, как интерпретировать оценки параметров из таких моделей: прогнозируемое изменение результата для заданного подогнанного уровня категориального предиктора относительно базовой категории. В чем …


2
Как расстояние Гауэра вычисляет разницу между двоичными переменными?
У меня есть 17 числовых и 5 двоичных (0-1) переменных, с 73 выборками в моем наборе данных. Мне нужно запустить кластерный анализ. Я знаю, что расстояние Гауэра является хорошим показателем для наборов данных со смешанными переменными. Однако я не мог понять, как расстояние Гауэра рассчитывает разницу между двоичными переменными . …

2
Преимущества гауссовских процессов
У меня эта путаница связана с преимуществами гауссовских процессов. Я имею в виду сравнение с простой линейной регрессией, где мы определили, что линейная функция моделирует данные. Однако в гауссовых процессах мы определяем распределение функций, что означает, что мы не определяем, что функция должна быть линейной. Мы можем определить априор над …

2
U-критерий Манна-Уитни с неравными размерами выборки
У меня есть две неравные группы (94 и 52), и я хочу провести U-тест Манна-Уитни, чтобы увидеть, отличаются ли их оценки по измеряемой переменной. Я вижу, что с Крускал-Уоллисом все в порядке, относится ли это к Манн-Уитни?

2
Вычисление вероятности совпадения списка генов между последовательностью РНК и набором данных чипа
Надеюсь, кто-то на этих форумах поможет мне с этой основной проблемой в исследованиях экспрессии генов. Я сделал глубокое секвенирование экспериментальной и контрольной ткани. Затем я получил значения кратного обогащения генов в экспериментальном образце для контроля. Эталонный геном имеет ~ 15 000 генов. 3000 из 15000 генов обогащены выше определенного порога …

1
Почему норма партии имеет обучаемый масштаб и сдвиг?
Насколько я понимаю, пакетная норма нормализует все входные объекты слоя до единичного нормального распределения, N( μ = 0 , σ= 1 )N(μзнак равно0,σзнак равно1)\mathcal{N}(\mu=0,\sigma=1) . Среднее значение и дисперсия оцениваются путем измерения их значений для текущей мини-партии.μ , σ2μ,σ2\mu, \sigma^2 После нормализации входы масштабируются и сдвигаются на скалярные значения: Икс^'я= …

5
Существует ли визуальный инструмент для проектирования и применения нейронных сетей / глубокого обучения? [закрыто]
Закрыто. Этот вопрос не по теме . В настоящее время он не принимает ответы. Хотите улучшить этот вопрос? Обновите вопрос, чтобы он соответствовал теме перекрестной проверки. Закрыт 10 месяцев назад . Я знаю, что есть много библиотек для машинного обучения и глубокого обучения, таких как caffe, Theano, TensorFlow, keras, ... …

2
Лучшие практики для кодирования категориальных функций для деревьев решений?
При кодировании категориальных признаков для линейной регрессии существует правило: количество манекенов должно быть на единицу меньше общего количества уровней (чтобы избежать коллинеарности). Существует ли подобное правило для деревьев решений (в мешках, усиленных)? Я спрашиваю об этом, потому что стандартная практика в Python, по-видимому, заключается в расширении nуровней в nманекены (sklearns …

1
Значение оси Y на графике частичной зависимости Random Forest
Я использую RandomForestпакет R и не понимаю, как интерпретировать значения оси Y на графиках их частичной зависимости. Справочные документы утверждают, что график представляет собой «графическое изображение предельного влияния переменной на вероятность класса». Тем не менее, я все еще не понимаю, что именно представляет ось Y. В частности, что означают отрицательные …

1
MCMC с алгоритмом Метрополис-Гастингс: выбор предложения
Мне нужно сделать симуляцию, чтобы оценить интеграл от трехпараметрической функции, скажем, , которая имеет очень сложную формулу. Предлагается использовать метод MCMC для его вычисления и реализации алгоритма Метрополиса-Гастингса для генерации значений, распределенных как , и было предложено использовать 3-х переменную нормаль в качестве распределения предложения. Читая некоторые примеры об этом, …

1
Как читать добро подходят по NLS R?
Я пытаюсь интерпретировать вывод nls (). Я прочитал этот пост, но я все еще не понимаю, как выбрать наиболее подходящий. Из моих припадок у меня есть два выхода: > summary(m) Formula: y ~ I(a * x^b) Parameters: Estimate Std. Error t value Pr(>|t|) a 479.92903 62.96371 7.622 0.000618 *** b …


8
Если p-значение точно равно 1 (1.0000000), каковы должны быть пределы доверительного интервала, чтобы поддерживать истинность нулевой гипотезы? [закрыто]
Закрыто . Этот вопрос нуждается в деталях или ясности . В настоящее время он не принимает ответы. Хотите улучшить этот вопрос? Добавьте детали и проясните проблему, отредактировав этот пост . Закрыто 7 месяцев назад . Это чисто гипотетический вопрос. Очень распространенным утверждением является то, что никогда не соответствует действительности, это …

Используя наш сайт, вы подтверждаете, что прочитали и поняли нашу Политику в отношении файлов cookie и Политику конфиденциальности.
Licensed under cc by-sa 3.0 with attribution required.