Наука о данных

Вопросы и ответы для специалистов по науке о данных, специалистов по машинному обучению и тех, кто хочет больше узнать об этой области

1
Кодирование обучающего сигнала
У меня есть большое количество выборок, которые представляют битовые потоки, закодированные в Манчестере, в виде аудиосигналов. Частота, на которой они кодируются, является основной составляющей частоты, когда она высокая, и на заднем плане присутствует постоянный уровень белого шума. Я вручную декодировал эти потоки, но мне было интересно, смогу ли я использовать …

1
Реляционный Data Mining без ILP
У меня есть огромный набор данных из реляционной базы данных, для которого мне нужно создать модель классификации. Обычно для этой ситуации я бы использовал индуктивное логическое программирование (ILP), но из-за особых обстоятельств я не могу этого сделать. Другой способ решения этой проблемы - просто объединить значения, когда у меня есть …

4
Предложить наборы учебных текстовых классификаторов
Какие свободно доступные наборы данных я могу использовать для обучения текстового классификатора? Мы пытаемся повысить заинтересованность наших пользователей, порекомендовав для него наиболее связанный контент, поэтому мы подумали, что если мы классифицируем наш контент на основе заранее определенного набора слов, мы можем порекомендовать ему интересный контент, получив его отзыв о случайном …

1
Как следует обращаться с неявными данными в рекомендации
Система рекомендаций ведет учет того, какие рекомендации были сделаны конкретному пользователю и принимает ли этот пользователь рекомендацию. Это как user_id item_id result 1 4 1 1 7 -1 5 19 1 5 80 1 где 1 означает, что пользователь принял рекомендацию, а -1 означает, что пользователь не ответил на рекомендацию. …

2
Распознавание человеческой деятельности с помощью набора данных смартфона
Я новичок в этом сообществе, и, надеюсь, мой вопрос вполне уместится здесь. В рамках моего курса по анализу данных для студентов я выбрал проект по распознаванию человеческой деятельности с использованием наборов данных смартфона. Что касается меня, то эта тема касается машинного обучения и опорных векторных машин. Я еще не очень …

1
Какая метрика наилучшей производительности используется при балансировке набора данных с использованием техники SMOTE
Я использовал технику smote для пересчета моего набора данных, и теперь у меня есть сбалансированный набор данных. Проблема, с которой я столкнулся, заключается в том, что показатели производительности; точность, напоминание, измерение f1, точность в несбалансированном наборе данных выполняются лучше, чем при сбалансированном наборе данных. Какое измерение я могу использовать, чтобы …

1
ModelCheckpoint от keras не работает
Я пытаюсь обучить модель в кератах и ​​использую ModelCheckpoint, чтобы сохранить лучшую модель в соответствии с отслеживаемой метрикой валидации (в моем случае это индекс Жакара ). В то время как я вижу улучшение модели в тензорной доске, когда я пытаюсь загрузить веса и оценить модель, она не работает вообще. Кроме …
8 keras  convnet 

1
Категоризация подходов к работе с несбалансированными классами
Каков наилучший способ классификации подходов, разработанных для решения проблемы класса дисбаланса? Эта статья разделяет их на: Предварительная обработка: включает передискретизацию, недостаточную выборку и гибридные методы, Чувствительное к затратам обучение: включает в себя прямые методы и мета-обучение, которые последние делят на пороговые значения и выборку, Методы ансамбля: включает в себя чувствительные …


3
Существуют ли методы машинного обучения для определения точек на графиках / изображениях?
У меня есть данные для бокового положения каждого транспортного средства с течением времени и номер полосы, как показано на этих 3 графиках в изображении и данных примера ниже. > a Frame.ID xcoord Lane 1 452 27.39400 3 2 453 27.38331 3 3 454 27.42999 3 4 455 27.46512 3 5 …

5
Учебники по теме моделей и LDA
Я хотел бы знать, есть ли у вас хорошие учебные пособия (быстрые и понятные) о тематических моделях и LDA, обучающие интуитивно, как устанавливать некоторые параметры, что они означают и, если возможно, с некоторыми реальными примерами.

2
Почему регрессия Gradient Boosting предсказывает отрицательные значения, когда в моем тренировочном наборе нет отрицательных значений y?
Как я могу увеличить количество деревьев в scikit узнать «S GradientBoostingRegressor, я получаю более негативные прогнозы, несмотря на то, нет отрицательных значений в моем обучении или тестирования набора. У меня есть около 10 функций, большинство из которых являются двоичными. Вот некоторые параметры, которые я настраивал: количество деревьев / итераций; глубина …

2
Ошибка памяти при использовании большего количества слоев в модели CNN
На моем dell core i7 - 16 ГБ ОЗУ - 4 ГБ 960-метровый ноутбук с графическим процессором я работаю над проектом по классификации изображений КТ легких с использованием 3D CNN. Я использую процессорную версию tenorflow. Изображения подготовлены как размер массива (25,50,50). В моей модели CNN было 2 слоя конвона, два …

2
Следует использовать sklearn или тензор потока для нейронных сетей?
Я только начал изучать нейронные сети для глубокого изучения cs231. Я пытаюсь реализовать нейронную сеть в Python. Я смотрю на использование Tensorflow или scikit-learn. Каковы некоторые плюсы и минусы этих библиотек для этого приложения?

1
Вопрос о компромиссном отклонении и способах оптимизации
Поэтому мне было интересно, как, например, лучше всего оптимизировать модель, которую они пытаются построить, когда сталкиваются с проблемами, вызванными большим смещением или высокой дисперсией. Теперь, конечно, вы можете поиграть с параметром регуляризации, чтобы достичь удовлетворительной цели, но мне было интересно, возможно ли это сделать, не полагаясь на регуляризацию. Если b …
Используя наш сайт, вы подтверждаете, что прочитали и поняли нашу Политику в отношении файлов cookie и Политику конфиденциальности.
Licensed under cc by-sa 3.0 with attribution required.