Наука о данных

Вопросы и ответы для специалистов по науке о данных, специалистов по машинному обучению и тех, кто хочет больше узнать об этой области

2
Найти оптимальный P (X | Y), учитывая, что у меня есть модель, которая имеет хорошие показатели при обучении на P (Y | X)
Входные данные: -> особенности футболки (цвет, логотип и т. Д.)XXX -> маржа прибылиYYY Я натренировал случайный лес на вышеуказанных и Y и добился разумной точности на тестовых данных. Так что яXXXYYY .P(Y|X)P(Y|X)P(Y|X) Теперь я хотел бы найти то есть распределение вероятностей X объектов, учитывая, что я ожидаю такой большой прибыли.P(X|Y)P(X|Y)P(X|Y)XXX …

2
В чем разница между дилатацией и деконволюцией?
Эти две операции свертки очень распространены в глубоком обучении прямо сейчас. Я читал о расширенном сверточном слое в этой статье: WAVENET: ОБЩАЯ МОДЕЛЬ ДЛЯ СЫРЬЕГО АУДИО и Деконволюция в этой статье: полностью сверточные сети для семантической сегментации Оба, кажется, улучшают изображение, но в чем разница?

1
Поезд на партиях в Tensorflow
В настоящее время я пытаюсь обучить модель для большого файла CSV (> 70 ГБ с более чем 60 миллионов строк). Для этого я использую tf.contrib.learn.read_batch_examples. Я изо всех сил пытаюсь понять, как эта функция на самом деле читает данные. Если я использую размер пакета, например, 50 000, считывает ли он …

1
Нейронная сеть Tensorflow TypeError: Аргумент Fetch имеет недопустимый тип
Я делаю простую нейронную сеть, используя тензор потока, с данными, которые я собрал сам, однако, это не сотрудничает: PI столкнулся с ошибкой, которую я не могу исправить или исправить, и я буду рад вашей помощи. Сообщение об ошибке: TypeError: Аргумент Fetch 2861.6152 из 2861.6152 имеет недопустимый тип, должен быть строкой …

2
Невозможно определить слой линейного вложения в сверточную нейронную сеть?
У меня есть сетевая архитектура из статьи «Изучение мелкозернистого сходства изображений с глубоким ранжированием», и я не могу понять, как выходные данные из трех параллельных сетей объединяются с использованием слоя линейного внедрения. Единственная информация, приведенная на этом слое, в статье Наконец, мы нормализуем вложения из трех частей и объединяем их …

4
Извлечь информацию из предложения
Я создаю простой чат-бот. Я хочу получить информацию из ответа пользователя. Пример сценария: Bot : Hi, what is your name? User: My name is Edwin. Я хочу извлечь имя Эдвин из предложения. Тем не менее, пользователь может ответить по-разному, например, User: Edwin is my name. User: I am Edwin. User: …
11 python  nlp 

1
Как определить пользовательскую метрику производительности в Керасе?
Я попытался определить пользовательскую метрическую функцию (F1-Score) в Keras (бэкэнд Tensorflow) согласно следующему: def f1_score(tags, predicted): tags = set(tags) predicted = set(predicted) tp = len(tags & predicted) fp = len(predicted) - tp fn = len(tags) - tp if tp>0: precision=float(tp)/(tp+fp) recall=float(tp)/(tp+fn) return 2*((precision*recall)/(precision+recall)) else: return 0 Пока все хорошо, но …

6
Определение модели в машинном обучении
Это определение не совсем применимо, так как мы не всегда предполагаем базовое распределение. Так что же такое модель на самом деле? Может ли GBM с указанными гиперпараметрами считаться моделью? Является ли модель набором правил?


2
Как «намерение recognisers» работу?
Амазонка Alexa , Nuance в Mix и Facebook, Wit.ai все используют подобную систему , чтобы указать , как преобразовать текстовую команду в умысел - то есть что - то компьютер поймет. Я не уверен, что это за «официальное» название, но я называю это «признание намерений». В основном путь от «пожалуйста …

2
Классификация документов с использованием сверточной нейронной сети
Я пытаюсь использовать CNN (сверточная нейронная сеть) для классификации документов. CNN для коротких текстовых / предложений было изучено во многих работах. Тем не менее, кажется, что ни один документ не использовал CNN для длинного текста или документа. Моя проблема заключается в том , что существует слишком много функций из документа. …

1
Как определить, является ли последовательность символов английским словом или шумом
Какие функции вы будете пытаться извлечь из списка слов для будущего предсказания, это уже существующее слово или просто беспорядок символов? Там есть описание задачи, которую я там нашел . Вы должны написать программу, которая может ответить, является ли данное слово английским. Это было бы легко - вам просто нужно поискать …

1
применяя word2vec к небольшим текстовым файлам
Я совершенно новичок в word2vec, так что, пожалуйста, несите это со мной. У меня есть набор текстовых файлов, каждый из которых содержит набор твитов, между 1000-3000. Я выбрал общее ключевое слово ("kw1") и хочу найти семантически релевантные термины для "kw1", используя word2vec. Например, если ключевое слово «яблоко», я ожидаю увидеть …

4
Как word2vec может быть использован для выявления невидимых слов и соотнести их с уже подготовленными данными
Я работал на word2vec gensim модели и нашел, что это действительно интересно. Меня интересует, как неизвестное / невидимое слово при проверке с моделью сможет получить аналогичные термины от обученной модели. Это возможно? Может word2vec быть переделаны для этого? Или учебный корпус должен иметь все слова, из которых я хочу найти …

3
Несбалансированные классы - Как минимизировать ложные негативы?
У меня есть набор данных, который имеет атрибут бинарного класса. Имеется 623 случая с классом +1 (рак положительный) и 101 671 случай с классом -1 (рак отрицательный). Я пробовал различные алгоритмы (Наивный Байес, Случайный лес, AODE, C4.5), и все они имеют недопустимые ложноотрицательные отношения. Случайный лес имеет наивысшую общую точность …

Используя наш сайт, вы подтверждаете, что прочитали и поняли нашу Политику в отношении файлов cookie и Политику конфиденциальности.
Licensed under cc by-sa 3.0 with attribution required.