Data Science | Тесты
2.54K subscribers
25 photos
382 links
Cайт easyoffer.ru
Реклама @easyoffer_adv
ВП @easyoffer_vp

Вопросы собесов t.iss.one/+RQVnIJT__Z42ZWUy
Вакансии t.iss.one/+Ir52wMvyEgo5YWIy
Download Telegram
🤔 Какой метод уменьшает смещение и дисперсию, добавляя случайные шумы в данные?
Anonymous Quiz
12%
Bagging
15%
Dropout
68%
Data Augmentation
5%
Boosting
💊20
🤔 Какой метод машинного обучения используется для кластеризации данных на основе плотности?
Anonymous Quiz
17%
K-средние
65%
DBSCAN
11%
Иерархическая кластеризация
7%
T-SNE
🤔 Какой оптимизатор выбрать для обучения нейронной сети?

Adam часто используется из-за адаптивного шага обучения. SGD предпочтителен для больших данных.


Ставь 👍 если знал ответ, 🔥 если нет
Забирай 📚Базу Знаний
Please open Telegram to view this post
VIEW IN TELEGRAM
🤔 Какой метод оптимизации используется для минимизации функции потерь путем адаптивного изменения скорости обучения?
Anonymous Quiz
12%
Градиентный спуск
22%
Стохастический градиентный спуск
12%
RMSProp
54%
Адам
🤔 Какой метод использует алгоритм ожидаемого максимума для кластеризации данных?
Anonymous Quiz
20%
K-means
19%
DBSCAN
36%
Gaussian Mixture Models
26%
Hierarchical Clustering
🤔 Сравнение архитектуры RNN, CNN, трансформера?

RNN обрабатывает данные последовательно и хорошо работает с временными рядами или текстами, но страдает от проблем с градиентами и плохо масштабируется. CNN извлекает локальные признаки через свёртки, изначально предназначен для изображений, но может применяться к тексту. Трансформер использует механизм внимания, обрабатывает всё параллельно и учитывает контекст целиком, что делает его эффективным в работе с языком и последовательностями.


Ставь 👍 если знал ответ, 🔥 если нет
Забирай 📚Базу Знаний
Please open Telegram to view this post
VIEW IN TELEGRAM
💊1
🤔 Какой метод уменьшает дисперсию в ансамблевом обучении?
Anonymous Quiz
65%
Bagging
25%
Boosting
3%
Gradient Descent
7%
Cross-Validation
🔥1
🤔 Какой метод снижает дисперсию ансамблевой модели в машинном обучении?
Anonymous Quiz
67%
Бэггинг
18%
Градиентный бустинг
11%
Случайные леса
4%
Стеккинг
🤔 В чем разница между командами DELETE и TRUNCATE?

`DELETE` удаляет строки из таблицы на основе указанного условия и записывает каждое удаление в журнал транзакций, что позволяет выполнить откат операции. `TRUNCATE` быстро удаляет все строки из таблицы, не записывая в журнал отдельные удаления, что делает эту операцию быстрой, но необратимой.

Ставь 👍 если знал ответ, 🔥 если нет
Забирай 📚Базу Знаний
Please open Telegram to view this post
VIEW IN TELEGRAM
🤔 Какой метод уменьшения размерности часто используется для визуализации данных?
Anonymous Quiz
41%
PCA
51%
T-SNE
7%
LDA
2%
NMF
🤔 Какой метод машинного обучения используется для анализа изображений и распознавания объектов на основе их особенностей?
Anonymous Quiz
3%
Decision Tree
3%
Логистическая регрессия
89%
Convolutional Neural Networks (CNN)
5%
Автоэнкодеры
🤔 Почему хорошо работает случайный лес?

Случайный лес работает хорошо, потому что он сочетает предсказания множества независимых деревьев решений, что снижает вероятность переобучения и увеличивает общую точность модели. Каждое дерево строится на случайной подвыборке данных и случайных признаках, что обеспечивает разнообразие моделей. За счёт этого случайный лес становится устойчивым к шуму и переобучению, предоставляя более стабильные и обобщающие предсказания. Модель также устойчива к выбросам и может эффективно работать с большим количеством признаков.

Ставь 👍 если знал ответ, 🔥 если нет
Забирай 📚Базу Знаний
Please open Telegram to view this post
VIEW IN TELEGRAM
🤔 Какой алгоритм находит ближайших соседей по эвклидовому расстоянию?
Anonymous Quiz
2%
Decision Tree
2%
Random Forest
94%
K-Nearest Neighbors
1%
Gradient Boosting
🤔 Что знаешь про early stopping?

Early stopping — это техника регуляризации, которая завершает обучение модели, если метрика качества на валидационном наборе перестаёт улучшаться. Это предотвращает переобучение, позволяя сохранить оптимальные параметры до ухудшения обобщающей способности. Метод основан на мониторинге функции ошибки или качества модели во время каждой итерации обучения.

Ставь 👍 если знал ответ, 🔥 если нет
Забирай 📚Базу Знаний
Please open Telegram to view this post
VIEW IN TELEGRAM
🤔 Какой метод используется для выбора наиболее важных признаков в модели?
Anonymous Quiz
57%
PCA
28%
Lasso
9%
K-means
7%
Decision Tree
🔥1
🤔 Какой алгоритм машинного обучения хорошо работает с линейно неразделимыми данными?
Anonymous Quiz
27%
Линейная регрессия
23%
K-ближайших соседей
45%
Метод опорных векторов с ядром
5%
Метод опорных векторов с ядром
💊15
🤔 Какие есть детекторы и архитектуры в CV?

Классические: SIFT, HOG. Современные архитектуры: YOLO, SSD, Faster R-CNN для детекции объектов, U-Net, DeepLab для сегментации.


Ставь 👍 если знал ответ, 🔥 если нет
Забирай 📚Базу Знаний
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1🔥1
🤔 Какой метод уменьшает смещение и дисперсию в регрессии с L1 и L2 штрафами?
Anonymous Quiz
11%
Ridge Regression
18%
Lasso
66%
Elastic Net
5%
PCA
🤔 Какой метод машинного обучения находит ближайших соседей данных точек?
Anonymous Quiz
20%
K-Means Clustering
1%
Random Forest
79%
K-Nearest Neighbors
1%
Support Vector Machines
🤔 Зачем нужен yield вместо return в функции?

`yield` используется в генераторах Python и позволяет функции возвращать промежуточный результат, приостанавливая выполнение функции и сохраняя ее состояние для последующего возобновления. Это эффективно для работы с большими данными или сложными алгоритмами.

Ставь 👍 если знал ответ, 🔥 если нет
Забирай 📚Базу Знаний
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥2