Data Science | Тесты
2.55K subscribers
26 photos
388 links
Cайт easyoffer.ru
Реклама @easyoffer_adv
ВП @easyoffer_vp

Вопросы собесов t.iss.one/+RQVnIJT__Z42ZWUy
Вакансии t.iss.one/+Ir52wMvyEgo5YWIy
Download Telegram
🤔 Какой метод используется для обнаружения аномалий в данных?
Anonymous Quiz
75%
Isolation Forest
3%
Linear Regression
20%
K-means Clustering
3%
Decision Tree
🤔 Какая скорость поиска в хэш-таблице

Скорость поиска в хэш-таблице (например, HashMap) в среднем составляет O(1), так как ключи напрямую отображаются в индекс с помощью хэш-функции. В худшем случае, при коллизиях, время поиска может увеличиваться до O(n), если хэш-таблица не оптимизирована или используется неэффективная стратегия разрешения коллизий. Однако в большинстве случаев эффективные хэш-функции и методы обработки коллизий поддерживают близкую к O(1) скорость.

Ставь 👍 если знал ответ, 🔥 если нет
Забирай 📚Базу Знаний
Please open Telegram to view this post
VIEW IN TELEGRAM
🤔 Какой метод уменьшения размерности используется для выделения линейных комбинаций признаков, которые максимизируют разницу между классами?
Anonymous Quiz
52%
PCA
23%
LDA
23%
T-SNE
3%
T-SNE
🤔 Какой метод используют для уменьшения дисперсии оценок модели в кросс-валидации?
Anonymous Quiz
30%
Bootstrap Aggregating
11%
Principal Component Analysis
53%
K-fold Cross Validation
6%
Random Subsampling
👍1💊1
🤔 Какой функционал оптимизируется в задаче линейной регрессии? Как записать это в векторной записи?

Оптимизируется ошибка между предсказанными и фактическими значениями, минимизируя среднеквадратичное отклонение, что позволяет определить параметры модели.

Ставь 👍 если знал ответ, 🔥 если нет
Забирай 📚Базу Знаний
Please open Telegram to view this post
VIEW IN TELEGRAM
🤔 Какой метод машинного обучения используется для классификации изображений?
Anonymous Quiz
5%
K-ближайших соседей
1%
Линейная регрессия
93%
Convolutional Neural Networks (CNN)
1%
Логистическая регрессия
🤔 В чем разница между pivot и pivot_table?

`pivot` может создавать новый производный DataFrame, переформатируя исходный DataFrame. Он не поддерживает агрегацию данных. `pivot_table` делает то же самое, что и `pivot`, но также поддерживает агрегацию данных, позволяя использовать функции агрегирования, такие как суммирование, среднее и т.д.

Ставь 👍 если знал ответ, 🔥 если нет
Забирай 📚Базу Знаний
Please open Telegram to view this post
VIEW IN TELEGRAM
🤔 Какой метод машинного обучения используется для классификации изображений?
Anonymous Quiz
5%
K-ближайших соседей
1%
Линейная регрессия
91%
Convolutional Neural Networks (CNN)
2%
Логистическая регрессия
🤔 Какой метод используется для оценки неопределенности в прогнозах нейросетей?
Anonymous Quiz
34%
Dropout в тестовом режиме
24%
Batch Normalization
21%
L1-регуляризация
21%
Min-Max Scaling
🤔 Что такое Median?

Это центральное значение упорядоченного ряда.
- Если количество элементов нечетное, медиана – это средний элемент.
- Если четное, медиана – среднее двух центральных значений.
Медиана менее чувствительна к выбросам, чем среднее (Mean).


Ставь 👍 если знал ответ, 🔥 если нет
Забирай 📚Базу Знаний
Please open Telegram to view this post
VIEW IN TELEGRAM
💊2
🤔 Какой метод уменьшения размерности используется для выделения скрытых факторов в данных с учетом неотрицательных ограничений?
Anonymous Quiz
27%
PCA
11%
LDA
43%
NMF
19%
T-SNE
🤔 Какой метод уменьшения размерности используется для выделения скрытых факторов в данных с учетом неотрицательных ограничений?
Anonymous Quiz
27%
PCA
17%
LDA
49%
NMF
7%
T-SNE
🤔 В чем разница между классификацией и регрессией?

Классификация определяет категории, а регрессия – непрерывные значения. Например, классификация предсказывает класс, а регрессия – числовой результат.


Ставь 👍 если знал ответ, 🔥 если нет
Забирай 📚Базу Знаний
Please open Telegram to view this post
VIEW IN TELEGRAM
🤔 Какой метод оценки помогает избежать переобучения модели?
Anonymous Quiz
46%
Кросс-валидация
6%
Гиперпараметрическая оптимизация
48%
Регуляризация
0%
Аугментация данных
💊7
🤔 Какой метод используется для классификации текстовых данных с учетом частотных характеристик слов?
Anonymous Quiz
1%
Decision Tree
84%
TF-IDF
11%
Naive Bayes
4%
K-means
🤔 Как работает градиентный бустинг регрессор?

Это ансамблевый метод, который комбинирует множество слабых моделей (обычно деревьев решений) для улучшения качества предсказаний:
1. Первая модель предсказывает исходные данные, а остатки ошибок передаются следующей.
2. Каждое новое дерево обучается на ошибках предыдущих, уменьшая отклонения.
3. Градиентный спуск минимизирует ошибку, выбирая оптимальные веса.
4. Итоговое предсказание – это взвешенная сумма предсказаний всех деревьев.
Градиентный бустинг хорошо работает с нелинейными зависимостями и устойчив к выбросам.


Ставь 👍 если знал ответ, 🔥 если нет
Забирай 📚Базу Знаний
Please open Telegram to view this post
VIEW IN TELEGRAM
🤔 Какой метод используется для оценки модели с дисбалансированными данными?
Anonymous Quiz
4%
Точность
63%
F1-score
29%
ROC AUC
5%
Каппа коэффициент
🤔 Какой метод применяется для борьбы с мультиколлинеарностью в регрессии?
Anonymous Quiz
18%
Ridge регрессия
38%
Lasso регрессия
17%
Elastic Net
28%
Principal Component Analysis (PCA)
🤔 Зачем нужен self super?

self указывает на текущий экземпляр класса, а super позволяет обращаться к методам родительского класса, избегая дублирования кода.

Ставь 👍 если знал ответ, 🔥 если нет
Забирай 📚Базу Знаний
Please open Telegram to view this post
VIEW IN TELEGRAM