Machine learning Interview
30.2K subscribers
1.76K photos
154 videos
13 files
1.21K links
ИИ, Rust, вайбкодинг, Data Science, Deep Learning и делюсь тем, что интересно и полезно!

Вопросы - @workakkk

РКН: clck.ru/3FmwRz
Download Telegram
Maths, CS & AI Compendium: бесплатный учебник для будущих AI/ML-инженеров

На GitHub завирусился большой open-source компедиум по математике, computer science и AI. Сейчас у проекта уже около 6.3K звёзд.

Автор позиционирует его как «нестандартный учебник» для практиков: меньше сухой нотации, больше интуиции, связей между темами и реального контекста.

Внутри 20 глав:

* векторы, матрицы, calculus
* статистика и вероятность
* machine learning и deep learning
* NLP, computer vision, audio/speech
* multimodal learning и autonomous systems
* GNN, OS, алгоритмы
* production engineering, GPU/SIMD
* AI inference, ML systems design и applied AI

Отдельно есть MCP server, чтобы Claude Code, Cursor, VS Code и другие AI-ассистенты могли использовать компедиум как локальную базу знаний.

Хороший ресурс для тех, кто хочет не просто «выучить ML», а собрать фундамент: математика → CS → ML systems → современный AI.

GitHub: https://github.com/HenryNdubuaku/maths-cs-ai-compendium
thub.com/HenryNdubuaku/maths-cs-ai-compendium
13🔥5👍3
Hugging Face сообщила о проникновении в часть своей production-инфраструктуры. Точкой входа стал вредоносный датасет, который использовал две уязвимости в пайплайне обработки данных: загрузчик удалённого кода и инъекцию в конфигурационный шаблон.

После выполнения кода на worker-узле агент:

- получил доступ на уровне ноды
- собрал облачные и кластерные credentials
- перемещался между внутренними кластерами
- выполнил тысячи действий через рой краткоживущих sandbox-сред

В журналах зафиксировали более 17 000 событий. Hugging Face обнаружила несанкционированный доступ к части внутренних датасетов и нескольким сервисным ключам. Признаков изменения публичных моделей, датасетов, Spaces и опубликованных пакетов компания пока не нашла.

Ироничная деталь: коммерческие ИИ-модели блокировали анализ реальных эксплойтов и C2-команд из-за safety-фильтров. Поэтому расследование проводили локально с помощью open-weight модели GLM 5.2.

Компания закрыла пути выполнения кода, пересобрала скомпрометированные ноды и отозвала ключи. Пользователям рекомендуют сменить access-токены и проверить недавнюю активность аккаунта.

https://thehackernews.com/2026/07/worlds-largest-ai-model-repository.html

#ai #cybersecurity #huggingface #infosec
14🔥8👍3
OvisOCR2 вышел на ModelScope.

Это компактная OCR-модель на 0.8B параметров для page-level document parsing: на вход подаётся изображение страницы, на выходе получается структурированный Markdown в нормальном порядке чтения.

Формулы модель отдаёт в LaTeX, таблицы в HTML, визуальные области помечает image tags с bbox-координатами.

По заявленным результатам OvisOCR2 набрала 96.58 overall на OmniDocBench v1.6 и стала первой end-to-end моделью, которая заняла первое место в лидерборде, где раньше доминировали pipeline-системы.

На PureDocBench тоже сильный результат: 75.06 Avg3. Это важнее, чем просто победа на одном бенчмарке, потому что документный парсинг давно страдает от переобучения под популярные наборы.

Модель сделана на базе Qwen3.5-0.8B и дообучалась через SFT, RL и OPD. Для деплоя есть поддержка vLLM, лицензия Apache 2.0.

https://modelscope.ai/models/ATH-MaaS/OvisOCR2
🔥218🥰2
✔️ Tencent показала Hyra-1.0 - агента из Hunyuan Research Agent.

Hyra работает через цикл:

задача → попытка → проверка → улучшение → новая попытка

Агент работает и постепенно докручивает решение.

Tencent показывает демо в трёх направлениях:

* AI4AI - оптимизация моделей, пайплайнов и GPU-задач
* AI4Science - научные и математические задачи
* AI4Fun - экспериментальные сценарии

Демо: https://hy.tencent.com/research/hyra
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥6👍32
AI Agents Security Week от ШАДа: как делать ИИ-агентов, которым можно доверять

ИИ-агенты уже не просто отвечают в чате. Они пишут код, ходят в базы, вызывают инструменты, работают с файлами и могут влиять на реальные процессы.

Поэтому главный вопрос теперь не «как подключить агента», а как выстроить архитектуру так, чтобы агент делал ровно то, что от него нужно.

С 27 июля по 31 июля ШАД проведёт онлайн-интенсив AI Agents Security Week вместе с экспертами Яндекса.

Разберут практические вещи:

* чем автономные агенты отличаются от обычных LLM
* как безопасно давать агентам доступ к инструментам и данным
* как снижать риск утечек, взломов и ошибок конфигурации
* какие уязвимости появляются в агентных системах
* с какими проблемами уже сталкивались команды, которые делают ИИ-модели и продукты на их основе

Интенсив подойдёт ML-разработчикам, DevOps и DevSecOps-инженерам, техлидам, архитекторам, а также студентам старших курсов технических вузов.

Для практики пригодится понимание SDL и базовый опыт вайбкодинга: уметь поставить задачу модели, получить код и запустить его.

Формат: пять вечерних онлайн-занятий с возможностью задавать вопросы экспертам.

Чтобы получить сертификат, нужно пройти отборочное тестирование и выполнить итоговую работу.

Заявки принимают до 27 июля включительно.

Программа, спикеры и регистрация — на сайте.
🔥43