Машинное обучение RU
18.1K subscribers
1.76K photos
252 videos
11 files
2.2K links
Все о машинном обучении

админ - @workakkk

@data_analysis_ml - анализ даннных

@ai_machinelearning_big_data - Machine learning

@itchannels_telegram -лучшие ит-каналы

@pythonl - Python

@pythonlbooks- python 📚

@datascienceiot - 📚

РКН: clck.ru/3FmrUw
Download Telegram
🚀 Высокопроизводительная диффузия на C++/CUDA

Librediffusion — это реализация StreamDiffusion на C++ с использованием CUDA и TensorRT. Оптимизирована для высокой производительности на современных графических процессорах, обеспечивая стабильные кадры для генерации изображений.

🚀Основные моменты:
- Поддержка моделей SDXL Turbo и SD Turbo.
- Высокая скорость: до 600 fps на RTX 5090.
- Интеграция с ossia score для удобства использования.

📌 GitHub: https://github.com/jcelerier/librediffusion

#cpp
🔥31
🌟 По данным Reuters, OpenAI ведёт продвинутые переговоры с крупными фондами private equity - TPG, Bain, Brookfield и Advent - о создании совместного предприятия с оценкой около $10 млрд до привлечения инвестиций (pre-money).

Ожидается, что инвесторы готовы вложить примерно $4 млрд.

Этот шаг может резко ускорить внедрение ИИ в корпоративном секторе. Планируется активно внедрять инструменты OpenAI в компании из портфелей этих фондов, одновременно помогая бизнесам адаптироваться и модернизироваться перед лицом AI-дисрапции.

OpenAI также испытывает определённое давление на этом рынке, поскольку Anthropic активно позиционирует себя как лидера в enterprise-сегменте, и OpenAI стремится закрепиться в этой сфере тоже.

https://www.reuters.com/business/openai-courts-private-equity-join-enterprise-ai-venture-sources-say-2026-03-16/
Please open Telegram to view this post
VIEW IN TELEGRAM
6👍3
Forwarded from Machinelearning
🌟 Xiaomi релизнула 3 модели: LLM, омнимодальную и TTS.

🟡MiMo-V2-Pro

Флагман. Триллион параметров суммарно, 42 млрд. активных при инференсе, архитектура MoE с гибридным вниманием и контекстным окном в 1 миллион токенов. До официального анонса модель тестировалась на OpenRouter под именем Hunter Alpha.

🟢Artificial Analysis Intelligence Index - 49 баллов, это 8 место в мире и 2 среди китайских LLM.

🟢PinchBench - 84,0 (3 место, сразу за Claude Sonnet 4.6).

🟢ClawEval - 61,5, тоже 3 место, выше GPT-5.2.

Реальная агентская эффективность на GDPval-AA: Elo 1434 (лучший результат среди китайских моделей).

Цена API: $1 вход / $3 выход за млн. токенов при контексте 256K и $2 вход / $6 выход для контекста 256К-1М.

🟡 MiMo-V2-Omni

Принимает текст, изображения, видео и аудио через единую базу с отдельными энкодерами для каждой модальности. Параметры не раскрыты. Модель поддерживает непрерывную обработку аудио длиной свыше 10 часов в одном запросе.

🟢MM-BrowserComp - 52,0, на GPDVal AA - 1435, оба выше Gemini 3 Pro.

Цена: $0,40 вход / $2,00 выход.

На демонстрации модель прошла цикл онлайн-покупки автономно: нашла отзывы на Xiaohongshu, сравнила продавцов на JD.com, поторговалась с поддержкой, оформила заказ.

Второе демо: получила одно текстовое задание, сняла 15-секундный ролик из 4 сцен, синтезировала звук, исправила ошибку рендеринга шрифта, загрузила на TikTok и опубликовала.


🟡MiMo-V2-TTS

Модель обучена на сотнях миллионов часов аудио, и допилена через многомерный RL. Синтезирует речь с управлением эмоциями на уровне отдельных предложений, поёт с сохранением высоты и ритма, воспроизводит китайские диалекты: сычуаньский, хэнаньский, кантонский, тайваньский. Поддержка других языков не заявлена.

Форматные маркеры в тексте: пунктуацию, частицы и выделение сама переводит в просодику без дополнительной разметки.

Доступ на ограниченный период - бесплатно. Сроки предложения не указаны.

Кстати, команду MiMo возглавляет Ло Фули, один из ключевых авторов DeepSeek R1.


Все модели релиза доступны через API на platform.xiaomimimo.com и в MiMo Studio.


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
4👍4🔥3
📌 Bezos готовит фонд на $100 млрд и это уже не про софт.

По данным WSJ и Reuters, он хочет скупать производственные компании и перестраивать их с помощью ИИ. Речь идёт о реальных отраслях: чипы, оборонка, тяжёлая промышленность.

Идея в том, чтобы использовать ИИ не только для кода, а прямо на заводах: оптимизировать процессы, ускорять сборку, снижать издержки.

Проект связан со стартапом Project Prometheus, который делает AI для инженерии и уже привлёк $6.2 млрд. В команду также вошёл David Limp из Blue Origin.

Сейчас Безос общается с крупными инвесторами, в том числе на Ближнем Востоке, чтобы собрать нужную сумму.

Если это реализуют, ИИ начнёт менять не только софт, но и то, как производят железо.
Please open Telegram to view this post
VIEW IN TELEGRAM
4🤔2
This media is not supported in your browser
VIEW IN TELEGRAM
⚡️ Самый мощный режим ChatGPT — «не спеши, сначала подумай»

Ты используешь ChatGPT как помощника.

Но самый мощный режим —
заставить его думать дольше.

Большинство пишет:
«Напиши код»


Профи пишут:
«Не отвечай сразу. Сначала продумай решение, варианты и риски.»

Что это даёт:

• меньше ошибок
• меньше галлюцинаций
• более продуманная архитектура
• код уровня senior
• лучше работает на сложных задачах

Это работает, потому что ты включаешь режим deliberate reasoning.

Один промпт иjndtns становятся в разы умнее.


t.iss.one/Chatgpturbobot - chatgpt бот в телеге без подписок

Task: [опиши задачу]

Before answering:
- Think through the problem step by step
- Consider multiple approaches
- Choose the best solution
- Check for edge cases and performance issues

Then provide the final answer only.
👍9🤯21
😁233🔥1🥰1
Media is too big
VIEW IN TELEGRAM
Новый интервью Andrej Karpathy - кратко главное:

- Проблемы с AI-агентами = чаще скилл пользователя, а не слабость модели
- Ошибки возникают из-за плохих инструкций и настройки
- Нужно мыслить не мелкими задачами, а крупными действиями (macro tasks)
- Делегируй задачи на ~20 минут нескольким агентам параллельно
- Примеры: кодинг, ресёрч, планирование фич
- Роль человека - дирижёр (оркестратор), который распределяет задачи
- Затем - ревью результата, а не ручная работа
- Это новый навык - сначала сложно, потом сильно бустит продуктивность
-
https://www.youtube.com/watch?v=kwSVtQ7dziU&t=1s
6👍5🔥3😁1
ВСЕ ЭТИ AI-МОДЕЛИ ВЫШЛИ В ЭТОМ МЕСЯЦЕ:

- GPT-5.4
- GPT-5.4 Pro
- GPT-5.4 Mini
- GPT-5.4 Nano
- GPT-5.3 Instant
- MiniMax M2.7
- Mistral Small 4
- MiMo-V2-Pro (Xiaomi, представлен как Hunter Alpha)
- NVIDIA Nemotron 3 Super
- серия Qwen3.5 (включая Qwen3.5-9B, 4B и др.)
- GPT-5.3 Instant (обновление в начале марта)

Это был просто безумный месяц.
👍192
🚀 X/Twitter Research Agent for AI

Эффективный CLI-инструмент для работы с X API. Позволяет искать, фильтровать и мониторить твиты, получая исследовательские данные без лишних усилий. Идеален для взаимодействия с AI-агентами и анализа контента.

🚀Основные моменты:
- Поиск твитов с сортировкой и фильтрацией
- Мониторинг аккаунтов через списки наблюдения
- Быстрый режим для экономии ресурсов
- Кэширование запросов для снижения затрат
- Прозрачность расходов на каждую операцию

📌 GitHub: https://github.com/rohunvora/x-research-skill

#typescript
👍3
⚡️ Накатываем себе БЕСПЛАТНЫЙ Claude Opus 4.6 навсегда - энтузиасты переобучили нейронку Qwen 3.5 на данных Opus 4.6 и получили полностью опен-сорсный Claude, который НЕ УСТУПАЕТ оригиналу и запускается на одной GPU.

• Модель можно запустить БЕЗ ограничений на домашнем компе и даже не слишком мощном железе.
• Нейронка шустрая и очень умная - для повседневных рабочих задач.
• Поддерживает контекст в 262 000 токенов, можно грузить целые книги, папки с кодом и документы.
• Полностью автономна, запускает целые цепочки рассуждений.
• Стабильнее других моделей Qwen работает с внешними API.
• БЕЗ ограничений, БЕЗ цензуры, БЕЗ подписок.

https://huggingface.co/Jackrong/Qwen3.5-27B-Claude-4.6-Opus-Reasoning-Distilled-GGUF
👎15😁9👍85🔥1
Forwarded from Machinelearning
Media is too big
VIEW IN TELEGRAM
⚡️ OpenAI закрывает генератор видео Sora.

Спустя всего 6 месяцев после релиза, OpenAI приняла решение закрыть сервис, который стал вирусным почти сразу: после запуска в конце сентября он набрал миллион скачиваний менее чем за 5 дней.

Несмотря на популярность, поддержка проекта оказалась слишком дорогой. Сейчас компания активно урезает издержки, чтобы подготовить финансовую базу для выхода на биржу.

В ближайшее время компания обещает опубликовать точные сроки отключения приложения и API, а также выпустить инструкции, которые помогут безопасно выгрузить и сохранить созданный контент.
SoraOfficialApp в сети Х

✔️ Anthropic научила Claude управлять компьютером.

В Claude Cowork и Claude Code появилась функция прямого контроля десктопа. Теперь Claude может перехватывать управление: перемещать курсор, кликать по интерфейсу, набирать текст и запускать инструменты разработчика напрямую.

Новая возможность раскрывается в связке с свежей функцией Dispatch. Например, можно отправить задачу со смартфона, находясь в пути, а запущенный десктопный клиент Claude на компьютере самостоятельно протестирует код, внесет изменения в IDE и подготовит PR.

Новая функция в стадии Research Preview и доступна подписчикам тарифов Pro и Max. На данный момент поддерживается исключительно macOS.
claude.com

✔️ Google Cloud отправляет ИИ-агентов отбиваться от киберугроз.

На конференции RSA 2026 Google выкатила обновление инструментов кибербезопасности. В платформу Security Operations добавили агентов на базе Gemini: они умеют сами копаться в инцидентах, собирать цифровые улики и выносить вердикт с подробным разбором полетов.

Этих же агентов прикрутили к системе Google Threat Intelligence - теперь они мониторят даркнет. Корпорация заявляет, что алгоритм переваривает миллионы событий ежедневно с точностью 98% и подсвечивает только те риски, которые касаются конкретной компании.

Параллельно Google подтвердила покупку компании Wiz. Ее технологии будут применятся для создания единой системы защиты мультиоблачных инфраструктур.
cloud.google.com

✔️ Ai2 выпустил open-source браузерного агента MolmoWeb.

Инструмент построен на базе моделей Molmo 2 с 4В и 8В параметров. Он смотрит на веб глазами пользователя: анализирует скриншот страницы и сам решает, куда кликнуть, что написать, где проскроллить или открыть новую вкладку.

Создатели не стали приукрашивать реальность: агент может тупить при чтении текста, ломается после случайного клика не туда и теряется от нечетких инструкций. Заодно ради безопасности его специально отрезали от работы с паролями и деньгами.

MolmoWeb установил новый SOTA среди открытых решений в 4 бенчмарках для веб-агентов, обошел визуальных агентов на базе GPT-4o и превзошел OpenAI CUA в 3 тестах из 4.
Проект полностью открыт: веса, код и датасет MolmoWebMix доступны по лицензии Apache 2.0.
allenai.org

✔️ Основатель FigureAI запустил стартап персонального AGI.

Бретт Адкок официально представил свой новый проект - ИИ-лабораторию Hark. Компания находилась в скрытом режиме 8 месяцев, собирая сильную команду инженеров в области программного и аппаратного обеспечения.

Адкок считает, что LLM-чатботы слишком примитивны. По его видению, настоящий AGI должен обладать долговременной памятью, глубокой персонализацией и способностью взаимодействовать с физическим миром. Hark будет создавать именно такой персональный интеллект. Система будет перенимать образ мышления пользователя, чтобы забирать на себя когнитивную нагрузку и действовать на опережение.

Несмотря на амбициозные цели, конкретных продуктов Hark пока не показал. На данный момент опубликован только концептуальный манифест и открыт список ожидания.
Brett Adcock в сети Х

@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
3👍2
Популярность Claude в США - вполне ожидаема.

Но неожиданно другое: Европа тоже активно подтянулась, процент использования выше среднего.

Китай сильно отстаёт. По крайней мере официально Claude там не используют.

И самое забавное - Австралия почти на уровне США по популярность Claude.
🔥5👍3😁3
🚀 WildHack от Wildberries & Russ - хакатон с призовым фондом 1.3 млн ₽

RWB запускает хакатон для студентов IT и технических направлений - с реальными задачами и шансом попасть в индустрию.

Что внутри:
- практические ML-задачи из логистики
- работа с реальной платформой компании
- два формата участия:
- индивидуальный - решение ML-задач
- командный - разработка ML-сервиса

💰 Призы и возможности:
- общий фонд - 1 300 000 ₽
- стажировка и шанс получить оффер

📅 Условия:
- участие для студентов 18+
- регистрация до 8 апреля

Это не просто хакатон - это быстрый вход в реальный AI и возможность поработать с задачами уровня продакшена.
1
Тест новых LLM - это новая работа на полный рабочий день.
11👍7😁5
Claude Code — это уже не просто инструмент. Это система разработки с памятью, автоматизацией и агентами.

Коротко по сути:

CLAUDE.md — мозг проекта
Хранит архитектуру, правила и контекст. Загружается автоматически.

• Skills — навыки
Позволяют автоматизировать ревью, тесты, деплой и любые процессы.

• Hooks — автодействия
Запускают проверки и действия без твоего участия.

• Agents — параллельная работа
Разбивают задачи и выполняют их одновременно.

• Workflow
plan → execute → auto
Минимум ручной работы, максимум результата.

• Структура
.claude / skills / commands / agents
Всё как у полноценной инженерной системы.

• Безопасность
permissions, sandbox, контроль доступа.

Это уже не про «спросить у ИИ».
Это про «дать задачу и получить результат».

Сохрани себе - пригодится.
9👍4👎2🥰1🤬1
Работа с корпоративными данными — типичный сценарий для ИИ-агентов. Основное ограничение здесь не столько возможности самой модели, сколько способность работать с разными форматами данных. Специально для таких сценариев Yandex B2B Tech обновили File Search в Yandex AI Studio, расширив его возможности.

Инструмент теперь поддерживает не только текст, PDF и изображения, но и видео, аудио и таблицы. Для мультимедиа используется отдельный пайплайн распознавания речи и изображений.

File Search – встроенный инструмент, который использует RAG-подход для доступа к данным: модели формируют ответы на основе загруженных файлов и корпоративных баз знаний, а не только общих знаний модели о мире. Добавлена поддержка поиска CSV и Excel, что важно для кейсов со структурированными данными. Инструмент можно использовать вместе с рассуждающей моделью DeepSeek V3.2.
5👍3🔥1
8🔥5👍1😁1
🔥 FireRed-Image-Edit: Мощный инструмент для редактирования изображений

FireRed-Image-Edit — это универсальная модель редактирования изображений, обеспечивающая высокое качество и согласованность редактирования. Она поддерживает множество сценариев, включая восстановление старых фотографий и редактирование текста с сохранением стиля.

🚀 Основные моменты:
- Высокая производительность редактирования с точным следованием инструкциям.
- Встроенные возможности редактирования на основе модели текст-в-изображение.
- Сохранение стилей текста с высокой точностью.
- Гибкость редактирования нескольких изображений.
- Достижение новых стандартов среди открытых моделей.

📌 GitHub: https://github.com/FireRedTeam/FireRed-Image-Edit
🔥7🥰21
Что такое Claude Skills

Файл CLAUDE.md изначально не задумывался как место для хранения целых процессов. Но на практике туда начинают складывать всё подряд - общие правила, кодстайл, длинные чек-листы безопасности, пайплайны деплоя. В итоге один файл грузится в каждую сессию и съедает контекст даже тогда, когда Claude просто переименовывает переменную.

Skills решают эту проблему. Они превращают процессы в отдельные модули, которые подгружаются только тогда, когда действительно нужны.

Идея простая. Skill - это папка внутри .claude/skills/. Внутри лежит файл SKILL.md, в котором есть две ключевые части: описание и сам процесс. Описание говорит модели, когда этот скилл нужно активировать. Инструкции объясняют, что именно делать.

Описание по сути становится триггером. Claude читает все доступные описания, следит за диалогом и, когда запрос совпадает по смыслу, автоматически подтягивает нужный скилл. Ничего вставлять вручную не нужно. Не нужны команды. Модель сама понимает намерение и включает нужный процесс. Если хочется контроля - любой скилл можно вызвать явно через slash-команду вроде /security-review.

Но автозапуск - это только верхний слой. Основная сила в том, что скиллы - это не просто инструкции, а полноценные пакеты.

SKILL.md может ссылаться на дополнительные файлы рядом с ним через @. Это могут быть стандарты безопасности, шаблоны релиз-нотов, чек-листы соответствия - всё, что нужно для конкретного процесса. Скилл упаковывает весь контекст в одном месте.

Внутри SKILL.md через YAML задаются имя, описание и доступ к инструментам. Последнее особенно важно. Например, скиллу для security review достаточно Read, Grep и Glob. Ему не нужно право на запись. Ограничение инструментов делает поведение предсказуемым и снижает риски.

Скиллы существуют на двух уровнях. Проектные лежат в .claude/skills/ и коммитятся в репозиторий, чтобы команда работала с одинаковыми процессами. Персональные находятся в ~/.claude/skills/ и переиспользуются между проектами.

Если в CLAUDE.md зашит длинный процесс из 20 шагов, он будет мешать в большинстве сессий. Тот же процесс, оформленный как отдельный скилл и активирующийся только по необходимости, работает точечно и не перегружает контекст.

В итоге роли разделяются. CLAUDE.md отвечает за правила и поведение. Skills - за выполнение конкретных процессов.

Ниже - подробный разбор всей системы: CLAUDE.md, хуки, skills, агенты и права доступа, и как это всё правильно собрать в рабочую конфигурацию.

https://uproger.com/chto-takoe-claude-skills/
👍64🥰1🤔1