Forwarded from Анализ данных (Data analysis)
Qwen выпустила Qwen3.8-27B.
27 млрд параметров, Apache 2.0, контекст 262K токенов с возможностью расширения до 1 млн. Есть поддержка текста, изображений и видео, thinking mode, tool use и агентных сценариев.
По опубликованным бенчмаркам модель набрала 61,7 в SWE-bench Pro, 90,3 в LiveCodeBench, 84,3 в OSWorld-Verified и 81,9 в AndroidWorld.
Qwen3.8-27B можно запускать через Transformers, vLLM и SGLang. Также доступны варианты для llama.cpp, Ollama и LM Studio.
https://huggingface.co/Qwen/Qwen3.8-27B
27 млрд параметров, Apache 2.0, контекст 262K токенов с возможностью расширения до 1 млн. Есть поддержка текста, изображений и видео, thinking mode, tool use и агентных сценариев.
По опубликованным бенчмаркам модель набрала 61,7 в SWE-bench Pro, 90,3 в LiveCodeBench, 84,3 в OSWorld-Verified и 81,9 в AndroidWorld.
Qwen3.8-27B можно запускать через Transformers, vLLM и SGLang. Также доступны варианты для llama.cpp, Ollama и LM Studio.
https://huggingface.co/Qwen/Qwen3.8-27B
👍99👨💻44🔥43❤19🤓15👏7🎉3🥱2🥰1
Главный упор сделали на обработку перегруженных страницы, где текст, изображения и подписи идут плотно и наслаиваются друг на друга.
По данным Mistral, модель точнее определяет границы каждого элемента - рамки не съезжают, изображения не наезжают одно в другое по ошибке.
На нагруженных технических диаграммах модель реже теряет блоки, а текстовые выноски считывает как самостоятельные объекты, а не сливает в один массив.
Отдельно заявлена работа с многоколоночными документами, OCR 4.1 сохраняет исходную структуру страницы и отдает каждую колонку отдельной областью текста.
В настроенных процессах тем, кто пользуется моделью, менять ничего не нужно. Алиас
mistral-ocr-latest уже переводит существующие интеграции на новую версию.Руками модель можно попробовать в Mistral Studio.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍71❤53👏12🔥8👌2🥰1
Американские компании начали активно использовать робособак для охраны дата-центров, спортивных объектов и даже сельскохозяйственных угодий с ценными культурами.
Главным драйвером автоматизации стала экономика. По оценкам аналитиков Business Insider, использование автономной машины для покрытия одной круглосуточной смены обходится на 80–130 тысяч долларов дешевле, чем содержание штата охранников.
Индустрия физической безопасности в США давно страдает от высокой текучести кадров. Причина кроется в низких зарплатах - медианный годовой доход охранника в 2024 году составил немногим более 38 тысяч долларов.
Кадровый дефицит и потребность бизнеса в оптимизации расходов открыли окно возможностей для технологических стартапов. Например, профильная компания Asylon уже развернула около 50 роботов для корпоративных клиентов по всей стране.
Центр труда Калифорнийского университета отмечает, что полная замена людей роботами в ближайшее время невозможна, но рынок ждет трансформация - патрулирование территорий полностью перейдет к роботам, а людям оставят реагирование на инциденты и выполнение задач, требующих нестандартного мышления.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🤔112👍25🤨20👌16❤5🤣5🔥4👏3😨2🥰1
Media is too big
VIEW IN TELEGRAM
В десктопном ChatGPT вместо Chronicle заработала Computer History. Прежний механизм собирал контекст скриншотами экрана, новый пишет журнал действий - клики, ввод текста, шорткаты, переключение окон. События складываются в единую хронологию и лежат локально.
Сбор по умолчанию выключен. В настройках приватности можно вывести из-под наблюдения отдельные приложения и сайты.
Разобрав журнал, ChatGPT замечает повторяющиеся действия и предлагает собрать под них сценарий для рутинной задачи. На тот же журнал опираются ответы ChatGPT и Codex - их можно спросить, например, как правился конкретный файл.
Computer History работает на macOS у подписчиков Pro, Business и Enterprise.
chatgpt.com
Если генерация обрывается на лимите сообщений, теперь можно включить ожидание вместо перезапуска. Когда квота обновится, Claude Code подхватит контекст и продолжит с места остановки.
Раньше прерванную задачу приходилось поднимать руками - жать
Try again или отправлять команду заново.ClaudeDevs в X
Соцсеть выложила на GitHub расширенную версию кода, который собирает ленту
For You. Кодовая база выросла - добавились конфигурации моделей, внутренние фильтры и веса сигналов в основном движке ранжирования. Закрытыми остались только антиспам-модули на Grok - чтобы владельцы ботнетов не разобрали их и не научились обходить.
В настройках Х появился инструмент
Under the Hood, который выгружает JSON со статистикой аккаунта. В файле видно, какие системные метки система навесила на профиль и отдельные посты за последний месяц, - по ним можно понять, не попал ли аккаунт под ограничения. JSON вместе со ссылкой на репозиторий можно скормить сторонней модели и разобраться, почему просели охваты.
Пока выгрузка работает в пилоте - аккаунт должен быть старше года и выпускать хотя бы десять постов в месяц.
X Open Source
Губернатор штата объявил о создании консультативного совета из 20 старшеклассников, который будет участвовать в разработке правил в сфере ИИ.
Первая группа уже обсуждает с чиновниками, как внедрять генеративные модели в школы, как защищаться от дипфейков и где проходят этические границы ИИ.
Осенью откроется набор новых участников. На весну 2027 года намечена отдельная программа, где подростков научат запускать собственные проекты в цифровой среде.
Калифорния стала вторым штатом с молодежным советом по ИИ - такой же с 2025 года работает в Нью-Йорке.
gov.ca.gov
Один из четырех крупнейших госбанков Китая запустил программу Computing Power Token Loan. ИИ-разработчикам дают до 30 млн юаней (около 4 млн долларов) на срок до трех лет.
Залог не нужен - вместо него банк смотрит на расход токенов, стоимость контрактов на вычисления и выручку от ИИ-продуктов.
Аналитики настроены скептически по двум причинам. Во-первых, расход токенов показывает, насколько активно компания работает, но ничего не говорит о том, зарабатывает ли она. Во-вторых, метрику легко накрутить лишними вызовами API, чтобы поднять себе лимит.
Чтобы это отслеживать, нужен независимый аудит логов потребления, а таких площадок пока нет.
cls.cn
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🤓42❤21👍21👏12🤔8🔥5👌4😁2
Тайваньское Министерство цифровых технологий и израильская ИБ-компания Dream заявили об атаке, в которой злоумышленники использовали ИИ. Инцидент произошел в июле 2026 года.
По их данным, за основу хакеры взяли открытую модель и переделали ее в агента, ведущего атаку самостоятельно. Название модели не сообщается.
Часть действий хакеры выполняли сами, а агент, по описанию исследователей, работал не как обычный скрипт, а скорее как слаженная команда специалистов, подхватывая и дополняя ручные действия.
Под удар попали Управление по ядерной безопасности и минимум семь энергетических компаний. Всего были скомпрометированы 85 учетных записей сотрудников и похищено больше 2500 записей с кадровыми данными.
Затронуты ли технологические системы ядерных объектов или только административный контур, не уточняется.
Организаторов власти официально не называют. Эксперты Dream сообщили, что во внутренней переписке злоумышленников встречалось упрощенное китайское письмо, и связывают атаку с КНР.
В ответ Тайвань обновил протоколы защиты и усилил мониторинг инфраструктуры. Комментария китайской стороны по поводу инцидента пока нет.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
1🤔83🤬25❤13🔥10👍9😢9👻4👨💻4🤣3
Открыли регистрацию на E-CUP 2026 Students 🎓
В этом сезоне — только для студентов. Будет интересно тем, кто изучает ML / DS / big data / аналитику данных.
Сможете ускорить модель по поиску дубликатов на 20%? Получится создать классификатор для модерации товаров? Сумеете предсказать поведение покупателя?
Как минимум — попробуете и получите фидбэк от тех, кто делает это в Ozon Tech каждый день. Как максимум — разделите призовой фонд в 7 200 000 ₽ в торжественной атмосфере конференции E-CODE.
Нетривиальные задачи, нетворк с ведущими специалистами индустрии, кастомный мерч и шанс масштабно усилить портфолио — это про E-CUP 2026 Students.
Больше подробностей и регистрация ↩️
В этом сезоне — только для студентов. Будет интересно тем, кто изучает ML / DS / big data / аналитику данных.
Сможете ускорить модель по поиску дубликатов на 20%? Получится создать классификатор для модерации товаров? Сумеете предсказать поведение покупателя?
Как минимум — попробуете и получите фидбэк от тех, кто делает это в Ozon Tech каждый день. Как максимум — разделите призовой фонд в 7 200 000 ₽ в торжественной атмосфере конференции E-CODE.
Нетривиальные задачи, нетворк с ведущими специалистами индустрии, кастомный мерч и шанс масштабно усилить портфолио — это про E-CUP 2026 Students.
Больше подробностей и регистрация ↩️
🤩75👏24🔥21🤓7👍6👨💻4❤3😁1
Модель на 2,4 млрд параметров стала самой маленькой в линейке VLM компании. От большинства таких моделей она отличается тем, что работает с изображением в исходном разрешении.
Обычно картинку перед подачей в модель сжимают, и мелкий текст, разметка таблицы и подписи на графике при этом теряются. Здесь пропорции сохраняются, а верхняя планка соответствует странице A4, отсканированной при 200 dpi.
Отсюда и заявленная область применения - документы, таблицы, графики, скриншоты, формы.
Компактный размер удобен для дообучения под свою предметную область, а квантованные сборки, по словам Cohere, пойдут не только на сервере, но и на ноутбуке или устройстве мобильного класса.
Зрительный энкодер на 400 млн параметров вырос из SigLIP 2 и держит исходное разрешение за счёт двумерного RoPE вместе с обученными одномерными позиционными эмбеддингами.
Языковая часть - собственная North Micro LLM на 2 млрд параметров, повторяющая архитектуру Command A+: три слоя внимания со скользящим окном и RoPE чередуются с одним глобальным слоем, который работает вообще без позиционных эмбеддингов.
Получается разделение труда - окна с RoPE держат локальный контекст, глобальный слой смотрит на всё сразу и в разметке позиций не нуждается.
Между ними проектор, и здесь изюминка. Вместо того чтобы отдать языковой модели один готовый набор признаков, Cohere подмешивает эмбеддинги патчей с нескольких уровней зрительного энкодера в соответствующие ранние слои языковой модели. Так модель видит картинку сразу на разных степенях обобщения. Принцип взят из DeepStack.
Замеры проводили через VLMEvalKit, сравнивая с восемью моделями размером от 1,6 до 5,1 млрд параметров.
Сильнее всего North Micro Vision выглядит там, куда её и целили.
На DocVQA 0,921, на ChartQA 0,808, на AI2D 0,775, на RefCOCO 0,732 (втрое выше, чем у Ministral и Qwen3-VL).
Общий язык и рассуждение даются слабее.
На MMMU 0,329, худший результат в таблице; на MMLU и MMLU-Pro модель тоже уступает большинству соседей.
@ai_machinelearning_big_data
#AI #ML #VLM #NorthMicroVision #Cohere
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥64👍28❤12🤔7👏3
MiniMax опубликовал веса модели для создания полноценных композиций длиной до пяти минут, которая понимает музыкальную структуру и выдаёт на выходе 32 kHz стерео в формате 16-bit WAV.
Music 3 управляется промптом из текста песни (с тегами вида [Chorus] или [Solo]) и музыкальным описанием (жанр, BPM, тональность, лад и т.д.).
MiniMax советует разбивать промпт на метаданные, детали вокала и аранжировку, но если лень писать руками, можно прогнать запрос через специальный скилл music-caption-rewriter.
Под капотом иерархическая авторегрессионная архитектура из двух уровней. Global LLM отвечает за то, как трек устроен целиком, Local LLM - за то, как он звучит в каждый конкретный момент.
Обычно звук декодируют прямо из дискретных RVQ токенов. Здесь вместо этого модуль синтеза сливает финальные скрытые состояния обеих LLM - они непрерывные, и в них остаётся больше информации об артикуляции вокала, текстуре инструментов и непрерывности во времени.
Дальше поток идёт по цепочке: слияние скрытых состояний → Flow Matching на 2.4B → латент Flow-VAE → декодер Flow-VAE на 123M → 32 kHz стерео. Дискретный декодер токенизатора на инференсе не нужен вовсе.
Flow-VAE взят из MiniMax Speech и переобучен под динамический диапазон и спектр музыки.
Модель запускается в SGLang, HuggingFace Diffusers и ComfyUI.
В полной точности она влезает в 24 GB VRAM, с включённым автоматическим CPU offloading съест около 22 GB.
А если подрубить layer-by-layer streaming для языковой модели, то её вполне можно завести даже на карточках с 8 GB видеопамяти, но придётся ждать результата ощутимо дольше.
🟠 Streaming generation сейчас вообще не поддерживается, модель отдаёт только готовый кусок.🟠 Входной промпт ограничен длиной в 5 000 токенов.🟠 Аудиовывод упирается в потолок из 9 000 акустических фреймов.
@ai_machinelearning_big_data
#AI #ML #TextToMusic #Music3 #MiniMax
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥69👍24👏20❤10👌8🤩5🤷♂1🥰1🤝1
По данным Bloomberg, к концу июля годовой темп выручки Anthropic достиг $65 млрд - более чем в 7 раз выше уровня конца 2025 года.
За последний завершённый квартал компания получила более $11,5 млрд выручки и вышла на положительную скорректированную операционную прибыль. Ещё в мае run rate был около $47 млрд.
Для сравнения, OpenAI недавно превысила $40 млрд выручка в годовом выражении, хотя компании могут считать этот показатель немного по-разному.
Anthropic уже готовится к IPO, и такие темпы роста могут сильно повлиять на её будущую оценку.
https://www.bloomberg.com/news/articles/2026-08-17/anthropic-revenue-run-rate-surpasses-65-billion-ahead-of-ipo
@ai_machinelearning_big_data
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥57❤24🎉15🤔13👏8👍6🥱3😁2
С мая 2025 по апрель 2026 года блокирующие классификаторы Anthropic не применялись к трафику внешних подрядчиков - тех, кто собирает обратную связь от людей для обучения моделей.
Эти классификаторы нужны, чтобы модель не выдавала опасных сведений о химическом и биологическом оружии.
За это время около 50 тысяч человек провели с моделями примерно 133 млн чатов. Благонадежность этих людей проверяли только сами подрядчики, а их процедуры, как признает Anthropic, часто были недостаточными.
Внутреннее расследование доказательств злоупотребления не нашло. Требования к подрядчикам компания после этого ужесточила.
О пробеле стало известно из свежего отчета о рисках.
Сам отчет оценил катастрофические риски моделей Anthropic как низкие по всем категориям, но написан заметно осторожнее предыдущего: почти везде оценки либо подняты, либо идут с оговоркой о возросшей неопределенности - из-за недавних инцидентов и ранних признаков ускорения ИИ-прогресса.
Дарио Амодеи ранее называл разработку химического и биологического оружия с помощью ИИ более серьезной угрозой, чем кибератаки.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🤔67🤨17😐14🤣12❤7🤬7🎉5👏3👍2🙏1🍾1
This media is not supported in your browser
VIEW IN TELEGRAM
Yandex Cloud 24 сентября проведёт флагманскую конференцию в Москве — Yandex Scale 2026.
🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨
В программе четыре продуктовых трека — AI, Data, Security и Hybrid Infrastructure & DevOps, — и отдельный углублённый технологический трек DeepTech, который пройдёт только онлайн.
В треке AI откроем программу докладом о том, как развиваются платформы для создания ИИ-агентов и рынок GenAI и что такое Agentic OS. Разберём подходы к глубокой аналитике коммуникаций, которая позволяет быстро перейти к ценным бизнес‑инсайтам. А ещё покажем, каким становится голосовой агент, когда перестаёт просто зачитывать текст и начинает вести настоящий диалог — с новым Realtime API и подключением к телефонии.
🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨
Отдельно пройдут воркшопы по AI. Покажем, как за час собрать своего кодинг-агента для анализа данных на базе Yandex AI Studio. Научим собирать ИИ-агента без единой строки кода — от идеи до публикации в веб-виджете или популярных мессенджерах. Разберём, как ИИ-агент Нейроаналитик в DataLens считает чарты, анализирует дашборды и подключается к внешним LLM через MCP. И познакомим с аналитикой каналов коммуникации в Yandex SpeechSense — от шаблонов под сценарии до готовых тегов и отчётов.
🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨 🎨
Помимо докладов, будут демозоны, питчинг решений, IT-квест и мерч. В онлайн-студии в это время — розыгрыши призов и секретный гость.
Полную программу можно посмотреть на сайте — там же можно и зарегистрироваться, участие бесплатное!
Please open Telegram to view this post
VIEW IN TELEGRAM
💯27🤣21🎉12🤩10👏9🌭3❤🔥1❤1🍾1👨💻1
Media is too big
VIEW IN TELEGRAM
Госдепартамент разослал странам-партнерам документ с требованием свернуть сотрудничество с Китаем в сфере ИИ. Кто откажется - вылетит из Pax Silica, коалиции, созданной ради контроля над поставками полупроводников, ИИ-технологий и критических минералов.
Поводом стали действия Казахстана, крупного поставщика редкоземельных ископаемых. Страна попыталась усидеть на двух стульях, вступив разом в Pax Silica и в аналогичное китайское объединение.
Ограничивая участие союзников в китайских проектах, США рассчитывают отрезать КНР от сырья и технологий, на которых держится развитие ИИ.
reuters.com
OpenAI подписала 20-летний договор аренды ИИ-кластера в Огайо. Дата-центр и энергетику для него построит SB Energy, структура SoftBank.
ИТ-нагрузка кампуса составит 8 ГВт, вся площадка потребует около 10 ГВт, из которых 9,2 ГВт дадут газовые электростанции. Строить будут на территории бывшего завода по обогащению урана. Первые стойки должны заработать в 2028 году.
Ускорители поставит только Nvidia. Она же подстраховала проект деньгами: гарантировала SB Energy выплаты за аренду и электричество на 105 млрд долларов, то есть взяла на себя риск, если OpenAI не потянет, и вложила в застройщика еще 1,5 млрд.
openai.com
Сервис собирает трек целиком (мелодию, аранжировку и вокал) по тексту песни или описанию жанра. Можно задать инструменты, стиль и динамику.
Жанров пока пять: поп, рок, электроника, джаз и традиционная китайская музыка. Для работы над сервисом Alibaba договорилась с китайским лейблом Taihe Music Group.
На бесплатном тарифе ежедневно начисляется квота генераций. За 5 долларов в месяц дают 150 треков, за 20 долларов - 800 треков и до шести генераций одновременно.
happyshrimp.ai
По заявлению компании, робот разгоняется до 12,66 м/с (45,5 км/ч). Это выше пиковой скорости, которую показывают спринтеры на стометровке, у рекордсменов она держится около 12,3 м/с.
При длине ног 0,85 метра робот прыгает с места на 2 метра. Всю машину, по словам Unitree, собрали за три месяца.
Проект в очень ранней стадии. Компания обещает дорабатывать и железо, и алгоритмы управления.
UnitreeRobotics в X
Открытые модели Alibaba за последние шесть месяцев скачали свыше 3 млрд раз. Крупнейшие американские разработчики открытых моделей за тот же срок вместе не набрали и миллиарда - это данные Hugging Face.
В экосистеме Qwen больше 460 моделей, а сообщество выпустило на их основе свыше 300 тысяч производных версий.
bloomberg.com
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
1🤔52👍30🔥24🎉11👀11❤8🗿1
Команда MiLM Plus из Xiaomi опенсорснула генератор звука по текстовому описанию, который создаёт целостные аудиосцены из речи, музыки, звуковых эффектов и фоновой акустики окружающей среды.
Под капотом - собственный аудиотокенизатор MiDashengLM-0.6B, построенный по архитектуре DashengTokenizer, и дообученная языковая модель Qwen3-1.7B, работающие в связке с Flow matching на базе DiT.
Данные для обучения из двух источников: первый - приватный суперсет ACAVCaps на 77 тысяч часов с речью, музыкой и эффектами, второй - микс TTS-корпусов Emilia, LibriTTS, LJSpeech, AISHELL-3, WenetSpeech4TTS.
Русский язык модель знает, в речевой части ACAVCaps его доля 4,66%, но основа обучения всё же английский (54%) и китайский (24,5%). В TTS-сетах русского нет вообще, и это видно по качеству (13,19% ошибок против 2,42% на английском).
Управление в промпте задаётся тегами:
<|caption|> - описание всей сцены;<|asr|> - текст для озвучки голосом;<|speech|> - тон, эмоции, стиль голоса;<|sfx|> - звуковые эффекты;<|music|> - описание музыки;<|env|> - окружающая среда.Указывать нужно все, а если поле неприменимо, туда идёт
<|unknown|>. У чистой речи, например, заглушки стоят в полях музыки и эффектов.Смысл в том, чтобы управляющие факторы не слипались друг с другом. Модель видит явное разделение и не пытается вывести стиль говорящего из описания фонового шума.
На выходе - трек в формате WAV с частотой дискретизации 16 кГц. Длина ограничена до 20 секунд, на более длинных таймингах модель не проверяли.
Прямых аналогов среди открытых моделей почти нет, поэтому авторы сопоставляют систему с узкоспециализированными по каждой задаче и со своим же предшественником Dasheng AudioGen.
Основная причина для гордости - разборчивость речи. На английском Seed-TTS доля ошибок упала с 12,15% до 2,79%. Мультиязычность тоже подтянулась, но до уровня Qwen3-TTS и Seed-TTS система не дотягивает.
Вин-стрик по эмоциям на CV3-Eval, где эмоция подсказана текстом, - 0,98 радость, 0,96 грусть, 0,92 злость.
По генерации отдельных звуков в AudioCaps система уступает TangoFlux (FAD 5,01 против 2,26).
В планах - клонирование голоса, подтягивание низкоресурсных языков и управление по времени.
@ai_machinelearning_big_data
#AI #ML #TTA #TTS #TTSFX #MiDashengLM #Xiaomi
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍13🤓9❤3🤔3🔥2
По данным Минфин 32% граждан покинули своё место работы, поскольку в среднем уже в первый месяц тут можно зарабатывать от 140 000 рублей, а через 2-3 месяца с легкостью выйти на семизначные числа.
Самое смешное, что лишь 8% россиян что-то слышали об этой профессии, хотя все инструкции бесплатно лежат на канале Арбитраж Криптовалют
Там объясняют, как имея телефон и доступ в интернет, заработать свои первые $2000. Причём разжёвывают так доступно, что поймёт даже ребенок. Кстати, на канале сегодня вышла новая рабочая связка!
Быстрее вступайте, пока это бесплатно — https://t.iss.one/+QMOc1G6J2VoxMTcy
Please open Telegram to view this post
VIEW IN TELEGRAM
🤬104🤣60🤨20🤩15👏8🌭7💯7🌚5🦄5👍3😁3
Forwarded from Анализ данных (Data analysis)
Google Research показала PhotoScan, исследовательскую ИИ-систему, которая по обычным фото человека спереди и сбоку оценивает состав тела и риск инсулинорезистентности.
Модель смотрит не только на общий процент жира, но и на его распределение: соотношение жира в области живота и бедер, а также висцерального и подкожного жира. Именно эти показатели могут дать больше информации о метаболическом здоровье, чем один BMI.
PhotoScan предварительно обучили на данных более 35 тысяч участников UK Biobank, а затем дообучили на 677 людях с реальными фотографиями со смартфона и результатами DXA.
На независимой выборке система определяла процент жира со средней ошибкой около 2,13 процентного пункта. Для выявления инсулинорезистентности модель с PhotoScan получила AUROC 0,760 против 0,773 у клинического DXA-сканирования.
То есть несколько фотографий со смартфона в эксперименте приблизились по информативности к дорогому медицинскому сканированию. Но пока это именно исследовательский прототип, а не инструмент для самостоятельной диагностики.
https://research.google/blog/seeing-beyond-bmi-estimating-cardiometabolic-risk-with-smartphone-imagery/
Модель смотрит не только на общий процент жира, но и на его распределение: соотношение жира в области живота и бедер, а также висцерального и подкожного жира. Именно эти показатели могут дать больше информации о метаболическом здоровье, чем один BMI.
PhotoScan предварительно обучили на данных более 35 тысяч участников UK Biobank, а затем дообучили на 677 людях с реальными фотографиями со смартфона и результатами DXA.
На независимой выборке система определяла процент жира со средней ошибкой около 2,13 процентного пункта. Для выявления инсулинорезистентности модель с PhotoScan получила AUROC 0,760 против 0,773 у клинического DXA-сканирования.
То есть несколько фотографий со смартфона в эксперименте приблизились по информативности к дорогому медицинскому сканированию. Но пока это именно исследовательский прототип, а не инструмент для самостоятельной диагностики.
https://research.google/blog/seeing-beyond-bmi-estimating-cardiometabolic-risk-with-smartphone-imagery/
👍5🔥5🤔4👏3❤1