Media is too big
VIEW IN TELEGRAM
Компания планирует продавать расширенные квоты на запросы к Apple Intelligence и обновленной Siri через подписку iCloud+. По словам Тима Кука, пользователи смогут доплачивать за снятие базовых дневных ограничений.
Текущие тарифы iCloud+ уже предлагают слегка увеличенные ИИ-лимиты. Для интенсивной работы с ИИ-функциями Apple добавит в линейку сервиса новые, более дорогие уровни подписки.
Релиз обновленной Siri ожидается осенью в составе очередного обновления iOS.
theverge.com
Science One - экспериментальный фреймворк для автоматической генерации научных статей. Инструмент использует архитектуру Chain-of-Evidence, которая минимизирует галлюцинации.
Алгоритм привязывает каждое утверждение в тексте к конкретному рабочему артефакту или результату выполнения кода. Для работы с литературой система игнорирует внутреннюю память языковой модели и обращается к научным API, выстраивая графы цитирования в реальном времени.
Оценку качества сгенерированных текстов проводит автоматизированный ревьюер CoE Audit. Он проверяет подлинность источников, работоспособность кода и воспроизводимость метрик.
В тестах 5 систем на базе Gemini 3.1 Pro написали 75 статей по 5 задачам. Все 337 цитат Science One оказались подлинными. Кроме того, 12 экспериментов выдали корректные результаты, а в 14 из 15 проверенных работ написанный код полностью совпал с заявленной методологией.
research.google
H3 - модель генерации видео с поддержкой мультимодального ввода, которая генерирует ролики длиной до 15 секунд в разрешении 2K со стереозвуком по составным промптам.
Модель одновременно обрабатывает текст, изображения, видео и аудио и умеет комбинировать референсы в одном запросе - извлечь движение камеры из загруженного ролика, внешность персонажа из фото, а звук - из аудиофайла. В один промпт можно передать до 12 референсов.
Генерация через API стоит 13 центов за секунду видео в 2К и 9 центов за 768P. Открытый релиз на ModelScope запланирован на 3 августа.
minimax.io
Новинка генерирует видео длиной до 30 секунд за один проход, что вдвое больше лимита предыдущей версии. Фрагменты можно объединять в ролики длительностью до нескольких минут.
Модель поддерживает расширенный мультимодальный промптинг - в один запрос можно передать до 30 изображений, 10 видеоклипов и 10 аудиодорожек. Для точного контроля визуального ряда и темпа генерации используются таймкоды.
В Китае Seedance 2.5 появилась на платформах Jiemeng AI и Doubao Professional, на глобальном рынке она доступна через сервис Dreamina экосистемы CapCut.
bytedance.com
Новая функция Character Casting парсит загруженный текст, извлекает персонажей и назначает им роли из библиотеки на 10 тысяч синтетических дикторов. При замене диктора алгоритм обновляет реплики для выбранного персонажа по всему документу.
Инструмент умеет определять нестандартные имена и выдуманные термины. Достаточно задать произношение один раз, после чего правило применяется ко всему тексту. Готовый проект можно дополнить звуковыми эффектами, экспортировать (заявлена поддержка более 70 языков) или опубликовать в ElevenReader.
По оценкам ElevenLabs, Character Casting снижает стоимость производства аудиокниги с $5000 до $200, а время создания - с трех месяцев до нескольких часов. Новая функция доступна в разделе Audiobooks.
elevenlabs.io
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👏51👍31❤20🤔13🔥9👌4🤣4🗿2😎2😁1
SQLite AI собрала движок на 6000 строк C, который гоняет полновесную K3 без BLAS, CUDA и Python в рантайме.
Kimi K3 после предварительной конвертации из safetensors в формат, который движок умеет читать, занимает 982 ГиБ (диск бы назвал это 1,05 ТБ). В оперативную память она не влезает даже приблизительно.
WASTE держит в RAM только резидентную часть на 27,28 ГБ, а экспертов подтягивает с SSD ровно тогда, когда они понадобились. Скорость генерации выходит 0,49-0,54 токена в секунду. Веса при этом полные, без дистилляции и обрезки слоёв.
На каждый токен K3 включает около 4% собственных весов - 16 экспертов в каждом из 92 слоёв. Простаивающему весу незачем сидеть в памяти, ему достаточно успеть подгрузиться вовремя.
Контейнер с моделью устроен так, что один эксперт стоит ровно одного чтения с диска - матрицы
gate, up и down лежат вплотную, а сами эксперты хранятся в остаточном векторном квантовании (3 ступени кодбуков по 256 записей, 3 бита на вес), и матрица никогда не разворачивается целиком.На один токен движок вычитывает 17 ГБ. Внутренний NVMe в MacBook выдаёт 12,78 ГБ/с, и модель успевает читать.
Внешний бокс по USB даёт 0,94 ГБ/с, и тот же токен считается 13 секунд.
Раздувать кэш экспертов выше 46 ГБ бесполезно и вредно - на 52 ГБ скорость падает втрое, на 58 ГБ в 8 раз.
Причина в том, что движок остаётся внутри своего бюджета, а система уже нет - macOS вытесняет кэш на диск, и попадание в память оборачивается обращением к подкачке. Поэтому по умолчанию WASTE не забирает все доступные ресурсы, а берёт на один рабочий набор экспертов меньше, чем мог бы.
Полтокена в секунду - это 30 секунд на одно предложение, но модели вчетверо меньше до сих пор запускают на серверах с терабайтом DDR5, а здесь почти 3 триллиона параметров отвечают без сети.
Если триллионы параметров не нужны, тот же движок крутит Kimi-Linear 48B из контейнера на 19 ГБ и выдаёт 10,7 токена в секунду - с этого проще начать знакомство.
Для K3 придётся освободить терабайт на диске и потратить около 5 часов на M5 Pro в три процесса, почти сутки - если гонять конвертацию чистым торчем.
Авторы, кстати, завели файл с опровергнутыми гипотезами и записали туда всё, что померили и выбросили.
@ai_machinelearning_big_data
#AI #ML #Inference #KimiK3 #WASTE #SQLiteAI
Please open Telegram to view this post
VIEW IN TELEGRAM
❤143👨💻86🔥57🤓21🤣19👍15👏14🤔11🎉1🗿1
⚡️ Qwen представила Qwen3.8-Max - модель на 2,4 трлн параметров для автономной разработки и рабочих агентов
По заявлению команды, модель способна вести длинные проекты почти без вмешательства человека: планировать работу, писать код, запускать инструменты, анализировать результат и исправлять ошибки по обратной связи.
Пример - oh-my-cli. Агент начал с пустой папки и развивал проект больше десяти дней, оставив полный журнал изменений в открытом GitHub-репозитории.
Qwen также заявляет о сотнях последовательных итераций при оптимизации чипов, долгосрочном планировании бизнес-стратегий и нативной работе с изображениями. Визуальные данные используются внутри цикла «планирование - выполнение - проверка», а не только как входной контекст.
Цена API:
- ввод - $2 за 1 млн токенов;
- вывод - $6;
- закешированный ввод - $0,25.
На следующей неделе компания обещает открыть веса Qwen3.8-Max и более компактной Qwen3.8-27B.
Если заявленные возможности подтвердятся на независимых тестах, Qwen получит редкую комбинацию: огромную агентную модель, мультимодальность и открытые веса.
Блог:
https://qwen.ai/blog?id=qwen3.8
Qwen Studio:
https://chat.qwen.ai/?models=qwen3.8-max
API:
https://qwencloud.com/models/qwen3.8-max
Автономный проект:
https://github.com/qwen-code-dev-bot/oh-my-cli
@ai_machinelearning_big_data
#qwen
По заявлению команды, модель способна вести длинные проекты почти без вмешательства человека: планировать работу, писать код, запускать инструменты, анализировать результат и исправлять ошибки по обратной связи.
Пример - oh-my-cli. Агент начал с пустой папки и развивал проект больше десяти дней, оставив полный журнал изменений в открытом GitHub-репозитории.
Qwen также заявляет о сотнях последовательных итераций при оптимизации чипов, долгосрочном планировании бизнес-стратегий и нативной работе с изображениями. Визуальные данные используются внутри цикла «планирование - выполнение - проверка», а не только как входной контекст.
Цена API:
- ввод - $2 за 1 млн токенов;
- вывод - $6;
- закешированный ввод - $0,25.
На следующей неделе компания обещает открыть веса Qwen3.8-Max и более компактной Qwen3.8-27B.
Если заявленные возможности подтвердятся на независимых тестах, Qwen получит редкую комбинацию: огромную агентную модель, мультимодальность и открытые веса.
Блог:
https://qwen.ai/blog?id=qwen3.8
Qwen Studio:
https://chat.qwen.ai/?models=qwen3.8-max
API:
https://qwencloud.com/models/qwen3.8-max
Автономный проект:
https://github.com/qwen-code-dev-bot/oh-my-cli
@ai_machinelearning_big_data
#qwen
🔥123⚡41👍28❤18🤔16👏6🎉2😁1🤝1
Генеративный ИИ перестал быть исключительно инструментом для прототипов. Все больше компаний интегрируют LLM в разработку, аналитику и внутренние бизнес-процессы. Одновременно растет вопрос: какие направления действительно изменят индустрию, а какие окажутся очередной волной хайпа.
Эти вопросы на ИТ-Пикнике, который пройдет уже в субботу, обсудят руководители AI-направлений крупнейших российских технологических компаний — специалисты, которые сегодня отвечают за развитие и внедрение генеративного ИИ в реальные продукты.
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍110🔥30🤔22❤21👏12🤣9💯5💅2
Исследовательский агент Hyra на базе открытой модели Hy3, помог ученым разгадать математическую проблему, которая оставалась нерешенной более 50 лет.
Задача из области комбинаторной математики касалась того, насколько размер множества сумм целых чисел может превышать размер его множества разностей.
Научное сообщество давно доказало, что соответствующий показатель степени не превышает двух, но оставалось неизвестным, является ли эта верхняя граница оптимальной.
Агент использовал модель Hy3 для поиска специфических множеств и вывода общей конструкции. За 24 часа вычислений ИИ нашел ядро решения, которое в итоге легло в основу научного открытия. Ученым оставалось лишь проверить логику, внести корректировки и структурировать доказательство.
Для финальной верификации результата использовали GPT-5.6 Sol, которая помогла корректно перевести расчеты на язык Lean 4.
Итоговая статья подтвердила, что искомый показатель действительно может бесконечно приближаться к 2, делая эту границу оптимальным ответом.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🤓112👍29❤22👏21🎉13💯7🔥6😁2
В проморолике модель часами работает над проектированием чипов, а затем переходит к задачам из биологии.
Выбор выглядит намеренным: полупроводники остаются одним из самых болезненных направлений для Китая, а США продолжают ограничивать поставки передовых ускорителей и оборудования для их производства.
Китай намерен закрывать критические технологические пробелы собственными моделями, вычислительной инфраструктурой и чипами.
Сцены с белками можно воспринимать как намёк на AlphaFold и амбицию конкурировать с американскими компаниями уже на уровне научных открытий.
@ai_machinelearning_big_data
#qwen
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍137🤔58🔥29🤬17❤13🤨7🎉5🥰2😁1
This media is not supported in your browser
VIEW IN TELEGRAM
В интерфейсе Yandex AI Studio появился инструмент для анализа поведения ИИ-агентов с Monium Traces
Трейсы — ключевой сигнал для observability агентных систем, который позволяет посмотреть весь путь выполнения агента и разобраться, почему он принял то или иное решение.
В отличие от обычных приложений, для ИИ-агентов классического мониторинга уже недостаточно. Даже если инфраструктура работает без ошибок, агент может потерять контекст, выбрать неподходящий инструмент или уйти в бесконечный цикл. Стандартные метрики этого не покажут.
Используя трейсы для мониторинга ИИ-агентов вы сможете:
• увидеть полную цепочку работы агента в виде трейса;
• видеть контекст каждого шага — системные и пользовательские промпты, ответы модели и вызовы инструментов;
• быстро отслеживать момент, на котором агент начал работать некорректно.
Обновление уже доступно — тестируйте Monium Traces в AI Studio!
Трейсы — ключевой сигнал для observability агентных систем, который позволяет посмотреть весь путь выполнения агента и разобраться, почему он принял то или иное решение.
В отличие от обычных приложений, для ИИ-агентов классического мониторинга уже недостаточно. Даже если инфраструктура работает без ошибок, агент может потерять контекст, выбрать неподходящий инструмент или уйти в бесконечный цикл. Стандартные метрики этого не покажут.
Используя трейсы для мониторинга ИИ-агентов вы сможете:
• увидеть полную цепочку работы агента в виде трейса;
• видеть контекст каждого шага — системные и пользовательские промпты, ответы модели и вызовы инструментов;
• быстро отслеживать момент, на котором агент начал работать некорректно.
Обновление уже доступно — тестируйте Monium Traces в AI Studio!
🤣42👍31🔥10❤9😁3🙉2
This media is not supported in your browser
VIEW IN TELEGRAM
⚡️ Qwen 3.8 Max обошла Fable 5 в жёстком тесте на генерацию 3D-физики и стоила почти в 7 раз дешевле
Команда Atomic Chat дала обеим моделям одинаковое задание: создать три автономных HTML-файла с интерактивными сценами.
В первой мраморные шарики поднимаются на колесо и проходят петлю. Во второй работает автомобильный конвейер. В третьей лесопилка превращает брёвна в доски.
Модель должна сохранять состояние объектов, рассчитывать столкновения, соблюдать геометрию механизмов и синхронизировать всю сцену во времени.
Результаты:
• Qwen 3.8 Max сгенерировала 46,6 тысячи токенов за $0,28.
• Fable 5 использовала 38,7 тысячи токенов за $1,93.
Qwen потратила больше токенов, но запуск обошёлся примерно в 6,9 раза дешевле. По оценке авторов теста, её физические сцены также получились качественнее и стабильнее.
https://x.com/atomic_chat_hq/status/2084231644597162201
@ai_machinelearning_big_data
#qwen
Команда Atomic Chat дала обеим моделям одинаковое задание: создать три автономных HTML-файла с интерактивными сценами.
В первой мраморные шарики поднимаются на колесо и проходят петлю. Во второй работает автомобильный конвейер. В третьей лесопилка превращает брёвна в доски.
Модель должна сохранять состояние объектов, рассчитывать столкновения, соблюдать геометрию механизмов и синхронизировать всю сцену во времени.
Результаты:
• Qwen 3.8 Max сгенерировала 46,6 тысячи токенов за $0,28.
• Fable 5 использовала 38,7 тысячи токенов за $1,93.
Qwen потратила больше токенов, но запуск обошёлся примерно в 6,9 раза дешевле. По оценке авторов теста, её физические сцены также получились качественнее и стабильнее.
https://x.com/atomic_chat_hq/status/2084231644597162201
@ai_machinelearning_big_data
#qwen
❤117👍57🔥33🤔6😁2
This media is not supported in your browser
VIEW IN TELEGRAM
Он использовал модель Opus 5, чтобы превратить абзац из книги "Властелин колец" в 5500 строк кода браузерной графической библиотеки Three.js.
Генерация сцены заняла около 2-х часов, потребовала миллион токенов и обошлась примерно в 10 долларов. Звук был сгенерирован через ElevenLabs.
По мнению Карпати, привычные тесты на пространственное мышление вроде рисования пеликана на велосипеде в SVG окончательно устарели. Современные мультимодальные модели справляются с ними без труда.
Генерация целых интерактивных миров с помощью кода, по мнению Андрея, может стать новым стандартом оценки возможностей ИИ.
Пока главным препятствием для идеального результата остается отсутствие у модели возможности анализировать собственный видеовыход - сейчас она вынуждена опираться на скриншоты, из-за чего в рендере возникают ошибки.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🤣71👍43❤🔥19❤8🔥8🌭3🥰2🤨1💋1💅1
Media is too big
VIEW IN TELEGRAM
Власти США отчитались о создании добровольного регламента тестирования новых моделей. Документ дает правительству и доверенным партнерам 30-дневный доступ к системам до их публичного релиза.
Содержание регламента, сроки внедрения и список допущенных к аудиту лиц не опубликованы. Эксперты рассчитывали, что администрация представит прозрачную структуру взаимодействия разработчиков с государством, включая требования к кибербезопасности, защите интеллектуальной собственности и конфиденциальности на время проверок.
По данным источников, на ближайшей закрытой встрече Белый дом обсудит новые стандарты с представителями ИИ-компаний.
axios.com
Компания ограничила прием баг-репортов из-за спама, сгенерированного языковыми моделями. С июня компания лимитировала количество одновременных отчетов и ввела месячную паузу для ИБ-исследователей.
Ограничения затронули легитимных специалистов. Итальянский стартап Bynario заявил, что за 3 недели нашел более 50 уязвимостей в macOS с помощью ChatGPT, включая цепочку повышения привилегий до полного контроля над устройством. Из-за ограничений команда не смогла передать все данные.
Сама Apple активно использует LLM для аудита безопасности. В последних патчах компания закрыла в 5 раз больше уязвимостей по сравнению с предыдущими релизами.
ft.com
Компания отказалась от планов по выпуску отдельного клиента для iOS и Android, несмотря на 800 тысяч предварительных регистраций. В Google пришли к выводу, что заставлять аудиторию скачивать еще одно приложение нецелесообразно.
Вместо этого кодинг-инструменты Studio интегрируют в базовую версию Gemini. Пользователи смогут описать нужный функционал в формате обычного диалога, после чего чат-бот самостоятельно напишет приложение. Ожидается, что эта опция станет доступна как на мобильных устройствах, так и на десктопах, хотя точные сроки запуска пока не раскрываются.
Веб-версия Google AI Studio продолжит работу и развитие.
Google AI Studio в сети Х
CEO компании Сатья Наделла подтвердил разработку универсального приложения, релиз которого запланирован в этом году. Новая платформа соберет под одной крышей диалоговые интерфейсы, кодинг-ассистентов и автономных агентов. Ожидается, что решение покроет задачи как обычных пользователей, так и корпоративного сектора.
По словам Наделлы, концепция Copilot стремительно эволюционирует из обычного чат-бота в цифрового коллегу и уже близка к формату полноценного автопилота. Интеграция всех этих сценариев в единый продукт должна начаться уже в текущем квартале.
Этот анонс официально подтверждает недавний инсайд, в котором сообщалось, что Microsoft готовит масштабный хаб, связывающий базовый чат-бот, GitHub Copilot, Copilot Cowork и Autopilot.
theverge.com
Модель под названием Namazu на базе Kimi K2.6 дообучена на закрытых данных под локальные бизнес-задачи с фокусом на японский контекст. В бенчмарке FairPoliticsQA файнтюн поднял результат с 34,10% (Kimi) до 56,30% (Namazu) при сохранении показателей родительской модели в логике и кодинге.
Стоимость токенов составляет $0,95 за 1 млн на входе и $4 на выходе. Внешние инструменты тарифицируются отдельно: вызов веб-поиска обойдется в $7 за 1000 обращений, среда выполнения кода - в $0,12 за час. API Namazu полностью совместим со стандартом OpenAI.
Из-за необходимости соблюдать GDPR модель недоступна в ЕС, Великобритании и Швейцарии.
sakana.ai
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍53🔥37❤17🤔14👏8😁3⚡2🎅1🎄1🦄1
В мире существуют лишь единицы систем, способных синтезировать физически точные данные для ИИ. Сбер выложил под открытой лицензией MIT семейство моделей Kandinsky WM 1.0, сделав технологию бесплатно доступной для всех разработчиков.
Системы генерируют физически достоверные видео и решают ключевую проблему — невозможность безопасно и дёшево снять вживую редкие или опасные сценарии вроде ДТП, экстремальной погоды или отказов оборудования.
Что внутри:
• Обучение на реальности: Kandinsky 5.0 Video Lite дообучили на нескольких миллионах видеозаписей реальных дорожных процессов и заводских линий;
• Контроль физики: Специальные алгоритмы через RL оценивают сохранение геометрии и естественность кинематики, избавляя ролики от деформации объектов;
• Модульные сценарии: Генерация 5-секундных блоков видео, из которых складывается обучение автономных систем и систем компьютерного зрения.
Модели становятся фундаментом для создания «моделей мира» — систем, способных предсказывать развитие событий в реальности. Решение уже применяют Центр робототехники Сбера и институт AIRI в своём дорожном симуляторе, а полный технический разбор опубликован в статье на Habr.
@ai_machinelearning_big_data
#ai #opensource #sber
Please open Telegram to view this post
VIEW IN TELEGRAM
👍74🔥50❤39🤣20🗿6😁3🤬3
Как и было обещано на релизе в пятницу, китайская компания опубликовала модель H3, которая делает короткие ролики со звуком по текстовому описанию, картинкам, видео и аудио на входе.
Модель на 33 миллиарда параметров генерирует клипы длиной от 4 до 15 секунд, 24 кадра в секунду, со стереозвуком 32 килогерца, в пропорциях от широких 21:9 до вертикальных 9:16. Реплики персонажей поддерживаются на 11 языках, включая русский.
Полный конвейер H3 состоит из трёх частей:
Но открыли не всю систему - только модуль, который отвечает непосредственно за генерацию. Закрытыми остались H3-Context-IR и H3-Regenerate-2K.
H3-Base-FL2VA работает с первым и последним кадром. Без картинок на входе это генерация по тексту, с одной или двумя - достройка ролика от заданного кадра или между двумя кадрами.
H3-Base-Ref2VA принимает смешанный ввод - до 9 изображений, до 3 видео и до 3 аудиодорожек, но суммарно не больше 12 файлов. Звук без картинки или видео система не примет.
По рейтингу Artificial Analysis, H3 занимает 1 место в редактировании видео, второе в генерации видео по тексту и третье - по изображению.
СomfyUI подготовили детальную инструкцию по использованию в своей среде и опубликовали базовые воркфлоу для генерации по тексту и референсу.
Помимо СomfyUI есть кукбуки под SGLang, vLLM и diffusers, а так же промпт-гайды под базу и фулл-реф мод.
Лицензия разрешает дообучать модель на своих видео, персонажах или визуальном стиле.Официального кода для трейна пока нет.
⚠️ Коммерческое использование допускается только для компаний с выручкой ниже 20 миллионов долларов.
@ai_machinelearning_big_data
#AI #ML #Video #H3 #Minimax
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍118🔥42❤14👏12🤩9💯5
547 участников, 17 выступлений и мастер-классов, три зала и целый день Data Science: от RecSys и антифрода до NLP, LLM и агентных систем.
Главная фишка — максимум практики и общения. Топовые спикеры из российского бигтеха и международных компаний делились не только подходами, но и реальными историями из разработки.
А после технической части гости продолжили общение на нетворкинге, играли в ИИ-шахматы, настольный теннис и баскетбол. А завершился день афтепати во дворе московского лофта.
Получился отличный день про ML — с сильными кейсами, живым общением и людьми, которые двигают индустрию вперед
@ai_machinelearning_big_data
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1🔥101👏30🎉17👌12👍11❤4😁4🥱1