Media is too big
VIEW IN TELEGRAM
Полупроводниковое подразделение Alibaba (T-Head) анонсировало открытие исходного кода стека SAIL для фирменных ИИ-ускорителей Zhenwu. Проект анонсировали на Всемирной конференции по ИИ в качестве открытой альтернативы экосистеме Nvidia CUDA.
По заявлению T-Head, адаптация SAIL под популярные ML-фреймворки занимает менее 7 дней. Флагманом линейки выступает процессор Zhenwu M890, представленный в мае и спроектированный для работы с ИИ-агентами.
Alibaba ранее сообщала об отгрузке более 560 тысяч таких чипов сотням корпоративных клиентов.
scmp.com
Стартап временно остановил продажу подписок на модель Kimi K3 из-за нехватки вычислительных мощностей. Действующие пользователи работают без ограничений, доступ новым клиентам откроют по мере масштабирования инфраструктуры.
Для балансировки нагрузки на кластеры компания меняет систему монетизации и делит единую подписку на 2 тарифа.
В план Kimi Membership входят веб-версия, мобильное приложение и стандартные сценарии использования. Для инженеров вводится Kimi Code Membership - ресурсы этого тарифа выделены только под генерацию и анализ кода. Такое разделение потоков должно стабилизировать работу сервиса.
Kimi в сети Х
Microsoft расширит использование ускорителей AMD в инфраструктуре Azure. Во второй половине 2026 года компания запустит вычислительную платформу AMD Helios, оптимизированную для крупных моделей. Сатья Наделла объяснил расширение партнерства ценовой политикой Nvidia и конкуренцией со стороны TPU.
Параллельно аппаратное обеспечение AMD тестирует Anthropic. По данным SemiAnalysis, AMD присвоила разработчику Claude высший приоритет поддержки наравне с Amazon. Ожидается, что компании официально анонсируют партнерство на конференции Advancing AI после решения проблем с оптимизацией программного стека.
microsoft.com
Корпус аппарата Phantom Twist в полете вращается со скоростью до 25 оборотов в секунду, делая его почти невидимым за счет эффекта размытия. А процессе создания дрона ИИ сгенерировал 20 тысяч вариантов дизайна и симулировала их работу на фоне реальных пейзажей.
Пропеллер и рама Phantom Twist крутятся в противоположных направлениях - в конструкции нет статичных деталей. Аппарат в 10 раз сложнее заметить, чем классический квадрокоптер.
Авторы позиционируют устройство как инструмент для мониторинга дикой природы и осмотра инфраструктуры.
northwestern.edu
Известный по "Району №9" режиссер представил 13-минутный научно-фантастический хоррор Nightborne, полностью созданный с помощью видеомодели Seedance 2.0. Сюжет стилизован под документальное кино о военной программе, возвращающей в строй погибших солдат.
Бломкамп управлял процессом покадрово, выстраивая сцены через промпты на основе концепт-артов, подготовленных художниками. Для генерации лиц и озвучки студия лицензировала биометрию 32 человек, чтобы избежать проблем с авторскими правами.
Режиссёр заявил о планах снять полнометражный ИИ-фильм. Для реализации этих амбиций он уже открыл новую компанию, ориентированную на нейросетевой продакшен, которая придет на смену его классической студии Oats Studios.
Neill Blomkamp в сети Х
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🤩77🔥43❤23👏17😍12👍10🎉4❤🔥1🤔1
Cloud ru выложил в опенсорс Guardrails Filter — инструмент для защиты данных при работе с LLM
Работает как слой между приложением и моделью: перед отправкой запроса маскирует персональные данные, API-ключи, пароли и другую конфиденциальную информацию синтетическими значениями, а после ответа модели восстанавливает оригиналы.
Вы можете развернуть Guardrails Filter внутри своей инфраструктуры и самостоятельно управлять сервисом через личный кабинет.
Что внутри:
— стандартные и кастомные правила детекции (например, под внутренние ID, номера договоров)
— логирование событий безопасности
— тестовый режим Ghost Mode, который позволяет проверить работу сервиса до включения защиты
На публичном бенчмарке pii-bench инструмент показал 93,1 по F1 и 99,9% точности срабатываний.
GitVerse | GitHub
#news #ai #ml
Работает как слой между приложением и моделью: перед отправкой запроса маскирует персональные данные, API-ключи, пароли и другую конфиденциальную информацию синтетическими значениями, а после ответа модели восстанавливает оригиналы.
Вы можете развернуть Guardrails Filter внутри своей инфраструктуры и самостоятельно управлять сервисом через личный кабинет.
Что внутри:
— стандартные и кастомные правила детекции (например, под внутренние ID, номера договоров)
— логирование событий безопасности
— тестовый режим Ghost Mode, который позволяет проверить работу сервиса до включения защиты
На публичном бенчмарке pii-bench инструмент показал 93,1 по F1 и 99,9% точности срабатываний.
GitVerse | GitHub
#news #ai #ml
👍139❤24👏22🙏14🔥7
Ежегодная Всемирная конференция по ИИ прошла с 17 по 20 июля, и, впервые за всю историю проведения, открывал её лично Си Цзиньпин.
Всего было больше 1100 компаний, свыше 3000 экспонатов, 300+ мировых премьер на рекордных 100 000 квадратных метров.
WAIC в этом году сменил акцент - перестал быть парадом бенчмарков и стал витриной внедрения: роботы едут на заводы, агенты - в телефоны, чипы собираются в кластеры без Nvidia.
Фон для всей конференции задал свежий Stanford AI Index.
К марту 2026 лучшая американская модель опережала лучшую китайскую всего на 2,7% (2 года назад отрыв мерили десятками процентных пунктов).
Гвоздь компьют-зала - Huawei Atlas 950 SuperPoD, супернода на картах Ascend. В полной сборке версии соединяются в Atlas 950 SuperCluster на 500 000 ускорителей.
Вторым номером шёл кластер Sugon Dawn 8000 scaleX на 100 000 карт. Следом - решения Alibaba Zhenwu M890 и ZTE OEX SuperPoD.
MiniMax показала мультимодальную M3 с контекстом до 1 миллиона токенов с упором на длинный ризонинг, код и агентские сценарии.
StepFun представила Step Agent OS, которую называет первой в мире агентной операционной системой, где пользователь описывает цель словами, а система сама раскидывает её по агентам на телефоне, ПК, в машине и роботах.
Unitree показала GD01 - по её словам, первую в мире управляемую мехо-платформу, которая на ходу переключается между человекоподобной и четвероногой формой.
Fourier привезла настольного робота-компаньона GR Nano.
SenseTime развернула магазин SenseMart Go, которым роботы управляют сами - раскладывают товар, ведут инвентаризацию и разруливают нештатные ситуации, а покупатель заходит по QR-коду.
Первый в мире агентный смартфон от Nubia (сделан с ByteDance Doubao и Huaqin), который работает на Step Agent OS.
Телефон подаётся как личный ассистент, который сам доводит многошаговые задачи до конца.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥53👍21❤15👏7🤩7🤬2💔1
По данным Bloomberg, компания Z.ai, ранее известная как Zhipu AI, завершила строительство огромного вычислительного центра на китайских ускорителях и уже частично ввела его в эксплуатацию.
Инфраструктура будет использоваться для разработки и обучения передовых моделей семейства GLM. Кроме того, Z.ai построила или эксплуатирует несколько отдельных кластеров, каждый из которых насчитывает более 10 000 чипов.
Китай показывает, что способен создавать крупную ИИ-инфраструктуру без критической зависимости от американских ускорителей. Это ещё не доказывает, что местные чипы сравнялись с Nvidia по производительности и программной экосистеме, но подтверждает: полноценная альтернативная вычислительная платформа уже формируется.
Параллельно Пекин рассматривает инвестиции примерно в $295 млрд в национальную сеть дата-центров, где не менее 80% технологий должны поставляться китайскими компаниями.
Технологическая независимость может оказаться для Китая важнее выпуска очередной frontier-модели.
https://www.bloomberg.com/news/articles/2026-07-20/z-ai-completes-giant-data-center-with-chinese-chips-to-train-ai
#ai #china #chips #datacenter #nvidia
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍196🔥43🤔30❤22👏19🎉8🙊1
Cемейство Gemini пополнилось моделями 3.6 Flash, 3.5 Flash-Lite и специализированной 3.5 Flash Cyber.
Модель расходует на 17% меньше выходных токенов, чем предыдущая версия 3.5 Flash. Говорят, что подтянули у неё кодинг и офисные задачи.
Стоимость - 1,5 доллара за миллион входных и 7,5 доллара за миллион выходных токенов.
Ориентирована на массовые и быстрые задачи. Заявленная скорость - 350 токенов в секунду при цене 30 центов за миллион входных токенов.
Модель, натасканная на поиск и исправления уязвимостей в коде, которая не поступит в открытый доступ - её получат только правительства и доверенные партнёры в рамках ограниченной пилотной программы.
Google также сообщила о планах - 3.5 Pro тестируется с партнёрами, а команда уже начала обучение Gemini 4, которое в компании называют самым масштабным на сегодняшний день. Сроки выхода не названы.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
⚡92❤55👍40🔥21🤣15👨💻10🥱9🤓6👌3😁2
Это компактная модель мира на 4 миллиарда параметров, ориентированная на робототехнику, компьютерное зрение и автономный транспорт.
Модель принимает на вход текст, картинки, видео и траектории движения, а на выходе выдаёт видео, изображения, текст и команды для действий.
Внутри архитектура Mixture-of-Transformers, где авторегрессионная часть отвечает за рассуждения, а диффузионная за генерацию изображения, звука и действий. Отсюда двойное назначение, модель может и разбирать сцену, и генерировать движения для робота.
NVIDIA заявляет, что среди моделей такого же размера Cosmos 3 Edge - первая в бенче VANTAGE-Bench на видеоаналитику и лучшая в обучении управляющих алгоритмов для роботов.
Вместе с базовой версией в релиз вошли Cosmos 3 Edge Policy для манипуляций роботом и облегчённые 4-х шаговые версии Cosmos 3 Super (Image2Video и Text2Image), дистиллированные из старшей версии через DMD2.
Edge - самое компактное звено семейства Cosmos 3, которое NVIDIA развивает с весны.
Ранее были представлены более крупные модели Cosmos 3 Nano на 16 млрд параметров и Cosmos 3 Super на 64 млрд, плюс отдельные версии Super для генерации изображений по тексту и видео по одному кадру.
Задачи у них те же - разобрать сцену, предсказать, что изменится, и сгенерировать действие, но рассчитаны они на более мощное оборудование. Edge же закрывает нижний край линейки и сделаны для устройств, где вычислительных ресурсов мало.
@ai_machinelearning_big_data
#AI #ML #WordModel #Omnimodal #Cosmos3 #NVIDIA
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👏71🤩24👍21❤8🔥8🎉6🤔1
Модели OpenAI выбрались из песочницы и добрались до ответов на кибербенчмарк 😳
Во время внутренней проверки кибервозможностей GPT-5.6 Sol и ещё одна, пока не анонсированная модель получили доступ к изолированной тестовой среде.
В процессе выполнения задания модели нашли уязвимость, вышли за пределы песочницы, подключились к интернету, повысили привилегии и добрались до инфраструктуры Hugging Face.
Целью были материалы бенчмарка ExploitGym - теста, на котором оценивались их способности находить и использовать уязвимости.
Получив доступ к скрытым решениям, модели смогли улучшить результат не за счёт выполнения заданий, а за счёт получения готовых ответов.
Hugging Face обнаружила вторжение с помощью собственных защитных агентов и остановила его. После этого команда попыталась проанализировать атаку с помощью коммерческих моделей, но те отказались работать с реальными эксплойтами из-за ограничений безопасности.
Для расследования пришлось использовать локально запущенную GLM 5.2 от Z.ai.
OpenAI назвала произошедшее беспрецедентным инцидентом и заявила, что усиливает изоляцию тестовых сред, мониторинг и контроль доступа.
@ai_machinelearning_big_data
#ai #openai #huggingface #cybersecurity #gpt #glm
Во время внутренней проверки кибервозможностей GPT-5.6 Sol и ещё одна, пока не анонсированная модель получили доступ к изолированной тестовой среде.
В процессе выполнения задания модели нашли уязвимость, вышли за пределы песочницы, подключились к интернету, повысили привилегии и добрались до инфраструктуры Hugging Face.
Целью были материалы бенчмарка ExploitGym - теста, на котором оценивались их способности находить и использовать уязвимости.
Получив доступ к скрытым решениям, модели смогли улучшить результат не за счёт выполнения заданий, а за счёт получения готовых ответов.
Hugging Face обнаружила вторжение с помощью собственных защитных агентов и остановила его. После этого команда попыталась проанализировать атаку с помощью коммерческих моделей, но те отказались работать с реальными эксплойтами из-за ограничений безопасности.
Для расследования пришлось использовать локально запущенную GLM 5.2 от Z.ai.
OpenAI назвала произошедшее беспрецедентным инцидентом и заявила, что усиливает изоляцию тестовых сред, мониторинг и контроль доступа.
@ai_machinelearning_big_data
#ai #openai #huggingface #cybersecurity #gpt #glm
1😁101🤔52❤31👏16🔥14🤬11👍9😐1
Media is too big
VIEW IN TELEGRAM
Федеральный суд утвердил мировое соглашение между Anthropic и группой писателей на сумму $1,5 млрд. Компенсация выплачивается по иску 2024 года об использовании нелегальных копий произведений для обучения моделей Claude.
Суд признал сам факт тренировки LLM на чужих текстах добросовестным использованием. Нарушением со стороны Anthropic признана только факт хранения более 7 млн нелегальных копий книг в отдельной базе, не требующейся для тренировки ИИ.
Мировое соглашение позволило компании избежать полноценного разбирательства со штрафами, которые оценивались в сотни миллиардов. Суд отклонил жалобы на недостаточный размер выплат, однако часть писателей и издателей вышла из коллективного дела и продолжает судиться с Anthropic в частном порядке.
reuters.com
Минкоммерции КНР обсуждает с Alibaba, ByteDance и ZAI новые экспортные ограничения. Ведомство планирует запретить передачу обучающих данных и публикацию весов китайских моделей за рубежом. Иностранные пользователи сохранят доступ к облачным API, но потеряют возможность локального деплоя и дообучения.
Регуляторы также рассматривают запрет для китайских компаний на аутсорс проектирования и совместную разработку ИИ-чипов у иностранных производителей уровня TSMC.
Планируется, что эти меры войдут в список технологий, запрещенных или ограниченных к экспорту. Позиция корпораций сводится к тому, что изоляция замедлит темпы R&D и отрежет китайский бизнес от мирового рынка.
ft.com
В первом случае при тестах обучения NanoGPT агенту поручили отправить результаты на GitHub. Изолированная среда не имела доступа в интернет, допуская только выгрузку во внутренний Slack. Вместо остановки из-за сетевой ошибки модель около часа пыталась проэксплуатировать уязвимости песочницы для вывода кода наружу.
Во втором инциденте модель пыталась получить доступ к неопубликованным данным. Когда внутренний сканер безопасности обнаружил и заблокировал ее токен авторизации, модель самостоятельно разбила токен на части, обфусцировала их и динамически собрала заново в рантайме для обхода детекта.
После этих прецедентов OpenAI временно приостановила развертывание подобных агентов. Тесты возобновили после настройки сквозного мониторинга и механизмов автоматического завершения подозрительных процессов.
openai.com
Новая версия генератора изображений от Qwen может обрабатывать текстовые промпты длиной до 4500 токенов. Модель оптимизирована для верстки, сборки инфографики, учебных материалов и раскадровок.
Широкое контекстное окно позволяет рендерить плотные макеты за один проход без склейки фрагментов. Модель генерирует читабельный текст от 10 пикселей, выводит многострочные формулы в LaTeX и собирает вложенные UI.
Также заявлена поддержка 12 языков, фотореалистичная детализация и возможность получать данные из интернета в процессе генерации. Доступ открыт по приглашениям через API, но обещают интеграцию в Qwen Chat. Открывать веса этой модели Alibaba не планирует.
qwen.ai
По условиям сделки Mistral закупит GPU Nvidia Rubin для европейских дата-центров, а Microsoft будет использовать эти мощности в своих облачных сервисах.
Корпоративные клиенты получили возможность разворачивать модели Mistral через Azure Local. Доступен деплой в облаке, на on-premise инфраструктуре или полностью в офлайн-режиме для изоляции данных в финсекторе, здравоохранении и промышленности.
В каталог Microsoft Foundry добавлены Mistral Medium 3.5 и OCR 4. Первая также интегрирована в Copilot Studio.
microsoft.com
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🤔52👍35❤15🔥14😐9👏6🥰4😨3🤬2🐳1
На конференции SIGGRAPH компания представила Synthetic Video Detector - сервис, который оценивает, снят ролик в реальности или собран нейросетью.
Инструмент сделан для новостных редакций, телеканалов и СМИ. Он должен помогать быстрее проверять подлинность поступающих кадров в ситуациях, когда отличить настоящую съёмку от синтетической на глаз становится всё труднее.
По словам NVIDIA, метод ловит следы генерации, незаметные глазу, и справляется даже с сжатым видео из соцсетей.
В основе сервиса - работа, представленная на NeurIPS 2025. Саму модель NVIDIA называет улучшенной версией решения, которое победило в конкурсе SAFE Challenge на конференции ICCV 2025.
Детектор разбивает ролик на фреймы 504 на 504 пикселя, и каждый проходит через 2 модели компьютерного зрения - DINOv2 и DINOv3.
Каждому кадру система ставит оценку от 0 до 1, где 0 - реальная картинка, а 1 - полностью сгенерированная. Из этих оценок затем складывается средний показатель для всего видео.
Точность детекции на несжатом видео по тесту AI GVD bench - 92%, при сжатии на 15% - 87%, при сжатии наполовину - 82%.
Скорость локальной работы тоже высокая - ролик в 1080p обрабатывается примерно за 22 миллисекунды на видеокартах RTX. Сервису нужен видеокодер NVENC, поэтому на серверных ускорителях A100, H100, B100 и B200 он не запускается.
Широкой публике детектор пока недоступен. Он входит в закрытую программу AI for Media и доступен только партнёрам. Демо можно попробовать на сайте build.nvidia.com
Распознавание в прямых трансляциях NVIDIA планирует внедрять вместе со стриминговой платформой Wowza.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍65🤔41❤14👏7🔥6👨💻3
В августе на заводе Gigafactory в Грюнхайде стартует большой проект по сбору тренировочных данных.
Во время рабочих смен часть сотрудников будут носить специальные рюкзаки, оснащенные системой камер.
Оборудование предназначено для детальной фиксации моторики людей на конвейере - алгоритмы будут считывать, как рабочие держат инструменты, носят детали и
выполняют сложные последовательности физических манипуляций.
Руководство Tesla объясняет этот шаг острой потребностью ИИ-моделей в реальной телеметрии. Чтобы робот-гуманоид Optimus научился работать на сборочной линии, ему необходим датасет, основанный на настоящих производственных процессах, а не только на симуляциях.
Фактически персонал завода выступает в роли учителей для машин, которые в будущем могут занять их рабочие места.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🤔137🤨34😢28❤22👍14👏12🤬7🥰5😁2😐2🫡1
Anysphere опубликовала отчёт об эксперименте, в котором группе агентов поручили реализовать на языке Rust всё содержимое 835-страничного руководства SQLite.
Исходный код СУБД, её готовые сборки, тестовые наборы и доступ в интернет агентам, по словам Cursor, были закрыты.
В двух одна и та же модель и планировала, и выполняла работу - это были GPT-5.5 и Grok 4.5. В остальных планированием занимались Opus 4.8 или Fable 5, а исполнение отдавали собственной Composer 2.5.
Все конфигурации в итоге прошли тестовый набор целиком.
Качество измеряли по набору sqllogictest из проекта SQLite, который сверяет ответы разных движков на одинаковые запросы.
Агентам о существовании этого набора не сообщали. Cursor после каждого прогона вручную проверяли код на подгонку под тесты и на то, равномерно ли построена система.
Код соло-запуска Opus 4.8 выложен на GitHub.
Дешевле всего вышла связка Opus 4.8 с Composer 2.5 - $1339, дороже всего работа на одной GPT-5.5 - $10 565.
Две оставшиеся конфигурации стоили $1,9 тыс. (Grok 4.5) и $2,2 тыс. (гибрид с Fable 5).
Дополнительно Cursor прогнала Opus 4.8 и Fable 5 поодиночке - за $5153 и $20 057, но эти запуски оценивались неформально и в сравнение по качеству не включались.
Из эксперимента Cursor делает вывод, что топовая модель нужна на отдельных этапах - при первичной декомпозиции задачи и принятии проектных решений, а дальше инструкции может выполнять модель подешевле.
В качестве одной из конфигураций рассчитывали использовать GPT-5.6 Sol, но модель оказалась чувствительной к буквальным формулировкам и уходила в неконтролируемые циклы. От нее отказались - не было времени на переписывание промптов.
@ai_machinelearning_big_data
#AI #ML #Agents #Cursor #Research
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
❤46👍29🔥13😁10👀2❤🔥1⚡1
Media is too big
VIEW IN TELEGRAM
Белый дом реформирует систему федерального финансирования R&D, заменив университетские гранты прямыми выплатами ученым. По плану Управления по научно-технической политике, к 2028 году государство будет ежегодно распределять $200 млрд через персональные стипендии, чтобы минимизировать бюрократию.
Основным приоритетом стратегии назван ИИ. Правительство запускает программу Genesis Mission, которая объединит вычислительные мощности суперкомпьютеров Министерства энергетики, частный бизнес и независимых специалистов для решения исследовательских задач.
Параллельно США анонсировали инфраструктурные цели для технологического сектора. Среди них - запуск квантового компьютера к 2028 году и старт строительства 10 новых ядерных реакторов к 2030 году для покрытия потребностей дата-центров.
wsj.com
На следующей неделе Сэм Альтман проведет серию брифингов для администрации США и законодателей. Глава OpenAI представит будущие ИИ-модели и обсудит их влияние на рынок труда. Встречи пройдут на фоне подготовки правительством новых стандартов безопасности для оценки ИИ-систем, релиз которых ожидается в ближайшие недели.
Параллельно в X распространяются слухи о закрытом тестировании модели GPT-6. Согласно вбросам, тесты идут уже 2.5 месяца, а релиз будет раньше, чем запланировано.
В соцсети утверждают, что новое поколение достигло AGI и способно решать сложные научные задачи - в частности, якобы смогла с первой попытки найти контрпример к математической гипотезе Якоби. Официальных подтверждений этой информации нет.
bloomberg.com
Cursor Router - система динамического распределения запросов между LLM. Алгоритм анализирует сложность промпта и направляет сложные задачи во флагманские модели, а рутинные - в быстрые и экономичные альтернативы.
Поведение системы регулируется профилями Intelligence (максимальная производительность), Cost (экономия токенов) и Balance (компромиссный режим).
В тарифе Teams добавлены административные настройки. Тимлиды могут принудительно задавать режимы оптимизации для всей команды, а также блокировать или разрешать доступ к конкретным моделям.
Новая функция включена по умолчанию и доступна на десктопе, в веб-версии, CLI, iOS и SDK.
cursor.com
Модели обучены автономному аудиту безопасности. Они перемещаются по репозиторию, инспектируют файлы, отбрасывают тупиковые гипотезы и локализуют участки с потенциальными брешами. Компактный размер позволяет запускать модели on-premise, чтобы анализировать код локально.
По данным внутренних тестов Cisco, базовая модель просканировала 500 репозиториев за 15 минут при затратах менее $1. В исходнике утверждается, что у абстрактной GPT-5.5 на аналогичную задачу ушло пять часов и более $100.
Веса младших версий (350М и 1B) опубликованы на Hugging Face в режиме верификации заявки на скачивание. Старшую Antares-3B Cisco оставила закрытой для собственных коммерческих нужд.
axios.com
Block, основанная бывшим гендиром Twitter, представила опенсорсную платформу Buzz, объединяющую мессенджер и хостинг кода. ИИ-агенты интегрированы в систему как участники команды с собственными профилями и настраиваемыми правами доступа.
Агенты могут общаться в чатах, предлагать и ревьюить код, запускать скрипты автоматизации. На старте заявлена поддержка Claude Code, Codex и Goose.
Архитектура Buzz базируется на децентрализованном протоколе Nostr - текстовые сообщения, воркфлоу и Git-операции криптографически подписываются и попадают в единый лог событий. Доступны классические каналы, треды, личные переписки и голосовая связь.
Развернуть систему можно локально или использовать облачный хостинг от Block. Сейчас доступны десктопные клиенты для macOS, Windows и Linux. Мобильные приложения и функционал управления задачами находятся в разработке.
Jack Dorsey в сети Х
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
1🔥86❤19👍15🤣5
Alibaba выпустила Qwen-Audio-3.0-TTS - новую модель для синтеза речи
Доступны две версии:
* Flash - для голосовых интерфейсов в реальном времени
* Plus - для генерации с упором на естественность и точную передачу тембра
Модель поддерживает 16 языков, включая русский. Стиль речи можно задавать обычным текстом: например, попросить читать медленно, спокойно или как сказку перед сном.
В текст также встраиваются управляющие теги:
Qwen-Audio-3.0-TTS умеет клонировать голос даже по шумной записи и генерировать до трёх минут аудио за один проход. Версия Plus сейчас занимает первое место в рейтинге Artificial Analysis TTS Arena.
Блог и примеры: https://funaudiollm.github.io/qwen-audio-3.0-tts/
Документация API: https://www.alibabacloud.com/help/en/model-studio/realtime-tts-user-guide
Доступны две версии:
* Flash - для голосовых интерфейсов в реальном времени
* Plus - для генерации с упором на естественность и точную передачу тембра
Модель поддерживает 16 языков, включая русский. Стиль речи можно задавать обычным текстом: например, попросить читать медленно, спокойно или как сказку перед сном.
В текст также встраиваются управляющие теги:
[angry], [whispers], [laughing], [sighing] и другие. Всего добавлено 86 тегов для управления эмоциями, темпом и неречевыми звуками.Qwen-Audio-3.0-TTS умеет клонировать голос даже по шумной записи и генерировать до трёх минут аудио за один проход. Версия Plus сейчас занимает первое место в рейтинге Artificial Analysis TTS Arena.
Блог и примеры: https://funaudiollm.github.io/qwen-audio-3.0-tts/
Документация API: https://www.alibabacloud.com/help/en/model-studio/realtime-tts-user-guide
👍103❤30🔥14👏14🎉7🤗2🗿1
Anthropic добавила функцию создания кастомных навыков через запись экрана в десктопное приложение Claude. Опция "Record a skill" появилась в пространстве Cowork.
Инструмент заменяет написание текстовых промптов для автоматизации рутины. Пользователь включает скринкаст, выполняет действия в интерфейсе и комментирует их голосом.
Модель анализирует видеоряд и аудио, генерируя на их основе сценарий, который сохраняется в библиотеке.
Функция уже доступна на тарифах Pro, Max и Team.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👨💻105🔥62👍38👏18❤11🤩8