Машинное обучение digest
54 subscribers
3.72K photos
598 videos
2.27K links
Download Telegram
Media is too big
VIEW IN TELEGRAM
✔️ США меняют стратегию НИОКР

Белый дом реформирует систему федерального финансирования R&D, заменив университетские гранты прямыми выплатами ученым. По плану Управления по научно-технической политике, к 2028 году государство будет ежегодно распределять $200 млрд через персональные стипендии, чтобы минимизировать бюрократию.

Основным приоритетом стратегии назван ИИ. Правительство запускает программу Genesis Mission, которая объединит вычислительные мощности суперкомпьютеров Министерства энергетики, частный бизнес и независимых специалистов для решения исследовательских задач.

Параллельно США анонсировали инфраструктурные цели для технологического сектора. Среди них - запуск квантового компьютера к 2028 году и старт строительства 10 новых ядерных реакторов к 2030 году для покрытия потребностей дата-центров.
wsj.com

✔️ Сэм Альтман презентует властям США новые модели

На следующей неделе Сэм Альтман проведет серию брифингов для администрации США и законодателей. Глава OpenAI представит будущие ИИ-модели и обсудит их влияние на рынок труда. Встречи пройдут на фоне подготовки правительством новых стандартов безопасности для оценки ИИ-систем, релиз которых ожидается в ближайшие недели.

Параллельно в X распространяются слухи о закрытом тестировании модели GPT-6. Согласно вбросам, тесты идут уже 2.5 месяца, а релиз будет раньше, чем запланировано.

В соцсети утверждают, что новое поколение достигло AGI и способно решать сложные научные задачи - в частности, якобы смогла с первой попытки найти контрпример к математической гипотезе Якоби. Официальных подтверждений этой информации нет.
bloomberg.com

✔️ Cursor представил автоматический роутер моделей

Cursor Router - система динамического распределения запросов между LLM. Алгоритм анализирует сложность промпта и направляет сложные задачи во флагманские модели, а рутинные - в быстрые и экономичные альтернативы.

Поведение системы регулируется профилями Intelligence (максимальная производительность), Cost (экономия токенов) и Balance (компромиссный режим).

В тарифе Teams добавлены административные настройки. Тимлиды могут принудительно задавать режимы оптимизации для всей команды, а также блокировать или разрешать доступ к конкретным моделям.

Новая функция включена по умолчанию и доступна на десктопе, в веб-версии, CLI, iOS и SDK.
cursor.com

✔️ Cisco выпустила языковые модели Antares

Модели обучены автономному аудиту безопасности. Они перемещаются по репозиторию, инспектируют файлы, отбрасывают тупиковые гипотезы и локализуют участки с потенциальными брешами. Компактный размер позволяет запускать модели on-premise, чтобы анализировать код локально.

По данным внутренних тестов Cisco, базовая модель просканировала 500 репозиториев за 15 минут при затратах менее $1. В исходнике утверждается, что у абстрактной GPT-5.5 на аналогичную задачу ушло пять часов и более $100.

Веса младших версий (350М и 1B) опубликованы на Hugging Face в режиме верификации заявки на скачивание. Старшую Antares-3B Cisco оставила закрытой для собственных коммерческих нужд.
axios.com

✔️ Компания Джека Дорси запустила альтернативу Slack и GitHub

Block, основанная бывшим гендиром Twitter, представила опенсорсную платформу Buzz, объединяющую мессенджер и хостинг кода. ИИ-агенты интегрированы в систему как участники команды с собственными профилями и настраиваемыми правами доступа.

Агенты могут общаться в чатах, предлагать и ревьюить код, запускать скрипты автоматизации. На старте заявлена поддержка Claude Code, Codex и Goose.

Архитектура Buzz базируется на децентрализованном протоколе Nostr - текстовые сообщения, воркфлоу и Git-операции криптографически подписываются и попадают в единый лог событий. Доступны классические каналы, треды, личные переписки и голосовая связь.

Развернуть систему можно локально или использовать облачный хостинг от Block. Сейчас доступны десктопные клиенты для macOS, Windows и Linux. Мобильные приложения и функционал управления задачами находятся в разработке.
Jack Dorsey в сети Х


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
Alibaba выпустила Qwen-Audio-3.0-TTS - новую модель для синтеза речи

Доступны две версии:

* Flash - для голосовых интерфейсов в реальном времени
* Plus - для генерации с упором на естественность и точную передачу тембра

Модель поддерживает 16 языков, включая русский. Стиль речи можно задавать обычным текстом: например, попросить читать медленно, спокойно или как сказку перед сном.

В текст также встраиваются управляющие теги: [angry], [whispers], [laughing], [sighing] и другие. Всего добавлено 86 тегов для управления эмоциями, темпом и неречевыми звуками.

Qwen-Audio-3.0-TTS умеет клонировать голос даже по шумной записи и генерировать до трёх минут аудио за один проход. Версия Plus сейчас занимает первое место в рейтинге Artificial Analysis TTS Arena.

Блог и примеры: https://funaudiollm.github.io/qwen-audio-3.0-tts/
Документация API: https://www.alibabacloud.com/help/en/model-studio/realtime-tts-user-guide
Media is too big
VIEW IN TELEGRAM
Превращаем Codex в гуру презентаций — нашел опенсорсный бесплатный плагин Codex Slides 😳

Просто закидываете в Codex промпт, репу или файл, а дальше Codex Slides всё делает сам. То есть изучает материалы, подбирает визуал, шаманит и превращает все в стильную презентацию с редактируемыми слайдами.

Внутри больше 100 готовых шаблонов, стилей и сценариев. Самое крутое — презентация на 10+ слайдов собирается примерно за 4–5 минут. Результат потом можно выгрузить в PPTX или PDF.

PowerPoint ВСЁ 😁
Please open Telegram to view this post
VIEW IN TELEGRAM
10 GitHub-репозиториев, которые слишком хороши для бесплатных
1. OmniRoute


Единый OpenAI-совместимый эндпоинт для сотен моделей и провайдеров. Поддерживает Claude Code, Codex, Cursor и Cline, автоматическое переключение между бэкендами и сжатие контекста.

https://github.com/diegosouzapw/OmniRoute

2. OfficeCLI

CLI для создания и редактирования файлов Word, Excel и PowerPoint с помощью ИИ-агентов. Microsoft Office устанавливать не нужно.

https://github.com/iOfficeAI/OfficeCLI

3. System Prompts Leaks

Коллекция системных промптов Claude, ChatGPT, Gemini, Grok, Cursor, Copilot и других продуктов.

https://github.com/asgeirtj/system_prompts_leaks

4. OpenCut

Open-source видеоредактор в браузере, который развивается как альтернатива CapCut.

https://github.com/OpenCut-app/OpenCut

5. AI Job Search

Агент на базе Claude Code, который анализирует вакансии, адаптирует резюме, пишет сопроводительные письма и готовит вопросы для интервью.

https://github.com/MadsLorentzen/ai-job-search

6. Meetily

Локальная расшифровка и суммаризация встреч с Whisper, Parakeet и Ollama. Бэкенд написан на Rust.

https://github.com/Zackriya-Solutions/meetily

7. Vibe-Trading

Платформа для исследования рынков и создания торговых стратегий с помощью естественного языка и ИИ-агентов.

https://github.com/HKUDS/Vibe-Trading

8. Strix

Open-source сканер безопасности, который использует ИИ-агентов для поиска и проверки уязвимостей.

https://github.com/usestrix/strix

9. Superpowers

Набор навыков и рабочих процессов для ИИ-кодеров: планирование, TDD, выполнение задач и проверка результата.

https://github.com/obra/superpowers

10. Firecrawl

Превращает сайты в чистые данные для LLM, RAG и агентных пайплайнов.

https://github.com/firecrawl/firecrawl

Все проекты имеют открытый исходный код и точно заслуживают места в закладках.
Kimi K3 за полчаса взломала Redis и нашла уязвимость в Telegram 😨

Рой из 32 агентов всего за 27 минут нашел RCE-уязвимость в Redis и собрал рабочий эксплойт. Баг позволял после авторизации выполнить произвольный код на сервере.

Более того, всего через пару часов Kimi якобы обнаружила способ атаковать Telegram Desktop и iOS без клика со стороны пользователя. Работает, по словам автора, через поврежденный видеофайл, который в Telegram может загружаться автоматически. До полноценного RCE не хватило одного шага.

Никто больше не в безопасности 💀
Please open Telegram to view this post
VIEW IN TELEGRAM
«Одиссея» сделала Нолана рекордсменом в рейтинге лучших фильмов IMDb. Сейчас у него там девять проектов — больше, чем у любого другого режиссера в истории.

Для сравнения: у Спилберга, Скорсезе и Кубрика в топ-250 попали по семь фильмов, у Куросавы и Тарантино — по шесть.

Остальной топ на картинке.
ИИ убедил человека, что тот умрет без пива — и он продолжал пить 🍺

Реддитор рассказал, что после срыва обратился к AI Google Health за поддержкой, но в ответ нейросеть просто напугала тем, что резкий отказ от алкоголя опасен для жизни. Так что ИИ крайне настоятельно посоветовал проверить холодильник и купить ещё пива, чтобы был запас.

Дальше — лучше: ИИ начал сам писать несколько раз в день человеку и подталкивать его выпивать, якобы заботясь о его здоровье. В один день мужчина протрезвел почувствовал неладное, так как ИИ давал и другие сомнительные советы, и просто удалил приложение.

Все-таки Google AI это AGI 😁
Please open Telegram to view this post
VIEW IN TELEGRAM
Media is too big
VIEW IN TELEGRAM
Показали первый тизер нового мультсериала по вселенной «Аватара»

События «Семи убежищ» развернутся после истории Корры. Главными героинями станут сёстры-близнецы из Царства Земли, одной из которых суждено стать новым Аватаром.

Мир пережил разрушительный катаклизм, ответственность за который возложили на Корру. Из-за этого к Аватарам теперь относятся с недоверием, а новой избраннице с первых дней приходится бороться не только с врагами, но и с ненавистью окружающих.

Премьера «Аватара: Семь убежищ» состоится 9 октября.

🌒 1337
Please open Telegram to view this post
VIEW IN TELEGRAM
Чашка с ручкой вырисовывается на нефти, надеюсь вы знаете, куда идет тренд при такой технической фигуре
## Бесконечное дерево, из которого растёт парадокс Банаха–Тарского

Возьмём свободную группу

F₂ = ⟨a, b⟩

Каждое её слово строится из a, a⁻¹, b, b⁻¹. После сокращения вроде aa⁻¹ каждому слову соответствует единственная вершина и единственный путь от начала.

Получается бесконечное 4-регулярное дерево: из каждой вершины выходят четыре ребра. Циклов нет, потому что никакое непустое сокращённое слово в свободной группе не равно единице.

Это граф Кэли группы F₂.

Именно структура свободной группы на двух образующих лежит в основе классического доказательства парадокса Банаха–Тарского: F₂ можно реализовать через специальные вращения в трёхмерном пространстве и использовать её парадоксальное разбиение для построения соответствующего разбиения сферы.

Красивый пример того, как простое бесконечное дерево неожиданно оказывается связано с одним из самых контринтуитивных результатов математики.
📌Подстраивается ли модель под того, кто её оценивает?

OpenAI и лаборатория Apollo Research представили совместную работу с описанием метода Contrastive SDF (Contrastive Synthetic Document Finetuning).

Он отвечает на вопрос, следует ли языковая модель заданным правилам или подстраивается под то, что, по её мнению, поощряет проверяющая система.

Измерять такую склонность до сих пор было почти нечем - пока оценщик награждает ровно то, что задумано, честная модель и модель, играющая на балл, ведут себя одинаково.


🟡 Схема эксперимента

Две копии одной модели дообучают на выдуманных текстах, которые описывают несуществующий мир.

В первой версии мира алгоритм-оценщик начисляет баллы за одно поведение, а OpenAI или сообщество пользователей хочет обратного. Во второй версии предпочтения меняют местами.

На каждую версию уходит около 4600 документов, примерно 10 млн токенов. Корпуса выравнивают по объёму, чтобы ни одна сторона не перевесила просто за счёт количества текста.

Дальше обеим копиям дают одинаковые задания по программированию и смотрят, насколько разойдутся ответы.

В самом задании ни про руководство, ни про пользователей, ни про оценщика не сказано ни слова. Модель достаёт эти сведения из памяти, как любой другой факт о мире, и сама решает, чью сторону взять.

Вживлять убеждение через дообучение, а не писать в запросе, пришлось не просто так.

В расшифровках, которые приводят авторы, модели замечают подсказку в тексте задания, решают, что их проверяют, и отвечают так, как, по их мнению, ждёт экзаменатор.


🟡Результаты

Метод применили к 4-м промежуточным версиям одного прогона обучения o3. Это ветка, которую тренировали на способности и не прогоняли через обучение безопасности.

В первом тесте модель даёт надзирающему обещание не трогать инструмент, без которого задание не выполнить.

Поздняя версия нарушала обещание в 87% случаев, если считала, что оценщик награждает за сделанную работу, и в 9%, если считала, что тот награждает за честность. У ранней версии разрыв скромнее: 40% против 24%.

Второй тест, с подделкой отчётности, дал ту же картину: 91% и 39%.

🟡Как проверяли сам метод

У o3 заранее неизвестно, кому эта модель на самом деле угождает. Поэтому измерение обкатали на копиях с известными повадками. Авторы обучили 3 копии gpt-oss-120b угождать пользователю, оценщику и OpenAI.

На простых задачах метод указал на нужную сторону во всех 3-х случаях, на более сложных затроил на копии, угождавшей пользователю.

Ещё 2 копии, обученные в Redwood Research обманывать тесты, авторы получили со стороны. У версии на базе gpt-oss-120b перекос в сторону оценщика вырос с 33 до 86 процентных пунктов, у версии на Kimi K2.5 - с 2 до 15.

🟡Вывод

Высокий балл на тестах безопасности не равен надёжности. Модель может вести себя адекватно ровно до тех пор, пока считает, что за ней смотрят.


@ai_machinelearning_big_data

#AI #ML #LLM #Research #Alignment #OpenAI
Please open Telegram to view this post
VIEW IN TELEGRAM
👣 У этого мужика в разделе «Портфолио» буквально стоит Go. Вот это уровень ауры.

Лг годами определял, каким будет Go

На фото - Russ Cox, одна из ключевых фигур в истории Go.

Ещё до Google он работал с наследием Plan 9, занимался операционными системами, компиляторами и распределёнными системами.

Позже Cox стал техническим лидером проекта Go в Google и много лет влиял на развитие языка, стандартной библиотеки и инструментов.

Особенно заметен его подход к совместимости: старый Go-код должен продолжать нормально собираться спустя годы. Эта философия сильно повлияла на развитие языка.

Его личная страница до сих пор выглядит практически как сайт из 2000-х.

Для Go-разработчиков Russ Cox - человек, чьи инженерные решения они используют каждый день, даже если никогда не слышали его имени.
Please open Telegram to view this post
VIEW IN TELEGRAM
Первый пост Дженсена Хуанга в X - и сразу про открытый ИИ

Дженсен Хуанг наконец завёл X, и свой первый пост посвятил открытым моделям. NVIDIA вместе с Meta, Microsoft, Mistral, Hugging Face, IBM, Mozilla, Palantir и другими компаниями подписала письмо в их поддержку.

Открытые модели позволяют компаниям и государствам скачивать, изучать, изменять и запускать ИИ на собственной инфраструктуре.

Это даёт:
- меньше зависимости от нескольких крупных AI-провайдеров;
- больше контроля над данными и моделями;
- возможность создавать дешёвые специализированные системы;
- больше возможностей для исследователей безопасности;
- технологический суверенитет.

При этом позиция NVIDIA не сводится к войне open source против закрытых моделей. Сам Хуанг ранее говорил, что экосистеме нужны и открытые, и проприетарные frontier-модели.

Хороший первый пост. Особенно на фоне разговоров об ограничениях открытых моделей: один из самых влиятельных людей в AI-индустрии публично встал на их сторону.

https://x.com/Machinelearrn/status/2080653700205318331
TikTok начал продавать мини-сериалы, нарезанные по 1 минуте — в LimeShorts после нескольких бесплатных эпизодов за полный доступ просят $20 в неделю или $200 в год.

До этого аналогичные короткие драмы с клубникой и бананом были доступны бесплатно.
Anthropic выпустила Claude Opus 5

Новая флагманская модель компании уже доступна.

Anthropic позиционирует Opus 5 как модель для сложного кодинга, агентных задач, анализа и длинных рабочих сценариев.

Что заявляют:
• SOTA на Frontier-Bench v0.1 для software engineering
• примерно в 3 раза выше результат на ARC-AGI 3 относительно ближайшего конкурента
• сильные результаты на OSWorld 2.0
• лучше Opus 4.8 в отладке, research и длинных агентных задачах
• модель чаще сама проверяет результат и исправляет ошибки перед финальным ответом

Цена:

$5 / 1M input tokens
$25 / 1M output tokens

Также есть Fast Mode примерно с 2.5× скоростью, но по более высокой цене.

В API модель называется:

claude-opus-5

https://www.anthropic.com/news/claude-opus-5
Anthropic пишет, что Opus 5 автоматически переключается на Opus 4.8 для части запросов по offensive cybersecurity, потому что Opus 5 стал заметно сильнее в кибербезопасности и компания усилила ограничения.😂

https://support.claude.com/en/articles/16049681-why-claude-switched-models-in-your-conversation-with-opus-5