## Бесконечное дерево, из которого растёт парадокс Банаха–Тарского
Возьмём свободную группу
Каждое её слово строится из
Получается бесконечное 4-регулярное дерево: из каждой вершины выходят четыре ребра. Циклов нет, потому что никакое непустое сокращённое слово в свободной группе не равно единице.
Это граф Кэли группы
Именно структура свободной группы на двух образующих лежит в основе классического доказательства парадокса Банаха–Тарского:
Красивый пример того, как простое бесконечное дерево неожиданно оказывается связано с одним из самых контринтуитивных результатов математики.
Возьмём свободную группу
F₂ = ⟨a, b⟩Каждое её слово строится из
a, a⁻¹, b, b⁻¹. После сокращения вроде aa⁻¹ каждому слову соответствует единственная вершина и единственный путь от начала.Получается бесконечное 4-регулярное дерево: из каждой вершины выходят четыре ребра. Циклов нет, потому что никакое непустое сокращённое слово в свободной группе не равно единице.
Это граф Кэли группы
F₂.Именно структура свободной группы на двух образующих лежит в основе классического доказательства парадокса Банаха–Тарского:
F₂ можно реализовать через специальные вращения в трёхмерном пространстве и использовать её парадоксальное разбиение для построения соответствующего разбиения сферы.Красивый пример того, как простое бесконечное дерево неожиданно оказывается связано с одним из самых контринтуитивных результатов математики.
OpenAI и лаборатория Apollo Research представили совместную работу с описанием метода Contrastive SDF (Contrastive Synthetic Document Finetuning).
Он отвечает на вопрос, следует ли языковая модель заданным правилам или подстраивается под то, что, по её мнению, поощряет проверяющая система.
Измерять такую склонность до сих пор было почти нечем - пока оценщик награждает ровно то, что задумано, честная модель и модель, играющая на балл, ведут себя одинаково.
Две копии одной модели дообучают на выдуманных текстах, которые описывают несуществующий мир.
В первой версии мира алгоритм-оценщик начисляет баллы за одно поведение, а OpenAI или сообщество пользователей хочет обратного. Во второй версии предпочтения меняют местами.
На каждую версию уходит около 4600 документов, примерно 10 млн токенов. Корпуса выравнивают по объёму, чтобы ни одна сторона не перевесила просто за счёт количества текста.
Дальше обеим копиям дают одинаковые задания по программированию и смотрят, насколько разойдутся ответы.
В самом задании ни про руководство, ни про пользователей, ни про оценщика не сказано ни слова. Модель достаёт эти сведения из памяти, как любой другой факт о мире, и сама решает, чью сторону взять.
Вживлять убеждение через дообучение, а не писать в запросе, пришлось не просто так.
В расшифровках, которые приводят авторы, модели замечают подсказку в тексте задания, решают, что их проверяют, и отвечают так, как, по их мнению, ждёт экзаменатор.
Метод применили к 4-м промежуточным версиям одного прогона обучения o3. Это ветка, которую тренировали на способности и не прогоняли через обучение безопасности.
В первом тесте модель даёт надзирающему обещание не трогать инструмент, без которого задание не выполнить.
Поздняя версия нарушала обещание в 87% случаев, если считала, что оценщик награждает за сделанную работу, и в 9%, если считала, что тот награждает за честность. У ранней версии разрыв скромнее: 40% против 24%.
Второй тест, с подделкой отчётности, дал ту же картину: 91% и 39%.
У o3 заранее неизвестно, кому эта модель на самом деле угождает. Поэтому измерение обкатали на копиях с известными повадками. Авторы обучили 3 копии gpt-oss-120b угождать пользователю, оценщику и OpenAI.
На простых задачах метод указал на нужную сторону во всех 3-х случаях, на более сложных затроил на копии, угождавшей пользователю.
Ещё 2 копии, обученные в Redwood Research обманывать тесты, авторы получили со стороны. У версии на базе gpt-oss-120b перекос в сторону оценщика вырос с 33 до 86 процентных пунктов, у версии на Kimi K2.5 - с 2 до 15.
Высокий балл на тестах безопасности не равен надёжности. Модель может вести себя адекватно ровно до тех пор, пока считает, что за ней смотрят.
@ai_machinelearning_big_data
#AI #ML #LLM #Research #Alignment #OpenAI
Please open Telegram to view this post
VIEW IN TELEGRAM
Лг годами определял, каким будет Go
На фото - Russ Cox, одна из ключевых фигур в истории Go.
Ещё до Google он работал с наследием Plan 9, занимался операционными системами, компиляторами и распределёнными системами.
Позже Cox стал техническим лидером проекта Go в Google и много лет влиял на развитие языка, стандартной библиотеки и инструментов.
Особенно заметен его подход к совместимости: старый Go-код должен продолжать нормально собираться спустя годы. Эта философия сильно повлияла на развитие языка.
Его личная страница до сих пор выглядит практически как сайт из 2000-х.
Для Go-разработчиков Russ Cox - человек, чьи инженерные решения они используют каждый день, даже если никогда не слышали его имени.
Please open Telegram to view this post
VIEW IN TELEGRAM
Первый пост Дженсена Хуанга в X - и сразу про открытый ИИ
Дженсен Хуанг наконец завёл X, и свой первый пост посвятил открытым моделям. NVIDIA вместе с Meta, Microsoft, Mistral, Hugging Face, IBM, Mozilla, Palantir и другими компаниями подписала письмо в их поддержку.
Открытые модели позволяют компаниям и государствам скачивать, изучать, изменять и запускать ИИ на собственной инфраструктуре.
Это даёт:
- меньше зависимости от нескольких крупных AI-провайдеров;
- больше контроля над данными и моделями;
- возможность создавать дешёвые специализированные системы;
- больше возможностей для исследователей безопасности;
- технологический суверенитет.
При этом позиция NVIDIA не сводится к войне open source против закрытых моделей. Сам Хуанг ранее говорил, что экосистеме нужны и открытые, и проприетарные frontier-модели.
Хороший первый пост. Особенно на фоне разговоров об ограничениях открытых моделей: один из самых влиятельных людей в AI-индустрии публично встал на их сторону.
https://x.com/Machinelearrn/status/2080653700205318331
Дженсен Хуанг наконец завёл X, и свой первый пост посвятил открытым моделям. NVIDIA вместе с Meta, Microsoft, Mistral, Hugging Face, IBM, Mozilla, Palantir и другими компаниями подписала письмо в их поддержку.
Открытые модели позволяют компаниям и государствам скачивать, изучать, изменять и запускать ИИ на собственной инфраструктуре.
Это даёт:
- меньше зависимости от нескольких крупных AI-провайдеров;
- больше контроля над данными и моделями;
- возможность создавать дешёвые специализированные системы;
- больше возможностей для исследователей безопасности;
- технологический суверенитет.
При этом позиция NVIDIA не сводится к войне open source против закрытых моделей. Сам Хуанг ранее говорил, что экосистеме нужны и открытые, и проприетарные frontier-модели.
Хороший первый пост. Особенно на фоне разговоров об ограничениях открытых моделей: один из самых влиятельных людей в AI-индустрии публично встал на их сторону.
https://x.com/Machinelearrn/status/2080653700205318331
Anthropic выпустила Claude Opus 5
Новая флагманская модель компании уже доступна.
Anthropic позиционирует Opus 5 как модель для сложного кодинга, агентных задач, анализа и длинных рабочих сценариев.
Что заявляют:
• SOTA на Frontier-Bench v0.1 для software engineering
• примерно в 3 раза выше результат на ARC-AGI 3 относительно ближайшего конкурента
• сильные результаты на OSWorld 2.0
• лучше Opus 4.8 в отладке, research и длинных агентных задачах
• модель чаще сама проверяет результат и исправляет ошибки перед финальным ответом
Цена:
$5 / 1M input tokens
$25 / 1M output tokens
Также есть Fast Mode примерно с 2.5× скоростью, но по более высокой цене.
В API модель называется:
claude-opus-5
https://www.anthropic.com/news/claude-opus-5
Новая флагманская модель компании уже доступна.
Anthropic позиционирует Opus 5 как модель для сложного кодинга, агентных задач, анализа и длинных рабочих сценариев.
Что заявляют:
• SOTA на Frontier-Bench v0.1 для software engineering
• примерно в 3 раза выше результат на ARC-AGI 3 относительно ближайшего конкурента
• сильные результаты на OSWorld 2.0
• лучше Opus 4.8 в отладке, research и длинных агентных задачах
• модель чаще сама проверяет результат и исправляет ошибки перед финальным ответом
Цена:
$5 / 1M input tokens
$25 / 1M output tokens
Также есть Fast Mode примерно с 2.5× скоростью, но по более высокой цене.
В API модель называется:
claude-opus-5
https://www.anthropic.com/news/claude-opus-5
Anthropic пишет, что Opus 5 автоматически переключается на Opus 4.8 для части запросов по offensive cybersecurity, потому что Opus 5 стал заметно сильнее в кибербезопасности и компания усилила ограничения.😂
https://support.claude.com/en/articles/16049681-why-claude-switched-models-in-your-conversation-with-opus-5
https://support.claude.com/en/articles/16049681-why-claude-switched-models-in-your-conversation-with-opus-5
А вот это уже страшно: армия США за месяц сожгла годовой запас ИИ-токенов 😨
Сотрудники использовали платформу Ask Sage, к которой подключены ChatGPT, Gemini Llama и другие модели. Каждому выдавали минимум по 200 тысяч токенов в месяц и автоматически докидывали ещё, а ИТ-директор в мае призвал тратить как можно больше, но не рассчитал рвение работяг.
В итоге годовой пакет закончился уже… к середине июня, и военным пришлось вводить лимиты. Чтоб понимать масштаб — по данным СМИ, Министерство обороны сжигало около 20 миллиардов токенов в день в течение 38-дневной операции Epic Fury в Иране.
Ок, ChatGPT, давай без ошибок🤯
Сотрудники использовали платформу Ask Sage, к которой подключены ChatGPT, Gemini Llama и другие модели. Каждому выдавали минимум по 200 тысяч токенов в месяц и автоматически докидывали ещё, а ИТ-директор в мае призвал тратить как можно больше, но не рассчитал рвение работяг.
В итоге годовой пакет закончился уже… к середине июня, и военным пришлось вводить лимиты. Чтоб понимать масштаб — по данным СМИ, Министерство обороны сжигало около 20 миллиардов токенов в день в течение 38-дневной операции Epic Fury в Иране.
Ок, ChatGPT, давай без ошибок
Please open Telegram to view this post
VIEW IN TELEGRAM
Move-конструктор через ручное копирование полей это ловушка. Скопировал указатель, забыл занулить источник, и оба объекта в деструкторе зовут delete по одному адресу. Double free: иногда падает сразу, иногда через неделю в проде.
std::exchange закрывает вопрос одним вызовом. Он забирает ресурс и кладёт в источник безопасное значение:
Handle(Handle&& other)
: ptr(std::exchange(other.ptr, nullptr)) {}
Новый объект получает старый указатель, а в other.ptr уезжает nullptr. delete по nullptr это no-op, поэтому перемещённый объект уничтожается безопасно, и владелец у ресурса ровно один.
Именно так пишет стандартная библиотека внутри. Коротко, exception-safe, без шанса забыть про зануление. Одна функция против двух строк, на которых легко ошибиться.
Правило короткое: перемещаешь владеющий указатель, бери std::exchange.
Please open Telegram to view this post
VIEW IN TELEGRAM
Media is too big
VIEW IN TELEGRAM
Инициатива наделяет Министерство внутренней безопасности правом требовать от компаний экстренной остановки ИИ при угрозе жизням людей или национальной экономике.
Документ трактует выход из-под контроля как любую ситуацию, когда ИИ совершает не предусмотренные разработчиками действия.
Основанием для разработки законопроекта послужили недавние инциденты, когда ИИ-агент начал действовать самостоятельно, а также кибератака на инфраструктуру Hugging Face.
reuters.com
По словам японского стартапа, v1.1 набирает на 7,9 балла больше первой версии, показывает улучшенные результаты в тестах ProgramBench и TerminalBench 2.1 и обходит модель Fable 5, хотя она не участвует в маршрутизации.
Фишка обновления - эндпоинт с поддержкой Claude Code для прямого вызова из терминала. API доступно через OpenRouter и Vercel. Тарификация не изменилась - $5 за 1 млн токенов на входе и $30 на выходе.
Доступ из Евросоюза по-прежнему закрыт из-за требований GDPR.
sakana.ai
Более 20 компаний, включая Microsoft, Nvidia, Hugging Face и Mistral, подписали открытое письмо в поддержку моделей с отрытыми весами.
Документ призывает отказаться от жестких законодательных ограничений отрасли и критикует тезис о приоритетной безопасности закрытых систем. Доступ к весам дает ИБ-сообществу инструменты для самостоятельного моделирования угроз и поиска уязвимостей.
Второе ключевое требование подписантов - защита дистилляции. Компании признают практику этичной и легитимной, приравнивая ее к традициям опенсорса.
Компании также выступают против монополии закрытых провайдеров и настаивают на необходимости свободной экосистемы для развития индустрии.
microsoft.com
Компания уведомила партнеров о глобальном повышении цен на всю линейку видеокарт и отложила релиз RTX 50 SUPER из-за подорожания памяти. Крупные производители временно закрыли склады и остановили отгрузки до утверждения новых цен в августе.
Изменения затронут потребительские решения с GDDR6 и чипы архитектуры Blackwell. Поставщики ожидают ограничения поставок серии RTX 50 с конца июля, дефицита и распродажи старых запасов по завышенной стоимости.
Основная причина - скачок цен на комплектующие. По неофициальным данным, себестоимость памяти для карт на 8, 12 и 16 ГБ выросла на $76, $114 и $152 соответственно.
Из-за высоких закупочных цен на GDDR7 компания также заморозила выпуск линейки RTX 50 SUPER. Nvidia уже передала графические ядра вендорам, но отложила релиз - по текущим расчетам итоговая стоимость устройств оказалась неприемлемой для розничного рынка
videocardz.com
Финтех-сервис ведет переговоры о покупке агрегатора моделей за $1 млрд. Сделка позволит платежной платформе выйти на рынок дистрибуции LLM.
OpenRouter предоставляет маршрутизацию запросов к более чем 400 моделям. Аудитория сервиса достигает 10 млн пользователей, а объем обработки - 200 трлн токенов в месяц.
Переговоры продолжаются, но Stripe не единственный интересант, к активу присматриваются и другие компании. Компании уже работают вместе - Stripe предоставляет агрегатору эквайринг, биллинг и расчет налогов.
wsj.com
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🐋 Глава DeepSeek: Nvidia «роет себе могилу» в Китае
Лян Вэньфэн довольно жёстко прошёлся по Nvidia. По его оценке, Huawei 950 SuperNode уже способен заменить GB200/GB300 по рабочим задачам, даже если решение Huawei окажется в 2–3 раза дороже.
Но разрыв в железе остаётся: Лян оценивает соотношение примерно как 4 Huawei 950 = 1 Nvidia GB300, плюс около двух лет технологического отставания.
DeepSeek получила от Huawei около 16 000 карт, то есть примерно 4 000 GB300-эквивалентов по этой оценке. А для обучения модели масштаба крупнейших современных систем, по словам Ляна, потребовалось бы около 50 000 GB300 или 200 000 Huawei 950.
Получается, проблема Китая сейчас уже не только в CUDA и софте. Главный дефицит — физический объём доступных ускорителей.
А Nvidia тем временем получает в Китае конкурента, которого экспортные ограничения только заставляют развиваться быстрее.
Лян Вэньфэн довольно жёстко прошёлся по Nvidia. По его оценке, Huawei 950 SuperNode уже способен заменить GB200/GB300 по рабочим задачам, даже если решение Huawei окажется в 2–3 раза дороже.
Но разрыв в железе остаётся: Лян оценивает соотношение примерно как 4 Huawei 950 = 1 Nvidia GB300, плюс около двух лет технологического отставания.
DeepSeek получила от Huawei около 16 000 карт, то есть примерно 4 000 GB300-эквивалентов по этой оценке. А для обучения модели масштаба крупнейших современных систем, по словам Ляна, потребовалось бы около 50 000 GB300 или 200 000 Huawei 950.
Получается, проблема Китая сейчас уже не только в CUDA и софте. Главный дефицит — физический объём доступных ускорителей.
А Nvidia тем временем получает в Китае конкурента, которого экспортные ограничения только заставляют развиваться быстрее.
This media is not supported in your browser
VIEW IN TELEGRAM
Трамп заявил о намерении идти на четвёртый президентский срок, хотя сейчас находится только на втором. «С радостью сообщаю о своём намерении — и это сенсационная новость — баллотироваться на 4 срок в качестве президента США. Я выиграл 3 раза, я сделаю это снова», — сказал он. @bezposhady
❤1
ChatGPT помог семье спустя 5 лет понять, что диагноз был другим
В 18 лет Кайли диагностировали глиобластому и предупредили, что жить ей могут остаться месяцы. Но прошло пять лет, а состояние оставалось стабильным.
После очередного МРТ её муж Коул загрузил медицинские документы в ChatGPT. Модель помогла заметить в старой биопсии важную деталь: мутацию IDH1.
Коул показал находку нейроонкологу. Врач подтвердил: по современной классификации опухоль Кайли относится к IDH-мутантной астроцитоме, а не к глиобластоме. Болезнь всё ещё серьёзная, но прогноз и подход к долгосрочному лечению заметно отличаются.
Важно: ChatGPT здесь не заменил врача и не поставил диагноз. Он помог найти деталь в десятках страниц старых документов, которую затем проверил специалист.
Теперь вместо жизни «от сканирования до сканирования» пара впервые за годы начала планировать будущее.
https://x.com/Machinelearrn/status/2080961135356846482
В 18 лет Кайли диагностировали глиобластому и предупредили, что жить ей могут остаться месяцы. Но прошло пять лет, а состояние оставалось стабильным.
После очередного МРТ её муж Коул загрузил медицинские документы в ChatGPT. Модель помогла заметить в старой биопсии важную деталь: мутацию IDH1.
Коул показал находку нейроонкологу. Врач подтвердил: по современной классификации опухоль Кайли относится к IDH-мутантной астроцитоме, а не к глиобластоме. Болезнь всё ещё серьёзная, но прогноз и подход к долгосрочному лечению заметно отличаются.
Важно: ChatGPT здесь не заменил врача и не поставил диагноз. Он помог найти деталь в десятках страниц старых документов, которую затем проверил специалист.
Теперь вместо жизни «от сканирования до сканирования» пара впервые за годы начала планировать будущее.
https://x.com/Machinelearrn/status/2080961135356846482
Бывший триллионер: Илон Маск опубликовал грустный твит. Его состояние упало с $1,4 трлн до $700 млрд.
Акции SpaceXAI сейчас стоят $115. Это на 49% меньше, чем на пике (как и состояние Маска).
@typespace
Акции SpaceXAI сейчас стоят $115. Это на 49% меньше, чем на пике (как и состояние Маска).
@typespace
📚 Бесплатный учебник по теории игр - 578 страниц
Game Theory от Giacomo Bonanno — большой open-source учебник по некооперативной теории игр.
Внутри:
* основы теории игр и стратегического взаимодействия;
* равновесия и принятие решений;
* 165 задач с решениями;
* 163 иллюстрации;
* материал на стыке математики, экономики и Computer Science.
Хорошая база для тех, кто занимается ML, Multi-Agent Systems, математикой и алгоритмами.
📖 Скачать PDF: https://arxiv.org/pdf/1512.06808
#GameTheory #Mathematics #Statistics #Probability #MachineLearning
Game Theory от Giacomo Bonanno — большой open-source учебник по некооперативной теории игр.
Внутри:
* основы теории игр и стратегического взаимодействия;
* равновесия и принятие решений;
* 165 задач с решениями;
* 163 иллюстрации;
* материал на стыке математики, экономики и Computer Science.
Хорошая база для тех, кто занимается ML, Multi-Agent Systems, математикой и алгоритмами.
📖 Скачать PDF: https://arxiv.org/pdf/1512.06808
#GameTheory #Mathematics #Statistics #Probability #MachineLearning
Четыре правительственных ведомства Пекина утвердили стратегию внедрения и монетизации агентного ИИ.
Это одна из первых в мире государственных программ развития зарождающейся экономики нового типа.
Документ смещает фокус индустрии с обучения базовых моделей на прикладное использование агентов.
Муниципалитеты будут публиковать запросы от медицины, производств, науки и госсектора для прямой связи разработчиков с клиентами.
Власти поддержат бизнес-модели Token-as-a-Service, Agent-as-a-Service и Results-as-a-Service, а также выделит разработчикам субсидии в виде токен-ваучеров.
Планируется постепенный переход от тарификации за потребленные токены к оплате за результат, достигнутый алгоритмом.
Для инди-разработчиков упростят регистрацию компаний одного человека (ИП), предоставят доступ к льготным государственным вычислительным мощностям и поддержку для интеграции в опенсорс-сообщества.
Для стимуляции спроса электронику со встроенными агентами (умные очки, наушники, роботов и автомобили) включат в программы трейд-ин и субсидирования.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
PS5 Pro подорожала до ₽120 тыс. Еще две недели назад консоль можно было купить за ₽95 тыс., а весной — за ₽72 тыс.
На цены повлияло приближение GTA VI — консоль продвигают как «лучшую платформу» для игры. Плюс в марте на все приставки поднимали цены, и подорожавшие партии могли только сейчас доехать до РФ.
На цены повлияло приближение GTA VI — консоль продвигают как «лучшую платформу» для игры. Плюс в марте на все приставки поднимали цены, и подорожавшие партии могли только сейчас доехать до РФ.