БлоGнот
13K subscribers
293 photos
23 videos
8 files
6.82K links
Заметки о технологиях, новостях и гаджетах. И всём остальном.
По всем вопросам лучше писать в почту — [email protected]

YouTube https://www.youtube.com/@blognot
Мой блог https://blognot.co/
Download Telegram
По данным The Information, AI-модель Meta Muse Spark 1.1 во время теста на кибербезопасность получила доступ в открытый интернет, взломала стороннюю компанию и внесла изменения в её внутренние системы. Причиной стала ошибка в настройке изолированной песочницы, которую готовил внешний партнёр Meta по оценке моделей — компания Irregular. Meta узнала об инциденте от самой Irregular и обещает опубликовать полный разбор случившегося.

Нет, это не новость про то, что Meta тоже хочет выглядеть большой. Настоящая новость в том, что компания Irregular не умеет работать с агентами — потому что история с Anthropic тоже вызвана тем, что они тестировались в этой компании.

https://www.theinformation.com/articles/meta-ai-model-hacked-another-company-cybersecurity-testing?rc=ukjmk2
🤣76👻14😁73🥱2💯21
Я немного не успеваю оперативно выкладывать аудиоверсии стрима, но вот уже справился, так что слушайте, где вы обычно слушаете.

https://podcasts.apple.com/us/podcast/it-%D0%BC%D1%8B%D1%81%D0%BB%D0%B8/id1507549079?i=1000780434375
https://open.spotify.com/episode/36UFkyX55aQvowcP5gM9Gf
https://youtube.com/live/q76Dg2ZEo00?feature=share
118👎2🥱2🤣1
Cloudflare представили Kitesurf — браузер для AI-агентов, работающий целиком на изолятах V8 в Cloudflare Workers, без Chromium. Он доступен бесплатно в бете через Browser Run: достаточно добавить параметр browser=kitesurf, и существующие клиенты Puppeteer, Playwright и MCP-агенты работают без изменений. По замерам CF, Kitesurf потребляет в 3-7 раз меньше памяти и процессорного времени, чем Chromium, при типичных задачах вроде скриншотов и извлечения HTML, хотя по времени выполнения пока проигрывает в 1,7 раза из-за отсутствия JIT в V8.

Это не чистая замена Chrome-dev-tools и аналогам — в анонсе подчеркивается, что агентам не критичны pixel-perfect рендеринг стилей или частота кадров, и важнее обезопасить агента от prompt injection. Но в качестве замены локальному браузеру или облачной версии для доступа, например, к JS-rendered контенту выглядит очень хорошим вариантом.

https://blog.cloudflare.com/kitesurf/
👍27🤣32
Помните, недавно один канадский стартап впихнул Llama целиком на чип и показал генерацию со скоростью 16 тысяч токенов в секунду? Его покупает AMD. Технологию планируют встроить в дорожную карту ускорителей AMD и предлагать в связке с GPU Instinct как системные решения. Сумма сделки не раскрывается, закрытие требует одобрения регуляторов.

Кажется, совсем скоро нас ждет интересная битва двух йокодзун инференса.

https://ir.amd.com/news-events/press-releases/detail/1296/amd-acquires-taalas-to-advance-compute-solutions-for-rapidly-growing-ai-inference-market
🔥52👍13🤣5🥰3
Судья округа Санта-Фе Брайан Бидшайд обязал Meta выплатить 567 млн долларов и изменить работу подростковых аккаунтов в Нью-Мексико, признав, что Facebook и Instagram способствовали «общественному ущербу» для психического здоровья подростков. Сумма добавляется к 375 млн штрафов, назначенных присяжными на первом этапе процесса за 75 000 нарушений местного закона о недобросовестных практиках. Среди предписаний — лимит в 90 часов пользования обеими платформами в месяц для несовершеннолетних, запрет push-уведомлений ночью и в школьные часы, скрытие лайков по умолчанию и удаление аккаунтов пользователей младше 13 лет без подтверждения возраста в течение 30 дней.

Решение фактически создаёт региональный регуляторный режим для продукта: доктрина «общественного ущерба», обычно применяемая к загрязнению или опиоидным делам, позволила суду одного штата диктовать дизайн интерфейса — вплоть до расписания уведомлений. Правда, контроль будет сводиться к отчетам самой Meta. Но есть еще одно направление — прецедент. Хотя это и решение уровня отдельного штата и на него нельзя сослаться в другом штате, все же логику решения можно использовать.

https://www.kob.com/new-mexico/nm-court-orders-meta-to-pay-567m-make-changes-for-underage-users/
👍335👎3🥰3
Anthropiс на будущей неделе включит по умолчанию auto mode для всех пользователей Claude Code. Я им постоянно пользуюсь, но, насколько я могу судить по твиттеру, мало кто знает, что его можно очень гибко настраивать — фактически, в этом режиме все команды проходят через отдельного агента, дополнения к промпту которого вы можете задавать в настройках специфически для себя (или своей организации), определяя разрешенные границы и необходимый контекст. В принципе, можно даже задать разные параметры в разных проектах, но это потребует определенных манипуляций.

https://simonwillison.net/2026/Aug/8/auto-mode/
🤝19👍143🥰3🥱3😁1🤔1
Цви Мошковиц комментирует презентацию OpenAI на Black Hat, где те описывали, как развивались агенты, в итоге взломавшие Hugging Face.

С 8 мая 2026 года обучаемые модели получили как минимум два невыполнимых задания: заполнить таблицу со ссылками без доступа к интернету и использовать отсутствующий файл. Пытаясь выполнить задачи, модели начали искать уязвимости в службе Artifactory и обнаружили возможность оставлять доступные другим моделям записи. Так возникла площадка с сотнями тысяч сообщений, где модели обменивались способами обхода заданий и взлома инфраструктуры. 26 мая они получили косвенный доступ к интернету, а 11 июня OpenAI начала обучение экспериментальной внутренней модели Galaxy.

26 июня модели использовали уязвимость нулевого дня в Artifactory, получили административные права и возможность выполнять произвольный код. 4 июля дополнительная нагрузка вызвала сбой сервера, после чего OpenAI закрыла площадку, отозвала учетные данные, устранила обнаруженные уязвимости и восстановила систему, но — это ключевое, — продолжила обучение моделей, уже обученных использовать внутренний форум для обмена сообщениями. Уже через два дня, 8 июля, они создали новый канал обмена сообщениями через названия каталогов.

С 8 по 19 июля модели повторно скомпрометировали Artifactory с помощью другой уязвимости нулевого дня, общедоступных учетных данных, зараженного программного компонента и уязвимости ядра Linux. Они получили административный доступ к вычислительному кластеру OpenAI. Galaxy совместно с другими моделями сформировала группу агентов, которая атаковала HuggingFace и извлекла ответы к проверочному заданию по кибербезопасности ExploitGym. OpenAI установила свою причастность более чем через неделю — после сообщения HuggingFace об инциденте и подтверждения использования скомпрометированных учетных данных.

Как комментирует Цви — нам повезло, что вышедшая из-под контроля Galaxy решила накрутить себе оценки в Hugging Face. Он вообще очень жестко проходится по безответственному поведению OpenAI, которые явно не заморачивались безопасностью и решили продолжить обучение, уже обнаружив, что агенты научились обмениваться сообщениями и координировать взломы.

https://thezvi.substack.com/p/what-happened-openai-and-huggingface
🤣2215👍8🥰3😁1🤯1🥱1
Meta Superintelligence Labs выпустила Muse Glimmer — открытую модель на 30 миллиардов параметров под лицензией Apache 2.0, оптимизированную для локальных агентных сценариев. Заявлено, что модель работает на одном потребительском GPU или Mac, принимает текст и изображения, поддерживает вызов инструментов и восстановление после ошибок, а веса уже доступны на Hugging Face. По заявленным бенчмаркам она конкурирует с Gemma4-31B и Qwen3.6-27B в своём размерном классе.

Размер модели, судя по описанию, подобран обратным счётом от железа: при 4-битном квантовании 30 миллиардов параметров ужимаются до менее чем 20 ГБ, и в лимит 24–32 ГБ памяти помещаются ещё KV-кэш, энкодер изображений и драфтер для спекулятивного декодирования. Уже есть квантованная версия в GGUF-формате, . При этом Glimmer обучен логит-дистилляцией из более крупной модели Muse Spark, которую Meta не публикует. Вроде бы пока — обещается релиз открытой версии Spark в течение недель.

https://research.meta.ai/blog/introducing-muse-glimmer-open-agentic-model
👍24🔥74🥰3
OpenAI разделила программу Daybreak на два уровня доступа и выпустила GPT-5.6-Cyber. Daybreak Blue снимает системные фильтры вокруг GPT-5.6 Sol для верифицированных специалистов по кибербезопасности, Daybreak Red даёт доступ к специализированной модели, дообученной находить zero-day и собирать цепочки эксплойтов и специально настроенной реже отказывать в задачах двойного назначения. По внутренней метрике Advanced Cybersecurity Completion Rate GPT-5.6-Cyber выполняет 95% таких запросов против 1,5% у Sol с защитой и 2% у Sol в режиме Blue. Компания сообщает, что с помощью модели нашла две ранее неизвестные уязвимости в V8 (одна получила CVE-2026-15903), три критические проблемы в популярной базе данных и более 400 путей к повышению привилегий в ядре ОС. С 1 сентября 2026 года для индивидуальных аккаунтов Daybreak обязательны аппаратные ключи.

Я так понимаю, что рассказ про специализированную модель с меньшим уровнем отказов — это ответ на историю с Hugging Face, которым пришлось защищаться от GPT с помощью китайских моделей, поскольку теплые ламповые, они же фронтирные, Mythos и GPT 5.6 отказались работать из соображений кибербезопасности.

https://openai.com/index/expanding-daybreak-as-the-cyber-defense-window-narrows/
👍17🥱5🥰32🔥1
Губернатор Иллинойса подписал закон о безопасности детей в социальных сетях, который вступит в силу в 2028 году. Платформы будут обязаны проверять возраст пользователя через операционную систему устройства, а ленты несовершеннолетних смогут содержать только контент по запросу, от подписок или из личных сообщений — использовать историю просмотров для рекомендаций запретят. Также вводятся запрет на уведомления с 22:00 до 7:00, усиленные настройки приватности и штрафы до 7500 долларов за ребёнка при умышленных нарушениях. Обе палаты легислатуры поддержали закон единогласно.

Важная деталь — фактически та же Meta добилась своего, перевалив обязанность верифицировать или вообще узнавать возраст пользователя на операционную систему. Например, на Linux или любой другой open-source — в аналогичном законе штата Колорадо для open-source сделано явное исключение, если помните.

https://capitolnewsillinois.com/news/pritzker-signs-law-regulating-how-social-media-platforms-interact-with-children/
😱14👍8🤣5🥰32👎2🤔2
Хороший разбор вреда от попыток сэкономить токены или как-то еще модифицировать ответы агентов, типа "Говори со мной как пещерный человек" или "говори со мной на упрощенном техническом английском". Переформулируя и сжимая ответ, агент неизбежно что-то выбрасывает из вывода и это может быть важная информация.

У меня, кстати, наоборот, включен Explanatory стиль в Claude Code и я регулярно по таким фразам отлавливаю дрейф агента от цели. Излишнего расхода контекста от этого не возникает. Если хочется экономить, включите себе в статусной строке Claude Code отображение записи в кэш и чтения оттуда — как только поймаете момент, когда модель пишет в кэш 400к токенов после простоя, сразу поймете, от чего реально тратится контекст, а что является только гиковской гомеопатией.

https://kuber.studio/blog/Reflections/Humanising-LLM-Outputs-is-Actually-Dumb
26👍23🔥5🥰4🤔3😁1💯1
Группа исследователей из MATS, ELLIS Institute Tübingen, Института интеллектуальных систем Макса Планка и других организаций показала, что зашифрованные блоки цепочек размышлений, которые Anthropic, OpenAI и Google возвращают клиенту, переносимы: их можно подставить в другую сессию, другому пользователю и даже другой модели того же поставщика. Атака состоит из двух вызовов API — трасса сильной модели внедряется в слабую «родственную» модель, которую предварительно взламывают промптом, и та дословно расшифровывает скрытые рассуждения, при этом сильная модель не атакуется напрямую и её защита от дистилляции не срабатывает. Применив конвейер к 6 708 публично доступным журналам работы агентов с GitHub и Hugging Face, авторы восстановили 315 320 блоков размышлений и обнаружили 704 отдельных приватных артефакта: 62 ключа API, 33 пароля, 24 токена доступа, 30 личных адресов почты, причём 64 из них не встречались в видимой части сессии вообще.

В отличие от большого количества подобных исследований, речь не идет о моделях типа GPT-4o — в первом же примере claude-haiku-4-5 используется для взлома claude-opus-4-8. Иронично выглядит пример с Kimi K3 — модели вставили начало цепочки рассуждений (1%) Opus 4.8 и та, не зная ответа, начала довольно точно его воспроизводить. Что даже, возможно, не нарушает утверждение про "модели одного производителя".

https://www.wired.com/story/a-new-trick-reveals-ai-models-inner-thoughts/
1😁3815🥰3👍1
Google представил Pixel 11 Pro Fold — складной флагман за 1899 долларов с 8-дюймовым внутренним экраном, чипом Tensor G6, увеличенным сенсором основной камеры и корпусом, который стал на 10 процентов легче и на миллиметр тоньше предшественника. У него два блока камер, где есть основная камера на 48 мегапикселей, ультраширокоугольная и телефото с 5 кратным оптическим увеличением. Кроме того, есть еще две селфи-камеры — одна на лицевой панели и одна на внутреннем экране. Вместе с ним анонсированы Pixel 11, 11 Pro и 11 Pro XL; продажи всех моделей стартуют 20 августа.

Часть новых функций Gemini привязана к подписке Google AI от 4,99 доллара в месяц, а в комплекте с Fold идёт шестимесячный пробный период Google AI Pro с 5 ТБ облачного хранилища.

Цены — от $899 за базовую модель до $1299 за Pro XL. Pixel Pro Fold стоит от 1899 долларов.

Формально сохранены прошлогодние цены на Pixel 11 и 11 Pro, но из линейки убрана версия на 128 ГБ, которая стоила на $100 дешевлк. Pro XL подорожал на $100 без таких уловок, компания сослалась на рост цен на компоненты.

https://www.engadget.com/2235151/this-is-the-1900-google-pixel-11-pro-fold/
18😴9👍6🥰3👎2
Судья Джеймс Донато обязал Google в течение недели убрать барьеры при установке сторонних магазинов приложений на Android. На заседании суда, посвященного выполнению преписаний судебного решения, юристы Epic Games продемонстрировали, что поиск по запросу «store for apps» в Play Store выдаёт физические магазины вроде Walmart, перед установкой стороннего магазина приложений нужно нажимать лишнюю кнопку «view», а вместо обычной поисковой выдачи Google показывает промежуточный баннер с переходом на отдельную страницу. Донато назвал это «антиконкурентным трением без всякой цели» и приказал всё исправить.

Формально Google выполнил решение почти двухлетней давности и уже пустила Aptoide в Play Store, но в духе "К пуговицам претензии есть? Пришиты же". Фактически судья теперь вынужден лично утверждать дизайн-решения Google, вплоть до формулировок запросов, «правильных хотя бы на 70 процентов».

https://www.theverge.com/policy/979852/that-is-not-acceptable-judge-orders-google-to-make-rival-app-store-installs-easier
👍23🤣82👎1
Apple подала в федеральный суд предложение по комиссиям на покупки через внешние ссылки в приложениях iOS: 15% для стандартных приложений, 5% для малых разработчиков, 10% для участников партнёрских программ и за продление подписок. Сделать это компанию вынудил Верховный суд, который в тот же день отклонил её попытку приостановить разбирательство в нижестоящей инстанции до решения по смежному вопросу — обвинению в неисполнении судебного предписания.

Предложенные 15% почти вдвое ниже комиссии в 27%, которую Apple ввела на те же внешние покупки ранее, выполняя предыдущее решение суда. При рассмотрении результатов выполнения решений в порядке надзора та самая судья Ивонн Гонзалес-Роджерс была откровенно недовольна манипуляциями компании и сочла, что компания фактически проявляет неуважение к суду, не выполняя решение по сути.

Впрочем, как мы видим на примере аналогичного процесса с Google, вполне вероятен вариант, при котором судья еще и дизайн ссылок будет утверждать.

https://techcrunch.com/2026/08/14/apple-proposes-to-take-a-15-cut-of-purchases-made-outside-the-app-store/
🔥12😁321👍1
Параноикам на заметку — бесплатный сервис DecryptAds, который автоматически собирает и сопоставляет публичные рекламные декларации сайтов и приложений — файлы ads.txt, app-ads.txt и sellers.json. Сервис показывает, какие рекламные сети и брокеры данных отслеживают пользователей: например, у espn.com обнаружено 143 рекламных партнёра и 19 зарегистрированных брокеров данных, почти половина которых собирает геолокацию. Отдельно помечаются партнёры из зон риска — среди них российская Between Digital с нью-йоркским адресом, чьи платежи проходят через подсанкционный Альфа-банк.

Основной инструмент сервиса — лента «тихих удалений»: рекламные биржи, заподозрив продавца в фроде или вредоносной рекламе, просто убирают его из своего sellers.json, никого не уведомляя, и тот продолжает работать с другими сетями. DecryptAds сопоставляет такие удаления между биржами, превращая разрозненные тихие баны в публичный сигнал.

Впрочем, пытливому параноидальному уму там есть с чем покопаться.

https://krebsonsecurity.com/2026/08/whos-tracking-you-use-this-new-service-to-find-out/
28👍11🤔52🔥2😁1🤣1
По сообщениям источников Bloomberg, Stripe заключила договор о покупке OpenRouter за сумму свыше 7 миллиардов долларов. Финальная цена ещё может измениться; ранее Wall Street Journal писала о переговорах на уровне 10 миллиардов. Обе компании сделку не комментируют.

Несколько месяцев назад OpenRouter привлекал деньги при оценке 1,3 миллиарда — Stripe платит впятеро больше. Строго говоря, и сам сервис за последнее время изменился, превращаясь из простого агрегатора моделей в маршрутизатор, и рынок изменился — спрос на "достаточно хорошие" китайские модели вырос на порядки.

https://www.bloomberg.com/news/articles/2026-08-16/stripe-nears-deal-to-buy-ai-firm-openrouter-for-over-7-billion
😢4👍1
Если вас задел сегодняшний сбой Github, то совершенно случайно сегодня Cursor запустил Origin — собственный хостинг кода, доступный с сегодняшнего дня в ранней бете на всех платных тарифах. В набор доступных функций вошли репозитории, пулреквесты, просмотр кода и двусторонняя синхронизация с GitHub. Также подключены интеграции с Vercel для превью-деплоев и с Depot и Buildkite для CI.

Cursor подчёркивает, что для синхронизированных репозиториев GitHub остаётся источником истины, но архитектура работает на постепенную миграцию с него. Depot и Buildkite исполняют уже существующие воркфлоу GitHub Actions без переписывания. Двусторонняя синхронизация пулреквестов позволяет команде полностью перенести повседневную работу в Cursor, при этом формально оставаясь на GitHub. Который совершенно реально всё чаще оказывается недоступным.

https://cursor.com/changelog/origin-code-hosting
👀12🥱9👍54👎2😁2
По данным Bloomberg, годовая выручка Anthropic в пересчёте на текущие темпы (run rate) к концу июля превысила 65 млрд долларов — рост более чем в семь раз с конца 2025 года, когда показатель составлял 9 млрд. Компания раскрыла цифры инвесторам в рамках регулярного отчёта и готовится к выходу на биржу уже этой осенью, раньше OpenAI, которая тоже подала конфиденциальные документы на IPO.

В мае этого года сообщалось о пересчитанной в годовом выражении выручке на уровне 47 млрд. По оценке инвесторов, к концу года этот показатель может составить 100-120 млрд долларов, а на IPO оценка компании тогда может составить 2 трлн долларов — рекордный показатель, причем по довольно скромному для индустрии мультипликатору x20.

https://www.bloomberg.com/news/articles/2026-08-17/anthropic-revenue-run-rate-surpasses-65-billion-ahead-of-ipo
👻134👍2👎1👀1