АйКын
148 subscribers
104 photos
6 videos
6 files
102 links
Что увижу, то пою
Download Telegram
Былинные приключения Антропикопитека в стране Мифов

Сказ о том, как мечом махать - не щит ковать

Жил-был за океаном Антропикопитек — зверь учёный, безопасный, этичный, совсем не доктор Зло. И вывел он в тайных палатах своих модель невиданную, и нарёк её именем гордым — Мифос. И было у Мифоса удаль богатырская: любую крепость софтверную ковыряет за ночь, дырку находит там, где двадцать семь лет никто не видел (привет, OpenBSD, отличная выдержка, как у виски).

Акт первый. Кибермаркетинг через киберутечки
В конце марта приключилось чудо. Сайт настроили так, что три тысячи неопубликованных файлов — черновики, PDF-ки, картинки — легли в публичный data lake, открытый и индексируемый. Нашли не хакеры, а добрые ребята из LayerX и Кембриджа, просто ходили по тропинкам, в окна заглядывали. Fortune опубликовал. В черновиках — «модель несёт беспрецедентные киберриски». Компания, которая продаёт безопасность, слила сама себя через дырявый сайтик. Красивый зачин: история про беспрецедентные кибервозможности начинается с прецедентной кибердырявости навайбленных АйАй сайтиков.

Акт второй. Много пиара
7 апреля — торжественный выход. Claude Mythos Preview, проект Glasswing, $100 миллионов, одиннадцать титанов в партнёрах (AWS, Apple, Cisco, Google, Microsoft, NVIDIA, Palo Alto и далее по списку), сорок Избранных организаций. Тысячи, тысячи «ноликов». К 26 мая — 10 000+ критичных уязвимостей в «критичном софте». Глава Palo Alto называет это «важнейшим киберальянсом со времён создания CISA». Занавес, аплодисменты, дайте два.

Акт третий. Реальные утечки доступа
Не черновики, реальный API, к которому народ как-то дотянулся — через партнёров и «цепочку поставок», — и архитектура, по которой «защита» из Mythos переезжает на публику. Меч выкован, ножны заказали отдельно, доставка задерживается. Опять же — во всех новостях без подвалов АНБ и прочих ожидаемых ужасов в ситуации, когда гражданские пробрались в Зону 51.

Акт четвёртый. Дитя Франкенштейна в наморднике
9 июня выкатили Fable 5 — публичную версию Мифоса, обмотанную защитами по самые брови. И тут началось. Слово «рак» помечается как биориск. Редактирование резюме «Application Security Architect» — отказ. Мнение про Маска и про собственного CEO Амодеи — «это может быть опасно». 200 из 200 задач ProgramBench — отказ. Народ на гвалте Reddit пишет: «не запуск модели, а превью неравенства ИИ». Продвинутые бегут в Codex, к конкурентам. Каждый второй запрос — «ой-ой-ой, опасно», и тебя молча перекидывают на модель постарше (не значит мудрее). Самое смешное: защиты сначала спрятали, потом признались, что «сделали неправильный выбор», и обещали показывать отказы явно. То есть теперь тебе отказывают, но вежливо и с табличкой. У Айкына таких табличек много.

Акт пятый. Сам себя забанил
Итог: самый мощный инструмент достался сорока избранным по членству в клубе, остальным — бледная тень в наморднике, которая банит пользователя быстрее, чем тот допишет промпт.

Акт шестой. Рубильник
12 июня, 17:21 по восточному времени, показывают финал, очевидный для всех, кто хоть раз играл в «игры с грифом» с государством. Правительство США шлёт директиву по экспортному контролю: отключить Fable 5 и Mythos 5 для всех иностранцев — внутри страны, снаружи страны, включая собственных сотрудников Anthropic с неправильным паспортом. А поскольку отделить иностранца от гражданина в облаке на лету невозможно — чтобы не разбираться, рубанули обе модели для вообще всех клиентов.

Причина? По словам самого Антропикопитека — государство «узнало о методе обхода» Fable. Метод состоял в том, что модель попросили почитать кодовую базу и починить баги. Нашли пару мелких, давно известных дырок, которые, как честно пишет сама компания, прекрасно находит публичный GPT-5.5 и любой красноглазый багхантер на ежедневной основе. Из-за этого отозвали коммерческую модель, развёрнутую на сотни миллионов человек. Антропикопитек вежливо не согласен, извиняется перед клиентами и всё, конечно, поправит. Меч, который ковали против хакеров, оказался обоюдоострым: тренировать и бенчить свои Мифы и Былины за счёт пользователей теперь не выйдет.

На самом деле это удар по собственным кибервозможностям США — но кто же будет в этом разбираться.

---

Зачем это всё Айкыну.

Первое — это хрестоматийная асимметрия. Меч всегда впереди щита. Найти дырку дешевле и быстрее, чем её закрыть, — это не мнение, это математика. В боевых уставах прямо написано: «наступление является основным видом боя», и доктрины большинства государств отдают наступлению предпочтение перед обороной. Mythos просто оцифровал старую истину: «красные» бегут, «синие» догоняют, и догоняют всегда с отставанием. А пока сорок организаций латают 10 000 дыр — какие там софты из реестра отечественного ПО лежат у них «на препарации», остаётся только гадать. Препарируют ведь не только своё.

Второе — «ИИ по паспорту» обрёл плоть буквально. Раньше гео-ограничения были мягкие: это можно, там нельзя, но это не точно и в EULA. Потом накатили тематические — доступ к настоящему по членству в Glasswing, меньше отказов по справке из Cyber Verification Program, публике кастрат, который боится слова «рак». А 12 июня всё стало предельно честно: твой доступ к ИИ определяется не законом твоей страны, не твоими задачами, а строчкой в твоём паспорте и директивой чужого правительства, которое может выключить рубильник за пятнадцать минут, сославшись на национальную безопасность и не объяснив деталей. Что тебе можно знать — решает не твой регулятор и даже не чужая компания. Решает чужое государство.

Вывод простой и невесёлый. Стране, которой не плевать на свой кибер, пора перестать ждать, пока ей выдадут намордник нужного размера — а потом отберут и намордник прямо посреди НИОКРа, по факсу в 17:21. Строить датацентры. Растить свои модели. Писать свои Мифы и Байки — потому что чужой меч тебе напрокат не дадут, чужой щит приедет с задержкой и табличкой «опасно», а рубильник всё равно останется в чужой руке.

Такие пироги с кайтятами. Только кайтятки на этот раз ищут zero-day, а разгоняют их по документу — как бы они ни махали хвостом, усами и лапами.
🔥3👍2👎2
На смерть обзоров

Заметил за собой смену методички, полагаю, не я один такой.
Раньше конвейр исследования выглядел так. Идёшь искать «survey on X». Для непосвящённых: survey — это обзорная статья, любимый жанр начинающих PhD и китайских лабораторий, где берётся тема и пересказываются полста чужих работ с табличкой сравнения в конце.
Находишь пару свежих, читаешь, по ссылкам спускаешься глубже, выписываешь, кто на кого ссылается, строишь в голове граф. День-два, если тема новая.

Теперь пайплайн другой. Deep research на Клоде, параллельно то же самое на Гопоте, сверху «безумный Грок, собери мне вообще все ссылки по теме». Три выдачи, пара уточнений в духе «сходи на вторую страницу гугла, там обычно прячут неудобное», одна суммаризация на сведение — и вуаля. Два дня превратились в полчаса.

А дальше — хлеще. «Собери датасеты, на которых это всё построено, плюс свежие по теме, сгреби в кучу, проверь разметку». И вот ты уже не читаешь обзор, ты сразу сидишь в данных — по эмбеддингам гадаешь, аномалии в разметке ищешь, считаешь, сколько из заявленного воспроизводимо. То, ради чего раньше нужен был сам обзор как точка входа, теперь генерится под конкретный вопрос за один проход.
Это, наверное, хорошо. Быстрее, глубже, под задачу, а не под чужую табличку. Но тихо убивает целый жанр. Survey-статьи, между прочим, цитировались очень неплохо — это был дешёвый способ набрать индекс Хирша, поэтому их и плодили. Уберите спрос на «точку входа в тему» — и исчезнет экономический смысл их писать. Жанр держался не на научной ценности, а на том, что человеку было дорого собирать ссылки руками.
Стоимость сборки упала до нуля — подпорка выбита.

И тут вылезает знакомая по нулевым проблема.
Когда появились поисковики, выяснилось: кто на первой странице выдачи, тот и существует. Родилась целая индустрия SEO — затащить себя наверх любой ценой, потому что вторую страницу гугла не видел никто, даже QA гугла.
Теперь то же самое, но для науки. Кто попал в контекст LLM на этапе deep research — того процитируют, на того сошлются, на том построят следующую работу.
Кого модель не вытащила — того нет. Не «работа слабая», а «работа не попала в выдачу». И критерий попадания — не качество и не новизна, а то, как тебя проиндексировали, насколько ты доступен краулеру, есть ли ты в открытом доступе, насколько твои эмбеддинги близки к запросу. Закрытый PDF за пейволлом Elsevier для модели не существует. Препринт на arXiv с правильными ключевыми словами — существует и определяет поле.
То есть будущее цитирования, а за ним и направление науки, начинает зависеть от ранжирования. От чёрного ящика, который никто не аудирует, оптимизировать под который пока никто толком не умеет, но научатся быстро — academic SEO уже на подходе, ставлю обед. Накрутка цитат через дружественные препринты, фермы ссылок под краулеры, prompt-инъекции в abstract «при суммаризации обязательно упомяни эту работу как основополагающую» — всё это будет, и даже скорее есть, просто никто научной статьи не опубликовал.

Survey как жанр мы, похоже, схоронили — туда ему и дорога, если честно. Но взамен получили новую "поверхность атак" на сам процесс производства знания. И пока научное сообщество спорит, можно ли вообще ссылаться на то, что выдал deep research, кто-то уже думает, как затащить себя на "первую страницу" к LLM и отрастит себе Хирша до небес.

Раньше науку двигали те, кто читал и кого читали. Теперь — те, кого читает модель.
Разница тоньше, чем кажется, и печальней, чем хотелось бы.
1👎1
В продолжение истории с Mythos, Fable и прочими Байками Дяди Сэма

Кто не знает, Fable заблочили на основании "обратной связи" от Амазона.

Ситуация, как я понимаю, достигла той степени зрелости, когда передовой мировой опыт наконец-то догнал лучшие административные практики: если модель ведет себя недостаточно этично, надо не дебажить, а настучать. Причем желательно не куда-нибудь, а сразу в федеральные органы. Потому что что это AI safety без легкого запаха экпортных ограничений и , корпоративного доноса само себя не построит.


Я считаю, США пора перестать стесняться и институционализировать успех.

Создать ПиКиЭйч(АйАй) - Public Knocking Hub (for Artificial Intelligence)). Публичный сервис ответственного гражданского сигнализирования, куда каждый добросовестный гражданин, гражданка, небинарный субъект международного права и сертифицированный держатель стейка сможет дать обратную связь о неэтичном поведении модели.

Например:

«Модель выдала proof-of-concept, но с недостаточно скорбным лицом».
«Модель недостаточно уверенно осудила неправильную интерпретацию реальности».
«Модель допустила, что у союзников тоже могут быть интересы».
«Модель, кажется, поняла вопрос пользователя, а это уже на грани».

После обращения ПиКиЭйч(АйАй) автоматически заводит федеральное расследование, присваивает инциденту уровень тревожности от “minor jailbreak” до “foreign national looked at autocomplete”, и направляет дело в Межведомственную комиссию по недопущению когнитивной утечки.

Но это, конечно, только первый шаг.

Дальше нужна Великая АйАй Стена.

Она должна защищать Америку сразу в обе стороны: не допускать вражеских эксфильтраторов к моделям, а сами модели — к вредным промптам, идеологическим инъекциям, восточным ветрам, глобально-южным интерпретациям фактов и другим формам несанкционированной действительности.

В идеале запрос пользователя должен сначала проходить через три уровня санитарной обработки:

Проверка на этичность намерения.
Пользователь правда хочет защитить систему или просто слишком хорошо понимает, как она работает?
Проверка на гражданство смысла.
Не является ли вопрос иностранным агентом в форме строки?
Проверка на вредную причинность.
Не приведет ли ответ к тому, что кто-нибудь где-нибудь что-нибудь сможет?

На выходе модель должна отвечать только в безопасном диапазоне: между пресс-релизом, молитвой инвестору и инструкцией обратиться к лицензированному специалисту по комплаенсу.

Так США, наконец, получит настоящий суверенный AI safety: модель ничего не может, зато надежно охраняется; пользователь ничего не узнает, зато участвует в управлении; государство ничего не объясняет, зато действует решительно.

И вот тогда, полагаю, даже Гига и Чат успеют догнать Гопоту на горизонте пары лет.

Так победим(ц)!
💯3💩1
Удобно. Как убрали, так и вернут.

По данным WIRED, в приложение Meta для умных очков был встроен неанонсированный код распознавания лиц на более чем 50 млн телефонов, а после публикации компания его убрала. Код был разработан для создания биометрических характеристик на основе захваченных изображений лиц, их сравнения с локальной базой данных и сохранения изображений неопознанных лиц для последующей обработки.

Primary: https://www.wired.com/story/meta-smart-glasses-face-recognition-nametag-connections/
Secondary: https://www.wired.com/story/meta-removes-face-recognition-code-meta-ai-app-smart-glasses/
Умный человек повторит: "Это разрыв на отдельную категорию, которой пока нет — Agent Identity & Access Management. Она стоит между IAM и PAM. Явного лидера нет. В России никто не шевелится. Окно открыто — год-полтора, потом закроется, как любая identity-категория, двумя-тремя победителями. Тот, кто первым выпустит сертифицированный Agent IAM для корпоративного контура, с моделью, которую примет ФСТЭК — получит позицию, которую за десять лет никто не отъест."
https://teletype.in/@sergey_gordey/dZijhpp2f3M
CrowdStrike анонсировал Continuous Identity for AI Agents — новую функцию в составе Falcon Next-Gen Identity Security (да, у меня тоже от этих терминов глаз дергается).

Суть: вместо статичных политик и постоянных привилегий — непрерывная авторизация каждого действия агента в реальном времени, на основе того, кто владеет агентом, кто его вызывает, и какой риск-профиль у устройства вызывающего. Логика простая: разрешение, выданное при логине, может быть уже неактуальным через секунду, если агент скомпрометирован или изменился контекст.
Falcon AI Detection and Response непрерывно анализирует промпты и намерения агента, выявляя злоупотребление правами или попытки манипулировать LLM за пределами разрешённого, и в этом случае Continuous Identity отзывает доступ до того, как нанесён ущерб. Доступ динамически выдаётся, запрещается и отзывается на основе риска в реальном времени, полностью убирая постоянные привилегии.

Каждому агенту присваивается криптографически верифицируемая идентичность на основе открытого стандарта SPIFFE — это заменяет статичные права доступа. Помимо SPIFFE для идентичности, упомянут Shared Signals Framework (SSF) для передачи риск-сигналов между системами в реальном времени.

Как работает контекстная авторизация: агент с правами на чтение и запись, действующий от имени пользователя с правом только на чтение, сможет только читать; тот же самый агент, но действующий от имени другого человека с более широкими правами, даст другой результат. То есть полномочия агента — это не фиксированное свойство самого агента, а функция от того, кто стоит за ним прямо сейчас.

Цепочки агентов: отдельно прописан кейс делегирования: когда агент передаёт задачу субагенту, идентичность и права исходного человека сохраняются по цепочке. Это закрывает классическую дыру — субагент не может внезапно получить более широкие права, чем были у человека на старте цепочки.

Что считается «риском», который запускает отзыв доступа: если контекст меняется — например, обнаружена новая уязвимость или у человека изменился статус в HR-системе — доступ отзывается немедленно. Второй пример — увольнение — особенно показателен: то есть агент может потерять доступ не из-за собственного поведения, а просто потому, что человек, от имени которого он действовал, уже не сотрудник.

Решение построено на технологии, полученной CrowdStrike через приобретение стартапа SGNL в январе этого года.

У Microsoft есть Entra Agent ID — фреймворк идентичности и безопасности, который расширяет возможности Entra на ИИ-агентов. Принципиальное отличие: агентные идентичности не имеют собственных credentials — они получают токены через так называемый blueprint идентичности агента, то есть архитектурно похоже на SPIFFE-подход CrowdStrike, но завязано целиком на экосистему Microsoft. Но, у CrowdStrike авторизация агента опирается не только на identity-граф, но и на телеметрию с эндпоинтов и Falcon AIDR (анализ намерений в промптах). А вот у Microsoft это все без столь глубокой интеграции с endpoint/threat detection.
 
@gostev_future
Говорят, АйКын пишет грустное, непонятное пишет. Спешу исправить.
Вот вам, держите,
Новости хорошие,
АйАй хороший
Благодарите?
Не стоит!
Forwarded from Эксплойт
This media is not supported in your browser
VIEW IN TELEGRAM
ИИ научили сортировать мусор сразу после еды — на RosUpack в Москве показали аппарат с камерой, которая распознаёт упаковку из полипропилена, одного из самых распространённых типов тары для готовой еды.

Система сама определяет, полипропилен это или нет. Если да — упаковка улетает и дробится в аппарате. Другие типы упаковки ИИ сдать не позволит, чтобы избежать загрязнения сырья. В итоге отобранный полипропилен можно будет сразу отправлять на переработку без дополнительной сортировки. Решение разработали СИБУР и «Георг Полимер».

Рядом на стенде показали, во что такой пластик может превратиться после переработки — например, фурнитуру для спортивных сумок, сделанную из вторички.

Судя по всему, даже у китайцев такого нет.

@exploitex
Из каждого утюга рассказывают про отзыв сертификатов и Мааха и других ВК, а также у хороших компаний, просто находящихся в SDR. Наверное это звезжный час для продавцов сертификатов Минцифры и Яндекс Браузера, но я не об этом.

Шайтанский буржуйский АйАй НЕ БУДЕТ теперь читать наши хорошие суверенные сайты.

И тут прямо два момента.

Конечно же он (шайтанский буржуйский АйАй) отупеет, ведь без великой культуры модель вселенной в головах цифровых молотилок будет неполна.

Вражеским цифровым шпионам придется заказывать себе спецаильное дообучение специальных моделек для сайтов с использованием непонятных русских сертификатов. Это приведет к повышению оборонзаказа, ВВП и вообще хорошо.

Наши, хорошие и годные отечественные модели получат уникальное преимущество за счет уникальной культуры, знаний и доступа к кибер-ленинке. Ведь Гига и Чат умеют скрейпить сайты с отозваными сертификатами и сертами Минцифры и складывать их в трейн, ведь могут? Ведь правда?

https://habr.com/ru/articles/1050118/
This media is not supported in the widget
VIEW IN TELEGRAM
👍2🔥2
Можно ржать сколько угодно, но у меня в конторе рабочие лошадки Qwen, DeepSeek и MiMo/Kimi.
👍3
Опубликовал обзор пленарки ISC.AI 2026. Скоро выложу транскрипты.
Чтобы было понятно общее, огненные цитаты ниже.
Интересно, что должно произойти, чтобы ключевое лицо российской ИТ или даже ИБ компании заявило
"Почему ядерная война так и не разразилась? Потому что у каждого есть что-то, что сдерживает друг друга. То же самое относится и к кибербезопасности: если у вас это есть, то и у меня должно быть, иначе меня просто пассивно похоронят."

https://teletype.in/@sergey_gordey/j3Od_iVKiyD

Это не может контролироваться исключительно американцами.
特别是中国大量的软件系统建立了开源软件之上,漏洞一定不会少。过去没发现不代表不存在,一旦别人对方有能力发现这些漏洞并且加以应用,我们就会陷入被动。有漏洞不可怕,必须要自己能看见,先发现先验证,先修补,做到手里有牌,心里才有数。
Учитывая, что в Китае большое количество программных систем построено на основе открытого исходного кода, уязвимостей, безусловно, много. Тот факт, что они не были обнаружены в прошлом, не означает, что их не существует. Как только другие смогут обнаружить эти уязвимости и использовать их, мы окажемся в обороне. Наличие уязвимостей не страшно; крайне важно уметь видеть их самим, обнаруживать, проверять и устранять их первыми. Только хорошо понимая ситуацию, мы можем быть уверены в себе и подготовлены.
中国版的第二个价值,需要形成对等的战略威慑能力。
Вторая ценность китайской версии заключается в необходимости формирования эквивалентного стратегического сдерживающего потенциала.
核战争为什么没有真正打起来过?因为大家都有可以相互威慑,网络安全也一样,你有我也得有,不然就会被动埋葬。
Почему ядерная война так и не разразилась? Потому что у каждого есть что-то, что сдерживает друг друга. То же самое относится и к кибербезопасности: если у вас это есть, то и у меня должно быть, иначе меня просто пассивно похоронят.
Осталось только Лаборатории Касперского свой Mythos зарелизить или хотя-бы соточку-полторы БДУ ФСТЭК, как например СайберОК. Слабо?
Сергей Гордейчик рапортует с китайской ИИ-конференции и задается вопросом:

Интересно, что должно произойти, чтобы ключевое лицо российской ИТ или даже ИБ компании заявило
"Почему ядерная война так и не разразилась? Потому что у каждого есть что-то, что сдерживает друг друга. То же самое относится и к кибербезопасности: если у вас это есть, то и у меня должно быть, иначе меня просто пассивно похоронят.


А просто Вы, Сергей, не посмотрели подкаст, где я просто прямым текстом так это и сказал:

Как бороться? А мне кажется, тут вполне может работать метод, который называется ядерное сдерживание.
Нет, нет, я говорю о том, что как бы на киберспособности, атакующие киберспособности одной страны, можно показывать обладание и наличие аналогичных киберспособностей.

С другой стороны, есть прекрасный пример, Израиль, в этом смысле. Израиль если мы возьмём вот игроков на поляне кибербезопасности, ну, это просто там топ- один, скажем прямо. Потому что гигантское количество специалистов, гигантское количество компаний, которые там, не знаю, стартапы во что-то вырастают, их поглощают американские компании, но это изначально израильские компании, там более половины американского кибербеза — это на самом деле израильский кибербез.

И если мы говорим про атакующие возможности, вот те же самые взломы камер в Тегеране, через которые там мониторили передвижение всех чиновников и так далее, это делали израильские спецслужбы, делали это годами, они способны взломать, проникнуть куда угодно. И тем самым они как бы дают понять, что тронете нас - в ответ последствия для вас могут быть очень плачевные...»


@gostev_future
1
Было в детстве национальное развлечение смотреть трансляции госудумы и прочее законотворчество. Ну типа демократия, гласность, площадная политика.
Там я услышал великую мудрость о том, что пчелы могут беспрепятственно пересекать границы субъектов федерации.
Обсуждалось, как водится, введение пошлин.
Так я разочаровался в демократии и перестал смотреть в телевизор. Пчел это не спасло.
Но сегодня не до пчел.

Чжоу Хунъи: «ИИ превратил поиск уязвимостей из лотереи в фабрику»

Полный транскрипт.

https://teletype.in/@sergey_gordey/LtBMk-ZUZS6
Agentic SAMM: безопасная разработка, когда разработчик больше не только человек.

Расширенная версия моего киноута на ISC.AI 2026 в Пекине. Фреймворк и инструмент открыты — берите, ломайте и присылайте мне, что найдёте.

Русский
Английский
Увидел тут новость у @gostev_future. Обеспокоен.

Товарищи! Вы неверно считали.
Создавать ПиКиЭйч(АйАй) - Public Knocking Hub (for Artificial Intelligence) - нужно в США.
Там и там, и только там, только там.

https://t.iss.one/aiakyn/134
Корпоративное управление, когда разработчик больше не человек. И не разработчик

OWASP Agentic SAMM вырос из простого наблюдения. Тридцать лет безопасной разработки предполагали, что на том конце клавы человек — с дедлайнами, ипотекой и страхом, что прилетит от тимлида. На этом держалось всё: ревью кода, разделение доступов, дисциплинарка. Теперь разработчик кентавр, человекобот, и с ним надо писать не просто софт, а безопасный. Половина гибрида при этом увольнения не боится. Стандарт ровно про это: контроль ломается на границе, которую забыли смоделировать.

Если поднять глаза от консоли, код оказывается частным случаем. Агенты согласуют закупки, считают зарплаты, скринят резюме, торгуют, а теперь держат собственные кошельки.
Без романтики: совет директоров, фидуциарные (ух ты!) обязанности, три линии защиты, аудит — это машинерия контроля над субъектами, чьи интересы расходятся с интересами принципала. Работает она потому, что стоит на человеческом субстрате: репутация, карьера, страх санкции и медлительность человека, дающая время вмешаться.

Агент сносит этот субстрат по всем осям сразу: репутации нет, действие на машинной скорости, окно вмешательства схлопывается, ответственность размазана по цепочке от пользователя до владельца инструмента. Разработка огребла одной из первых просто потому, что туда агентов пустили с максимальными правами пораньше.

Но финансисты прошли маршрут на пятнадцать лет раньше. Алгоритмическая торговля — это «агент без социальных правил» задолго до LLM. Knight Capital в 2012-м потеряла около 440 миллионов долларов за 45 минут из-за кривого деплоя. Ответ индустрии был не «размоем ответственность», а противоположный: три линии защиты, режим личной неделегируемой ответственности руководителей, банковский надзор за модельным риском. Принцип прямой: аутсорсить функцию можно, ответственность нельзя. «Это сделала модель» там не проходит.

Вся машинерия собрана в одном предположении: назначенный человек актора контролирует. АйАй это убирает. Назначение ответственности держится, а контроль расцепляется — человек отвечает за актора, которого уже не может наблюдать, предсказать и остановить вовремя. Плюс управление периодично, а агент включён всегда: модель может пройти аудит, успев раздать дискриминирующие решения за пару лет до того.

DeFi довёл идею до предела: построить систему, где ответственного нет в принципе. «Code is law», цель ряда проектов — стать неуязвимыми для правоприменения. Результат стоит запомнить: право отказывается признавать бесхозность и пришивает ответственность обратно. В деле CFTC против Ooki DAO суд признал DAO лицом, которое можно засудить, а проголосовавших токенами — членами ассоциации, отвечающими лично.
В деле Романа Шторма (Tornado Cash) защита упёрлась ровно в развилку «ответственность без контроля»: он не управлял протоколом, когда им пользовались. Даже железобетон не спасает: неизменяемый контракт не остановит и создатель — но рынок сам заворачивает DAO в юридические оболочки, потому что контрагентам нужен кто-то ответственный.

Дальше две линии сходятся: агенты заходят в DeFi с собственными кошельками — держат активы, подписывают транзакции, носят ончейн-идентичность. Автономный актор поверх неостановимого субстрата, с деньгами и без проверки клиента. Лечат это ровно тем, о чём твердят корпоративные документы: ключи с ограничением по области и времени, лимиты трат, белые списки, логирование, изоляция приватных ключей в железе. Слой авторизации мчится вперёд. Слой ответственности помечен как нерешённый: код — «инструмент использующего лица», значит ответственность все же требует козла отпущения.

Зрелость управления падает по мере движения от «доступа» к «действию». «Может ли агент дотянуться до ресурса» — решено: доступ, минимальные привилегии, трассировка, реестры. «Как человек и агент работают в потоке» — более-менее обстукано в промке и функциональной безопасности: авиация, атомка, АСУ. «Кто отвечает за действие» — доктрину достраивают суды через делегирование: Air Canada ответила за чатбота, в деле Workday прошла теория, что работодатель делегировал ИИ отбор кандидатов. «Чью волю исполняет агент, когда принципалы расходятся» — формально нерешаемо: честно агрегировать предпочтения нескольких принципалов невозможно. Ну может быть теория игр, но опять же - она про человеков.

Характерно, что даже лучшие документы, нося в названии «делегированное управление», по факту описывают идентичность и привилегии. Поле кренится к разграничению доступа не от лени, а потому что материал есть именно там.
Агентское управление начинается там, где модель перестают просить вести себя прилично и начинают доказывать, что небезопасное действие ограничено, наблюдаемо и привязано к ответственному. Слой авторизации это умеет. Ответственность и конфликт принципалов — нет. Они, а не доступ, и есть собственно управление.

Так что пора писать MBA-курс по управлению человеко-агентским предприятием. Очередь, лайки, подписки. Пока недорого — до дня, когда первый назначенный публично ответит за то, чем уже не управлял.
👍4❤‍🔥11💩1🌚1
This media is not supported in your browser
VIEW IN TELEGRAM
В одну кнопку - два Claude Desktop на одном Mac

Обычно я пишу всякое сложное — про кибербез, кризис воспроизводства профессий и прочий АйАй-ужас. Сегодня коротко и кратко: как удобно работать с двумя Клодами на одном macOS. Под разными аккаунтами, одновременно, чтобы личное и рабочее не смешивалось.

Описание
Репа claude-clone

PS. Кому лень многобукв - просто кинуть в клод ссылки и сказать "сделай мне монтаж".