Artificial Intelligence
16.8K subscribers
1.13K photos
11 videos
1 file
1.99K links
Artificial Intelligence

admin - @haarrp

@itchannels_telegram - 🔥 best it channels

@ai_machinelearning_big_data - Machine learning channel

@pythonl - Our Python channel

@pythonlbooks- python книги📚

@datascienceiot - ml 📚

РКН: clck.ru/3FmwZw
Download Telegram
Forwarded from Machinelearning
🙂 In the Weights: проверка тщеславия

В сети вирусится веб-приложение In the Weights, которое проверяет наличие информации о человеке или компании в GPT, Claude, Gemini и Llama и т.д.

Платформа работает через прямые запросы к моделям с принудительно отключенным доступом к сети, чтобы ИИ опирался исключительно на знания, полученные на трейне.

Анализируя выдачу, система высчитывает скоринг. Метрика оценивает вероятность того, что информация об объекте содержалась в обучающих датасетах и содержится в конкретной модели.

Помимо развлекательных целей, проект является наглядным аудитом того, как корпорации агрессивно скрейпят данные.

По мере того как чат-боты вытесняют поисковики, присутствие в памяти моделей становится новой метрикой публичной значимости.

Сервис напоминает о новых реалиях современной приватности: если информация о вас уже есть в весах LLM, стереть ее цифровой след практически невозможно.


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍21
✔️ Dockerless

Environment-free verifier для coding-агентов.

Он проверяет патчи без запуска кода и без Docker, при этом обгоняет сильнейший open-source verifier на 14.3 AUC points.

А RL post-training полностью без окружения достигает 62.0% на SWE-bench Verified.

https://paperswithcode.co/paper/2606.28436
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍1
Most upvoted papers on huggingface this week (July 6-12):

- The Mirage of Optimizing Training Policies: Monotonic Inference Policies as the Real Objective for LLM Reinforcement Learning
- Vidu S1: A Real-Time Interactive Video Generation Model
- RynnWorld-4D: 4D Embodied World Models for Robotic Manipulation
- AlayaWorld: Long-Horizon and Playable Video World Generation
- Accurate, Interdisciplinary and Transparent Structure-property Understanding with Deep Native Structural Reasoning
- RynnWorld-Teleop: An Action-Conditioned World Model for Digital Teleoperation
- OmniOpt: Taxonomy, Geometry, and Benchmarking of Modern Optimizers
- UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning
- Hierarchical Sparse Attention Done Right: Toward Infinite Context Modeling
- PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space
https://huggingface.co/papers/week/2026-W28
1👍1
Один из мифов вокруг ИИ-кодинга: если подобрать нужный промпт — модель сама напишет качественный код

На деле это проверяется за минуту. Два разработчика с одной и той же просьбой «собери сервис для регистрации пользователей» получат разные результаты. У одного выйдет чистый Litestar с типизацией и тестами. У второго — заготовка, которая ляжет при первой же доработке.

Дело не в тексте запроса.

Модель не видит ваш проект. Она не знает, какие соглашения приняты, какие библиотеки уже подключены, какой уровень покрытия тестами считается нормальным. Пока этой информации у нее нет — она отвечает по своему усредненному представлению, а не по вашему.

Поэтому вокруг модели нужно достроить то же самое, что и у обычного разработчика: набор правил, шаблоны, инструменты проверки, критерии приемки.

Именно это и делает Алексей Жиряков на воркшопе karpovꓸcourses «AI-first разработка на Python». За 4 часа собирает готовую агентную среду поверх живого проекта на Litestar и PostgreSQL — от настройки правил до автоматического ревью и подсчета вклада ИИ в цифрах.

Алексей покажет, как настроить правила проекта под задачу агента, как через OpenRouter поднять связку моделей «дешевая пишет — дорогая проверяет», которая помогает снижать стоимость генерации, как научить агента проверять код по чек-листу вашей архитектуры и как измерить вклад ИИ по коммитам.

С воркшопа забираете шаблон AI-first проекта, готовый к продакшену, набор правил и чек-листов, настроенную схему выбора модели под задачу и запись эфира в LMS. Тем, кто пишет на FastAPI, тоже подходит — это отдельно прописано в разделе с вопросами.

Соберите агентную среду, которая пишет код по правилам вашего проекта: https://clc.to/erid_2W5zFHgXtWd
С промокодом aikarpov20 — скидка 20%

Реклама. ООО «КАРПОВ КУРСЫ». ИНН 7811764627. erid: 2W5zFHgXtWd
👎21
Forwarded from Никита Иванов
Один из мифов вокруг ИИ-кодинга: если подобрать нужный промпт — модель сама напишет качественный код

На деле это проверяется за минуту. Два разработчика с одной и той же просьбой «собери сервис для регистрации пользователей» получат разные результаты. У одного выйдет чистый Litestar с типизацией и тестами. У второго — заготовка, которая ляжет при первой же доработке.

Дело не в тексте запроса.

Модель не видит ваш проект. Она не знает, какие соглашения приняты, какие библиотеки уже подключены, какой уровень покрытия тестами считается нормальным. Пока этой информации у нее нет — она отвечает по своему усредненному представлению, а не по вашему.

Поэтому вокруг модели нужно достроить то же самое, что и у обычного разработчика: набор правил, шаблоны, инструменты проверки, критерии приемки.

Именно это и делает Алексей Жиряков на воркшопе karpovꓸcourses «AI-first разработка на Python». За 4 часа собирает готовую агентную среду поверх живого проекта на Litestar и PostgreSQL — от настройки правил до автоматического ревью и подсчета вклада ИИ в цифрах.

Алексей покажет, как настроить правила проекта под задачу агента, как через OpenRouter поднять связку моделей «дешевая пишет — дорогая проверяет», которая помогает снижать стоимость генерации, как научить агента проверять код по чек-листу вашей архитектуры и как измерить вклад ИИ по коммитам.

С воркшопа забираете шаблон AI-first проекта, готовый к продакшену, набор правил и чек-листов, настроенную схему выбора модели под задачу и запись эфира в LMS. Тем, кто пишет на FastAPI, тоже подходит — это отдельно прописано в разделе с вопросами.

Соберите агентную среду, которая пишет код по правилам вашего проекта: https://clc.to/erid_2W5zFHgXtWd
С промокодом aikarpov20 — скидка 20%

Реклама. ООО «КАРПОВ КУРСЫ». ИНН 7811764627. erid: 2W5zFHgXtWd
Google Research попыталась объяснить, откуда у diffusion-моделей берётся «креативность».

Почему генератор изображений не просто копирует обучающие примеры, а создаёт новые сцены, которых не было в датасете?

Ответ оказался математическим.

Во время обучения нейросеть не запоминает идеальную функцию удаления шума. Из-за регуляризации и особенностей градиентного обучения она усваивает её более сглаженную версию. Google называет этот эффект score smoothing.

Если бы функция была идеальной, каждый случайный шум в конце превращался бы в точную копию одного из обучающих примеров.

Но сглаживание создаёт между примерами «зоны интерполяции». Модель может остановиться не на известной точке, а между несколькими знакомыми образами и получить новый, но правдоподобный результат.

В многомерном пространстве это помогает модели восстановить скрытый data manifold - область, где находятся осмысленные изображения. Движение к этой области сохраняется быстрым, а схлопывание к конкретным обучающим картинкам ослабевает. Так появляется баланс между качеством и новизной.

То есть «творчество» diffusion-модели может быть не загадочным свойством и не случайностью.

Это побочный эффект того, что нейросеть учится не идеально и строит мосты между известными примерами.

Работа представлена на ICLR 2026, код экспериментов опубликован открыто.

https://research.google/blog/towards-demystifying-the-creativity-of-diffusion-models/
👍5👎21
Andrej Karpathy just dropped 12-page PDF on "Graph Engineering" for multi-agentic systems

the shift: Karpathy's loop runs 700 experiments and forgets all of them. A graph remembers forever

here's the full system:

step 1 → build one loop: generate, critique, revise. 630 lines, 700 experiments in 48 hours

step 2 → go parallel: agents in separate worktrees, same repo, different branches, no conflicts

step 3 → add a knowledge graph: extract entities, resolve aliases, assemble typed edges, query through subgraphs

step 4 → ground your evaluator: it checks claims against graph edges, not vibes

step 5 → plug the graph as shared memory. workers write to it. evaluators fact-check against it. Loops persist overnight

step 6 → the agent forgets. the graph does not. stop rebuilding context from scratch every session

Karpathy ran 1 agent in 1 direction. Anthropic's graph runs 1,000 with shared memory - same model, it's the architecture

https://drive.google.com/file/d/1-GOg0kxcp8tx1BMUECMj2yJq6JYGmfhb/view
8👍4
Forwarded from Rust
✔️ Firecrawl открыла один из самых быстрых PDF-парсеров

Компания выложила в open source pdf-inspector - библиотеку на Rust, которая превращает PDF в Markdown, сохраняя структуру документа, заголовки и таблицы.

По заявленным тестам, обработка одной страницы занимает около 0,002 секунды, а набор из 200 PDF был пройден примерно за 2,8 секунды.

Главное здесь не одна скорость: парсер старается сохранить исходную логику документа, поэтому результат удобнее сразу отдавать в RAG, поиск, анализ или пайплайн подготовки данных.

Проект полностью открыт.

https://github.com/firecrawl/pdf-inspector

@rust_code
Please open Telegram to view this post
VIEW IN TELEGRAM
6👍3🔥2
История кликов, просмотров и действий пользователя сама по себе мало что даёт. Гораздо интереснее — собрать всё это в единое представление его интересов.

Именно такой подход разобрали в VK: трансформерная модель строит нейропрофиль пользователя на сигналах из разных сервисов.

В статье — токенизация событий, временные и контентные признаки, attention, двухбашенная архитектура и обучение на больших каталогах.
1
🚨 Цукерберг опубликовал большой текст о будущем ИИ - и его позиция довольно жёсткая: сверхинтеллект не должен принадлежать нескольким закрытым лабораториям.

Главные тезисы:

- задержка релиза американских моделей даже на месяц может ослабить лидерство США;
- самоулучшающийся ИИ теоретически способен в разы повысить эффективность вычислений;
- «единого доброжелательного сверхинтеллекта» не существует;
- опаснее всего сценарий, где несколько лабораторий создают самые мощные модели и оставляют их только себе;
- frontier-лаборатории, по его мнению, должны заранее передавать государству промежуточные чекпоинты для проверки.

Мощный ИИ должен распространяться шире, а контроль - строиться не через тотальное закрытие моделей, а через прозрачность и проверку.


#AI #LLM #OpenSource #Superintelligence
👍2🔥2
Forwarded from AI VK Hub
📢 Исследователи AI VK Research научили двухбашенный трансформер над историей оптимизировать удовлетворённость пользователя за всю сессию. Работа принята на воркшоп конференции KDD 2026, которая проходит сейчас в Южной Корее.

Большинство современных рекомендательных моделей решает локальную задачу — предсказать следующее взаимодействие или следующий положительный фидбэк. Мы сформулировали задачу как RL на уровне сессии и обучили кандидатогенератор через off-policy REINFORCE на логах.

На индустриальных данных такая модель выигрывает у next-item и next-positive prediction по всем оценкам награды за сессию, сохраняя качество кандидатогенерации по recall-метрикам.

➡️ Подробнее в статье на Хабре.

#aivkhub #ml #recsys
Please open Telegram to view this post
VIEW IN TELEGRAM
2👍1