Neural Networks | Нейронные сети

🎬 Восстание машин началось

Робот устроил целый спектакль: крутился, падал, размахивал руками — как будто в него вселился дух артхауса 🤖🎭

Киберпанковская трагикомедия, где ИИ забыл, что такое гравитация 😄

1.16K views11:01

Neural Networks | Нейронные сети

Forwarded from Machinelearning

🚨 Oracle официально согласилась поставить OpenAI 2 МИЛЛИОНА AI-чипов

Что это значит?

OpenAI строит новый дата-центр под *чудовищную* нагрузку:
— 4.5 ГВт вычислений (это больше, чем у некоторых стран)
— стоимость — $30 млрд в год 😳

💸 SoftBank? Больше не при делах:
— «SoftBank не участвует в финансировании»
— переговоры по деньгам сорвались ещё в январе

Oracle теперь главный поставщик чипов для OpenAI.

4,5 гигаватта — этого достаточно, чтобы обеспечить электричеством 3,4 миллиона домов.
OpenAI буквально строит инфраструктуру с потреблением энергии на уровне небольшого города — только ради обучения ИИ.

🔜

Новость

@ai_machinelearning_big_data

#openai #news #ml #ai

Please open Telegram to view this post

VIEW IN TELEGRAM

Please open Telegram to view this post

VIEW IN TELEGRAM

1.22K views12:00

Neural Networks | Нейронные сети

⚡️ Вышла GenCAD — новая open-source нейросеть для инженеров. Проект превращает фотографии деталей в готовые CAD-модели с параметрическими командами. При этом модель генерирует не просто меш, а полноценный скрипт для CAD-редакторов.

Она основана на диффузионных моделях и трансформерах, что позволяет сохранять редактируемую параметрику. Подходит для быстрого прототипирования и реверс-инжиниринга.

🔗 Ссылка - *клик*

@neural

1.41K viewsedited 08:54

Neural Networks | Нейронные сети

1:00

This media is not supported in your browser

VIEW IN TELEGRAM

Скриншоты с Google Earth теперь можно превратить в профессиональную съемку с дронов. Реддитор натренировал кастомную модель на базе FLUX Kontext.

Ии создает реалистичные кадры из простых 3D-снимков. На улицах появятся авто и пешеходы, а камера будет плавно пролетать по небу.

Эта модель доступна бесплатно здесь. Требования и инструкция по запуску — по ссылке.

1.74K views06:48

Neural Networks | Нейронные сети

Forwarded from Machinelearning

📌

ИИ, который сам создает ИИ: ASI-ARCH нашел 106 новых SOTA-архитектур.

ASI-ARCH - экспериментальная демонстрация искусственного сверхинтеллекта для исследований в области ИИ, который способен полностью автономно вести научную работу по поиску новых нейросетевых архитектур.

Система самостоятельно выдвигает гипотезы, реализует их в виде исполняемого кода, обучает и проверяет на практике. Результатом этой работы стали 1773 автономных эксперимента, которые заняли свыше 20 000 GPU-часов и привели к открытию 106 новых SOTA-архитектур с линейным механизмом внимания.

🟡

Весь процесс разделен на 2 этапа: поиск гипотез и их проверка.

На первом этапе, система работает с небольшими моделями размером около 20 млн параметров, обучая их на 1 млрд токенов. На этом этапе было проведено 1773 эксперимента, которые заняли примерно 10 000 GPU-часов.

Всего на этом этапе было отобрано 1350 перспективных кандидатов — все они превзошли базовую архитектуру DeltaNet как по лоссу, так и по метрикам на бенчмарках.

Второй этап - верификация. Кандидаты первого этапа были масштабированы до 340 млн параметров, чтобы соответствовать конфигурации DeltaNet. После фильтрации архитектур с избыточной сложностью или числом параметров осталось около 400 моделей.

Их обучение на 1 млрд. токенов потребовало ещё 10 000 GPU-часов. В итоге, именно из этой группы были выделены 106 архитектур, достигших SOTA-уровня.

Для финальной валидации исследователи отобрали 5 лучших моделей, обучили их на 15 млрд. токенов и сравнили с Mamba2, Gated DeltaNet и DeltaNet.

🟡

Анализ предпочтений системы показал интересные закономерности.

ASI-ARCH явно предпочитает работать с проверенными временем компонентами: гейтингом и свёрткой. Но самое главное - распределение компонентов в 106 лучших моделях имеет значительно менее выраженный long-tail distribution по сравнению с остальными 1667 сгенерированными архитектурами.

Это означает, что система добивается успеха не путем хаотичного перебора экзотических идей, а через итеративное улучшение набора проверенных техник. По сути, это очень напоминает методологию работы ученых-людей.

🟡

Результаты.

Одна из лучших найденных ИИ-архитектур, PathGateFusionNet, показала средний результат по всем бенчмаркам 48.51. Для сравнения, Mamba2 набрала 47.84, а разработанная человеком Gated DeltaNet — 47.32. Другая генерация, ContentSharpRouter, достигла показателя 48.34.

Если посмотреть на отдельные тесты, то PathGateFusionNet получила на BoolQ 60.58 балла, а Gated DeltaNet - 60.12. AdaptiveEntropyRouter в версии на 340 млн. параметров показала результат на тестах 44.31, что на 2.21 пункта выше, чем у Gated DeltaNet (42.10).

И так практически во всем, улучшения наблюдаются по всему спектру задач.

🟡

И самое интересное — откуда система черпает идеи? Источников всего 3:

🟢Cognition - знания, извлеченные из научной литературы;
🟢Analysis - выводы, сделанные на основе собственных прошлых экспериментов;
🟢Originality - абсолютно новые идеи.

Для всех 1773 сгенерированных архитектур распределение источников было таким:

🟠51.7% идей приходило из человеческой литературы;
🟠38.2% - из собственного анализа;
🟠10.1% были оригинальными.

Но если посмотреть только на 106 SOTA-итогов, картина меняется. Доля идей, основанных на Analysis, возрастает с 38.2% до 44.8%, а доля Cognition немного снижается до 48.6%.

Таким образом, чтобы достичь ощутимых результатов, ИИ недостаточно просто копировать и комбинировать человеческие наработки. Он должен анализировать собственный опыт, учиться на своих же удачах и провалах, синтезируя более совершенные решения.

🟡

Страница проекта

🟡

Arxiv

🖥

GitHub

@ai_machinelearning_big_data

#AI #ML #Research #ASIARCH

Please open Telegram to view this post

VIEW IN TELEGRAM

Please open Telegram to view this post

VIEW IN TELEGRAM

1.62K views13:04

Neural Networks | Нейронные сети

Жиза

1.47K views10:43

Neural Networks | Нейронные сети

🚀 MixGRPO от Tencent — теперь в открытом доступе! Новый подход к обучению моделей по человеческим предпочтениям

🔧 Что нового и крутого:

1⃣ Первый фреймворк с гибридным семплированием ODE+SDE — меньше шагов, меньше вычислений
2⃣ До 71% быстрее обучения (вариант MixGRPO‑Flash), при этом точнее и эффективнее, чем DanceGRPO
3⃣ Поддержка ускоренных ODE-решателей — ещё выше скорость без потери качества
4⃣ Работает как с диффузионными, так и с flow-based моделями — требует всего несколько итераций

🔗 Проект: https://tulvgengenr.github.io/MixGRPO-Project-Page/
📦 Код и модели: https://github.com/Tencent-Hunyuan/MixGRPO
📄 Статья: https://arxiv.org/abs/2507.21802

@neural

1.75K views08:33

Neural Networks | Нейронные сети

Forwarded from Анализ данных (Data analysis)

🚨 ANTHROPIC ОТКЛЮЧИЛА OPENAI ОТ ДОСТУПА К CLAUDE

> Anthropic отозвала доступ OpenAI к API своих моделей Claude
> Заявление: “Технические сотрудники OpenAI использовали наши инструменты для программирования перед запуском GPT-5”
> “К сожалению, это прямое нарушение условий использования”

🔥 Кажется, война ИИ-компаний вышла на новый уровень.

@data_analysis_ml

#GPT5 #openai #ANTHROPIC

Please open Telegram to view this post

VIEW IN TELEGRAM

Please open Telegram to view this post

VIEW IN TELEGRAM

1.73K views07:55

Neural Networks | Нейронные сети

Похоже, что GPT‑5 выйдет четверг

1.52K views12:06

Neural Networks | Нейронные сети

Просто парад релизов)

1.41K views08:47

Neural Networks | Нейронные сети

This media is not supported in your browser

VIEW IN TELEGRAM

⚠️ Мы в матрице - официально

Идеальная рекурсия достигнута с Google Genie 3.

🎬 ИИ, который создаёт миры… где сам себя воссоздаёт.

👉 Посмотри это видео до конца — ты офигеешь.

1.37K views20:46

Neural Networks | Нейронные сети

🎓 Студенты из Harvard и MIT массово бросают учёбу — и уходят в AI‑safety.

Причина? Страх перед будущим с суперразумным ИИ. Многие верят, что технология может вызвать массовую безработицу (до 20%) и уже сейчас ищут способы повлиять на вектор её развития.

> “Если твою карьеру автоматизируют к концу десятилетия, каждый год в колледже — это минус один год из короткой карьеры”,
— говорит Никола Юркович, выпускник Гарварда и лидер инициативы по подготовке к AGI.

Многие создают стартапы или идут работать в компании, занимающиеся безопасностью ИИ — пока ещё не стало поздно.

Источник

1.6K views14:08

About

Blog

Apps

Platform