Метаверсище и ИИще
51.4K subscribers
6.52K photos
5.32K videos
48 files
7.62K links
Это не новости, это персональный экспертный взгляд на то, как развивается индустрия ИИ, графики, метаверса, крипты, нейротехнологий и в каком направлении катится все это безобразие.
Для связи: @SergTsyp
Download Telegram
Нейрорендер добрался до взрослых мальчиков.

Chaos (разработчики V-Ray) сделали свой нейрорендер на максималках под названием Veras.

Под капотом Nanobanana 2 и Nanobanana Pro.

Как основной функционал, она умеет брать скриншот камеры (или фреймбуфер) и генерить Бананой красивые варианты дизайна - позиционируется все это прежде всего на архитектурную визуализацию.

Но кроме того, она умеет поворачивать скетчи и картинки (примерно как в новом Фотошопе).

А также умеет генерить короткие видосы - длинные облеты камеров вокруг сцены (я не нашел какой видеомоделью, наверное Veo). Есть Image-2-Video, есть референсы(в том числе материалов), есть First & last frame video и даже забавные попытки монтажа таких клипов.

Есть рульки "креативности" - насколько придерживаться исходной геометрии.

Про текстуры и наследование материалов ничего не нашел.

Есть отдельный web-app и есть standalone app, но основной упор на то, что она работает нативно внутри Enscape, V-Ray, and Corona, а как плагин с Revit, SketchUp, Rhino, Vectorworks, Archicad, Forma, and Allplan

Используется система кредитов от Chaos, часть включена в подписку, но можно докупать новые.

https://blog.chaos.com/veras-for-vray
https://blog.chaos.com/what-is-veras

Все это выглядит как нативное встраивание Нанабананы в продукты Chaos.
Ждем ответа от Автодеска, а то там этим занимаются энтузиасты аниматоры.

@cgevent
👍207🔥4😱2👎1
This media is not supported in your browser
VIEW IN TELEGRAM
Нейрорендер 4

Говоря про энтузиастов-аниматоров, прекрасный Матарави продолжает развивать свой нейрорендер.

Как вы помните, он берет простой превиз-плейбласт в Maya и делает из него нейрорендер, ускоряя процесс в разы.

Теперь же он рендерит (нормальным рендером) ОДИН кадр и подает его как референс в свой нейрорендер.
Из этого кадра подхватываются текстуры, материалы кожи и волос, окружение и свет - и нейрорендер имитирует взрослый рендер (только в разы быстрее) сохраняя анимацию.

У меня только один вопрос, кто поднимет веки автодеску - идея настолько хороша, пока уже проснуться не только Chaos Group.

@cgevent
🔥424👍2
Higgsfield plugins for Adobe Premiere Pro and After Effects

Интересный ход. Хиггсы в своих тулах избегают таймлайна, чтобы не перегружать новаго нормального юзера сложностями монтажа.

Однако, они только что бахнули два плагина для Премьера и Афтера.

Можно генерить прямо внутри, делать генеративные транзишены, вроде как рефреймить без кропа, удалять фон, рисовать(?!) на футаже как реф для генерации, и вроде даже апскейлить до 4К.

Как и в случае с Chaos и V-Ray из сегодняшнего утреннего поста - это выглядит как очень логичный шаг (некий нейрорендер\нейрокомпоз) прямо в профессиональном софте.

Понятно, что Gemini Omni как бы умеет все это из коробки, но.

Не надо генерить в где-то, скачивать куда-то, импортировать в премьер, тащить, обрезать, вставлять.

И у меня, опять один вопрос: Адобченко, але! Почему это делает кто-то посторонний?

Причем мы уже видели намеки на это от самого Адобченко год назад, в демках с chatGPT. Да, там есть потуги в виде морфкат+Firefly, но так чтобы бахнуть простые и удобные плагины Адобу как будто яиц не хватает.

Они вроде уже отказались от эксклюзивности на Файерфлай. Уже генерят разными моделями на своих Mood Boards.

Что мешает?

Я не знаю, как это будет работать у Хиггсов, особенно по части фреймрейтов, аспектов, неквадратных пикселей и прочей неприятной требухи, но ход очень правильный.

Я также еще не попробовал UX - тут важно попадать в заученные годами движения\патерны мышкой инвалидов Афтера и ветеранов Премьера. Инпайнт, маски, слои - все должно быть нативно.

Ну и механика выбора моделей для генерации тоже должна себя обозначить.

Но ход отличный, как по мне. Пусть даже это не работает как заявлено. Рано или поздно заработает, не у Хигсов. так у кого-то еще.

https://higgsfield.ai/adobe-plugin

@cgevent
🔥439👍5😁1
Media is too big
VIEW IN TELEGRAM
#Нейропрожарка

SHADOW RACE × Sevendust "Broken Down"
Racing Concept Music Video

Автор: Павел Жигарев @noizlab

🎬 YOUTUBE 4K
Лучшие гонщики планеты собираются чтобы
посоревноваться — кто лучший. Главный приз: 1 000 000 000$.

Главный герой принимает приглашение чтобы закрыть долги
и узнать кто виноват в аварии, в которой погиб его брат.
Но когда он принимает участие — оказывается что это не
простые гонки, а сверхсимуляция, в которой можно умереть
по-настоящему.

Так бы я хотел, чтобы это было написано на обороте DVD,
купленного на Митинском радиорынке в 2003 году.

NFS Underground, Форсаж и Nu-Metal саундтреки —
что ещё нам тогда было надо?

А если серьёзно — то я просто не видел тут роликов с гонками
и хотел для себя и для нейронки устроить тест.
Ну и вам.

———

ИНСТРУМЕНТЫ:

• Nano Banana Pro — персонажи, рефы
• Seedance 2.0 — видео
• Topaz Starlight 2.5 — апскейл

Плюс много разных трюков с изображениями и промптами.

МЫСЛИ:

Мне кажется, мы уже достигли технического потолка
в ИИ-генерациях. И теперь вопрос уже не в инструментах —
а в вере в свои силы и чувстве вкуса.

P.S. - В комментах кидайте треки из "того" времени,
P.S.S - Киноляпы присутствует — иначе было бы скучно
P.S.S.S - Сцена после титров присутствует! 🤫

Жарьте 🔥

@cgevent
👎63👍17😁6🔥5
Forwarded from AI Product | Igor Akimov
Новый Opus 4.8! Переключаемся!

Сильно прям революции нет, но несколько обидных вещей пофиксили:

- В 4 раза реже пропускает баги в собственном коде «не заметив». Раньше любили бодро рапортовать об успехе на тонких доказательствах
- Алайнмент. Команда Anthropic пишет, что 4.8 «достигает новых максимумов» по просоциальным чертам (поддержка автономии пользователя, действие в его интересах).
- Бенчмарки. 84% на Online-Mind2Web (computer-use / браузерные агенты) – ощутимый скачок над 4.7 и GPT-5.5. На Legal Agent Benchmark – первая модель, перешагнувшая 10% по строгому all-pass стандарту. Ну и остальное чуть поднялось.

Еще по мелочи отгрузили фич
- Effort control в claude.ai и Cowork. Рядом с выбором модели теперь ползунок «усилия»: на высоких – думает чаще и глубже, на низких – отвечает быстрее и экономит лимиты. По дефолту – high. Есть extra (xhigh в Claude Code) и max для тяжёлых задач.

- Dynamic workflows в Claude Code (research preview). Claude планирует работу, запускает сотни параллельных сабагентов в одной сессии, верифицирует результат и только потом отчитывается. Заявленный кейс – миграции масштаба кодовой базы на сотни тысяч строк, от kickoff до merge, с тестовым набором в роли планки. Доступно на Enterprise / Team / Max.

- Fast mode. 2.5× скорость, и теперь в 3 раза дешевле, чем у прошлых моделей.

- Messages API. Теперь принимает system-записи внутри массива messages – можно обновлять инструкции агенту по ходу задачи, не ломая prompt cache.

Цены те же, fast в 2 раза дороже.

https://www.anthropic.com/news/claude-opus-4-8
👍2415
CTO-ESTIMATE

Подписчик Алексей сделал полезный и бесплатный инструмент для тех, кто работает с локальными LLM или следит за развитием open-weight моделей:
https://cto-estimate.openweights.space/

Сервис собирает в одном месте данные, которые обычно приходится смотреть отдельно: бенчмарки в Artificial Analysis и конфиги моделей в Hugging Face.

Что внутри:
• каталог open-weight моделей
• фильтры по размеру, модальности, context length, reasoning и лицензии
• рейтинги на основе бенчмарков
• сравнение моделей бок о бок
• детали по архитектуре и параметрам
• ежедневные обновления списка моделей

Также есть практический раздел для тех, кто рассматривает локальный запуск моделей: первичная оценка требований к GPU и экономики собственного сервера.

@cgevent
🔥43👍158
NETFLIX INKUBATOR

Как-то пропустил эту новость в мае.

Netflix набирает персонал для анимационной студии INKubator: основное внимание будет уделено использованию ИИ для создания короткометражных анимационных роликов, а в будущем планируется масштабирование проекта до полнометражных фильмов.

https://www.animationmagazine.net/ru/2026/05/netflix-staffing-for-inkubator-ai-powered-experimental-animation-studio/

Ранее Netflix объявила о приобретении InterPositive, стартапа по производству фильмов с использованием искусственного интеллекта, основанного Беном Аффлеком, в рамках сделки, стоимость которой, как сообщается, достигает 600 миллионов долларов. Среди людей, связанных с INKubator в LinkedIn, — Серрена Айер, бывший руководитель отдела стратегии и операционной деятельности в таких студиях, как DreamWorks Animation, A24 и MRC

Интересно, что в объявлениях о найме CG Experimental Artists от Нетфликс, наряду с требованиями о владении традиционными коммерческими софтами (Photoshop, Maya, Houdini, Harmony, Blender), есть запрос на владение ComfyUI: to generate concept frames, style frames, character explorations, and environment designs based on scripts, outlines, or verbal direction.

Также есть пункт: Build and fine-tune generative image and video models.

Ну то есть сколько бы мы тут не ныли о засилии ИИ-слопа, кринжовой анимации, некачественного контента - взрослые мальчики уже фигачат. И будут фигачить.

ИИ вползает в пайплайны, как еще один инструмент. И скоро вопрос "это ИИ-слоп или это просто контент" потеряет свою актуальность.

@cgevent
🔥26👎9👍64😱1
У Нанабананы апгрейд.

Во-первых, почитайте тут, про доступность по API: Nano Banana 2 (Gemini 3.1 Flash Image) and Nano Banana Pro (Gemini 3 Pro Image) are generally available (GA) today via Gemini Enterprise Agent Platform.
https://cloud.google.com/blog/products/ai-machine-learning/nano-banana-2-and-nano-banana-pro-are-generally-available

А во-вторых, она теперь принимает на вход видео и понимает, что происходит на этом видео. И может генерить картинки, на основе этого понимания. Генерация презентаций, иллюстраций, обучающих слайдов и тому подобное.

Но народ в твитторах самозабвенно генерит комиксы на основе подгруженного видео. Выше пример видео из Сиданского, которое Нанабанана превращает в аниме-комикс. Сделано в Gemini App.
https://x.com/BrentLynch/status/2060053849621274829

Начинать можно с простого промпта: " create a comic strip from this video"
или, как в примере выше: "Create a faithful 100% accurate anime direct adaptation image from 6 specific exact shots from this video include the exact matching dialogue"

К многочисленным терминам добавился теперь video-2-image...

@cgevent
1🔥50👍97👎2
FLUX Virtual Try-On

Black Forrest lab вместо того, чтобы бахнуть FLUX.3 продолжают выпускать стартаперские продукты.

На сей раз - это виртуальная примерочная.
Доступно только по API, например на FAL:
https://fal.ai/models/fal-ai/flux-pro/v1/vto
Стоит $0.0375 за 1024х1024.
Сделано на основе Flux.2 Pro.

Есть демо, там можно загружать свою одежду:

https://flux-tools.bfl.ai/virtual-try-on

Мне кажется, Форресты отчаянно тормозят. У Гугла такая примерочная есть с полгода как:
https://www.google.com/shopping/tryon
Ну и Банана в этом качестве уделывает Флюкс.

Вопрос, конечно, в удобстве пользования.

Но интересно наблюдать, как год назад мы вовсю обсуждали виртуальные примерочные на основе опенсорсных моделей, но потом приходят взрослые мальчики и начинают убивать стартапы пачками.

@cgevent
16🔥5👎2👍1
This media is not supported in your browser
VIEW IN TELEGRAM
Epic затизерила UE6

Aнонс был сделан во время Rocket League Championship Series Paris Major 2026 - в трейлере к Rocket League можно углядеть цифру 6.

Посмотреть в качестве можно тут:
https://youtu.be/p5d7y1cbWIk

Мне понравился комментарий из твиттора: все это конечно хорошо, но даже в 5.7 мы не видим качества из демо к UE5, которое случилось шесть лет назад.

По словам Тима Суини Unreal Engine 6 призван объединить традиционную разработку на Unreal Engine с инструментами, ориентированными на создателей контента, которые лежат в основе Unreal Editor for Fortnite (UEFN).

Про ИИ ничего не сказано. Сроки - 2028.

И вот это неплохо:

> be Epic Games
> build Unreal Engine 6
> skip all major gaming conferences
> announce it at a Paris Esports tournament
> target 2028 release date
> kill C++ for Verse language
> fix UE5 single core bottlenecks
> port Rocket League straight to UE6
> skip an entire engine generation
> refuse to elaborate

@cgevent
😁17👍103
This media is not supported in your browser
VIEW IN TELEGRAM
Годный метаверс.

Забыл написать про очень интересную штуку, которую показали на Google I\O.

Они соединили данные StreetView из Google Maps (накопленные за 20 лет, на минутчку) и Project Genie.

И теперь в этом генераторе миров можно указать точку на карте и промптом описать, во что превратить реальный мир. В примере выше - это подводный мир вокруг затопленного моста в Сан-Фрациско.

Грубо говоря, можно сделать любой "скин" для любой реальной локации. Причем не 2Д, а 3Д.

Вместо локейшен скаутов, теперь будут локейшен промптеры.

Такой метаверс нам нужен.

Работает пока, только для координат в US.

@cgevent
🔥61😱147👎5
This media is not supported in your browser
VIEW IN TELEGRAM
#Нейропрожарка

Погоня

Цель: ролик на конкурс «Ну, ИИ погоди!» от Союзмультфильма
Результат: попали в шорт-лист конкурса
Автор идеи и озвучка: Андрей Пинаев
ИИ-креатор (раскадровка, анимация, монтаж): Екатерина Пинаева

Идея и сценарий
Идея «Погони» появилась очень быстро и спонтанно. До этого мы много думали о конкурсе, перебирали разные варианты и уже успели сдать одну работу на этот конкурс. Музыка в этой работе стала важной частью, именно она задала сценарную и драматургическую основу. Поэтому мы сначала нашли музыку под идею, а уже от неё начали выстраивать сцены, темп, монтаж и общую динамику ролика.

Отдельно про озвучку
Озвучка в ролике живая, реальная. Голос записал Андрей Пинаев, стараясь передать манеру Анатолия Папанова из оригинальной серии «Ну, погоди!» с зайцем-роботом. Фраза «Мама» тоже отсылает к этой серии — для тех, кто не узнал.
Отдельные звуковые эффекты мы сознательно не добавляли. Нам показалось, что динамичная музыка уже достаточно держит ритм и напряжение, а дополнительные SFX могли перегрузить ролик. Напишите, если не согласны 👇

Трудности и косяки
Главная сложность возникла с образом волка. В какой-то момент Nano Banana Pro начал уводить персонажа в более «пиксаровскую» или «диснеевскую» сторону. Этот момент мы не сразу отследили, поэтому в некоторых кадрах волк отличается от того образа, который планировался изначально. Для анимации мы выбрали безлимитную версию Kling 2.5 во Freepik из соображений экономии. Тоже помучились.

Затраченное время
Совокупно работа была сделана за 5 дней. При этом важно учитывать, что ролик создавался параллельно с коммерческими проектами, поэтому работа шла в очень плотном режиме.

Инструменты и затраты
Nano Banana Pro — раскадровка и основные изображения, Flow, годовая студенческая подписка.
Kling 2.5 во Freepik / Magnific — основная анимация. Использовали безлимитный режим, подписка — 36 евро.
Seedance 2.0 — один отдельный кадр, где волк проскальзывает по асфальту. Подписка в SJinn — 50 долларов, но она бралась для других задач; конкретно для этого ролика было сделано около 5 итераций.
Suno — музыка. Использовалась подписка через Syntx, точный тариф уже не помним.
Topaz — апскейл. Стационарная версия.
CapCut — монтаж.

@cgevent
👎123👍249🔥8🙏2
Forwarded from Сиолошная
Finally, PC 2 — Nvidia и Microsoft «переизобрели» персональные компьютеры для эпохи AI (я не шучу, в анонсе так и пишут, и даже «новая глава»).

За анонсом стоит новая платформа для PC и ноутбуков на основе RTX Spark Superchip, состоящего из GPU, CPU и объединённой памяти. По сути это то же самое, что M-чипы в ноутбуках Apple в последних лет, и они тоже на архитектуре Arm, и за счёт этого очень энергоэффективны.

В ноутбуки, а позже и в персональные компьютеры будут ставить 128 ГигаБайт памяти, чтобы можно было запускать LLM на 120 миллиардов параметров (в FP4 — чипы как раз это поддерживают). Собственно, это и есть «новизна» персональных компьютеров — теперь у каждого будет персональный локальный ассистент наподобие OpenClaw или Hermes, получающий доступ к окнам приложений Windows. Обещают более плотную интеграцию и в частности продвинутые настройки безопасности для доступа к данным.

Глобально концепция понятная, но думаю, что первые годы будет немного буксовать (из-за тяжести интеграций + нужды сделать 1-2 итераций над чипом + адаптировать разработчиков), но потом, особенно как модели поумнеют и ассистенты станут продвинутыми — полетит, и виртуальный Джарвис станет нуждой каждого.

Интересно, как в эту картину вплетутся OpenAI и Anthropic с проприетарными моделями? В теории могу даже представить, что они могут предоставлять закрытые локальные модели, за которые придётся платить — а в остальном для вас это просто выбрать другой пунктик в меню и подождать, пока закончится загрузка.
🔥31👍9😁51
SANA-Streaming by NVIDIA

Еще одна новость он Нвидия - аналог Stream Diffusion, но c редактированием, который работает локально в реальном времени.

Качество, конечно, отстой, но это здесь прямо в реальном времени меняется видео с помощью промптов.

Если прокрутить вперед на год, то на чипах из предыдущего поста это может крутиться в хорошем качестве и fullHD, а может даже в 4К.

И вы такие, смотрите Нетфликс, а сами с телефона: "поменяй тома круиза за бреда пита, и бену аффлеку убери 10 кило с лица". Хотя, о чем я говорю, реалтаймовые раздеваторы будут рулить контентом.

Пока это крутится локально на 5090 и всего 5.56 GB VRAM в 720р.
(4-step distillation + causal VAE decoding)

https://nvlabs.github.io/Sana/Streaming/

@cgevent
👍173😱1