Forwarded from эйай ньюз
Bonsai Image 4B — чудеса квантизации
Стартап PrismML, специализирующийся на экстремальном сжатии моделек, сделал квантизированную до одного бита FLUX.2 Klein 4B, вышло на удивление достойно. С таким уровнем квантизации Diffusion Transformer занимает всего лишь 930 мегабайт в 1-битном варианте и 1.2 гигабайта в тернарном варианте. Текстовый энкодер настолько же сильно ужать не удалось, поэтому весь комплект весит ~3.5 гига.
Такая квантизация позволяет запускать модель прямо в браузере и на телефонах, используя лишь 2 гигабайта оперативки. На генерацию 512x512 картинки на iPhone 17 Pro Max с такой моделью уходит 9.4 секунды при 4 шагах, что неплохо если учитывать факт офлоадинга. Ждём моделек побольше, для локального деплоймента.
Инференс в браузере
Веса
@ai_newz
Стартап PrismML, специализирующийся на экстремальном сжатии моделек, сделал квантизированную до одного бита FLUX.2 Klein 4B, вышло на удивление достойно. С таким уровнем квантизации Diffusion Transformer занимает всего лишь 930 мегабайт в 1-битном варианте и 1.2 гигабайта в тернарном варианте. Текстовый энкодер настолько же сильно ужать не удалось, поэтому весь комплект весит ~3.5 гига.
Такая квантизация позволяет запускать модель прямо в браузере и на телефонах, используя лишь 2 гигабайта оперативки. На генерацию 512x512 картинки на iPhone 17 Pro Max с такой моделью уходит 9.4 секунды при 4 шагах, что неплохо если учитывать факт офлоадинга. Ждём моделек побольше, для локального деплоймента.
Инференс в браузере
Веса
@ai_newz
👍23🔥10❤5
Media is too big
VIEW IN TELEGRAM
ElevenLabs Music V2
Обновили свою модель генерации музыки.
Inpainting - можно перегенерить только выбранную часть трека.
Быстрые смены стиля прямо внутри одного трека
Немузыкальные шумовые эффекты внутри треков.
Но самое интересное, что они обещают API, чего нет у SUNO.
Впрочем, китайские умельцы уже давно соорудили лайфхаки:
https://kie.ai/suno-api
@cgevent
Обновили свою модель генерации музыки.
Inpainting - можно перегенерить только выбранную часть трека.
Быстрые смены стиля прямо внутри одного трека
Немузыкальные шумовые эффекты внутри треков.
Но самое интересное, что они обещают API, чего нет у SUNO.
Впрочем, китайские умельцы уже давно соорудили лайфхаки:
https://kie.ai/suno-api
@cgevent
👍23❤9
Небольшой промпт-гайд для Gemini Omni прямо от Google
Есть примеры промптов
Основные правила
1. Используйте знания из реального мира.
Вам не нужно слишком подробно объяснять мир Gemini Omni. Он создан с учетом глубокого понимания истории, науки и культуры, поэтому может надежно создавать результаты, которые выглядят, ощущаются и движутся реалистично. Избегайте подробных описаний. Используйте культурные ориентиры, исторические эпохи или научные термины непосредственно в своем задании.
2. Возьмите под контроль отрисовку текста.
Gemini Omni не только обладает расширенными возможностями рендеринга текста, но и позволяет плавно интегрировать текст в визуальные эффекты. Вы можете задать типографику, пространственное расположение, стили анимации и сложные визуальные эффекты, такие как двойная экспозиция, — всё это идеально синхронизировано с действием в вашем видео.
3. Направляйте камеру.
Думайте как оператор. Omni невероятно хорошо реагирует на точные указания по видеосъемке, типам камер и кадрированию. Попробуйте включать эти термины в ваши промпты.
4. Монтаж и композ.
Каждое отличное видео создается на этапе монтажа. С Gemini Omni вам не нужно переписывать весь сценарий с нуля, чтобы исправить одну-единственную ошибку. Запросите конкретные, целенаправленные изменения, например, смену фона или замену подписи. Omni сохранит основную структуру вашего видео при многократном внесении правок, позволяя вам сосредоточиться только на том, что нуждается в корректировке.
Хотите изменить темп или эмоции персонажа прямо посреди сцены? Вы можете напрямую настроить Gemini Omni на изменение движений или взаимодействия объекта с окружающей средой, не нарушая целостность модели персонажа.
https://x.com/GoogleAI/status/2059381218660270435
@cgevent
Есть примеры промптов
Основные правила
1. Используйте знания из реального мира.
Вам не нужно слишком подробно объяснять мир Gemini Omni. Он создан с учетом глубокого понимания истории, науки и культуры, поэтому может надежно создавать результаты, которые выглядят, ощущаются и движутся реалистично. Избегайте подробных описаний. Используйте культурные ориентиры, исторические эпохи или научные термины непосредственно в своем задании.
2. Возьмите под контроль отрисовку текста.
Gemini Omni не только обладает расширенными возможностями рендеринга текста, но и позволяет плавно интегрировать текст в визуальные эффекты. Вы можете задать типографику, пространственное расположение, стили анимации и сложные визуальные эффекты, такие как двойная экспозиция, — всё это идеально синхронизировано с действием в вашем видео.
3. Направляйте камеру.
Думайте как оператор. Omni невероятно хорошо реагирует на точные указания по видеосъемке, типам камер и кадрированию. Попробуйте включать эти термины в ваши промпты.
4. Монтаж и композ.
Каждое отличное видео создается на этапе монтажа. С Gemini Omni вам не нужно переписывать весь сценарий с нуля, чтобы исправить одну-единственную ошибку. Запросите конкретные, целенаправленные изменения, например, смену фона или замену подписи. Omni сохранит основную структуру вашего видео при многократном внесении правок, позволяя вам сосредоточиться только на том, что нуждается в корректировке.
Хотите изменить темп или эмоции персонажа прямо посреди сцены? Вы можете напрямую настроить Gemini Omni на изменение движений или взаимодействия объекта с окружающей средой, не нарушая целостность модели персонажа.
https://x.com/GoogleAI/status/2059381218660270435
@cgevent
1👍34🔥12❤6
Forwarded from Neural Shit
Таки там прошла первая Олимпиада для биохакеров-торчков. Enhanced Games.
Концепт прост и незатейлив: отменяем все спортивные комиссии и допинг-контроли, вкалываем в себя всё, что не прибито к полу, и идём ставить мировые рекорды. Организаторы гордо выкатили статистику подготовки: 91% атлетов плотно сидели на тестостероне, 79% на гормоне роста, а ещё в ход шли стимуляторы и прочие спиды. За обычную победу давали 250к долларов, за мировой рекорд лям баксов.
Казалось бы, нас ждёт парад мутантов-супергероев. Но всё прошло скучно:
— Американский спринтер Фред Керли обещал разорвать рекорд Усэйна Болта в клочья, а в итоге пробежал 100 метров за 9.97 сек. На обычной олимпиаде в Париже несколько лет назад он же бежал без всякой фармы и показал 9.81.
— Чистые спортсмены которые затесались на этот праздник химии, умудрились выиграть несколько дисциплин.
— Единственный мировой рекорд выдал грек: 50 метров вольным стилем за 20.81. На 0.07 быстрее официального мирового рекорда. Правда, этот чувак помимо запрещенных веществ использовал какой-то хитрый запрещённый плавательный костюм. А потом интернет-сыщики ещё и выяснили, что у организаторов были какие-то траблы с таймером.
Пока вывод такой:на обычной Олимпиаде фарма посильнее будет химия, это прошлый век и полумеры. Ждём, когда выкатят чувака с титановыми ногами от Бостон Динамикс, вот тогда и поговорим про рекорды.
тут подробнее
Концепт прост и незатейлив: отменяем все спортивные комиссии и допинг-контроли, вкалываем в себя всё, что не прибито к полу, и идём ставить мировые рекорды. Организаторы гордо выкатили статистику подготовки: 91% атлетов плотно сидели на тестостероне, 79% на гормоне роста, а ещё в ход шли стимуляторы и прочие спиды. За обычную победу давали 250к долларов, за мировой рекорд лям баксов.
Казалось бы, нас ждёт парад мутантов-супергероев. Но всё прошло скучно:
— Американский спринтер Фред Керли обещал разорвать рекорд Усэйна Болта в клочья, а в итоге пробежал 100 метров за 9.97 сек. На обычной олимпиаде в Париже несколько лет назад он же бежал без всякой фармы и показал 9.81.
— Чистые спортсмены которые затесались на этот праздник химии, умудрились выиграть несколько дисциплин.
— Единственный мировой рекорд выдал грек: 50 метров вольным стилем за 20.81. На 0.07 быстрее официального мирового рекорда. Правда, этот чувак помимо запрещенных веществ использовал какой-то хитрый запрещённый плавательный костюм. А потом интернет-сыщики ещё и выяснили, что у организаторов были какие-то траблы с таймером.
Пока вывод такой:
тут подробнее
Telegram
Neural Shit
Сооснователь PayPal и один из ранних инвесторов Facebook* Питер Тиль вложился в Олимпиаду с разрешённым допингом
Проект называется Enhanced Games, и первые соревнования запланированы на декабрь этого года. Авторы, гордо прикрываясь мотивом спортивном революции…
Проект называется Enhanced Games, и первые соревнования запланированы на декабрь этого года. Авторы, гордо прикрываясь мотивом спортивном революции…
😁47❤9
Forwarded from Сиолошная
Anthropic выпустили пост-обновление про Mythos и Project Glasswing с промежуточными результатами.
Спустя месяц большинство партнеров обнаружили в своем коде сотни уязвимостей критического и высокого уровня опасности каждый. В общей сложности они выявили десятки тысяч уязвимостей. Некоторые из партнёров сообщили, что скорость обнаружения багов выросла более чем в десять раз. Например, компания Cloudflare нашла 2000 уязвимостей (400 из которых имеют высокий или критический уровень опасности) в своих критически важных системах, при этом доля ложных срабатываний, по мнению команды Cloudflare, оказалась ниже, чем у тестировщиков-людей.
Я видел много комментариев про то, что, мол, Mythos да может что-то находит, но наверняка выдаёт и много мусора, где уязвимостей нет — так вот это не так. Помимо закрытых проектов, Anthropic натравили Mythos и на опенсурс для сканирования более 1000 крупных репозиториев, на которых во многом держится современный интернет. На данный момент, по оценкам Anthropic, в этих проектах найдено 6202 уязвимости высокого или критического уровня (из 23 тысяч в общей сложности, включая те, которые относятся к среднему или низкому уровню опасности).
На данный момент лишь 1752 из этих уязвимостей с высоким и критическим уровнем прошли тщательную проверку силами одной из шести независимых исследовательских компаний в сфере кибербезопасности. Из них 90% оказались подтвержденными, а 62% (1100 штук) были классифицированы именно как уязвимости высокого или критического уровня.
Некоторые из уязвимостей носили очень серьёзный уровень угрозы, если бы они были обнаружены злоумышленниками. Как пример, Mythos смо написать эксплойт, который позволил бы злоумышленнику подделывать сертификаты через библиотеку wolfSSL. Это, к примеру, дало бы ему возможность разместить фальшивый сайт банка или почтового провайдера, и для конечного пользователя такой сайт выглядел бы абсолютно легитимным, браузер не показал бы никаких уведомлений.
Обнаруженные уязвимости льются как из рога изобилия, их не успевают исправлять, не хватает людей. Некоторые команды/проекты даже просили снизить темпы раскрытия информации об уязвимостях, поскольку им требуется больше времени на создание патчей. (В среднем, на устранение бага высокого или критического уровня, найденного с помощью Mythos Preview, уходит две недели).
В настоящее время ни одна компания — включая Anthropic — не разработала достаточно надежных механизмов защиты, способных предотвратить использование подобных ИИ-моделей во зло и для причинения потенциально серьезного ущерба. Именно поэтому к модели не дают доступ широкой аудитории. Но по этой же причине и был запущен Project Glasswing: если модель с аналогичными возможностями будет выпущена кем-то без соответствующих мер, то в скором времени для любого человека в мире станет значительно дешевле и проще эксплуатировать уязвимый код.
Спустя месяц большинство партнеров обнаружили в своем коде сотни уязвимостей критического и высокого уровня опасности каждый. В общей сложности они выявили десятки тысяч уязвимостей. Некоторые из партнёров сообщили, что скорость обнаружения багов выросла более чем в десять раз. Например, компания Cloudflare нашла 2000 уязвимостей (400 из которых имеют высокий или критический уровень опасности) в своих критически важных системах, при этом доля ложных срабатываний, по мнению команды Cloudflare, оказалась ниже, чем у тестировщиков-людей.
Я видел много комментариев про то, что, мол, Mythos да может что-то находит, но наверняка выдаёт и много мусора, где уязвимостей нет — так вот это не так. Помимо закрытых проектов, Anthropic натравили Mythos и на опенсурс для сканирования более 1000 крупных репозиториев, на которых во многом держится современный интернет. На данный момент, по оценкам Anthropic, в этих проектах найдено 6202 уязвимости высокого или критического уровня (из 23 тысяч в общей сложности, включая те, которые относятся к среднему или низкому уровню опасности).
На данный момент лишь 1752 из этих уязвимостей с высоким и критическим уровнем прошли тщательную проверку силами одной из шести независимых исследовательских компаний в сфере кибербезопасности. Из них 90% оказались подтвержденными, а 62% (1100 штук) были классифицированы именно как уязвимости высокого или критического уровня.
Некоторые из уязвимостей носили очень серьёзный уровень угрозы, если бы они были обнаружены злоумышленниками. Как пример, Mythos смо написать эксплойт, который позволил бы злоумышленнику подделывать сертификаты через библиотеку wolfSSL. Это, к примеру, дало бы ему возможность разместить фальшивый сайт банка или почтового провайдера, и для конечного пользователя такой сайт выглядел бы абсолютно легитимным, браузер не показал бы никаких уведомлений.
Обнаруженные уязвимости льются как из рога изобилия, их не успевают исправлять, не хватает людей. Некоторые команды/проекты даже просили снизить темпы раскрытия информации об уязвимостях, поскольку им требуется больше времени на создание патчей. (В среднем, на устранение бага высокого или критического уровня, найденного с помощью Mythos Preview, уходит две недели).
В настоящее время ни одна компания — включая Anthropic — не разработала достаточно надежных механизмов защиты, способных предотвратить использование подобных ИИ-моделей во зло и для причинения потенциально серьезного ущерба. Именно поэтому к модели не дают доступ широкой аудитории. Но по этой же причине и был запущен Project Glasswing: если модель с аналогичными возможностями будет выпущена кем-то без соответствующих мер, то в скором времени для любого человека в мире станет значительно дешевле и проще эксплуатировать уязвимый код.
😱23❤10😁4👍1
Немного мыслей про уязвимости по мотивам предыдущего поста.
"Обнаруженные уязвимости льются как из рога изобилия, их не успевают исправлять, не хватает людей. Некоторые команды/проекты даже просили снизить темпы раскрытия информации об уязвимостях, поскольку им требуется больше времени на создание патчей."
Пока речь идет про уязвимости в коде. Но интересно взглянуть на проблему шире.
Кожаные успели себе "накодить" не только тонны кода, но и некоторое количество правил, законов, парадигм, которые не описываются только кодом.
Ну например медицину, экономику, юриспруденцию.
Про медицину - отдельный вопрос, какие баги найдет ИИ в описательной кожаной медицине.
Про экономику - похоже кожаные накодили плохо, все кризисы предсказываются задним числом, а ИИ в качестве управления инвестициями показывает себя плохо. Скорее всего не потому что он тупой, а потому что "код экономики" не просто забагован, а не имеет стройной (а не спекулятивной) матбазы.
А вот с юристами интереснее. Кожаные "накодили" себе законов, в которых же сами постоянно ищут дыры, прецеденты, исключения. И тут ИИ может развернуться по полной. И речь не только про поиск дыр в контрактах, а вообще в своде законов, в котором есть уязвимости и противоречия. Интересно, как кожаные будут латать эти дыры, когда ИИ начнет их тыкать мордой в эти кейсы.
За рамками дискуссии можно оставить мысль, что каждый кожаный после рождения "кодит" у себя в голове модель мира (которая часто ничего общего с миром не имеет). Когда ИИ начнет находить уязвимости в этом ментальном коде - как он будет это использовать?
@cgevent
"Обнаруженные уязвимости льются как из рога изобилия, их не успевают исправлять, не хватает людей. Некоторые команды/проекты даже просили снизить темпы раскрытия информации об уязвимостях, поскольку им требуется больше времени на создание патчей."
Пока речь идет про уязвимости в коде. Но интересно взглянуть на проблему шире.
Кожаные успели себе "накодить" не только тонны кода, но и некоторое количество правил, законов, парадигм, которые не описываются только кодом.
Ну например медицину, экономику, юриспруденцию.
Про медицину - отдельный вопрос, какие баги найдет ИИ в описательной кожаной медицине.
Про экономику - похоже кожаные накодили плохо, все кризисы предсказываются задним числом, а ИИ в качестве управления инвестициями показывает себя плохо. Скорее всего не потому что он тупой, а потому что "код экономики" не просто забагован, а не имеет стройной (а не спекулятивной) матбазы.
А вот с юристами интереснее. Кожаные "накодили" себе законов, в которых же сами постоянно ищут дыры, прецеденты, исключения. И тут ИИ может развернуться по полной. И речь не только про поиск дыр в контрактах, а вообще в своде законов, в котором есть уязвимости и противоречия. Интересно, как кожаные будут латать эти дыры, когда ИИ начнет их тыкать мордой в эти кейсы.
За рамками дискуссии можно оставить мысль, что каждый кожаный после рождения "кодит" у себя в голове модель мира (которая часто ничего общего с миром не имеет). Когда ИИ начнет находить уязвимости в этом ментальном коде - как он будет это использовать?
@cgevent
1👍70🔥14❤9😁2
This media is not supported in your browser
VIEW IN TELEGRAM
Метаверс, который мы заслужили.
Наконец-то нормальное применение VR, а понятие удаленная работа приобретает нужный смысл.
И, мне кажется, братья Вачовски нам чего-то не договаривали.
@cgevent
Наконец-то нормальное применение VR, а понятие удаленная работа приобретает нужный смысл.
И, мне кажется, братья Вачовски нам чего-то не договаривали.
@cgevent
😁59😱10👎4🔥4👍2❤1
Media is too big
VIEW IN TELEGRAM
#Нейропрожарка
"Переход"
Автор — Руслан Аларханов @ruslan_alarhanov
Ролик создавался как личная реклама в качестве ai-creatora.
Это мой второй опыт, ошибок много, но полагаюсь на то, что людям понравится сам вайбик.
Мне хотелось сделать сцену где все со всем связано. Чтобы переходы были из одной сцены в другую.
Использовал по классике бабану 2 для генерации себя и рефов, ну и Seedance 2.0.
Озвучку сиденс сделал на русском, но она была кривая. Поэтому пришлось самому записывать свой голос и уже крутить его, чтобы голос вписался в окружение.
В первый день я проработал сценарий, продумал свою речь в видео. Потом 2 дня собирал все шоты в Seedance 2.0 и финальный день вместе с другом звукорежиссером @abikhs сделали саунд дизайн.
Ушло 80-100к кредитов в Magnific (бывший Freepik)
Косяки уже вижу сам, но мне интересно все равно ваше мнение 🤝
@cgevent
"Переход"
Автор — Руслан Аларханов @ruslan_alarhanov
Ролик создавался как личная реклама в качестве ai-creatora.
Это мой второй опыт, ошибок много, но полагаюсь на то, что людям понравится сам вайбик.
Мне хотелось сделать сцену где все со всем связано. Чтобы переходы были из одной сцены в другую.
Использовал по классике бабану 2 для генерации себя и рефов, ну и Seedance 2.0.
Озвучку сиденс сделал на русском, но она была кривая. Поэтому пришлось самому записывать свой голос и уже крутить его, чтобы голос вписался в окружение.
В первый день я проработал сценарий, продумал свою речь в видео. Потом 2 дня собирал все шоты в Seedance 2.0 и финальный день вместе с другом звукорежиссером @abikhs сделали саунд дизайн.
Ушло 80-100к кредитов в Magnific (бывший Freepik)
Косяки уже вижу сам, но мне интересно все равно ваше мнение 🤝
@cgevent
👎103👍43🔥10❤9😁1😱1
This media is not supported in your browser
VIEW IN TELEGRAM
Stream Diffusion только для музыки.
Очень прикольный проект.
Реалтаймовый генератор музыки как отдельного инструмента\трека с привязкой к хардверным крутилкам.
Под капотом опенсорсный ACEStep1.5. Все это летает на локальной машине (30/40/5090), а крутилки хардверного пульта напрямую влияют на параметры генерации.
Это позволяет играть на ACEStep как на музыкальном инструменте, создавая ремиксы песен и лупов с обратной связью, которая не отстает от реального времени.
Звучит очень интересно.
https://daydreamlive.github.io/DEMON/
Есть демо:
https://music.daydream.live/
https://civitai.com/models/2416425/acestep-loras
https://huggingface.co/daydreamlive/DreamVAE
@cgevent
Очень прикольный проект.
Реалтаймовый генератор музыки как отдельного инструмента\трека с привязкой к хардверным крутилкам.
Под капотом опенсорсный ACEStep1.5. Все это летает на локальной машине (30/40/5090), а крутилки хардверного пульта напрямую влияют на параметры генерации.
Это позволяет играть на ACEStep как на музыкальном инструменте, создавая ремиксы песен и лупов с обратной связью, которая не отстает от реального времени.
Звучит очень интересно.
https://daydreamlive.github.io/DEMON/
Есть демо:
https://music.daydream.live/
https://civitai.com/models/2416425/acestep-loras
https://huggingface.co/daydreamlive/DreamVAE
@cgevent
🔥28❤5
Нейрорендер добрался до взрослых мальчиков.
Chaos (разработчики V-Ray) сделали свой нейрорендер на максималках под названием Veras.
Под капотом Nanobanana 2 и Nanobanana Pro.
Как основной функционал, она умеет брать скриншот камеры (или фреймбуфер) и генерить Бананой красивые варианты дизайна - позиционируется все это прежде всего на архитектурную визуализацию.
Но кроме того, она умеет поворачивать скетчи и картинки (примерно как в новом Фотошопе).
А также умеет генерить короткие видосы - длинные облеты камеров вокруг сцены (я не нашел какой видеомоделью, наверное Veo). Есть Image-2-Video, есть референсы(в том числе материалов), есть First & last frame video и даже забавные попытки монтажа таких клипов.
Есть рульки "креативности" - насколько придерживаться исходной геометрии.
Про текстуры и наследование материалов ничего не нашел.
Есть отдельный web-app и есть standalone app, но основной упор на то, что она работает нативно внутри Enscape, V-Ray, and Corona, а как плагин с Revit, SketchUp, Rhino, Vectorworks, Archicad, Forma, and Allplan
Используется система кредитов от Chaos, часть включена в подписку, но можно докупать новые.
https://blog.chaos.com/veras-for-vray
https://blog.chaos.com/what-is-veras
Все это выглядит как нативное встраивание Нанабананы в продукты Chaos.
Ждем ответа от Автодеска, а то там этим занимаются энтузиасты аниматоры.
@cgevent
Chaos (разработчики V-Ray) сделали свой нейрорендер на максималках под названием Veras.
Под капотом Nanobanana 2 и Nanobanana Pro.
Как основной функционал, она умеет брать скриншот камеры (или фреймбуфер) и генерить Бананой красивые варианты дизайна - позиционируется все это прежде всего на архитектурную визуализацию.
Но кроме того, она умеет поворачивать скетчи и картинки (примерно как в новом Фотошопе).
А также умеет генерить короткие видосы - длинные облеты камеров вокруг сцены (я не нашел какой видеомоделью, наверное Veo). Есть Image-2-Video, есть референсы(в том числе материалов), есть First & last frame video и даже забавные попытки монтажа таких клипов.
Есть рульки "креативности" - насколько придерживаться исходной геометрии.
Про текстуры и наследование материалов ничего не нашел.
Есть отдельный web-app и есть standalone app, но основной упор на то, что она работает нативно внутри Enscape, V-Ray, and Corona, а как плагин с Revit, SketchUp, Rhino, Vectorworks, Archicad, Forma, and Allplan
Используется система кредитов от Chaos, часть включена в подписку, но можно докупать новые.
https://blog.chaos.com/veras-for-vray
https://blog.chaos.com/what-is-veras
Все это выглядит как нативное встраивание Нанабананы в продукты Chaos.
Ждем ответа от Автодеска, а то там этим занимаются энтузиасты аниматоры.
@cgevent
👍20❤7🔥4😱2👎1
This media is not supported in your browser
VIEW IN TELEGRAM
Нейрорендер 4
Говоря про энтузиастов-аниматоров, прекрасный Матарави продолжает развивать свой нейрорендер.
Как вы помните, он берет простой превиз-плейбласт в Maya и делает из него нейрорендер, ускоряя процесс в разы.
Теперь же он рендерит (нормальным рендером) ОДИН кадр и подает его как референс в свой нейрорендер.
Из этого кадра подхватываются текстуры, материалы кожи и волос, окружение и свет - и нейрорендер имитирует взрослый рендер (только в разы быстрее) сохраняя анимацию.
У меня только один вопрос, кто поднимет веки автодеску - идея настолько хороша, пока уже проснуться не только Chaos Group.
@cgevent
Говоря про энтузиастов-аниматоров, прекрасный Матарави продолжает развивать свой нейрорендер.
Как вы помните, он берет простой превиз-плейбласт в Maya и делает из него нейрорендер, ускоряя процесс в разы.
Теперь же он рендерит (нормальным рендером) ОДИН кадр и подает его как референс в свой нейрорендер.
Из этого кадра подхватываются текстуры, материалы кожи и волос, окружение и свет - и нейрорендер имитирует взрослый рендер (только в разы быстрее) сохраняя анимацию.
У меня только один вопрос, кто поднимет веки автодеску - идея настолько хороша, пока уже проснуться не только Chaos Group.
@cgevent
🔥42❤4👍2
Higgsfield plugins for Adobe Premiere Pro and After Effects
Интересный ход. Хиггсы в своих тулах избегают таймлайна, чтобы не перегружать новаго нормального юзера сложностями монтажа.
Однако, они только что бахнули два плагина для Премьера и Афтера.
Можно генерить прямо внутри, делать генеративные транзишены, вроде как рефреймить без кропа, удалять фон, рисовать(?!) на футаже как реф для генерации, и вроде даже апскейлить до 4К.
Как и в случае с Chaos и V-Ray из сегодняшнего утреннего поста - это выглядит как очень логичный шаг (некий нейрорендер\нейрокомпоз) прямо в профессиональном софте.
Понятно, что Gemini Omni как бы умеет все это из коробки, но.
Не надо генерить в где-то, скачивать куда-то, импортировать в премьер, тащить, обрезать, вставлять.
И у меня, опять один вопрос: Адобченко, але! Почему это делает кто-то посторонний?
Причем мы уже видели намеки на это от самого Адобченко год назад, в демках с chatGPT. Да, там есть потуги в виде морфкат+Firefly, но так чтобы бахнуть простые и удобные плагины Адобу как будто яиц не хватает.
Они вроде уже отказались от эксклюзивности на Файерфлай. Уже генерят разными моделями на своих Mood Boards.
Что мешает?
Я не знаю, как это будет работать у Хиггсов, особенно по части фреймрейтов, аспектов, неквадратных пикселей и прочей неприятной требухи, но ход очень правильный.
Я также еще не попробовал UX - тут важно попадать в заученные годами движения\патерны мышкой инвалидов Афтера и ветеранов Премьера. Инпайнт, маски, слои - все должно быть нативно.
Ну и механика выбора моделей для генерации тоже должна себя обозначить.
Но ход отличный, как по мне. Пусть даже это не работает как заявлено. Рано или поздно заработает, не у Хигсов. так у кого-то еще.
https://higgsfield.ai/adobe-plugin
@cgevent
Интересный ход. Хиггсы в своих тулах избегают таймлайна, чтобы не перегружать новаго нормального юзера сложностями монтажа.
Однако, они только что бахнули два плагина для Премьера и Афтера.
Можно генерить прямо внутри, делать генеративные транзишены, вроде как рефреймить без кропа, удалять фон, рисовать(?!) на футаже как реф для генерации, и вроде даже апскейлить до 4К.
Как и в случае с Chaos и V-Ray из сегодняшнего утреннего поста - это выглядит как очень логичный шаг (некий нейрорендер\нейрокомпоз) прямо в профессиональном софте.
Понятно, что Gemini Omni как бы умеет все это из коробки, но.
Не надо генерить в где-то, скачивать куда-то, импортировать в премьер, тащить, обрезать, вставлять.
И у меня, опять один вопрос: Адобченко, але! Почему это делает кто-то посторонний?
Причем мы уже видели намеки на это от самого Адобченко год назад, в демках с chatGPT. Да, там есть потуги в виде морфкат+Firefly, но так чтобы бахнуть простые и удобные плагины Адобу как будто яиц не хватает.
Они вроде уже отказались от эксклюзивности на Файерфлай. Уже генерят разными моделями на своих Mood Boards.
Что мешает?
Я не знаю, как это будет работать у Хиггсов, особенно по части фреймрейтов, аспектов, неквадратных пикселей и прочей неприятной требухи, но ход очень правильный.
Я также еще не попробовал UX - тут важно попадать в заученные годами движения\патерны мышкой инвалидов Афтера и ветеранов Премьера. Инпайнт, маски, слои - все должно быть нативно.
Ну и механика выбора моделей для генерации тоже должна себя обозначить.
Но ход отличный, как по мне. Пусть даже это не работает как заявлено. Рано или поздно заработает, не у Хигсов. так у кого-то еще.
https://higgsfield.ai/adobe-plugin
@cgevent
🔥43❤9👍5😁1
Media is too big
VIEW IN TELEGRAM
#Нейропрожарка
SHADOW RACE × Sevendust "Broken Down"
Racing Concept Music Video
Автор: Павел Жигарев @noizlab
🎬 YOUTUBE 4K
Лучшие гонщики планеты собираются чтобы
посоревноваться — кто лучший. Главный приз: 1 000 000 000$.
Главный герой принимает приглашение чтобы закрыть долги
и узнать кто виноват в аварии, в которой погиб его брат.
Но когда он принимает участие — оказывается что это не
простые гонки, а сверхсимуляция, в которой можно умереть
по-настоящему.
Так бы я хотел, чтобы это было написано на обороте DVD,
купленного на Митинском радиорынке в 2003 году.
NFS Underground, Форсаж и Nu-Metal саундтреки —
что ещё нам тогда было надо?
А если серьёзно — то я просто не видел тут роликов с гонками
и хотел для себя и для нейронки устроить тест.
Ну и вам.
———
ИНСТРУМЕНТЫ:
• Nano Banana Pro — персонажи, рефы
• Seedance 2.0 — видео
• Topaz Starlight 2.5 — апскейл
Плюс много разных трюков с изображениями и промптами.
МЫСЛИ:
Мне кажется, мы уже достигли технического потолка
в ИИ-генерациях. И теперь вопрос уже не в инструментах —
а в вере в свои силы и чувстве вкуса.
P.S. - В комментах кидайте треки из "того" времени,
P.S.S - Киноляпы присутствует — иначе было бы скучно
P.S.S.S - Сцена после титров присутствует! 🤫
Жарьте 🔥
@cgevent
SHADOW RACE × Sevendust "Broken Down"
Racing Concept Music Video
Автор: Павел Жигарев @noizlab
🎬 YOUTUBE 4K
Лучшие гонщики планеты собираются чтобы
посоревноваться — кто лучший. Главный приз: 1 000 000 000$.
Главный герой принимает приглашение чтобы закрыть долги
и узнать кто виноват в аварии, в которой погиб его брат.
Но когда он принимает участие — оказывается что это не
простые гонки, а сверхсимуляция, в которой можно умереть
по-настоящему.
Так бы я хотел, чтобы это было написано на обороте DVD,
купленного на Митинском радиорынке в 2003 году.
NFS Underground, Форсаж и Nu-Metal саундтреки —
что ещё нам тогда было надо?
А если серьёзно — то я просто не видел тут роликов с гонками
и хотел для себя и для нейронки устроить тест.
Ну и вам.
———
ИНСТРУМЕНТЫ:
• Nano Banana Pro — персонажи, рефы
• Seedance 2.0 — видео
• Topaz Starlight 2.5 — апскейл
Плюс много разных трюков с изображениями и промптами.
МЫСЛИ:
Мне кажется, мы уже достигли технического потолка
в ИИ-генерациях. И теперь вопрос уже не в инструментах —
а в вере в свои силы и чувстве вкуса.
P.S. - В комментах кидайте треки из "того" времени,
P.S.S - Киноляпы присутствует — иначе было бы скучно
P.S.S.S - Сцена после титров присутствует! 🤫
Жарьте 🔥
@cgevent
👎63👍17😁6🔥5
Forwarded from AI Product | Igor Akimov
Новый Opus 4.8! Переключаемся!
Сильно прям революции нет, но несколько обидных вещей пофиксили:
- В 4 раза реже пропускает баги в собственном коде «не заметив». Раньше любили бодро рапортовать об успехе на тонких доказательствах
- Алайнмент. Команда Anthropic пишет, что 4.8 «достигает новых максимумов» по просоциальным чертам (поддержка автономии пользователя, действие в его интересах).
- Бенчмарки. 84% на Online-Mind2Web (computer-use / браузерные агенты) – ощутимый скачок над 4.7 и GPT-5.5. На Legal Agent Benchmark – первая модель, перешагнувшая 10% по строгому all-pass стандарту. Ну и остальное чуть поднялось.
Еще по мелочи отгрузили фич
- Effort control в claude.ai и Cowork. Рядом с выбором модели теперь ползунок «усилия»: на высоких – думает чаще и глубже, на низких – отвечает быстрее и экономит лимиты. По дефолту – high. Есть extra (xhigh в Claude Code) и max для тяжёлых задач.
- Dynamic workflows в Claude Code (research preview). Claude планирует работу, запускает сотни параллельных сабагентов в одной сессии, верифицирует результат и только потом отчитывается. Заявленный кейс – миграции масштаба кодовой базы на сотни тысяч строк, от kickoff до merge, с тестовым набором в роли планки. Доступно на Enterprise / Team / Max.
- Fast mode. 2.5× скорость, и теперь в 3 раза дешевле, чем у прошлых моделей.
- Messages API. Теперь принимает system-записи внутри массива messages – можно обновлять инструкции агенту по ходу задачи, не ломая prompt cache.
Цены те же, fast в 2 раза дороже.
https://www.anthropic.com/news/claude-opus-4-8
Сильно прям революции нет, но несколько обидных вещей пофиксили:
- В 4 раза реже пропускает баги в собственном коде «не заметив». Раньше любили бодро рапортовать об успехе на тонких доказательствах
- Алайнмент. Команда Anthropic пишет, что 4.8 «достигает новых максимумов» по просоциальным чертам (поддержка автономии пользователя, действие в его интересах).
- Бенчмарки. 84% на Online-Mind2Web (computer-use / браузерные агенты) – ощутимый скачок над 4.7 и GPT-5.5. На Legal Agent Benchmark – первая модель, перешагнувшая 10% по строгому all-pass стандарту. Ну и остальное чуть поднялось.
Еще по мелочи отгрузили фич
- Effort control в claude.ai и Cowork. Рядом с выбором модели теперь ползунок «усилия»: на высоких – думает чаще и глубже, на низких – отвечает быстрее и экономит лимиты. По дефолту – high. Есть extra (xhigh в Claude Code) и max для тяжёлых задач.
- Dynamic workflows в Claude Code (research preview). Claude планирует работу, запускает сотни параллельных сабагентов в одной сессии, верифицирует результат и только потом отчитывается. Заявленный кейс – миграции масштаба кодовой базы на сотни тысяч строк, от kickoff до merge, с тестовым набором в роли планки. Доступно на Enterprise / Team / Max.
- Fast mode. 2.5× скорость, и теперь в 3 раза дешевле, чем у прошлых моделей.
- Messages API. Теперь принимает system-записи внутри массива messages – можно обновлять инструкции агенту по ходу задачи, не ломая prompt cache.
Цены те же, fast в 2 раза дороже.
https://www.anthropic.com/news/claude-opus-4-8
👍24❤15
CTO-ESTIMATE
Подписчик Алексей сделал полезный и бесплатный инструмент для тех, кто работает с локальными LLM или следит за развитием open-weight моделей:
https://cto-estimate.openweights.space/
Сервис собирает в одном месте данные, которые обычно приходится смотреть отдельно: бенчмарки в Artificial Analysis и конфиги моделей в Hugging Face.
Что внутри:
• каталог open-weight моделей
• фильтры по размеру, модальности, context length, reasoning и лицензии
• рейтинги на основе бенчмарков
• сравнение моделей бок о бок
• детали по архитектуре и параметрам
• ежедневные обновления списка моделей
Также есть практический раздел для тех, кто рассматривает локальный запуск моделей: первичная оценка требований к GPU и экономики собственного сервера.
@cgevent
Подписчик Алексей сделал полезный и бесплатный инструмент для тех, кто работает с локальными LLM или следит за развитием open-weight моделей:
https://cto-estimate.openweights.space/
Сервис собирает в одном месте данные, которые обычно приходится смотреть отдельно: бенчмарки в Artificial Analysis и конфиги моделей в Hugging Face.
Что внутри:
• каталог open-weight моделей
• фильтры по размеру, модальности, context length, reasoning и лицензии
• рейтинги на основе бенчмарков
• сравнение моделей бок о бок
• детали по архитектуре и параметрам
• ежедневные обновления списка моделей
Также есть практический раздел для тех, кто рассматривает локальный запуск моделей: первичная оценка требований к GPU и экономики собственного сервера.
@cgevent
🔥43👍15❤8