Метаверсище и ИИще
51.3K subscribers
6.48K photos
5.23K videos
48 files
7.53K links
Это не новости, это персональный экспертный взгляд на то, как развивается индустрия ИИ, графики, метаверса, крипты, нейротехнологий и в каком направлении катится все это безобразие.
Для связи: @SergTsyp
Download Telegram
Media is too big
VIEW IN TELEGRAM
Живая сталь или "главное - не терять головы"
Про URKL я уже писал - это реальные битвы робатов, как в легендарном фильме с Хью Джекманом.

А здесь идеальная иллюстрация анекдота: "-А зачем вам голова? - ЭЭ, а я в неё ем!!"

Смотрите до конца, там победитель радуецца.

С другого ракурса тут

@cgevent
😁43🔥146😱3
Netflix превращает ИИ-шашечки в ИИ-ехать

На Q2 2026 earnings call Тед Сарандос прямо сказал, что GenAI уже влияет на сотни продакшенов Netflix. По его словам, AI-workflows использовались примерно в 300 тайтлах, причем самая большая концентрация пока на постпродакшене.

Netflix напрямую не говорит “мы заменяем кожаных нейросеткой”. Просто аккуратно заявляет: AI помогает делать сложные кадры быстрее, дешевле и там, где раньше сцену просто выкинули бы из-за бюджета или сроков.

Сарандос перечислил, где именно AI уже работает:
concept и set references;
previs;
VFX;
sequence prep;
shot planning;
post-production;
delivery;
сложные сцены с массовкой;
исторические батальные сцены;
кадры, которые без AI были бы слишком дорогими или долгими.

Ключевой пример - документальный сериал The American Experiment. В нем, по словам Сарандоса, есть 17 минут AI-enhanced footage. Эти 17 минут сделали в два раза быстрее и за половину стоимости по сравнению с предыдущими вариантами.

Что с InterPositive

InterPositive, купленная у Бена Аффлека, отвечает за filmmaker-first AI: инструменты для работы с уже снятым материалом, визуальной логикой сцены, continuity, светом, фонами и missing shots
InterPositive - это не единственный AI-инструмент Netflix. Сарандос прямо уточняет: у компании есть InterPositive, но также есть Eyeline и собственная animation lab. То есть Netflix собирает не один “магический AI-продукт”, а набор внутренних и купленных инструментов, которые вместе закрывают разные части production pipeline.


Хорошая финальная фраза в интервью:
Netflix не говорит: “AI будет снимать кино вместо людей”. Netflix говорит куда более жоско: “AI позволит нам делать сцены, которые раньше были слишком дорогими, слишком долгими или просто вылетали из сценария”. Это не замена Голливуда одной кнопкой, а перепрошивка экономики продакшена.

Только вот с перепрошивкой кожаным возможно тоже придется вылететь из сценария.

Investing.com transcript Netflix Q2 2026

Netflix про InterPositive
.

@cgevent
👍29😁145🔥2👎1
Чорное зеркало уже с нами

Основатель Hinge (анти-Тиндер, но тоже дейтинг апп) Джастин Маклеод посмотрел на dating apps, которые сам помог превратить в бесконечную мозоль свайпов, и решил: так, проблема, конечно, не в том, что мы пятнадцать лет учили людей выбирать партнера как доставку еды. Проблема в том, что алгоритм еще недостаточно глубоко залез в личную жизнь.

Поэтому теперь он делает Overtone - это “не dating app” - так аккуратно написано на сайте. Там не будет профилей, матчей и бесконечной прокрутки лиц. Вместо этого сервис “узнает вас через ваши собственные слова” и сам решает, когда два человека действительно стоят знакомства.

Сам - ну вы поняли про кого идет речь.

Вы же все смотрели серию Black Mirror “Hang the DJ”, где система гоняет людей через алгоритмически назначенные отношения, пока не вычислит “идеального” партнера. Overtone пока не обещает таймер расставания, но сама идея “не выбирай, система лучше знает, кого тебе надо любить” на полном серьезе заявлена в питче.

Самое смешное(?): на это уже подняли $18 млн. Среди инвесторов — Match Group, владелец Hinge, Tinder и OkCupid. То есть компания, которая построила империю на свайпе, теперь инвестирует в человека, который говорит, что свайп не работает.

В совете также Эстер Перель - бельгийско-американский психотерапевт, одна из самых известных публичных экспертов по отношениям, сексуальности, браку и изменам. Автор книг вроде Mating in Captivity и The State of Affairs, ведущая популярных подкастов о парах и отношениях - ну, чтобы доверия было больше.

И да, весь рынок dating apps сейчас внезапно “переосмысливает свайп”. Bumble отказывается от свайпинга, Facebook тестирует AI dating assistant, Tinder борется с AI-профилями через проверку глаз. Все дружно делают вид, что усталость кожаных пользователей - это загадочная природная аномалия, а не прямой результат экономики внимания, которую они сами построили.

Главный вопрос однако не в том, “кого найдет вам ИИ”. Главный вопрос в том: сколько еще раз индустрия сможет продать одиночество (или похоть) обратно кожаным, каждый раз называя это более человечным интерфейсом.

Возможности коммуникаций выросли в тысячи раз, чувство одиночества выросло примерно также. Может ИИ спасет мир?

https://overto.ne/intro

@cgevent
139😁23🔥11👎4👍3
Появился способ ускорить корпоративный ИИ без дополнительных затрат на железо

Т-Технологии дропнули на Hugging Face модель T-Search — первую русскоязычную модель для Agentic RAG для многошагового поиска по внутренним документам. Но самое любопытное здесь — не сам поиск, а то, как удалось сократить требования к железу.

Архитектура модели позволяет запускать ее на одной Nvidia H100, хотя по качеству она сопоставима с открытыми решениями, которым обычно требуется от 16-ти и выше GPU на модуль. В сравнении с классическими RAG-системами, T-Search позволяет сократить расходы на инференс еще на 20-50% в зависимости от сценария. А благодаря возможности запускать модель на собственной инфраструктуре компании могут не расширять GPU-кластер даже при пиковых нагрузках, одновременно снижая стоимость обработки запросов. Ну и приятный бонус для бизнеса, что данные остаются внутри компании и не отправляются во внешние облачные сервисы.

В корпоративном ИИ, где тысячи запросов проходят через модели каждый день, такие оптимизации часто оказываются важнее, чем очередной рекорд в бенчмарках.

@cgevent
👍35🔥2118😁16👎12
Media is too big
VIEW IN TELEGRAM
#Нейропрожарка

Не откладывай жизнь на потом

Автор: Анастасия Абрамова

🔗 ТГ: https://t.iss.one/shetalks_ai | YouTube: @SheTalks_AI | Instagram: @she_talks_ai

⏱️ Хронометраж: 3:28, формат - музыкальный клип
💡 Как всё началось: обычно я делаю короткие мультики в стиле Pixar, и мне захотелось проверить себя на дистанции подлиннее. Чистый личный эксперимент: смогу ли я удержать одну идею на три с половиной минуты, а не на пятнадцать секунд.
🎬 Главная ошибка, которую я допустила: сначала придумала видео и начала его делать, а песня родилась уже потом. Так, разумеется, никто не делает. В итоге пришлось жёстко подгонять готовое видео под слова песни - переставлять, дотягивать, резать. Если бы делала заново, начинала бы со звука.
🛠 Инструменты и этапы:
Видео: Runway, модель Seedance 2.0 - весь ролик целиком
Картинки: ChatGPT - предметы, локации, карточки персонажей
Текстовая работа: Claude - промпты для видео и картинок, слова песни и промпт для музыки
Музыка: Suno (бесплатный тариф, дневных генераций хватает)
Монтаж: CapCut - всё там же
Апскейл: не делала
Голос и липсинк: нет, это клип, только музыка
⚙️ Как строила генерации: работала только через веб. Загружала фото-референсы персонажей, локаций, предметов и прописывала их прямо в промпте (IMG_1 — книга и т.д.). Video-to-video не использовала, только фото-референсы. Дальше расписывала происходящее по таймингу: 0–3 сек персонаж делает то-то, 3–6 — то-то. Расположение камеры, свет и атмосферу задавала в том же промпте.
📊 Цифры:
33 генерации на весь ролик, каждая по 15 секунд
~15 генераций песни в Suno, пока не получила устраивающий вариант
3 дня работы, с утра до позднего вечера
Деньги: посчитать честно не могу - у меня Unlimited-подписка Runway, плюс подписки на остальные сервисы (кроме Suno). Отдельного бюджета на ролик не было.
🚧 Что бесило:
- Очень долгое ожидание генераций
- После коротких мультиков делать большую форму оказалось тяжело физически и по концентрации
- Хвост из первого пункта: монтаж под уже готовое видео (сама тупанула)
📌 Итог: идея была, и я её додержала до конца - этим довольна. Процесс понравился, но повторять пока не тянет. И честный момент: на YouTube ролик набрал заметно меньше просмотров, чем мои короткие мультики. Длинная форма в этой нише пока окупается хуже, чем пятнадцатисекундный Pixar.

@cgevent
👎49👍228🔥5😁1
Fable остается по подписке. Но только для олигархов.

Помните, как Антропики говорили, что после 7 июля Fable будут доступен только про API кредитам?

Но тут подсуетились OpenAI и бахнули 5.6.

Антропик стал резко переобуваться типа "ну если очень хочется, что мы продлим на недельку доступ по подписке" и "и еще продлим, мы же держим слово".

Сейчас в очередной раз переобулись.

С 20 июля Fable оставляют доступной в планах Max ($100 и $200) и Team Premium, на них Fable может использовать половину лимитов. Нищебродам Pro (20 баксов)дадут $100 кредитов.

Похоже юзеры все-таки мигрируют на OpenAI раз началась такая суета.

@cgevent
😁57👍173👎2
Forwarded from Neural Shit
Да((
1😁104😱63🙏2
Forwarded from эйай ньюз
Слив Suno

Хакер под ником ellie.191 слил старые исходники Suno, и это подтвердило то, о чем все и так догадывались. Модель обучали, соскрэпив миллионы (а скорее всего десятки миллионов) треков и текстов с YouTube Music, Deezer, Genius, Pond5, Jamendo, Freesound и IMSLP. В слитых данных засветились исходники за 2023–2024 годы и скрипты для скрейпинга.

Только с YouTube Music стащили больше 2 миллионов клипов. Причем разработчики специально выкачивали акапеллы, чтобы получить чистый вокал для обучения. Для обхода защит ютуба Suno юзали сторонний сервис Bright Data, а в планах было выкачать миллион часов подкастов через PodcastIndex.

Suno защищаются тем, что тренировать модели на копирайтных материалах, которые публично доступны в интернеты - это fair use (есть такое понятие в США).

Утечка произошла еще в ноябре 2025-го, но компания технично умолчала об этом. Под шумок утекли и данные клиентов: email, номера телефонов и платежная информация из Stripe. Suno оправдываются тем, что полных номеров карт у них не было, поэтому уведомлять пользователей по закону они были не обязаны.

Сейчас RIAA (Американская ассоциация звукозаписывающих компаний) как раз судится с Suno за нарушение копирайта, и этот слив для них настоящий подарок.

Статья на The Verge

@ai_newz
1🔥25😱23😁32
Я, вообще-то говоря, за Suno из предыдущего поста.

Всё по той же причине: кожаным, значит можно смотреть ютюпчик, а потом сочинять музыку и снимать дурацкие видео, а ИИ нельзя?
Кожаным можно учицца, а ИИ нельзя?

В общем все как обычно, кожаным можно, остальным нельзя.

@cgevent
3👍84🔥2012👎7😁5🙏2
Смотрю на индустрию последнюю пару лет и ловлю себя на мысли: Data Science, каким мы его помним — модели, метрики, ноутбуки с EDA — тихо перестаёт быть всей картиной и становится одной из деталек.

Ещё вчера «заниматься ML» означало обучить модельку лучше бейзлайна и померяться четвёртым знаком после запятой на лидерборде. Красиво, спортивно и примерно никому за пределами Kaggle не нужно. А теперь модель — это в лучшем случае первая из трёх ступенек. Дальше идёт агент, который решает, когда и с каким контекстом эту модель дёрнуть и в какую цепочку действий её вставить. И только потом — продукт, ради которого весь сыр-бор и затевался.

Показательно, что это считывается даже в новостях. LLM-провайдеры давно меряются не самой моделью, а тем, чей стек агентов лучше выживает в проде. В OpenAI и Alibaba бодаются не за бенчмарк ради бенчмарка, а за то, у кого к модели аккуратнее прикручен агент, а к агенту — продуктовая логика. Бенчмарк забудут через неделю, а связку, которая приносит деньги, — нет.

И вот в чём соль. Спец, который умеет только «модель», теперь конкурирует не с другими ML-инженерами, а с целыми связками «модель + агент + продукт». Ценность утекает к тем, кто видит все три слоя разом: где кончается ответственность модели, где начинается агентная логика и где всё это обязано упереться в конкретную пользу. Я это вижу на живых примерах — соло-предприниматели в AI-first концепте в одну каску собирают мультиагентные сервисы и ловят первые оплаты там, где ещё недавно требовалась команда и раунд инвестиций.

Кто понял это прямо сейчас — выигрывает на старте. AI Talent Hub под это сделали ИИ-магистратуру. Поступить туда можно без экзаменов через конкурс ML-проектов. Если у вас есть проект и вам важно влиять на продукт и бизнес — залетайте.

@cgevent
👎32👍198🔥6😁2😱1
Forwarded from Сиолошная
Две новости в утро воскресенья, 2026-й год:

1. Huggingface, платформа для загрузки моделей и датасетов + тренировки, раскрыли, что недавно подверглись атаке на инфраструктуру. Эта атака отличалась от предыдущих одним свойством: она была произведена автономной системой ИИ-агентов от начала и до конца.

В результате атаки серьезного урона, по их оценкам, нет, но атакующие получили доступ к ограниченному набору внутренних данных и к нескольким учетным записям внутренних сервисов. Злоумышленник использовал два пути выполнения кода в пайплайне обработки данных, в результате которых внутренняя виртуальная машина запустила вредоносный код. После этого злоумышленник получил доступ на уровне сервера, собрал учетные данные облака и кластера и за выходные проник в несколько внутренних кластеров.

«Кампанией управлял автономный агент (используемая LLM до сих пор неизвестна), который выполнял тысячи отдельных действий в рое короткоживущих виртуальных машин с самомигрирующей командно-контрольной инфраструктурой, развернутой на общедоступных сервисах. Это соответствует сценарию "агентcкого злоумышленника", который давно прогнозировали в индустрии». Ну прям как в Терминаторе показывали 👀

Заметить и отразить атаку получилось из-за... ИИ, так как у HuggingFace за логами и аномалиями следит LLM (по описанию похоже на то, что сначала система на основе правил находит разные потенциальные инциденты, а затем модель их перепроверяет более детально).

«Когда мы начали анализ логов, мы сначала использовали передовые модели, работающие через коммерческие API. Это не сработало: для анализа требуется загружать большие объемы реальных команд и артефактов, но эти запросы блокировались защитными механизмами провайдеров, которые не могут отличить специалиста по реагированию на инциденты от злоумышленника. В итоге мы провели криминалистический анализ на нашей собственной инфраструктуре, используя GLM 5.2».

2. Bloomberg: США рассматривают возможность создания надзорного органа для аудита передовых ИИ-моделей. Уже составлен черновик предложения, и он рассматривается главой аппарата Белого дома. Это предложение предусматривает создание независимого регулирующего агентства в сфере ИИ, которое будет подотчетно Комиссии по ценным бумагам и биржам (SEC).

В целом, план США согласуется с предложениями, опубликованными ранее на этой неделе CEO DeepMind Demis Hassabis, который на следующей неделе поедет в Вашингтон обсуждать и лоббировать свои идеи. В публикации в твиттере он сравнил потенциальный новый надзорный орган с FINRA — независимым, финансируемым самой отраслью регулятором брокерских фирм, который технически не является частью правительства США. Свои полномочия он получает от SEC, которая, по сути, делегирует надзор, но проводит аудит и устанавливает правила.

Моё понимание такое, что схема нужна потому, что государство с одной стороны не может быть очень быстрым (как частные компании), а с другой стороны не может платить сотрудникам большие деньги. Официально-то директора и министры получают сущие копейки, меньше чем миддл-инженеры в Google — кто туда пойдет работать?
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥17😱123👍2👎1🙏1
Alibaba анонсировал Qwen3.8 - как бы открытого конкурента гигантской Kimi K3


Qwen3.8 - новая флагманская модель семейства Qwen с 2,4 трлн параметров. Компания пока ограничилась коротким тизером: модель «скоро» запустят и опубликуют в формате open-weight, а её возможности продолжат развивать после релиза. Ни архитектуру, ни число активных параметров, ни длину контекста, ни результаты тестов Alibaba пока не раскрыла.

Анонс выглядит как прямой ответ на недавний запуск Kimi K3 от Moonshot AI. Та ещё крупнее — 2,8 трлн параметров, использует разреженную MoE-архитектуру с активацией 16 из 896 экспертов, получила нативное понимание изображений и видео и контекстное окно на 1 млн токенов. Kimi K3 уже доступна в приложениях и через API, а полные веса Moonshot обещает опубликовать 27 июля 2026 года.

Уже можно попробовать Qwen3.8-Max-Preview, но пока не в обычном бесплатном чате Qwen Studio.

Сейчас Alibaba официально указывает три точки доступа:

QwenCloud Token Plan — международный вариант. Нужно оформить платный Token Plan; после этого модель должна появиться как Qwen3.8-Max-Preview.
Qoder — среда/агент Alibaba для программирования.
QoderWork — агентная рабочая платформа для более общих задач.

@cgevent
👍24🔥177
𝗦𝗲𝗻𝘀𝗲𝗡𝗼𝘃𝗮 𝗨1 𝗣𝗿𝗼

Эта китайская модель для генерации картинок уже мелькала в новостях.

Но сейчас вышла версия V3 и там есть пара любопытных моментов.

Up to 8𝗞 𝗻𝗮𝘁𝗶𝘃𝗲 𝗿𝗲𝘀𝗼𝗹𝘂𝘁𝗶𝗼𝗻 output
Enables 𝘂𝗹𝘁𝗿𝗮-𝘄𝗶𝗱𝗲 and 𝘂𝗹𝘁𝗿𝗮-𝘁𝗮𝗹𝗹 image creation

Модель редактирующая.

А также есть специальная версия именно для текстов и инфографики.

Правда примеры инфографики подозрительно желтят, так и хочется их присунуть в chatGPT и спросить, а не ты ли брат нагенерил это добро.

Модель открытая, оформлена очень хорошо, есть GGUFs для 10-12 гиг врам, все подробности тут:

https://github.com/OpenSenseNova/SenseNova-U1

Веса тут:
https://huggingface.co/sensenova/SenseNova-U1-8B-MoT-Infographic-V3
https://modelscope.cn/models/SenseNova/SenseNova-U1-8B-MoT-Infographic-V3

Демо:
https://huggingface.co/spaces/sensenova/sensenova-u1-infographic-v3

Разработчики честно пишут, что им надо еще поработать над анатомией, что бы это не значило.

А еще у низ есть модель Vision:
https://github.com/OpenSenseNova/SenseNova-Vision
𝗗𝗲𝘁𝗲𝗰𝘁𝗶𝗼𝗻/𝗢𝗖𝗥/𝗚𝗨𝗜
𝗗𝗲𝗽𝘁𝗵 & 𝗻𝗼𝗿𝗺𝗮𝗹
𝗦𝗲𝗴𝗺𝗲𝗻𝘁𝗮𝘁𝗶𝗼𝗻
𝗠𝘂𝗹𝘁𝗶-𝘃𝗶𝗲𝘄

@cgevent
23🔥17😁4👍3😱1
У Хиггсфилда появился раздел Community

Там можно найти довольно познавательные вещи.

Можно выбрать готовый проект (видео) и посмотреть не только промпт, но и все ассеты, использованные на проекте, количество сделанных генераций, количество сожженных кредитов, некоторые даже указывают количество и сами зафейленные генерации. Ну и у многих есть прям подробные описания пайплайна.

Довольно полезно для оценки ресурсов в принципе.

Также они приподнабили свой новый раздел Академия.

С точки зрения выстраивания коммьюнити и экосистемы они, конечно, молодцы.
https://higgsfield.ai/community

@cgevent
👍529🔥5👎2
Взвод менеджеров

Вынесу из коментов пару текстов от Дениса Лучанского.

Он, в отличие от многих, мешки ворочает с ИИ и пишет вот что:

Новое приложение chatGPT с солом 5.6 просто работает на компе как взвод менеджеров. Отличие только в ЗП и перерывах на сон и перекуры. За 20 баксов в месяц в браузере читает любые облачные приложения, собирает данные из нескольких источников в браузере, формирует заказы для десятков магазинов клиентов (может для любого количества), разрабатывает или добавляет в портфель новые продукты (сейчас расширяю портфель с 13 до 40 SKU за две-четыре недели, чтобы увеличить маржинальность одной доставки в торговую точку), управляет рекламными кампаниями в соцсетях (видит дневные продажи точки, сравнивает с затратами на рекламу, и принимает решения, как улучшить ROAS), может постить в любых соцсетях от моего имени всякую дичь 🤪, чуть позже отдам ему бизнес-процесс роста бизнеса почти весь.

Это нереально круто. Кожаные отдыхают, служба идет.

Теперь можно в одну рожу пилить нереально крутые бизнесы, и быстро выходить на недостижимый раньше уровень.

20, блять, баксов в месяц.

Про токеномику:
Да, да. Токены могут закончиться быстро, если промпт «сделай мне бизнес». 😂

И глюки могут сильно влиять, если задачи для ИИ ставит гуманитарий «яхудожникятаквижу» 🥹

Но

1) все эти несложные задачи решаются дешевой моделью, не по API, а несложными запросами по расписанию. Нет расхода токенов за рамками тарифа за 20 баксов в месяц.

2) Конечно же пока остается проверка кожаным, но она занимает мизерное время по сравнению с вариантом «сделать самому». Ошибки в начале запуска нового процесса бывают, но они быстро вылавливаются и исправляются.

3) Все процессы очень простые, и основаны на данных. Я не очень полагаюсь на творчество моделей, а в основном на холодный расчет и объективные показатели на основе данных. Например, одна сеть присылает заказы на мэйл в очень упрощенном виде. ИИ проверяет ежедневно почту, и при получении заказа делает накладные, и отправляет заявки на отгрузки на склад. Если мэйл не пришел вовремя, система поднимает шухер на несколько кожаных участников процесса. Все просто, нет вариантов для творчества. Тупая функция администратора.

4) сбор данных из источников - это не парсинг бреда из интернетов. Мне сети дают подключения к системам обмена информацией о движении товаров/заказах, но они разные, и мне проще промптом попросить ИИ вытащить товарный запас в точке с веб-страницы, где я залогинился в систему, чем кодить коннекторы, да еще клянчить доступ у сети, которая надменно считает себя крупным ритейлером, а зажравшийся перегруженный надменный ИТ-шник снизойдет до моего запроса через месяц.

5) я знаю свою область очень хорошо, и не внедряю ИИ во все процессы без разбора, у меня нет показателей на максимальное использование ИИ где попало. Я трачу инференс очень сфокусированно - в первую очередь на текущем ограничении бизнеса. Поэтому мне не нужен миллион на ИИ. Но отдача от ИИ максимальная.

P.S. Денис занимается продуктами питания, а не этим вот вашим цифровым бизьнесом.

@cgevent
👍7526👎11🔥10😁3
😳Google AI Pro на 18 месяцев за 990 рублей

Есть сервис через который можно дешево оформить подписку сразу на полтора года! Кстати активируется на ваш личный аккаунт.

Что входит в подписку:
- 🤖 Gemini
- 👩‍🎨 Veo 3 и Omni Flash
- 👨‍🎨 Nano Banana Pro
- 📂 5 ТБ на Google Диске
- 💎 Antigravity

В месяц начисляется 1000 кредитов, одна десятисекундная генерация в Omni Flash стоит 15 кредитов. То есть в месяц доступно 66 полных десятисекундных генераций. Цена одного ролика в пересчёте на стоимость подписки - 0.303$ (24 рубля)

Это почти в 3 раза дешевле, чем цена того же ролика через прямой доступ по официальному Gemini API (примерно $1.00–$1.01 за 10-секундное видео по счётчику токенов), и ещё выгоднее по сравнению со сторонними агрегаторами, которые обычно добавляют наценку сверху официального прайса API.

Ребята дают гарантию на весь срок, если вдруг возникнут проблемы с подпиской, они готовы сделать замену в течение всего срока действия подписки.

По любым вопросам всегда можно обратиться в Службу поддержки, они помогут.

Сам бот: @gemini_subscribe_bot
Please open Telegram to view this post
VIEW IN TELEGRAM
57👎53👍8😱8🔥4😁1
#ябвзял

Пока одни учат робатов двойному боковому арабскому сальто, другие делают игрушки для взрослых мальчиков (девачек?).

Такой скутер я бы взял покатать...

Зовут тварь Kepler Qilin, масса 300kg,может нести тонну(!), зарядка на 8 часов(не верю).

@cgevent
🔥37👍72
Frozen v2

Речь идёт не о мультике или следующем поколении TPU, а о гораздо более радикальном эксперименте Google - специализированном серверном чипе, в который часть модели Gemini будет буквально «зашита» на уровне кремния.

Первое развёртывание планируется ориентировочно на 2028 год.
Чип предназначен прежде всего для инференса - генерации ответов уже обученной моделью, а не для её обучения.
По данным The Information, Google рассчитывает получить в 6-10 раз больше токенов на единицу потреблённой энергии, чем на своих нынешних AI-чипах.
Архитектура пока не утверждена - инженеры ещё решают, какая доля параметров Gemini будет физически зафиксирована в чипе.

В чём фокус
Обычно веса модели хранятся в HBM-памяти, постоянно считываются и передаются вычислительным блокам. Это расходует огромное количество энергии и упирается в пропускную способность памяти.
В Frozen часть весов или вычислительных структур хотят сделать постоянными - условно превратить модель из программы, исполняемой процессором, в часть самого процессора. Так можно убрать множество обращений к памяти и заменить универсальные вычислительные блоки более простыми фиксированными схемами.
Отсюда и название Frozen - часть модели «заморожена» в кремнии.

Это не замена TPU
Frozen разрабатывается как отдельная линейка, дополняющая TPU:
TPU 8t предназначен для обучения моделей.
TPU 8i - для более универсального инференса и AI-агентов.
Frozen - для чрезвычайно дешёвого и массового обслуживания конкретного семейства Gemini.

https://www.reuters.com/business/google-plans-new-chip-run-gemini-models-more-efficiently-information-reports-2026-07-20/

@cgevent
👍23😱209🔥6
Media is too big
VIEW IN TELEGRAM
#Нейропрожарка

С днём рождения, Таша

Автор: @sershanga

Предыстория:
Это небольшой мульт, в основе которого лежит реальная история одного дня рождения, когда я решил удивить свою девушку и вручить ей подарок необычным способом. Договорившись с другом, чтобы он подлетел на квадрокоптере с привязанным подарком в определённое время к нужному месту на пляже, я срезал верёвку и вручил подарок своей девушке, получив взамен бурю ярких эмоций и радости от неожиданности.Мне хотелось не просто собрать красивую последовательность кадров, а сделать законченную мини-историю-отсылку, которая эмоционально возвращала бы в тот момент.


Как создавался мультфильм:
В первую очередь был написан сценарий, в котором всё было детально расписано. Помог мне в этом ChatGPT, которому я надиктовал всю историю в деталях. После добился от него сцен-план и приступил к его реализации.Сначала подготовил персонажей. Для этого использовал наши с девушкой фотографии. В основном работал с Nano Banana 2. Много времени ушло на создание похожих лиц. После этого уже делал полноценные sheet сборки с разными позами, эмоциями и крупностями.Дальше ключевые кадры локации и на основе фотографий из интернета получил что-то похожее на реальное место, в котором мы находились в тот день. Изредка пользовался GPT Image 2.0, если не получалось правильно расположить камеру, передвинуть лавочку и т. д. В некоторых сценах он лучше понимал, что нужно, в отличие от NB2, но был дороже. Также использовал Photoshop, чтобы добить картинку или убрать мусор. Почти во всех сценах я финально объединял персонажей и локацию, подготавливая к анимации, по сути, ключевой кадр.

Анимация создавалась с помощью Seedance 2.0 и Kling 3.0. Для сохранения внешности персонажей между сценами я всегда подгружал две sheet картинки с нашими персонажами и одну ключевую локации вместе с ними. Для написания промптов в Seedance я создал себе агента через клода, который понимал архитектуру модели. Также я загрузил ему данные с официального сайта ByteDance о том, как грамотно писать промпты. С таким подходом почти с первого нажатия кнопки я получал устраивающий меня результат. Сиденский в этой задаче — мой фаворит(естественно) но клинг был хорош в простых сценах, например с крупным планом лица или шагами по песку, и стоил дешевле. Перед каждым нажатием кнопки я десять раз всё перепроверял и пытался спрогнозировать результат, внимательно читая промпт.

Технические детали:
Картинки делал во Flora.ai. Очень кайфанул: удобная нодовая структура, и на тот момент у каждой модели была фиксированная цена за генерацию независимо от выбора 2K/4K. Это было очень дёшево, плюс был бонус за переход на тарифе. Сейчас, увы, эту схему они пересмотрели и сделали как у всех.
Анимацию делал в Higgsfield, без всяких студий и наворотов. 1080p без апскейлов.
Монтаж, цветокор и финальную обработку делал в DaVinci Resolve. Звук брал на Envato и слегка дорабатывал его под монтаж в Suno. SFX также брал на Envato.
На всё вместе ушло около пяти дней, иногда без сна, хотя реализацию мультфильма я планировал около года.

Затраты на нейросети и сервисы:
Flora.ai — Nano Banana 2, GPT Image 2.0, Upscale — 30 $
Higgsfield — Seedance 2.0, Kling 3.0 — 50 $ за 1000 токенов, из которых в конце осталось 120
ChatGPT, Claude — годовые подписки, 20 $
Envato — годовая подписка
Suno — бесплатная версия

В итоге получился личный подарок на день рождения, который по затратам на генерации стоит меньше 100 $, а общая стоимость ролика — бесценна.

@cgevent
👎30👍2712😁6🔥5