VAI
4.86K subscribers
545 photos
93 videos
4 files
173 links
15 лет в компьютерной графике, 6 лет - арт-директор.
Работал над десятками проектов.
Изучаю ИИ для развития и собираю здесь свой опыт, находки и эксперименты.
Присоединяйтесь!
Личный контакт - @AlexBakakin
Boosty - boosty.to/vai_art

AI l ИИ
Download Telegram
Когда-нибудь мы сможем играть в наши любимые игры разных времен переключив стилистику в настройках графики.

Поэкспериментировал со стилями культовых игр.

Все узнали?

@VAI_ART
#VAI_Gallery
1🔥113
Интересно, как сильно ИИ влияет на вещи, которые раньше отнимали кучу времени.

В общем, я давно не переустанавливал винду и комп, особенно когда много всего запущено, начал сильно подвисать.

Пришёл к Клоду и попросил посмотреть, что происходит с системой. 10 минут он пыхтел, вернулся и сказал, что стоит удалить, и что починил. У меня так комп уже давно не летал. 🙂

@VAI_ART
#VAI_Notes
Please open Telegram to view this post
VIEW IN TELEGRAM
👍9🔥4
Немного новостей в ИИ за неделю. Все по плану. Погнали!

🔹 FLUX 3 — Black Forest Labs восстали из пепла
Пока это ранний доступ по заявке: видео через API и веса избранным партнёрам, версия для изображений обещана в ближайшие недели.
— ролики до 20 секунд со звуком, который генерируется вместе с картинкой, а не подкладывается сверху
— умеет text-to-video, image-to-video, video-to-video и продолжение готового ролика, плюс работает как редактор изображений
— на той же архитектуре сделали FLUX-mimic для роботов — она уже крутится на линиях Audi


Презентация в комментариях.

🔹 Claude Opus 5 — Anthropic выпустили модель уровня Fable 5 за половину цены
$5/$25 за 1М токенов — как у прошлого Opus, контекст 1М. Стала дефолтной в Max и самой сильной на Pro.
— на ARC-AGI 3 набирает втрое больше ближайшего конкурента
— первой решила все шесть задач математической олимпиады IMO 2026 на 42 балла из 42
— в агентных задачах тратит заметно меньше токенов на ту же работу


Графики в комментариях.

🔹 Qwen-Image 3.0 — Alibaba научили модель рисовать читаемый текст и вёрстку
Доступна бесплатно в веб-чате. Весов и техотчёта не выложили.
— держит текст размером от 10 пикселей и формулы — можно верстать инфографику и раскадровки прямо в генерации
— принимает промпт до 4500 токенов, то есть подробное ТЗ на всю картинку целиком
— 12 языков нативно, без кракозябр


🔹 Midjourney 8.2 — версия из превью стала основной
Включается по умолчанию, флаг больше не нужен. Апдейт про эстетику и персонализацию.
— персонализация точнее ловит ваш вкус, особенно если накоплено много рейтингов
— пул картинок для сбора нового профиля персонализации стал больше

🔹 ElevenLabs Vocals — теперь можно петь своим голосом
Обновление ElevenMusic: генерация песен с вокалом плюс подбор стиля по референсу.
— вокал можно взять свой или из библиотеки голосов
— заливаете трек от 10 секунд до 5 минут — модель повторяет его стиль и настроение
— все загруженные голоса и песни проходят проверку на копирайт до генерации

🔹 Seed Audio 1.0 — ByteDance добавили русский язык и точный тайминг
Обновление уже доступно через BytePlus.
— 20 языков вместо двух, русский в списке
— реплики расставляются по секундам — попадает в монтаж без подгонки
— в одной генерации сразу диалог, музыка и эффекты, голоса персонажей не путаются


🔹 Health в ChatGPT — OpenAI пустили чат в медкарту
Отдельный раздел в боковом меню, пока только США,18+, веб и iOS. Работает на всех тарифах, включая бесплатный.
— с разрешения подтягивает Apple Health и записи из клиник: лекарства, анализы, визиты, сон, активность
— сравнивает свежие анализы с прошлыми и пересказывает,что изменилось с последнего приёма
— эти данные не идут в обучение и рекламу, шифруются отдельно от остальных чатов


🔹 Fugu-Ultra 1.1 — Sakana обновили модель, которая раздаёт задачи другим моделям
Это не одна нейросеть, а оркестратор:под каждую подзадачу поднимает агентов на Claude, Gemini или GPT. Цена прежняя — $5/$30 за 1М токенов.
— плюс до 7.9 балла к прошлой версии, сильнее всего подтянули код и работу в терминале
— торчит наружу одним API в формате OpenAI — подключается туда же, куда обычная модель


График в комментариях.

Не смог пройти мимо следующей новости.

🔹 Roblox Build — игру теперь собирают текстовым запросом.
Пишете «приключение в лесу с монстрами» — получаете рабочий прототип, который тут же публикуется. Публичный тест стартует на днях в Новой Зеландии, базовый доступ обещают бесплатным.
— генерирует не картинку, а саму заготовку: окружение, персонажей, механику, звук и стиль
— начали на телефоне, продолжаете в Roblox Studio — история запросов и серверная часть общие
— следом обещают агентов, которые сами тестируют игру, ищут баги и объясняют аналитику словами


По факту очередная песочница для залипания.

Презентация в комментариях.

🔹 Unity CLI — движок открыли для ИИ-агентов
Claude Code, Cursor и тд. теперь управляют проектом Unity прямо из терминала. Бесплатно, пока бета.

— агент выполняет C# из терминала и сразу видит результат в проекте
— режим MCP оставили, старые связки с агентами работают


Пример в комментариях.

@VAI_ART
#VAI_News
👍4🔥31
This media is not supported in your browser
VIEW IN TELEGRAM
Последнее время много новостей о том, как за один заход генерируют довольно крупные по объёму проекты. Решил поделиться одним, который увидел в сети.

Claude Opus 5 за сутки собрал космический симулятор

Разработчик оставил модель работать в одной непрерывной сессии - на выходе The Long Silence, браузерная игра про исследование космоса. Автор утверждает, что код, графику и звук целиком написала модель.

Что есть внутри:
- процедурная генерация звёзд, планет, колец и туманностей
- высадка на поверхность
- межзвёздные перелёты и fold drive
- сканирование объектов, станции, покинутые корабли
- галактическая карта, сюжетная линия и архив собранных данных
- адаптивное качество картинки ради стабильных 60 FPS

Всё крутится на WebGL2 и, как утверждает автор, без единого готового ассета: миры разворачиваются из сида, рендер - на GLSL, музыка и звуки синтезируются на лету.

Далеко незаконченный продукт, но для суток работы модели результат впечатляющий.

Кстати, интересный момент: модель не всегда генерирует всё сама - периодически подтягивает ассеты с бесплатных стоков и вставляет прямо в игру. Недавно на этом был скандал: проект подавали как полностью сгенерированный ИИ, а потом пришёл автор ассетов и сказал, что материалы его. Ситуация показательная.

Поиграть тут. Посмотреть код тут.

@VAI_ART
#VAI_Notes
👍6🔥62🤯2
В общем, я тут за вечерок небольшой проект сделал. Решил новую рубрику открыть. В которой будут полезные инструменты и сервисы.

Вижу, что у многих сейчас проблемы с поиском работы, так как индустрию штормит, поэтому решил сделать сайт, на котором собираются вакансии от работодателей. Парсится всё, что можно, из доступных сервисов, сайтов, тг-каналов, и на сайт выводится общий список вакансий, которые есть в открытом доступе.

Пока просто для теста, но хочется, чтобы объявления обновлялись каждый день, закрытые архивировались и т. д. Работы еще много. Сейчас есть деление по вакансиям и рынкам.

Надеюсь, кому-то поможет. Если зайдёт, то доработаю по дизайну и функционалу, ну и поставлю агентов на постоянную поддержку, чтобы самому не возиться)

По сути, сейчас сделать можно всё что угодно, нужна только идея и чутка желания. И уже выбираешь, на что потратить своё время, чтобы это было действительно чем-то нужным.

Заодно хотел попрактиковаться с мультиагентными системами в работе.

Если кому-то поможет, то будет достаточно спасибо.

Ставьте/пишите что-нибудь, чтобы было понятно, нужно ли.

@VAI_ART
#VAI_TOOLS
2🔥20👍12🤗4
Пробежимся по новостям за неделю.

🔹 MiniMax H3 — видеомодель с 2K и звуком, которую обещают выложить в открытый доступ
Вышла 30 июля, уже крутится на fal и OpenRouter. Веса обещают в ближайшие дни — если сдержат слово, это будет самая сильная открытая видеомодель.
— ролики 5-15 секунд в 2K, со стереозвуком: голоса, музыка и эффекты генерируются вместе с картинкой
— в одном промпте принимает текст, картинки, видео и аудио — смешивайте референсы персонажей и сцен
— умеет редактировать готовое видео и переносить движение с одного ролика на другой


Пример в комментариях.

🔹 Seedance 2.5 — ByteDance наконец официально запустили модель
Релиз 31 июля: Dreamina по всему миру, Jimeng и Doubao в Китае. API обещают 7 августа.
— 30 секунд видео со звуком одним дублем, без склеек; в бете растягивается до трёх минут
— до 50 референсов в одной генерации: персонажи, объекты, стиль
— появились плагины для Blender и Maya — черновой превиз из 3D превращается в готовый кадр


Презентации и сравнения со второй версией в комментариях.

🔹 Grok Imagine 1.5 — добавили референсы персонажей и голос
Апдейт от 1 августа для видеомодели Imagine 1.5: уже на сайте и в iOS, референсы стартовали в США на SuperGrok Plus и Heavy.
— до семи картинок-референсов сразу: персонаж, окружение, реквизит — сериал не разваливается от кадра к кадру
— если дать вместе фото и образец голоса, персонаж звучит одинаково во всех сценах
— 1080p генерится нативно, без апскейла на выходе


Презентация в комментариях.

🔹 Lyria 3.5 — Google переписали генератор музыки в Flow Music
Вышла 29 июля, доступна в Flow Music всем, включая бесплатный тариф. Обучена на лицензированных данных — в отличие от Suno и Udio, которые судятся с Sony.
— вокал стал выразительнее, слова проговариваются внятно
— держит структуру текста: куплет остаётся куплетом, припев припевом
— темп и длительность песни теперь задаются вручную


🔹 Kimi K3 — Moonshot всё-таки выложили веса флагмана
Обещали до 27 июля — успели впритык. Лицензия разрешает коммерческое использование.
— скачать может кто угодно, но файл весит 1.4 ТБ и для запуска нужны сотни гигабайт видеопамяти
— важнее другое: теперь модель может поднять у себя любой провайдер, и цена за токены пойдёт вниз


🔹 Nano Banana 2 в Google Earth — любую точку планеты можно перерисовать промптом
Кнопка Create image в веб-версии Google Earth, раскатывают глобально.
— опирается на реальные спутниковые и 3D-данные, поэтому геометрия места сохраняется
— работает и в прошлое, и в будущее: реконструкция руин или концепт застройки на пустыре


Пример в комментариях.

🔹 GPT-5.6 подешевел — OpenAI срезали цены через три недели после релиза
Цены в API снизили 30 июля.
— Luna дешевле в пять раз: $0.20/$1.20 за 1М токенов вместо $1/$6
— Terra минус 20%: $2/$12
— у Sol цена прежняя, но появился Fast mode — вдвое дороже, до 2.5 раз быстрее


График по ценам в комментариях.

🔹 Обновили MCP — подключать ИИ-агента к сервисам стало проще
MCP — стандарт, по которому агент ходит в вашу почту, календарь, Notion или базу: под каждый сервис пишется переходник, MCP-сервер. 28 июля вышла новая версия — крупнейшая с запуска.
— раньше переходник держал постоянное соединение и помнил всю сессию, поэтому его приходилось круглосуточно крутить на своём сервере
— теперь каждый запрос самодостаточный: переходник можно повесить на дешёвый облачный сервис, который просыпается на вызов
— в итоге свой MCP-сервер стало дешевле держать и проще написать


🔹DeepSeek V4-Flash — вышла из превью и подтянулась в агентных задачах
Официальный релиз 31 июля. Архитектуру не трогали, весь прирост — за счёт дообучения. Цена $0.14/$0.28 за 1М токенов.
— на агентном кодинге обходит собственную старшую V4-Pro-Preview
— контекст 1М токенов, параллельные вызовы инструментов, три уровня размышлений
— нативно поддерживает Responses API — подключается в Codex как родная


График в комментариях.

@VAI_ART
#VAI_News
👍53
Сегодня добавили новые фишки в GPT. Сейчас генерировать концепты/изображения можно достаточно легко. Уже давно можно попросить сгенерировать сразу 10 вариантов, и он сделает. А вот сегодня заметил, что он сам начал себя править. Отправил запрос на генерацию, и он сделал не так, как я хотел. Он, не дожидаясь конца, сразу написал, что ошибся в некоторых местах и сейчас всё исправит, и что самое интересное - правда исправил). Это круто, что они встроили проверку перед тем, как отдать результат. Получить желаемый вариант теперь намного проще.

@VAI_ART
#VAI_Notes
👍112🙈1
Forwarded from AI-Шипучка
Всем пшшшш, мои шипучие, наконец то выложила оставшиеся переводы и адаптации курсов Anthropic на русском языке.

Гайд по всем шести курсам: что где лежит и в каком порядке это брать.

48 уроков, все бесплатно и без регистрации. Прогресс сохраняется прямо в браузере, так что можно бросить на середине и вернуться через неделю.

Сначала маршруты, потом что внутри каждого.

———

ЕСЛИ ВЫ НЕ ПИШЕТЕ КОД

Первый, второй, третий. Примерно десять часов, и вы закрываете весь путь от «я не понимаю, как с ним разговаривать» до «я собираю рабочие промпты под свои задачи».

ЕСЛИ ВЫ РАЗРАБОТЧИК

Второй, четвёртый, пятый. База по промптам, потом API, потом инструменты. Первый курс можно пролистать, но не пропускайте четвёртый ради пятого: агенты без понимания messages разваливаются в первый же вечер.

ЕСЛИ ВЫ УЖЕ ЧТО-ТО ВЫКАТИЛИ НА ЛЮДЕЙ

Сразу шестой. Он неприятный и самый полезный.

———

1. Свободное владение ИИ
13 уроков, без кода

Про то, как вообще устроена работа с ИИ: что ему отдавать, а что делать самой, как объяснять, чему верить и что перепроверять. Тот случай, когда после курса меняется не набор приёмов, а привычка думать. Начинать с нуля - отсюда.
aishipuchka.com/courses/ai-fluency/

2. Промпт-инжиниринг
9 глав, ≈20 минут на главу, без кода

Курс, по которому промптингу учатся сами инженеры Anthropic. Устройство запроса, роли, XML-теги, примеры, пошаговое рассуждение, борьба с галлюцинациями, сборка сложных промптов с нуля. Скелет, на котором держится всё остальное.
aishipuchka.com/courses/prompt-engineering/

3. Промптинг на реальных задачах
5 уроков, ≈30 минут, без кода

Три настоящие задачи целиком: данные из медицинской карты, саммари телефонного разговора, бот поддержки по своей базе. Первая версия промпта, что сломалось, что дописали. Про то, что хороший промпт не пишется, а отлаживается.
aishipuchka.com/courses/real-world-prompting/

4. Основы Claude API
6 уроков, ≈25 минут, Python

Выход из окна чата в код. Первый запрос, формат messages, почему модель ничего не помнит, чем модели отличаются, параметры, стриминг, картинки. Скучно ровно настолько, насколько обязательно.
aishipuchka.com/courses/api-fundamentals/

5. Инструменты для Claude

6 уроков, ≈30 минут, Python

Как модель вызывает ваш код. Вы описываете функции, она говорит какую позвать, выполняете вы. Из этого цикла собраны все агенты и MCP. После курса «агент» перестаёт быть магией и становится архитектурой.
aishipuchka.com/courses/tool-use/

6. Оценка промптов
9 уроков, ≈25 минут, Python

Как понять, что промпт стал лучше, а не «вроде лучше». Тестовые наборы, проверка ответов кодом, оценка моделью по вашей рубрике, автоматический прогон при каждом изменении. Самый пролистываемый и самый важный курс из шести.
aishipuchka.com/courses/prompt-evaluations/

———

Все бесплатно, потому что лицензия прямо запрещает на этом зарабатывать. Единственная просьба - если пригодилось, перешлите тому, кто до сих пор говорит нейросети «сделай красиво».

Все курсы: aishipuchka.com/courses/

🤩 - сохранил(а) гайд
🔥 - иду проходить шестой
🔥11👍85
Немного новостей в ИИ за неделю. Погнали!

🔹 Wan 3.0 — Alibaba научили видеомодель держать 30 секунд одним дублем
Публичная бета с 6 августа: Qwen Cloud и Alibaba Cloud Model Studio, полноценный API обещают позже. Весов пока не выкладывали.
— 30 секунд одной генерацией вместо 2-15 у прошлой версии: камера едет непрерывно, склеивать нечего
— на вход можно кинуть pdf, презентацию или таблицу — модель сама разбирает документ и собирает из него ролик
— звук пишется вместе с картинкой, а не подкладывается сверху
— 480p/720p/1080p по $0.05/$0.10/$0.20 за секунду — полный тридцатисекундный ролик в 1080p выходит около $6


Презентация и видео в комментариях.

🔹 Grok Imagine Image 2.0 — xAI выпустили генератор картинок с нормальным редактированием
Вышел 7 августа, работает как Quality Mode на grok.com/imagine и в приложениях. На обеих аренах второе место — после gpt-image-2. API обещают позже.
— «волшебная палочка» правит выделенный кусок картинки, не перерисовывая всё остальное
— вырезает объект и отдаёт с прозрачным фоном — можно сразу тащить в композ
— принимает до пяти референсов за раз: персонаж, фон и объект собираются в один кадр без ручной склейки
— Smart Resize перекомпоновывает картинку под девять пропорций, а не просто кропает


Презентация и примеры в комментариях.

🔹 FLUX 3 Video — Black Forest Labs открыли видеомодель всем
В июле она была по заявке избранным партнёрам, с 4 августа доступна через API BFL любому. По замерам BFL обходит конкурентов в text-to-video и идёт вровень с Seedance 2.0 в image-to-video.
— ролики до 20 секунд одной генерацией: HD нативно, Full HD через апскейл
— звук и диалоги генерируются вместе с картинкой, липсинк на 14 языках
— есть черновой режим — прогоняете идею дёшево и рендерите в качестве только финал
— умеет продолжать готовый ролик и собирать несколько сцен подряд, не теряя связность


Видео в комментариях.

🔹 Wan Animate 2 — Alibaba переносят движение с видео на персонажа без скелета
Открытая модель от Tongyi Lab, демо и код уже выложены, веса базовой версии обещают следом.
— раньше движение сначала превращали в скелет и теряли детали; теперь модель ест исходное видео целиком — мимика и пальцы остаются на месте
— ракурс камеры задаётся текстом отдельно от исходника: та же сцена с другой точки
— тянет несколько персонажей в кадре, а версия Lite считает почти в реальном времени


🔹 Qwen3.8-Max — Alibaba выкатили флагман на 2.4 триллиона параметров
Релиз 3 августа, пока только по API за $2/$6 за 1М токенов. На следующей неделе обещают выложить веса — впервые для Max-модели.
— контекст 1М токенов, на вход идут текст, картинки и видео
— заточена под длинные задачи: сама планирует, пишет код, запускает инструменты и правит свои ошибки
— на тесте работы за компьютером OSWorld-Verified — 86.1, выше GPT-5.6 Sol Max и Claude Fable 5


Как обычно побивает всех. Графики в комментариях.

🔹 Muse Spark 1.2 и Muse Code — у Meta появилась своя модель для кода и агент к ней
5 августа. Модель доступна через Meta Model API, агент в терминале — в бете. $1.25/$4.25 за 1М токенов.
— контекст 1М, обучали на целых репозиториях, а не на отдельных файлах
— агент пишет все свои действия в локальный лог: прогон можно точно повторить или продолжить после падения
— есть тариф в десять раз дешевле, если разрешить обучать модель на ваших запросах


Графики в комментариях.

🔹 Grok Voice Think Fast 2.0 — голосовая модель xAI стала дефолтной
Вышла 29 июля, а 5 августа на неё переключили grok-voice-latest — теперь её получают все, кто дёргает API по умолчанию. $0.08 за минуту разговора.
— отвечает через 0.7 секунды вместо 1.25 — пауза перестаёт быть заметной в живом диалоге
— распознаёт речь в полтора-два раза точнее Deepgram Nova 3 и ElevenLabs Scribe v2, а в шуме разрыв доходит до десяти раз
— успевает вызвать нужный инструмент до того, как договорит первую фразу


@VAI_ART
#VAI_News
2👍2
VAI
В общем, я тут за вечерок небольшой проект сделал. Решил новую рубрику открыть. В которой будут полезные инструменты и сервисы. Вижу, что у многих сейчас проблемы с поиском работы, так как индустрию штормит, поэтому решил сделать сайт, на котором собираются…
В общем, ещё пару вечеров посидел и более-менее довёл до ума.

Из сделанного:
— сильно расширился поиск, а по итогу стало намного больше вакансий
— у вакансии появилась своя страница
— стало понятно, что где искать (новая сортировка)
— сайт стал быстрым

и многое другое.

Дизайн трогать не стал: чёрно-белый минимализм, что может быть лучше для подобного продукта 😎

Потыкайте, если ещё что-то нужно - добавлю и пойду дальше, а так он полностью автономный, вакансии будут пополняться и закрываться автоматически.

@VAI_ART
#VAI_TOOLS
Please open Telegram to view this post
VIEW IN TELEGRAM
👍15🔥2
Давненько не было практики. 🫡

Я разработал небольшой и простой пайплайн для текстурирования моделей. Ни на что не претендую, но способ реально рабочий и помогал мне уже не раз. К слову, недавно нужно было перетекстурировать часть объектов для локации, которые были в бэкграйнде, и этим методом я сделал это за пару часов. В старые времена мне бы потребовалось несколько дней.

Сразу скажу, что, как и многие вещи с ИИ, способ не идеальный: есть артефакты, и чем сложнее модель, тем их становится больше. Но даже так загрузить потом модель в Substance, Coat и другие аналоги и подправить руками - намного быстрее, чем делать с нуля.

Сам пайплайн строится с пониманием того, что модель с развёрткой уже есть.

🔹 Делаю скрин/скрины модели с нужных ракурсов
🔹 Загружаю их в Imagen от GPT и прошу сделать нужную текстуру поверх модели или вариацию текстуры от существующей. Тут всё зависит от ситуации: могу подгрузить лёгкий драфт поверх или пару референсов
🔹 Получаю модель с нужной текстурой или вариации текстуры
🔹 Загружаю модель в Tripo. Тут есть оговорка: Tripo у меня куплен, и у меня полный карт-бланш с ним (там есть и некоторое количество бесплатных попыток), загружаю референс с сгенерированным изображением. Из-за того что силуэты и формы совпадают, он хорошо понимает, что нужно сделать. Также большим плюсом является то, что Tripo сохраняет развёртку загруженной модели. Могу ошибаться, но аналогов я не встречал - сервисы, которые работают с заданной развёрткой, зачастую игнорируют её и перегенерируют новую, что не очень удобно, но в целом не критично, так как это просто добавляет одну лишнюю итерацию, где нужно будет перепечь текстуру с одной модели на другую или с канала на канал в развёртке
🔹 Проделываем этот цикл столько раз, сколько нужно, чтобы получить нужные варианты текстур

Пробуйте и экономьте своё время для более интересных вещей. 🔥🔥🔥

@VAI_ART
#VAI_Practice
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥12👍811
Неделю LLM объявляю закрытой. Быстро пробежимся по самому интересному.

🔹 LTX-2.5 — Lightricks выложили открытую видеомодель, которая едет на домашней карте
Веса открыты, минимум 16 GB VRAM, ComfyUI с первого дня. Коммерция бесплатна до $10 млн выручки. API — $0.09/с за 720p, $0.15/с за 1080p, $0.37/с за 4K.
— нативный multishot: связанные шоты идут одной генерацией, персонаж, свет и голос держатся на склейках
— модель сама решает длительность сцены, а не режет по фиксированному лимиту
— новый видеодекодер даёт меньше артефактов в движении, заявлены 4K HDR и редактирование готового ролика


Видео в комментариях.

🔹 Seedream 5.0 Pro Layer Separation — ByteDance научили модель разбирать картинку на слои
Работает на fal в Playground и API. $0.034 за слой до 1536×1536 и $0.068 выше — разбор на 10 слоёв ≈ $0.34.
— на выходе от 2 до 17 PNG с прозрачностью: персонажей, предметы и фон двигаете независимо
— промптом указываете, что именно отделять, а не получаете фиксированную нарезку
— фон дорисовывается за объектом, который его закрывал — дырки не остаётся


Видео в комментариях.

🔹 Meshy 7 — image-to-3D, который точнее попадает в референс
На всех тарифах, скачивание — с Pro. Генерация меньше минуты, на выходе FBX, GLB, OBJ или USDZ.
— лучше понимает форму, но еще есть вопросики
— появился режим Smart Topology: чистая сетка, части модели разделены сразу, полигонаж от 100 до 15 000
— ultra_mode за +5 кредитов вытягивает мелкий рельеф поверхности
— полный PBR-набор albedo/normal/metallic/roughness, текстуры до 4K


Примеры в комментариях.

🔹 Gemini 3.7 Flash — Google выпустили рабочую модель под код и агентов
В Gemini API, AI Studio и Spark. До конца 2026 — $0.75/$3.75 за 1М токенов, в 2.5–3 раза дешевле Sonnet 5 и GPT-5.6 Terra. С января вдвое дороже.
— код в реальных репозиториях: закрывает две трети задач вместо половины у 3.6 Flash
— рутину в бизнес-процессах доводит до конца почти втрое чаще
— а в терминале и за компьютером работать толком не умеет: тут GPT-5.6 впереди


Графики в комментариях.

🔹 Grok 4.6 — xAI обновили флагман и целят в долгие агенты
$2/$6 за 1М токенов. Доступ сразу везде: API, Cursor, Grok Build, OpenRouter.
— за месяц догнала топовые модели по общему уровню, оставшись втрое дешевле
— лучше всех разбирает документы: на юридических задачах отрыв от GPT-5.6 шестикратный
— а код пишет слабее конкурентов — за этим идти не сюда


Презентация и график в комментариях.

🔹 GLM-5.3Z.ai вытянули модель одним post-training
База та же, что у 5.2 — весь прирост из дообучения. Пока в GLM Coding Plan и ZCode, веса позже.
— работа в терминале выросла в шесть раз — из демо в рабочий инструмент
— думает короче: на сложные задачи тратит меньше токенов, чем 5.2
— сильнее всего прибавила в поиске уязвимостей: было четверть задач, стало половина


Графики в комментариях.

🔹 Qwen3.8-27B — Alibaba выложили компактную модель под Apache 2.0
27B, контекст 262K с расширением до 1М, на вход текст, картинки и видео.
— правит код в живых проектах на уровне платных флагманов, и это всего 27B
— умеет работать за компьютером и в Android: щёлкает интерфейсы, а не только пишет текст
— заводится локально: llama.cpp, Ollama, LM Studio

Графики в комментариях.

🔹 GPT-5.6 Sol Ultrafast mode — OpenAI показали инференс на чипах Cerebras
Пока для избранных в API. До 750 токенов в секунду, ускорение до 14 раз: веса лежат прямо на огромных wafer-чипах и не гоняются между памятью и хранилищем. Прогон HLE занял 11 часов против 80 у Fable.

Презентация в комментариях.

🔹 Suno Studio 2.0 — браузерная студия дотянулась до полноценной DAW
Только подписчикам Premier: 10 000 кредитов в месяц и экспорт стемов в 32-bit / 48 kHz.
— нормальный MIDI на таймлайне: импорт, запись, редактирование, подключение контроллеров
— MIDI-клип можно скормить как промпт: сыграли аккорды — модель продолжает партию
— Chat Bar в бете: словами заказываете новый звук, обработку вокала или собственный плагин


Видео в комментариях.

@VAI_ART
#VAI_News
👍721
Media is too big
VIEW IN TELEGRAM
Моя любимая рубрика. Посты подписчиков. 🦄

На этот раз Александр прислал пост, демонстрирующий способ рендера поверх болванки.

Workflow для генерации оружия (и не только) в заданном стиле в ComfyUI.

Тут применяются две модели: Krea 2 для создания шейпа оружия и Klein Edit для наложения материалов. В случае с Klein участвует и собственная лора (Klein LoRA - это LoRA-адаптер, натренированный поверх FLUX.2 [klein]) для этой edit модели.

Krea 2 берет за основу 3D блокуат и детальный промпт, делает первую итерацию - оружие. Потом картинка из Krea 2 прогоняется через Klein. Klein лоре нужен лишь промпт, он может быть детальный, а может и простой - "примени такие-то материалы". Но лучше детальный. В итоге получается оружие в нужном стиле, в данном случае реалистичном, CoD стиле.

Материалы накладываются безупречно, все косяки приходят с формы оружия, то есть с модели Krea 2. Если натренировать лору и для модели Krea 2, то и формы объектов попадут в стиль. Что открывает возможность генерации огромного количества объектов в каком нужно стиле, чтобы, например, наполнять уже существующую вселенную.

Данный воркфлоу презентует оружие, но что им генерить зависит от лоры, что вы тренируете. Это, конечно, могут быть и пропсы, персонажи, локации и ui.

Исходники можно взять тут.

@VAI_ART
#VAI_Authors
Please open Telegram to view this post
VIEW IN TELEGRAM
👍7🔥2
Media is too big
VIEW IN TELEGRAM
В продолжение темы создания игр в одной непрерывной сессии.

Мэтт Шумер написал статью How to run a Gauntlet Loop, где рассказывает, как именно подходит к своим one-shot промптам.

Много полезных идей - можно подсмотреть, как писать промпт для больших проектов, чтобы он работал.

До этого еще показывал как он сделал Claude of Duty - клон Call of Duty за 1 промпт в Opus 5.

Upd. Докинул перевод в комментарии.

@VAI_ART
#VAI_Notes
👍5👎1👌1