Валера Ковальский
Завтра, 30.06.2026 Запишем новый стрим по самой базе (по версии Валеры Ковальского) Изучим то, что именно все перепрыгивают когда открывают GUI для вайбкодинга Опустимся в самые недра терминалов и сборки ядра Linux (шучу). Приходите, будет интересно. Также…
Настроим рабочее место разработчика
Попробуем уложится в 1-2 часа
Ну что чутка раньше начнем
Раньше закончим!
https://telemost.360.yandex.ru/live/eec190763e54494891c33a2f092cd9e2
Попробуем уложится в 1-2 часа
Ну что чутка раньше начнем
Раньше закончим!
https://telemost.360.yandex.ru/live/eec190763e54494891c33a2f092cd9e2
telemost.360.yandex.ru
Яндекс Телемост — бесплатные видеовстречи без регистрации и ограничения по времени
Бесплатные видеоконференции и встречи прямо в браузере. Подключение без регистрации, удобно с ПК и телефона. Работайте, учитесь и общайтесь онлайн
❤15🔥11👍5🤡4
Валера Ковальский
Настроим рабочее место разработчика Попробуем уложится в 1-2 часа Ну что чутка раньше начнем Раньше закончим! https://telemost.360.yandex.ru/live/eec190763e54494891c33a2f092cd9e2
Всем спасибо за участие! Стрим завершился
Мы собрали более 350 зрителей на стартовом вводном стриме «Как настроить рабочее место разработчика по мнению Валеры Ковальского».
Пишите в комментариях, что бы вы хотели разобрать в следующих сериях.
Отберу лучшие запросы и разберем!
Что мы ставили и настраивали тут
Запись будет!
После вступления в группу для коментов не забывайте пройти капчу по ссылке https://t.iss.one/neuraldeepchat
Мы собрали более 350 зрителей на стартовом вводном стриме «Как настроить рабочее место разработчика по мнению Валеры Ковальского».
Пишите в комментариях, что бы вы хотели разобрать в следующих сериях.
Отберу лучшие запросы и разберем!
Что мы ставили и настраивали тут
Запись будет!
После вступления в группу для коментов не забывайте пройти капчу по ссылке https://t.iss.one/neuraldeepchat
👍49🔥32❤9
Forwarded from Илья Филиппов
2026_07_09_калькулятор_LLM_инференса_filippov_GenAI.xlsx
25.2 KB
Сколько на самом деле стоит 1M токенов на своём железе
Сделал калькулятор того, как стоимость своего GPU переходит в себестоимость токенов.
Оказалось, что достаточно нетривиальная задача, тк челленджит все знания об LLM: как работают слои, чем MoE отличается от dense, как устроен KV cache. В общем обновил по пути все свои знания GenAI. Понятно, что куча допущений внутри, а параметры собирал Fable, надо тестировать на реальных серверах, но это может быть отправной точкой.
Что по выводам?
• Строить или покупать — это вопрос утилизации, не технологии. Сможет ли сервис создать высоукую утилизацию сервера и есть ключевой вопрос.
• MoE — скидка на скорость, но не на память. Кол-во активных параметров 3 млрд из 35: карта пишет быстро, но веса лежат целиком. Отсюда контринтуитивный результат: большие MoE модели на дешёвых картах — экономически лучшая пара, пока хватает VRAM.
• ROI-ловушка. 390% годовых и выше работает при УЖЕ НАЙДЕННОМ спросе; поиск клиентов, SLA, биллинг в модели не учтены. Поэтому супер важно обеспечить потребление, а не накупить дорогих игрушек.
Скачивайте, подставляйте свои данные и посмотрите себестоимость. Найдете ошибки - дайте знать)
Илья Филиппов
Сделал калькулятор того, как стоимость своего GPU переходит в себестоимость токенов.
Оказалось, что достаточно нетривиальная задача, тк челленджит все знания об LLM: как работают слои, чем MoE отличается от dense, как устроен KV cache. В общем обновил по пути все свои знания GenAI. Понятно, что куча допущений внутри, а параметры собирал Fable, надо тестировать на реальных серверах, но это может быть отправной точкой.
Что по выводам?
• Строить или покупать — это вопрос утилизации, не технологии. Сможет ли сервис создать высоукую утилизацию сервера и есть ключевой вопрос.
• MoE — скидка на скорость, но не на память. Кол-во активных параметров 3 млрд из 35: карта пишет быстро, но веса лежат целиком. Отсюда контринтуитивный результат: большие MoE модели на дешёвых картах — экономически лучшая пара, пока хватает VRAM.
• ROI-ловушка. 390% годовых и выше работает при УЖЕ НАЙДЕННОМ спросе; поиск клиентов, SLA, биллинг в модели не учтены. Поэтому супер важно обеспечить потребление, а не накупить дорогих игрушек.
Скачивайте, подставляйте свои данные и посмотрите себестоимость. Найдете ошибки - дайте знать)
Илья Филиппов
🔥38👍12❤5👀5
Моему GitHub ровно год
101 репозитория
72 проекта
стеки от Python до Rust
Главное не цифры на сегодня, а то, что ИИ убрал барьер между "придумал" и "выложил в мир"
гипотеза
прототип
показал
120 минут =)
Не переставайте экспериментировать и показывать свои решения миру
Это ваша ценность сегодня, и то что будет сподвигать вас исследовать завтра!💀
101 репозитория
72 проекта
стеки от Python до Rust
Главное не цифры на сегодня, а то, что ИИ убрал барьер между "придумал" и "выложил в мир"
гипотеза
прототип
показал
120 минут =)
Не переставайте экспериментировать и показывать свои решения миру
Это ваша ценность сегодня, и то что будет сподвигать вас исследовать завтра!
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥129❤28👍21🤣3🤡1 1
Запись стрима не абы какая, а самая ИИшная и всё на локальном железе!
Я решил взять 3 продукта с нашего хаба:
1) https://speechcore.neuraldeep.ru/ (ASR для больших видео с возможностью выгрузить субтитры через API)
2) https://hub.neuraldeep.ru/app/overview (API к LLM-моделям и к qwen3.6-fp8 для описания видео)
3) https://hub.neuraldeep.ru/app/overview (API к qwen3.6-fp16-noreasoning для очистки терминов)
И сделал интерфейс для просмотра и взаимодействия с таким вот анализом:
- Субтитры автоматически правильные
- Хайлайты
- Транскрипт
- Спросить у LLM по видео
Смотрим тут на хабе! https://neuraldeep.ru/learn/lessons/claude-code-setup
Я решил взять 3 продукта с нашего хаба:
1) https://speechcore.neuraldeep.ru/ (ASR для больших видео с возможностью выгрузить субтитры через API)
2) https://hub.neuraldeep.ru/app/overview (API к LLM-моделям и к qwen3.6-fp8 для описания видео)
3) https://hub.neuraldeep.ru/app/overview (API к qwen3.6-fp16-noreasoning для очистки терминов)
И сделал интерфейс для просмотра и взаимодействия с таким вот анализом:
- Субтитры автоматически правильные
- Хайлайты
- Транскрипт
- Спросить у LLM по видео
Смотрим тут на хабе! https://neuraldeep.ru/learn/lessons/claude-code-setup
🔥62👍11❤9👀4
Copyosity 1.0.0 первый стабильный релиз
Давайте рассматривать это все как эксперимент!
Иногда по вечерами, и вот он
нативный менеджер буфера обмена для macOS, который реально понимает то, что ты копируешь и нравится в первую очередь он мне лично =) Реальность персональных аппов тут как тут! Крч делал исключительно для себя любимого, что бы мне было удобно и все нравилось + опыт!
Не электрон-помойка как мы привыкли видеть, а Tauri + Rust + Apple Vision под капотом
Живёт в менюбаре и не отсвечивает, пока не позовёшь.
История буфера всё скопированное, полнотекстовый поиск, закрепление, коллекции
Локальная SQLite, ничего не улетает
OCR на устройстве скопировал скриншот текст внутри картинки ищется через Apple Vision, без облака
Голос в текст зажал хоткей, наговорил, вставил чистый текст с пунктуацией
Командная палитра с ИИ-агентом полноценный ReAct-чат: видно тулколлы и reasoning, диалог можно продолжать
Веб-поиск, заметки, напоминания, календарь прямо из палитры
Хоткеи на всё ⌘⇧V история, ⌘⇧C меню у курсора, ⌘⇧Space палитра, ⌥Space голос
Итеграция с neuraldeep.ru для получения доступа к моделям
Главное для 1.0: автообновление наконец работает как надо тянет подписанные апдейты с GitHub и ставит сам
Всё подписано Developer ID, нотаризовано Apple Gatekeeper открывает чисто даже офлайн
Есть сборки под Apple Silicon и Intel, Windows(скоро)
Из идей сделать синк между устройствами
И редизайн настроек
Может чуть чуть поколдую с агентом
Байт на коменты )))))
⬇️ https://vakovalskii.github.io/copyosity/
🐙 https://github.com/vakovalskii/copyosity
Давайте рассматривать это все как эксперимент!
Иногда по вечерами, и вот он
нативный менеджер буфера обмена для macOS, который реально понимает то, что ты копируешь и нравится в первую очередь он мне лично =) Реальность персональных аппов тут как тут! Крч делал исключительно для себя любимого, что бы мне было удобно и все нравилось + опыт!
Не электрон-помойка как мы привыкли видеть, а Tauri + Rust + Apple Vision под капотом
Живёт в менюбаре и не отсвечивает, пока не позовёшь.
История буфера всё скопированное, полнотекстовый поиск, закрепление, коллекции
Локальная SQLite, ничего не улетает
OCR на устройстве скопировал скриншот текст внутри картинки ищется через Apple Vision, без облака
Голос в текст зажал хоткей, наговорил, вставил чистый текст с пунктуацией
Командная палитра с ИИ-агентом полноценный ReAct-чат: видно тулколлы и reasoning, диалог можно продолжать
Веб-поиск, заметки, напоминания, календарь прямо из палитры
Хоткеи на всё ⌘⇧V история, ⌘⇧C меню у курсора, ⌘⇧Space палитра, ⌥Space голос
Итеграция с neuraldeep.ru для получения доступа к моделям
Главное для 1.0: автообновление наконец работает как надо тянет подписанные апдейты с GitHub и ставит сам
Всё подписано Developer ID, нотаризовано Apple Gatekeeper открывает чисто даже офлайн
Есть сборки под Apple Silicon и Intel, Windows(скоро)
Из идей сделать синк между устройствами
И редизайн настроек
Может чуть чуть поколдую с агентом
Байт на коменты )))))
⬇️ https://vakovalskii.github.io/copyosity/
🐙 https://github.com/vakovalskii/copyosity
2🔥57❤26👍13⚡2😁1
Forwarded from Pavel Zloi
Сегодня выступаю на ML&DS Offstage от Ozon.
Собираемся закрытым составом ML- и DS-инженеров, тема вечера - агенты, поиск и LLM-платформы.
Мой доклад про SGR Agent Core, открытый фреймворк для агентов, расскажу, как и зачем на нём собирать своих агентов, на примерах конфигов, схемах и в коде.
Мой слот начинается в 20:35, заглядывайте в гости.
Собираемся закрытым составом ML- и DS-инженеров, тема вечера - агенты, поиск и LLM-платформы.
Мой доклад про SGR Agent Core, открытый фреймворк для агентов, расскажу, как и зачем на нём собирать своих агентов, на примерах конфигов, схемах и в коде.
Мой слот начинается в 20:35, заглядывайте в гости.
👍13❤2🔥1
Pavel Zloi
Сегодня выступаю на ML&DS Offstage от Ozon. Собираемся закрытым составом ML- и DS-инженеров, тема вечера - агенты, поиск и LLM-платформы. Мой доклад про SGR Agent Core, открытый фреймворк для агентов, расскажу, как и зачем на нём собирать своих агентов,…
А вы забыли уже про SGR Agent Core?
А оно живет и развивается!
https://github.com/vamplabAI/sgr-agent-core
А оно живет и развивается!
https://github.com/vamplabAI/sgr-agent-core
GitHub
GitHub - vamplabAI/sgr-agent-core: Schema-Guided Reasoning (SGR) has agentic system design created by neuraldeep community
Schema-Guided Reasoning (SGR) has agentic system design created by neuraldeep community - vamplabAI/sgr-agent-core
👍11🔥9👏1
Kimi K3
Ждем весов, будет 2.5T не меньше!
UPDATE:
https://www.kimi.com/blog/kimi-k3
Говорят рвет все что только было до этого
Ждем весов, будет 2.5T не меньше!
UPDATE:
https://www.kimi.com/blog/kimi-k3
Говорят рвет все что только было до этого
1🔥49👍8👀3
This media is not supported in your browser
VIEW IN TELEGRAM
1🔥40😁12🤡10🤮6🖕5❤2
Forwarded from Константин Доронин
Мы начинаем наш стрим "Харнесс будущего. Какой он?"
Подключайтесь: https://youtube.com/live/LAUdN1-4mgI
Подключайтесь: https://youtube.com/live/LAUdN1-4mgI
YouTube
Харнесс будущего. Какой он?
Подписывайтесь на Telegram:
Александр Абрамов – https://t.iss.one/dealerAI
Павел Рыков – https://t.iss.one/evilfreelancer
Тимур Хахалев – https://t.iss.one/the_ai_architect
Константин Доронин – https://t.iss.one/kdoronin_blog
Александр Абрамов – https://t.iss.one/dealerAI
Павел Рыков – https://t.iss.one/evilfreelancer
Тимур Хахалев – https://t.iss.one/the_ai_architect
Константин Доронин – https://t.iss.one/kdoronin_blog
🔥11❤3🙉3
Говорить с Qwen на одном языке
Давно хотел выложить свои локальные наработки для агентов и промптинга Qwen через кодинг агентов
Выложил гайд и skill для того, чтобы строить и промптить под модели семейства Qwen3.x на их родном диалекте так, как это делает сама Alibaba.
РЕПО: https://github.com/vakovalskii/qwen-native-agents
Давно хотел выложить свои локальные наработки для агентов и промптинга Qwen через кодинг агентов
Выложил гайд и skill для того, чтобы строить и промптить под модели семейства Qwen3.x на их родном диалекте так, как это делает сама Alibaba.
РЕПО: https://github.com/vakovalskii/qwen-native-agents
3👍33🔥20 8❤4🤔2👀2💊2
Forwarded from LLM под капотом
Kimi K3 - в топе бенчмарка LLM для агентов
По очкам модель сравнима с GPT-5.5 Pro, но раз в 15 дешевле и раза в 2 быстрее. С такими показателями она автоматом попадает на оба Парето-Фронта, сдвигая их.
Эта модель с открытыми весами размером аж в 2.8T параметров, веса обещают выложить в открытый доступ 27 июля.
Из минусов - гигантский размер и большее количество пропущенных уязвимостей. Но плюсы перевешивают. Модель с открытыми весами впервые в топе моего бенчмарка LLM на бизнес задачах (среди всех трех поколений, которые тянутся с 2023 года).
Очень круто, что засилье OpenAI моделей в топах наконец прервано. Будем теперь ждать, пока открытым модели поменьше не подвинут с фронтира и остальные экземпляры OpenAI!
Ваш, @llm_under_hood 🤗
По очкам модель сравнима с GPT-5.5 Pro, но раз в 15 дешевле и раза в 2 быстрее. С такими показателями она автоматом попадает на оба Парето-Фронта, сдвигая их.
Эта модель с открытыми весами размером аж в 2.8T параметров, веса обещают выложить в открытый доступ 27 июля.
Из минусов - гигантский размер и большее количество пропущенных уязвимостей. Но плюсы перевешивают. Модель с открытыми весами впервые в топе моего бенчмарка LLM на бизнес задачах (среди всех трех поколений, которые тянутся с 2023 года).
Очень круто, что засилье OpenAI моделей в топах наконец прервано. Будем теперь ждать, пока открытым модели поменьше не подвинут с фронтира и остальные экземпляры OpenAI!
Ваш, @llm_under_hood 🤗
❤41🔥20🤣10
От менеджера сессий к мультитерминальному решению
Я решил угореть и заснуть терминал прямо в наше с вами решении https://github.com/vakovalskii/codbash 230+ звезд 20+ контрибутеров
За 3 месяца разработки мы поддержали и встроили более 10 CLI-агентных решений для анализа и менедж сессий
Zero-deps не очень получилось поддержать =)
Зато теперь можно прокинуть такой браузер наружу и кодить по сети =), или поставить только cli или запускать через браузер или поставить dmg
Что-то начало к чему-то большему.
И я ушел с Iterm2 на Codbash.
Все так же в open-source.
Присоединяйтесь в сообщество более 20 контрибьюторов! (планирую раздачу подписок на neuraldeep.ru всем активным!)
Установить DMG
Я решил угореть и заснуть терминал прямо в наше с вами решении https://github.com/vakovalskii/codbash 230+ звезд 20+ контрибутеров
За 3 месяца разработки мы поддержали и встроили более 10 CLI-агентных решений для анализа и менедж сессий
Zero-deps не очень получилось поддержать =)
Зато теперь можно прокинуть такой браузер наружу и кодить по сети =), или поставить только cli или запускать через браузер или поставить dmg
Что-то начало к чему-то большему.
И я ушел с Iterm2 на Codbash.
Все так же в open-source.
Присоединяйтесь в сообщество более 20 контрибьюторов! (планирую раздачу подписок на neuraldeep.ru всем активным!)
Установить DMG
1🔥20❤14🤣2⚡1👀1
Forwarded from Глеб Кудрявцев про AI
Вообще, как вы видите сейчас, нефть будущего — это вовсе не софт, а железки. Покрайней мере, пока мы не вошли в сингулярность, когда ИИ начнет штамповать их
себе самостоятельно.
Всем бизнесам нужен инференс, но есть проблема: когда компании переводят процессы на LLM, они просто охреневают от счетов за API OpenAI или Claude.
Рынок ломается о стоимость вычислений. Которые можно сильно сократить, если оптимизировать косты на железо и работать со специализированными небольшими моделями, четко подобранными под задачу.
К чему это я?
Мы с @neuraldeep хотим построить свой AI-датацентр в Европе. Мы даем бизнесу тот же результат, но в 90–100 раз дешевле крупных провайдеров.
Продуктово это не просто классический хостинг, а хаб, где мы монетизируем одну железяку трижды: продаем голые токены, сдаем GPU в аренду и продаем бандлы подписок на AI-продукты (чат, RAG, OCR, транскрибация и т.д.).
Самое важное: хаб уже работает в проде и генерит кэш. Без копейки платного маркетинга откручено 21.9 млрд токенов, за 2 месяца, собрано более 1000 платящих юзеров, а операционная маржинальность инференса 90%.
Сейчас мы поднимаем Seed-раунд на $5M (за 25% доли, оценка $20M post-money),
чтобы кратно отмасштабировать флот серверов на весь мир.
Почему мы порвем этот рынок:
1) Идеальная локация. Я живу в хостинговой столице мира — Финляндии. Тут самая дешевая электроэнергия в ЕС и сосредоточены мощности Google, Microsoft, Hetzner, Небиус. В самой Финке нет амазона Амазона (мы платим за доставку из Германии), зато есть его датацентры.
2) Налоги. Местная система может отбирать 60% с зарплаты, но зато максимально благосклонно относится к реинвестированию хоть в трактора хоть в видеокарты. Будем эффективно списывать затраты на железо.
3) Умный CAPEX. Мы не сжигаем капитал на флагманские стойки с B300 под жидкостным охлаждением за бешеные миллионы. Наша ниша позволяет использовать просьюмерские RTX PRO 6000 — это дает нам на 58% больше токенов на каждый вложенный доллар.
4) Валера (@neuraldeep) — абсолютно гениальный технарь с лояльной аудиторией в 15k AI-разработчиков, который готов это отскелить на любой масштаб.
В отличие от венчура, где 90% хипстерских стартапов проедают деньги и закрываются, у нас большая часть раунда пойдет напрямую в закупку GPU.
Это хард-ассет бизнес. Риски даунсайда минимальны: даже если всё пойдет по одному месту, GPU сохраняют свою ликвидность и их можно продать любому другому датацентру, которым сейчас не хватает свободных мощностей. Вы инвестируете в ликвидное железо с окупаемостью 10-15 месяцев, а не в воздух.
Рынок GPU-инфраструктуры сейчас горячий как никогда, и окно возможностей открыто именно сейчас.
Так что если вы инвестор и вам интересно вложиться в понятную AI-инфраструктуру с подтвержденной экономикой — велкам в личку. Пришлю наш питч-дек, финмодель под NDA и отвечу на любые вопросы.
себе самостоятельно.
Всем бизнесам нужен инференс, но есть проблема: когда компании переводят процессы на LLM, они просто охреневают от счетов за API OpenAI или Claude.
Рынок ломается о стоимость вычислений. Которые можно сильно сократить, если оптимизировать косты на железо и работать со специализированными небольшими моделями, четко подобранными под задачу.
К чему это я?
Мы с @neuraldeep хотим построить свой AI-датацентр в Европе. Мы даем бизнесу тот же результат, но в 90–100 раз дешевле крупных провайдеров.
Продуктово это не просто классический хостинг, а хаб, где мы монетизируем одну железяку трижды: продаем голые токены, сдаем GPU в аренду и продаем бандлы подписок на AI-продукты (чат, RAG, OCR, транскрибация и т.д.).
Самое важное: хаб уже работает в проде и генерит кэш. Без копейки платного маркетинга откручено 21.9 млрд токенов, за 2 месяца, собрано более 1000 платящих юзеров, а операционная маржинальность инференса 90%.
Сейчас мы поднимаем Seed-раунд на $5M (за 25% доли, оценка $20M post-money),
чтобы кратно отмасштабировать флот серверов на весь мир.
Почему мы порвем этот рынок:
1) Идеальная локация. Я живу в хостинговой столице мира — Финляндии. Тут самая дешевая электроэнергия в ЕС и сосредоточены мощности Google, Microsoft, Hetzner, Небиус. В самой Финке нет амазона Амазона (мы платим за доставку из Германии), зато есть его датацентры.
2) Налоги. Местная система может отбирать 60% с зарплаты, но зато максимально благосклонно относится к реинвестированию хоть в трактора хоть в видеокарты. Будем эффективно списывать затраты на железо.
3) Умный CAPEX. Мы не сжигаем капитал на флагманские стойки с B300 под жидкостным охлаждением за бешеные миллионы. Наша ниша позволяет использовать просьюмерские RTX PRO 6000 — это дает нам на 58% больше токенов на каждый вложенный доллар.
4) Валера (@neuraldeep) — абсолютно гениальный технарь с лояльной аудиторией в 15k AI-разработчиков, который готов это отскелить на любой масштаб.
В отличие от венчура, где 90% хипстерских стартапов проедают деньги и закрываются, у нас большая часть раунда пойдет напрямую в закупку GPU.
Это хард-ассет бизнес. Риски даунсайда минимальны: даже если всё пойдет по одному месту, GPU сохраняют свою ликвидность и их можно продать любому другому датацентру, которым сейчас не хватает свободных мощностей. Вы инвестируете в ликвидное железо с окупаемостью 10-15 месяцев, а не в воздух.
Рынок GPU-инфраструктуры сейчас горячий как никогда, и окно возможностей открыто именно сейчас.
Так что если вы инвестор и вам интересно вложиться в понятную AI-инфраструктуру с подтвержденной экономикой — велкам в личку. Пришлю наш питч-дек, финмодель под NDA и отвечу на любые вопросы.
🔥70😁23❤13🤡3🤯2🙉2