🔥 Stepik Курс: «Python современный AI для разработчика и автоматизации задач» ровно про второе.
63 урока, 382 шага, ноль вдохновляющих рассуждений. В каждом уроке разбор темы с рабочим кодом, короткие вопросы и задача с автопроверкой, которая решается на чистом Python без ключей и без интернета.
Внутри то, о чём молчат туториалы: структурированный вывод по схеме, RAG, который не выдумывает, агенты с tool calling, evals и ловля регрессий, кэш, лимиты и очереди, инъекции промптов, локальный запуск через Ollama и vLLM, text-to-SQL с правами только на чтение, pgvector с HNSW, MCP и песочница для кода агента.
Плюс то, что окупается в первый же день: разбор входящей почты, отчёты без выдуманных чисел, вебхуки, боты, сценарии в браузере.
Для тех, кто уже пишет на Python и устал от демок.
72 часа скидка 55% процентов, начать учиться - https://stepik.org/a/295921
63 урока, 382 шага, ноль вдохновляющих рассуждений. В каждом уроке разбор темы с рабочим кодом, короткие вопросы и задача с автопроверкой, которая решается на чистом Python без ключей и без интернета.
Внутри то, о чём молчат туториалы: структурированный вывод по схеме, RAG, который не выдумывает, агенты с tool calling, evals и ловля регрессий, кэш, лимиты и очереди, инъекции промптов, локальный запуск через Ollama и vLLM, text-to-SQL с правами только на чтение, pgvector с HNSW, MCP и песочница для кода агента.
Плюс то, что окупается в первый же день: разбор входящей почты, отчёты без выдуманных чисел, вебхуки, боты, сценарии в браузере.
Для тех, кто уже пишет на Python и устал от демок.
72 часа скидка 55% процентов, начать учиться - https://stepik.org/a/295921
👍1
🔥 9B-модель на 7 ГБ, которая по тестам автора лезет на территорию 27B
На Hugging Face вышла
Самое интересное в результатах. По собственному набору из семи бенчмарков автор заявляет, что 9B-версия обходит базовые Qwen3.5-9B, Qwen3.5-27B и Qwen3.6-35B-A3B, а местами приближается к Qwen3.6-27B. Причём сильные результаты сохраняются даже после 4-bit квантования. Это пока именно авторские тесты, а не независимый leaderboard.
Для локального запуска уже готовы обычные и MTP GGUF с NEO IMATRIX.
Контекст у базовой архитектуры до 262K токенов. Запускать можно через llama.cpp, Ollama, LM Studio, vLLM и другие локальные рантаймы, а через llama.cpp сразу поднимается OpenAI-compatible API.
Если независимые тесты подтвердят цифры, это хороший пример того, насколько далеко сейчас можно вытянуть маленькую 9B-модель правильным fine-tuning, merge и квантованием.
#AI #Qwen #LLM #LocalAI #GGUF
На Hugging Face вышла
Qwen3.5-9B The Defiant Fable от DavidAU. Это многоэтапный fine-tune Qwen3.5-9B с упором на reasoning, instruction following, код и creative-задачи. Модель распространяется под Apache 2.0, а автор также позиционирует её как uncensored/heretic-версию с минимальными отказами.Самое интересное в результатах. По собственному набору из семи бенчмарков автор заявляет, что 9B-версия обходит базовые Qwen3.5-9B, Qwen3.5-27B и Qwen3.6-35B-A3B, а местами приближается к Qwen3.6-27B. Причём сильные результаты сохраняются даже после 4-bit квантования. Это пока именно авторские тесты, а не независимый leaderboard.
Для локального запуска уже готовы обычные и MTP GGUF с NEO IMATRIX.
Q4_K_M занимает примерно 6,8-7 ГБ, IQ3_M около 5,6 ГБ, а экстремальный IQ2_M всего 4,94 ГБ.Контекст у базовой архитектуры до 262K токенов. Запускать можно через llama.cpp, Ollama, LM Studio, vLLM и другие локальные рантаймы, а через llama.cpp сразу поднимается OpenAI-compatible API.
Если независимые тесты подтвердят цифры, это хороший пример того, насколько далеко сейчас можно вытянуть маленькую 9B-модель правильным fine-tuning, merge и квантованием.
#AI #Qwen #LLM #LocalAI #GGUF
👍6❤2
⚡️ Harness Engineering - полный курс на русском
Как заставить AI-агента писать код надёжно. Не «какую модель выбрать», а как спроектировать вокруг неё рабочую систему: инструкции, инструменты, среду, состояние и верификацию.
Курс - от нуля до продвинутых тем: теоретическая база из 11 блоков, 14 модулей, 8 практических проектов, 14 лабораторных работ, диагностический протокол «как починить агента», библиотека готовых шаблонов, карта инструментов, 40 приёмов и каталог антипаттернов.
Главный тезис курса: способность модели и надёжность исполнения - это две разные вещи. Одна и та же модель в «голой» среде и в среде с продуманным harness даёт качественно разные результаты. Апгрейд модели - это самый дорогой и обычно не самый эффективный способ починить агента.
https://github.com/justxor/Harness_ru
Как заставить AI-агента писать код надёжно. Не «какую модель выбрать», а как спроектировать вокруг неё рабочую систему: инструкции, инструменты, среду, состояние и верификацию.
Курс - от нуля до продвинутых тем: теоретическая база из 11 блоков, 14 модулей, 8 практических проектов, 14 лабораторных работ, диагностический протокол «как починить агента», библиотека готовых шаблонов, карта инструментов, 40 приёмов и каталог антипаттернов.
Главный тезис курса: способность модели и надёжность исполнения - это две разные вещи. Одна и та же модель в «голой» среде и в среде с продуманным harness даёт качественно разные результаты. Апгрейд модели - это самый дорогой и обычно не самый эффективный способ починить агента.
https://github.com/justxor/Harness_ru
❤2👍2🔥2