Python RU
12.4K subscribers
1.04K photos
100 videos
40 files
1.28K links
Все для python разработчиков

админ - @haarrp

@python_job_interview - Python собеседования

@ai_machinelearning_big_data - машинное обучение

@itchannels_telegram - 🔥лучшие ит-каналы

@programming_books_it - it книги

@pythonl

РКН: clck.ru/3Fmy2j
Download Telegram
Forwarded from Machinelearning
✔️ Qwen анонсировала модель для управления роботами разных конструкций

Подразделение Alibaba сообщила о выпуске Qwen-VLA - модели, которая способна управлять роботами разных типов без отдельной настройки под каждую платформу.

VLA-модели получают на вход изображение с камеры и текстовую команду, а на выходе выдают конкретные действия для робота.


Новинка построена на VL-основе Qwen3.5-4B и дополнена декодером действий на 1,15 млрд параметров.

Модель объединяет 3 типа задач: манипуляции (захват и перемещение предметов), навигацию и прогнозирование траекторий, а переключение между разными роботами требует лишь изменения текстовой инструкции.

Qwen-VLA не уступает специализированным системам, обученным под каждую отдельную задачу - GR00T (разработка NVIDIA) и π0.5 (Physical Intelligence).

На наборе тестов LIBERO Qwen-VLA показала 97,9%, на RoboTwin-Hard - 87,2%, а в экспериментах с двуруким роботом ALOHA средний процент успешных выполнений в знакомых условиях составил 83,6% и 76,9% в незнакомых.

Пока опубликован технический отчет и создан репозиторий проекта, о доступности самих моделей не сообщается.


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
4
This media is not supported in your browser
VIEW IN TELEGRAM
Какую модель Claude выбрать в 2026: Sonnet, Opus, Haiku и подписки Pro/Max

Если нужен Claude для ежедневной работы, базовый выбор - Sonnet 4.6.

Он хорошо закрывает почти всё: посты, новости, сценарии, озвучки, переводы, саммари, ресёрч по текстам, правки и обычные рабочие задачи. Это самая сбалансированная модель по качеству, скорости и стоимости.

Opus 4.8 лучше не тратить на рутину. Его стоит включать там, где реально нужна глубина:

* сложная архитектура
* разбор больших кодовых баз
* отладка пайплайнов
* тяжёлый анализ документов
* нестандартный креатив
* задачи, где ошибка дорого стоит

Haiku 4.5 — это модель для потока. Быстрые черновики, массовая обработка, классификация, простые переписывания, генерация вариантов, дешёвые итерации. Там, где важнее скорость и объём, чем максимальная глубина.

По подпискам логика такая:

Pro подойдёт, если Claude нужен периодически: написать текст, проверить идею, помочь с небольшим кодом. Но при длинных чатах, картинках, Claude Code и частых итерациях лимиты быстро начинают мешать.

Max 5x — самый практичный вариант для активной ежедневной работы. Его обычно хватает для контента, кода, анализа, длинных обсуждений и нормального рабочего ритма.

Max 20x имеет смысл брать только тем, кто реально живёт в Claude: весь день гоняет Claude Code, агентов, большие репозитории, длинные сессии и тяжёлые задачи.

Итог простой:

Для большинства оптимальная связка — Sonnet 4.6 + Max 5x.

Haiku — для быстрых массовых задач.
Opus — только для действительно сложных случаев.
Max 20x — если Claude стал основным рабочим инструментом на весь день.

#claude #claudecode #ai #нейросети
1
🔥 9B-модель на 7 ГБ, которая по тестам автора лезет на территорию 27B

На Hugging Face вышла Qwen3.5-9B The Defiant Fable от DavidAU. Это многоэтапный fine-tune Qwen3.5-9B с упором на reasoning, instruction following, код и creative-задачи. Модель распространяется под Apache 2.0, а автор также позиционирует её как uncensored/heretic-версию с минимальными отказами.

Самое интересное в результатах. По собственному набору из семи бенчмарков автор заявляет, что 9B-версия обходит базовые Qwen3.5-9B, Qwen3.5-27B и Qwen3.6-35B-A3B, а местами приближается к Qwen3.6-27B. Причём сильные результаты сохраняются даже после 4-bit квантования. Это пока именно авторские тесты, а не независимый leaderboard.

Для локального запуска уже готовы обычные и MTP GGUF с NEO IMATRIX. Q4_K_M занимает примерно 6,8-7 ГБ, IQ3_M около 5,6 ГБ, а экстремальный IQ2_M всего 4,94 ГБ.

Контекст у базовой архитектуры до 262K токенов. Запускать можно через llama.cpp, Ollama, LM Studio, vLLM и другие локальные рантаймы, а через llama.cpp сразу поднимается OpenAI-compatible API.

Если независимые тесты подтвердят цифры, это хороший пример того, насколько далеко сейчас можно вытянуть маленькую 9B-модель правильным fine-tuning, merge и квантованием.

#AI #Qwen #LLM #LocalAI #GGUF
👍62