Forwarded from Machinelearning
Подразделение Alibaba сообщила о выпуске Qwen-VLA - модели, которая способна управлять роботами разных типов без отдельной настройки под каждую платформу.
VLA-модели получают на вход изображение с камеры и текстовую команду, а на выходе выдают конкретные действия для робота.
Новинка построена на VL-основе Qwen3.5-4B и дополнена декодером действий на 1,15 млрд параметров.
Модель объединяет 3 типа задач: манипуляции (захват и перемещение предметов), навигацию и прогнозирование траекторий, а переключение между разными роботами требует лишь изменения текстовой инструкции.
Qwen-VLA не уступает специализированным системам, обученным под каждую отдельную задачу - GR00T (разработка NVIDIA) и π0.5 (Physical Intelligence).
На наборе тестов LIBERO Qwen-VLA показала 97,9%, на RoboTwin-Hard - 87,2%, а в экспериментах с двуруким роботом ALOHA средний процент успешных выполнений в знакомых условиях составил 83,6% и 76,9% в незнакомых.
Пока опубликован технический отчет и создан репозиторий проекта, о доступности самих моделей не сообщается.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
❤4
This media is not supported in your browser
VIEW IN TELEGRAM
Какую модель Claude выбрать в 2026: Sonnet, Opus, Haiku и подписки Pro/Max
Если нужен Claude для ежедневной работы, базовый выбор - Sonnet 4.6.
Он хорошо закрывает почти всё: посты, новости, сценарии, озвучки, переводы, саммари, ресёрч по текстам, правки и обычные рабочие задачи. Это самая сбалансированная модель по качеству, скорости и стоимости.
Opus 4.8 лучше не тратить на рутину. Его стоит включать там, где реально нужна глубина:
* сложная архитектура
* разбор больших кодовых баз
* отладка пайплайнов
* тяжёлый анализ документов
* нестандартный креатив
* задачи, где ошибка дорого стоит
Haiku 4.5 — это модель для потока. Быстрые черновики, массовая обработка, классификация, простые переписывания, генерация вариантов, дешёвые итерации. Там, где важнее скорость и объём, чем максимальная глубина.
По подпискам логика такая:
Pro подойдёт, если Claude нужен периодически: написать текст, проверить идею, помочь с небольшим кодом. Но при длинных чатах, картинках, Claude Code и частых итерациях лимиты быстро начинают мешать.
Max 5x — самый практичный вариант для активной ежедневной работы. Его обычно хватает для контента, кода, анализа, длинных обсуждений и нормального рабочего ритма.
Max 20x имеет смысл брать только тем, кто реально живёт в Claude: весь день гоняет Claude Code, агентов, большие репозитории, длинные сессии и тяжёлые задачи.
Итог простой:
Для большинства оптимальная связка — Sonnet 4.6 + Max 5x.
Haiku — для быстрых массовых задач.
Opus — только для действительно сложных случаев.
Max 20x — если Claude стал основным рабочим инструментом на весь день.
#claude #claudecode #ai #нейросети
Если нужен Claude для ежедневной работы, базовый выбор - Sonnet 4.6.
Он хорошо закрывает почти всё: посты, новости, сценарии, озвучки, переводы, саммари, ресёрч по текстам, правки и обычные рабочие задачи. Это самая сбалансированная модель по качеству, скорости и стоимости.
Opus 4.8 лучше не тратить на рутину. Его стоит включать там, где реально нужна глубина:
* сложная архитектура
* разбор больших кодовых баз
* отладка пайплайнов
* тяжёлый анализ документов
* нестандартный креатив
* задачи, где ошибка дорого стоит
Haiku 4.5 — это модель для потока. Быстрые черновики, массовая обработка, классификация, простые переписывания, генерация вариантов, дешёвые итерации. Там, где важнее скорость и объём, чем максимальная глубина.
По подпискам логика такая:
Pro подойдёт, если Claude нужен периодически: написать текст, проверить идею, помочь с небольшим кодом. Но при длинных чатах, картинках, Claude Code и частых итерациях лимиты быстро начинают мешать.
Max 5x — самый практичный вариант для активной ежедневной работы. Его обычно хватает для контента, кода, анализа, длинных обсуждений и нормального рабочего ритма.
Max 20x имеет смысл брать только тем, кто реально живёт в Claude: весь день гоняет Claude Code, агентов, большие репозитории, длинные сессии и тяжёлые задачи.
Итог простой:
Для большинства оптимальная связка — Sonnet 4.6 + Max 5x.
Haiku — для быстрых массовых задач.
Opus — только для действительно сложных случаев.
Max 20x — если Claude стал основным рабочим инструментом на весь день.
#claude #claudecode #ai #нейросети
❤1
🔥 9B-модель на 7 ГБ, которая по тестам автора лезет на территорию 27B
На Hugging Face вышла
Самое интересное в результатах. По собственному набору из семи бенчмарков автор заявляет, что 9B-версия обходит базовые Qwen3.5-9B, Qwen3.5-27B и Qwen3.6-35B-A3B, а местами приближается к Qwen3.6-27B. Причём сильные результаты сохраняются даже после 4-bit квантования. Это пока именно авторские тесты, а не независимый leaderboard.
Для локального запуска уже готовы обычные и MTP GGUF с NEO IMATRIX.
Контекст у базовой архитектуры до 262K токенов. Запускать можно через llama.cpp, Ollama, LM Studio, vLLM и другие локальные рантаймы, а через llama.cpp сразу поднимается OpenAI-compatible API.
Если независимые тесты подтвердят цифры, это хороший пример того, насколько далеко сейчас можно вытянуть маленькую 9B-модель правильным fine-tuning, merge и квантованием.
#AI #Qwen #LLM #LocalAI #GGUF
На Hugging Face вышла
Qwen3.5-9B The Defiant Fable от DavidAU. Это многоэтапный fine-tune Qwen3.5-9B с упором на reasoning, instruction following, код и creative-задачи. Модель распространяется под Apache 2.0, а автор также позиционирует её как uncensored/heretic-версию с минимальными отказами.Самое интересное в результатах. По собственному набору из семи бенчмарков автор заявляет, что 9B-версия обходит базовые Qwen3.5-9B, Qwen3.5-27B и Qwen3.6-35B-A3B, а местами приближается к Qwen3.6-27B. Причём сильные результаты сохраняются даже после 4-bit квантования. Это пока именно авторские тесты, а не независимый leaderboard.
Для локального запуска уже готовы обычные и MTP GGUF с NEO IMATRIX.
Q4_K_M занимает примерно 6,8-7 ГБ, IQ3_M около 5,6 ГБ, а экстремальный IQ2_M всего 4,94 ГБ.Контекст у базовой архитектуры до 262K токенов. Запускать можно через llama.cpp, Ollama, LM Studio, vLLM и другие локальные рантаймы, а через llama.cpp сразу поднимается OpenAI-compatible API.
Если независимые тесты подтвердят цифры, это хороший пример того, насколько далеко сейчас можно вытянуть маленькую 9B-модель правильным fine-tuning, merge и квантованием.
#AI #Qwen #LLM #LocalAI #GGUF
👍6❤2