Machinelearning – Telegram

Machinelearning

@ai_machinelearning_big_data

304K subscribers

4K photos

705 videos

17 files

4.58K links

Погружаемся в машинное обучение и Data Science

Показываем как запускать любые LLm на пальцах.

По всем вопросам - @haarrp

@itchannels_telegram -🔥best channels

Реестр РКН: clck.ru/3Fmqri

Download Telegram

About

Blog

Apps

Platform

Machinelearning

304K subscribers

Machinelearning

This media is not supported in your browser

VIEW IN TELEGRAM

🪄

InternLM-XComposer

Multi-Objective Reinforcement Learning algorithms implementations.

MORL-Baselines - это библиотека алгоритмов многоцелевого обучения с подкреплением (MORL).

Данный репозиторий содержит рабочие реализации алгоритмов MORL в PyTorch.

🖥

Code: https://github.com/lucasalegre/morl-baselines

🦾 Project: lucasalegre.github.io/morl-baselines

🖥

Colab: https://colab.research.google.com/drive/1ByjuUp8-CJeh1giPOACqPGiglPxDnlSq?usp=sharing

📚

Paper: https://arxiv.org/abs/2311.12495v1

🔗

Dataset: https://paperswithcode.com/dataset/mo-gymnasium

@ai_machinelearning_big_data

Please open Telegram to view this post

VIEW IN TELEGRAM

👍9🥰2❤1🍌1

9.26K views12:44

Machinelearning

💸 На AI Journey авторы лучшей статьи про искусственный интеллект получили 1 млн рублей

Сбер наградил группу исследователей из Университета Иннополис и МФТИ в составе Михаила Рудакова, Александра Безносикова, Ярослава Холодова и Александра Гасникова — они получили 1 млн рублей за свою статью «Техники сжатия активаций слоёв и градиентов для распределённого обучения моделей искусственного интеллекта».

Её и еще 37 работ других претендентов опубликуют в научном сборнике международной конференции AI Journey — «Путешествие в мир искусственного интеллекта». Всего для участия в отборе прислали более 270 заявок.

«Лучшую статью члены экспертной комиссии отобрали в силу её высокой научной ценности, огромного фундаментального и прикладного значения. Я поздравляю победителей и надеюсь, что они продолжат свои исследования в этом важном направлении», — рассказал первый заместитель председателя правления Сбера Александр Ведяхин.

@ai_machinelearning_big_data

Please open Telegram to view this post

VIEW IN TELEGRAM

👍36🔥12❤4🍌2😁1

36.2K views17:57

Machinelearning

🐬

ShareGPT4V:Improving Large Multi-Modal Models with Better Captions

🔥 Масштабный набор данных,содержащий изображения и тексты.
🔥 1,2 млн высококачественных подписей к ихображениям для предварительного обучения.
🔥 Программа для создания описания изображений, приближающаяся по возможностям к GPT4-Vision.
🔥 Большая мультимодальная модель, ShareGPT4V-7B

🖥

Code: https://github.com/InternLM/InternLM-XComposer/tree/main/projects/ShareGPT4V

🦾 Project: https://sharegpt4v.github.io/

⚡️

Demo: https://huggingface.co/spaces/Lin-Chen/ShareGPT4V-7B

📚

Paper: https://arxiv.org/pdf/2311.12793.pdf

🔗

Dataset: https://huggingface.co/datasets/Lin-Chen/ShareGPT4V

@ai_machinelearning_big_data

Please open Telegram to view this post

VIEW IN TELEGRAM

👍11❤3🔥3🍌2

8.92K views19:43

Machinelearning

Новый фреймворк файнтюнинга ЛЛМ

Higgsfield AI выпустил бета версию фулл-стек легковесного фреймворка для тренировки больших моделей. Пользователи загружают датасет через веб интерфейс и получают модель, которая тренируется на их серверах. Доступны любые модели llama/mistral. Метод оплаты не требуется. Лучше всего работает с десктопным Chrome.

Попробовать запустить новую видео диффузию: https://higgsfield.ai/stable-diffusion

Зафайнтюнить ЛЛМ: https://higgsfield.ai/profile/submit

Github фреймворк который позволяет оркестрировать несколько ГПУ нод без необходимости менеджить Slurm/Kubernetes: https://github.com/higgsfield-ai/higgsfield

ai_machinelearning_big_data

GitHub - higgsfield-ai/higgsfield: Fault-tolerant, highly scalable GPU orchestration, and a machine learning framework designed…

Fault-tolerant, highly scalable GPU orchestration, and a machine learning framework designed for training models with billions to trillions of parameters - higgsfield-ai/higgsfield

👍17🔥9❤3🍌1

9.19K views11:31

Machinelearning

This media is not supported in your browser

VIEW IN TELEGRAM

⭐️ Karpathy just uploaded what could be the best Intro to Large Language Models.

Обязательно к просмотру. Карпатый только что выложил, возможно, лучшее введение в большие языковые модели.

В лекции продолжительностью 1 час рассматривается абсолютно все: обучение, вывод, взлом, тонкая настройка и многое другое.

🔗

Смотреть здесь: https://youtube.com/watch?v=zjkBMFhNj_g

🔗

Слайды: https://drive.google.com/file/d/1pxx_ZI7O-Nwl7ZLNk5hI3WzAsTLwvNU7/view

ai_machinelearning_big_data

Please open Telegram to view this post

VIEW IN TELEGRAM

🔥42👍21❤5🍌1

10.5K views18:16

Machinelearning

🤖

Российская художница написала картину совместно с Kandinsky

Мария Суворова использовала ИИ для создания картин, уделив особое внимание логическому расположению цвета и тона. Такая методика предполагает установление баланса тона, цвета и динамики, что похоже на очень сложный аналитический процесс.

Суворова говорит, что для работы с Kandinsky нужно соединить два полюса, создавая эскиз по методу Матисса и постепенно дополнять его абстрактным видением.

Плоды ее творчества человека и искусственного интеллекта представила галерея «МастАРТ» на международной конференции AI Journey.

@ai_machinelearning_big_data

Please open Telegram to view this post

VIEW IN TELEGRAM

🥴19🔥13💊6😁3❤2👍2🥱2🥰1🍌1

22.1K views12:03

Machinelearning

🗣 HierSpeech++: Bridging the Gap between Semantic and Acoustic Representation by Hierarchical Variational Inference for Zero-shot Speech Synthesis

Синтез речи на основе больших языковых моделей получил широкое распространение.

Однако такие модели требуют большого объема данных и обладают теми же недостатками, что и предыдущие авторегрессионные модели речи, включая низкую скорость вывода и плохое качетсво речи.

В данной работе прелставлен HierSpeech++, быстрый и надежный синтезатор речи для преобразования текста в речь (TTS) и голоса (VC).

Данная модель синтеза речи позволяют значительно повысить надежность и выразительность синтетической речи.

Кроме того, значительно улучшено естественность и сходство с диктором синтетической речи даже в сценариях синтеза речи с нулевым результатом.

🖥

Code: https://github.com/sh-lee-prml/hierspeechpp

🦾 Checkpoint: https://drive.google.com/drive/folders/1-L_90BlCkbPyKWWHTUjt5Fsu3kz0du0w?usp=sharing

⚡️

Demo: https://sh-lee-prml.github.io/HierSpeechpp-demo/

📚

Paper: https://arxiv.org/abs/2311.12454v1

🔗

Dataset: https://paperswithcode.com/dataset/libri-light

@ai_machinelearning_big_data

Please open Telegram to view this post

VIEW IN TELEGRAM

👍16❤3🔥1🍌1

9.31K views14:03

Machinelearning

Профессия AI-тренера, гонка нейросетей: о чем еще говорили на YaC 2023?

YaC 2023 — это сериал из 4 серий — про город, дом, интернет и людей. Главные герои — не только сервисы, но и команды, которые их разрабатывают.

✨ Нейросерия — одна из самых интересных. Яндекс рассказал:

- как генеративные нейросети меняют подход к поиску информации и работе с ней
- как pretrain модель влияет на качество ответов нейросети
- как компания разрабатывала языковые модели и нейросети, встраивала технологии в свои продукты и ввела новую профессию AI-тренера — специалиста, который работает над тем, чтобы нейронка выдавала качественные, этичные и безопасные ответы.

Посмотреть сериал полностью можно на Кинопоиске и Ютубе

@ai_machinelearning_big_data

Кинопоиск

Yet another Conference 2023, 2023

Смотрите онлайн сериал «Yet another Conference 2023» (2023) на Кинопоиске все серии, 1 сезон. Большой рассказ Яндекса о технологиях дома, в городе, интернете и о людях, которые их создают

❤11👍9🔥3🍌1🙈1

8.99K views19:24

Machinelearning

🔥

Diffusion360: Seamless 360 Degree Panoramic Image Generation based on Diffusion Models.

Модель для формирования панорамных изображений 360 на основе стабильной диффузии.

🖥

Code: https://github.com/archerfmy/sd-t2i-360panoimage

📚

Paper: https://arxiv.org/abs/2311.13141v1

🔗

Dataset: https://paperswithcode.com/dataset/sun360

@ai_machinelearning_big_data

Please open Telegram to view this post

VIEW IN TELEGRAM

👍17❤3🤩2🔥1🍌1

8.84K views21:24

Machinelearning

🎮

Language Models are Super Mario: Absorbing Abilities from Homologous Models as a Free Lunch

В данной работе показано, что языковые модели (ЯМ), могут приобретать новые возможности за счет ассимиляции параметров однотипных моделей без переобучения или использования графических процессоров.

🖥

Code: https://github.com/yule-BUAA/MergeLM

📚

Paper: https://arxiv.org/abs/2311.03099

🔗

Dataset: https://paperswithcode.com/task/instruction-following

@ai_machinelearning_big_data

Please open Telegram to view this post

VIEW IN TELEGRAM

Please open Telegram to view this post

VIEW IN TELEGRAM

🔥11👍8❤4🍌2

9.37K views10:36

Machinelearning

♟ ChessVision - A dataset for logically coherent multi-label classification.

Набор данных с изображениями шахматных досок в различных позициях.

🖥

Github: https://github.com/espressovi/chessvisionchallenge

📕

Paper: https://arxiv.org/abs/2311.12610

🔥Datasets: https://zenodo.org/records/8278015

@ai_machinelearning_big_data

Please open Telegram to view this post

VIEW IN TELEGRAM

🔥11👍5🥴2🍌1

9.02K viewsedited 08:01

Machinelearning

This media is not supported in your browser

VIEW IN TELEGRAM

🖥

Swift Parameter-free Attention Network for Efficient Super-Resolution

Сверхразрешение изображений (SISR) - важнейшая задача низкоуровневого компьютерного зрения, направленная на восстановление изображений высокого разрешения по их аналогам низкого разрешения.

Традиционные механизмы внимания значительно улучшили производительность SISR, но такие механизмы часто приводят к сложной структуре сети и большому количеству параметров, что приводит к низкой скорости вывода и большому размеру модели.

Parameter-free Attention Network (SPAN) - новая высокоэффективная модель SISR, которая позволяет сбалансировать количество параметров, скорость вывода и качество изображения.

В SPAN используется новый механизм внимания без параметров, который использует симметричные функции активации для усиления качества генерации и подавления избыточной информации.

SPAN был протестирован на нескольких бенчмарках,которые показали что она превосходит существующие модели суперразрешения как по качеству изображения, так и по скорости вывода, достигая компромисса между качеством и скоростью.

Это делает SPAN весьма пригодной для использования в реальных приложениях, особенно в случаях с ограниченными ресурсами.

🖥

Code: https://github.com/hongyuanyu/span

🦾 Checkpoint: https://drive.google.com/file/d/1iYUA2TzKuxI0vzmA-UXr_nB43XgPOXUg/view?usp=sharing

📚

Paper: https://arxiv.org/abs/2311.12770v1

🔗

Dataset: https://paperswithcode.com/dataset/manga109

@ai_machinelearning_big_data

Please open Telegram to view this post

VIEW IN TELEGRAM

👍27🔥3❤2😢1🍌1🆒1

9.66K views08:17

Machinelearning

🦜🦴Skeleton-of-Thought (новый шаблон LangChain!)

⭐️Большие Языковые модели могут работать параллельно и быстро⭐️.

В недавней работе Университета Цингуа и Microsoft Research показано, как можно значительно уменьшить время генерации LLM.

Данная техника сначала направляет LLM на генерацию скелета answer☠️, а затем выполняет параллельные вызовы API для параллельного заполнения содержимого каждой точки скелета🚤.

▪Шаблон LangChain здесь: https://github.com/langchain-ai/langchain/tree/master/templates/skeleton-of-thought.
▪Посмотрите видео на YouTube о его создании: https://youtube.com/watch?v=wLRHwKuKvOE
▪Прочитать статью здесь: https://arxiv.org/abs/2307.15337

@ai_machinelearning_big_data

👍16❤4🔥4🍌1

9.11K views08:12

Machinelearning

🔵

Differentiable and accelerated spherical transforms with JAX

Новые алгоритмы для ускоренного и дифференцируемого вычисления обобщенных преобразований Фурье на сфере и группы вращения т.е. сферических гармонических преобразований и преобразований Вигнера.

Новый гибридный подход к автоматическому и ручному дифференцированию, позволяющий эффективно вычислять градиенты.

Алгоритмы реализованы в рамках дифференцируемого программирования JAX.

🖥

Code: https://github.com/astro-informatics/s2fft

🦾 Project: https://astro-informatics.github.io/s2fft/

📚

Paper: https://arxiv.org/abs/2311.14670v1

@ai_machinelearning_big_data

Please open Telegram to view this post

VIEW IN TELEGRAM

👍20❤3🔥2🎉1🍌1

8.9K views17:55

Machinelearning

👨‍💻 Нейросети, помогающие в написании и редактировании кода

Здесь собраны ИИ, которые пишут качественный код и по-настоящему помогут исправить баги в вашем проекте.В кажом проекте есть инструкция по установке и использованию.

1️⃣ Codeium - Поддерживаемые языки: более 70, но наиболее развиты C#, C, Python, CSS, Go, Groovy, Kotlin. В отличие от Copilot, Codeium позиционируется как помощник, который допишет код сам или найдет необходимые программисту инструменты в собственном хранилище. Пользователь пишет запрос на английском языке, а ИИ ищет и предлагает варианты.

2️⃣ Autogen - новейшее разработка от Microsoft вызвала фурор на GitHub: компания представила Autogen. Этот фреймворк позволяет ИИ-агентам общаться между собой для выполнения ваших задач.

Настройка Autogen проста — например, для устранения ошибок, написания кода, создания веб-дизайнов и выполнения различных проектов. Нейронные сети выдают себя за команду IT-специалистов, ведут диалог в чате и выполняют различные задачи по вашему запросу.

3️⃣ Code GPT — расширение для Visual Studio Code от OpenAI, которое помогает писать код по текстовым промптами. Он поддерживает множество популярных языков программирования и упрощает разработку, автоматически предлагая код на основе введенного вами текста.

4️⃣ CodePal — инструмент для написания и оптимизации кода, который также помогает находить ошибки и проводить код-ревью, делая разработку проще для программистов всех уровней.

5️⃣ Codesnippets — это сервис, который создает код по текстовым запросам. Он предлагает функции отладки, рефакторинга и возможность сохранения кода для командной работы. Существует как платная, так и бесплатная версия этого сервиса, что делает его доступным для широкого круга разработчиков.

6️⃣ BlackBox.AI - ИИ способный использовать поиск в интернете, но с добавлением агентов, который ориентирован на работу с кодом и чтение документации.

7️⃣ Tabnine - нейросеть, которая поддерживает различные популярные языки программирования. Этот сервис может дополнять строки кода и даже целые ветки кода.

8️⃣ Adrenaline - помогает анализировать и исправлять код, обнаруживая и предлагая варианты исправлений ошибок. Особенностью этого сервиса является возможность видеть свой код и предложенные изменения от Adrenaline на одном экране.

@ai_machinelearning_big_data

🔥47👍5😱3❤1

7.74K viewsedited 19:03

Machinelearning

This media is not supported in your browser

VIEW IN TELEGRAM

📐 Sketch Video Synthesis

Новая модель для создания скетчей из видео, представленных покадровыми кривыми Безье.

🖥

Code: https://github.com/yudianzheng/sketchvideo

🦾 Project: https://sketchvideo.github.io/

📚

Paper: https://arxiv.org/abs/2311.15306v1

@ai_machinelearning_big_data

Please open Telegram to view this post

VIEW IN TELEGRAM

🥰14🔥4❤2🍌1

8.89K views21:01

Machinelearning

This media is not supported in your browser

VIEW IN TELEGRAM

🪄

Introducing SDXL Turbo: A Real-Time Text-to-Image Generation Model

SDXL Turbo: Модель генерации текста в изображение в режиме реального времени.

SDXL Turbo достигает высочайшей производительности благодаря новой технологии дистилляции, позволяющей создавать изображения за 1 шаг с беспрецедентным качеством, сокращая количество необходимых шагов с 50 до одного.

Доступны: код, статья, веса.

Вы можете протестировать SDXL Turbo на платформе для редактирования изображений Stability AI. с бета-версией демонстрации возможностей генерации текста в изображение в режиме реального времени.

🖥

Code: https://stability.ai/news/stability-ai-sdxl-turbo

🦾 Demo: https://clipdrop.co/stable-diffusion-turbo

🔥

Model weights → https://huggingface.co/stabilityai/sdxl-turbo

📚

Paper:https://stability.ai/research/adversarial-diffusion-distillation

@ai_machinelearning_big_data

Please open Telegram to view this post

VIEW IN TELEGRAM

🔥17👍9❤1🍌1👀1

9.18K views07:46

Machinelearning

🚀

Graph Prompt Learning: A Comprehensive Survey and Beyond

Это репозиторий призван предоставить список научных работ, в которых исследуются промпты для работы с графами.

🖥

Code: https://github.com/wxxshirley/awesome-graph-prompt

🦾 Project: https://graphprompt.github.io/

📚

Paper: https://arxiv.org/abs/2311.16534v1

@ai_machinelearning_big_data

Please open Telegram to view this post

VIEW IN TELEGRAM

❤9👍6🔥2😁1🍌1

9.07K views17:03

Machinelearning

This media is not supported in your browser

VIEW IN TELEGRAM

🔥Building and Evaluating Advanced RAG Applications

Вышел новый бесплатный курс от deeplearning.ai по сложным техникам RAG (Retrieval Augmented Generation).🦾

В этом курсе преподаются продвинутые техники работы с LLM, которые помогут вам генерировать хорошие и релевантные ответы и.

deeplearning.ai/short-courses/building-evaluating-advanced-rag/

@ai_machinelearning_big_data

❤21👍3🔥3🍌1

11K views09:01

Machinelearning

⭐️

LEDITS++: Limitless Image Editing using Text-to-Image Models

LEDITS++ модель, которая выводит редактирование изображений текcтом на новый уровень.

LEDITS++:
- быстрый 🚀
- универсальный 🎨
- привязывает изменения к соответствующим областям 🎑
- не зависит от архитектуры ⚙️

🖥

Code: https://huggingface.co/spaces/editing-images/leditsplusplus/tree/main

🔥

Project: https://leditsplusplus-project.static.hf.space/index.html

🦾 Demo: https://huggingface.co/spaces/editing-images/leditsplusplus

📚

Paper: https://arxiv.org/abs/2311.16711

@ai_machinelearning_big_data

Please open Telegram to view this post

VIEW IN TELEGRAM

👍10🔥2❤1🍌1

9.15K views14:02