Love. Death. Transformers.
спасибо @nadlskom за нормальный ui и @akhaliq за домен твитер репостить тут
v5 вышла, теперь она нативно училась с rlcd и на вижен и агентик задачах, теперь в 0.8b 2b и 4b размере, на каких то рандомных бенчах неплохо себя показывает
https://huggingface.co/AlexWortega/openjev
https://x.com/justalexwortega/status/2102828012362223864?s=46
https://huggingface.co/AlexWortega/openjev
https://x.com/justalexwortega/status/2102828012362223864?s=46
👍27🔥12😁5💊2⚡1
Forwarded from латте
ПРОВЕРЬ СВОЮ УЧИТЕЛЬНИЦУ НА ВБРОС
Около 40% УИКов находится в школах, а работают там те, в чьи обязанности входит(ло) нас обучать в самые юные годы.
Фальсификации происходят и там, а значит представители древнейшей профессии тоже оказываются замешанными в них...
Мы видим, что многие познакомились с результатами нашего исследования и даже поиграли в мини-игры на сайте.
Пора проверить и свои школы — переходите по ссылке: https://gosduma2026.org/#/school
Около 40% УИКов находится в школах, а работают там те, в чьи обязанности входит(ло) нас обучать в самые юные годы.
Фальсификации происходят и там, а значит представители древнейшей профессии тоже оказываются замешанными в них...
Мы видим, что многие познакомились с результатами нашего исследования и даже поиграли в мини-игры на сайте.
Пора проверить и свои школы — переходите по ссылке: https://gosduma2026.org/#/school
😭81😁46🤡29👍15💩11❤🔥4🥴3🤔2
SourceCraft
В обсуждениях GitLab теперь можно поручать задачи автономным ИИ-агентам. В SourceCraft появилась возможность подключать таких агентов для написания кода, проверки его безопасности и других задач разработки.
Агент работает под собственной учетной записью, самостоятельно выполняет задачу и возвращает результат на ревью. Если в процессе нужны дополнительные данные или согласование, он сам обращается к команде.
Можно подключать и собственных агентов, в том числе созданных в Yandex AI Studio. Взаимодействовать с ними можно через GitLab, VS Code, командную строку и мессенджеры.
📱 @git_developer
В обсуждениях GitLab теперь можно поручать задачи автономным ИИ-агентам. В SourceCraft появилась возможность подключать таких агентов для написания кода, проверки его безопасности и других задач разработки.
Агент работает под собственной учетной записью, самостоятельно выполняет задачу и возвращает результат на ревью. Если в процессе нужны дополнительные данные или согласование, он сам обращается к команде.
Можно подключать и собственных агентов, в том числе созданных в Yandex AI Studio. Взаимодействовать с ними можно через GitLab, VS Code, командную строку и мессенджеры.
📱 @git_developer
🤡67 22⚡5🔥3🤷♂2👍1👏1
Love. Death. Transformers.
v5 вышла, теперь она нативно училась с rlcd и на вижен и агентик задачах, теперь в 0.8b 2b и 4b размере, на каких то рандомных бенчах неплохо себя показывает https://huggingface.co/AlexWortega/openjev https://x.com/justalexwortega/status/2102828012362223864?s=46
https://huggingface.co/TypeSafeAI/Step-5-Preview-BF16
забавно, 600А27 по экономике действительно забавен, в nvfp4 еще поди и 70% профита на их jev сетапе дает
забавно, 600А27 по экономике действительно забавен, в nvfp4 еще поди и 70% профита на их jev сетапе дает
huggingface.co
TypeSafeAI/Step-5-Preview-BF16 · Hugging Face
We’re on a journey to advance and democratize artificial intelligence through open source and open science.
🤡21
Love. Death. Transformers.
https://huggingface.co/TypeSafeAI/Step-5-Preview-BF16 забавно, 600А27 по экономике действительно забавен, в nvfp4 еще поди и 70% профита на их jev сетапе дает
вы ща охуеете, это были ДОМЕННЫЕ ТРОЛИ которые угнали имя на хф
😁94😭13
Forwarded from AbstractDL
Evidence of Linear Superposition in LLMs
Языковые модели ЕЩЁ ЛИНЕЙНЕЕ, чем мы думали. Это, конечно, какой-то смех, но если тупо усреднить инпут-эмбеддинги у входных текстов, то LLM будет в аутпуте продолжать оба текста сразу. То есть она может параллельно о двух разных вещах думать и разбираться в усреднённых активациях, распутывая их. Похоже, это следствие линейности внутренних репрезентаций, которую я описывал в старой работе.
У меня тоже получилось немного помочь с этой статьёй и залететь в соавторы, но я там скорее рядом постоял просто. Все лавры Паше Тихонову за крутую находку.
Статья
Языковые модели ЕЩЁ ЛИНЕЙНЕЕ, чем мы думали. Это, конечно, какой-то смех, но если тупо усреднить инпут-эмбеддинги у входных текстов, то LLM будет в аутпуте продолжать оба текста сразу. То есть она может параллельно о двух разных вещах думать и разбираться в усреднённых активациях, распутывая их. Похоже, это следствие линейности внутренних репрезентаций, которую я описывал в старой работе.
У меня тоже получилось немного помочь с этой статьёй и залететь в соавторы, но я там скорее рядом постоял просто. Все лавры Паше Тихонову за крутую находку.
Статья
huggingface.co
Paper page - Your Transformer Can Hold Two Thoughts at Once: Evidence of Linear Superposition in LLMs
Join the discussion on this paper page
1👍62🔥32😨12😁7🤔5🍓4 4🎉2👏1💩1🤗1
Forwarded from Just links
Self-Play Pretraining with Zero Data https://arxiv.org/abs/2609.30063
arXiv.org
Self-Play Pretraining with Zero Data
Advances in language modeling have been driven by scaling pretraining on ever more data. Yet, the training data is still largely curated on the model's behalf. A more general approach to...
🥴32🔥9👍4🌭3
Forwarded from The place to land
Amy_Fighter35_Nordland_demo_version_digital_art_catalog_2014_2021.pdf
9.3 MB
★
Как я упоминала ранее, обстоятельства моей жизни изменились, поэтому я расширила и переосмыслила концепцию Федерации Нордланд. Опубликованные ранее работы сохраняют свою ценность в качестве демо-версии Нордланд. Я собрала их в каталог, охватывающий мои разработки в период с 2014 по 2021 год.
Каталог прикреплен к сообщению, его также можно использовать, если вы заинтересованы в покупке принтов, оригиналов файлов и т.д. – все актуальные ссылки и другая информация внутри (все ссылки кликабельны).
Кроме того, я полностью провела ребрендинг своих страниц во всех социальных сетях – теперь меня можно найти только по никнейму/тэгу Amy_Fighter35✈️ 💅 ⚡ (с вариациями amy_fighter35, amy-fighter35 или amyfighter35 в некоторых аккаунтах).
Скоро появятся другие обновления – следите за новостями!✨
★
As I mentioned earlier, my life circumstances have changed, prompting me to expand and rethink the concept of The Federation of Nordland. The artworks published earlier retain their value as the Nordland demo version. I have compiled them into a catalog covering my work from 2014 to 2021.
The catalog is attached to this post. You can also use it if you're interested in purchasing prints, original files, custom art, etc. – all relevant links and information are inside (all links are clickable).
Additionally, I have completed a full rebranding of my social media pages – I can now be found only under the username/tag Amy_Fighter35✈️ 💅 ⚡ (also appears as amy_fighter35, amy-fighter35 or amyfighter35 in some handles).
Further updates are coming soon – stay tuned!✨
#Amy_Fighter35 #The_Federation_of_Nordland
#updates
Please open Telegram to view this post
VIEW IN TELEGRAM
💊38👍3❤🔥1
Забавно что авторка гениального the federation of nordland в один момент жизни слегка изменила взгляды, получила визу в штаты и постит под ником fighter 35
Да, это ее реальный канал
Да, это ее реальный канал
😁35💩11 3😭1 1
в LA нормальный кофе теперь???
https://www.google.com/maps?ll=34.090422,-118.373917&z=14&t=m&hl=en-GB&gl=US&mapclient=embed&cid=355009618858333223
https://www.google.com/maps?ll=34.090422,-118.373917&z=14&t=m&hl=en-GB&gl=US&mapclient=embed&cid=355009618858333223
Drinkit Coffee · 8424 Santa Monica Blvd # C, West Hollywood, CA 90069
★★★★★ · Coffee shop
⚡49🤡19❤🔥3😁3😍3👍2🔥1💋1💅1 1
Forwarded from black_samorez
This media is not supported in your browser
VIEW IN TELEGRAM
Disaggregated quantization
Новая статья. Процессим LLM префилл и генерацию разными квантизациями одной модели. Дообучаем обе вместе с учетом того какой токен процессится какой моделью. Чекпоинт для префилла можно сгрузить на SSD, спрятав подгрузку за long-context промпт прцессиногом, чтобы память была как только у модели для генерации.
Статья: arxiv.org/abs/2609.26333
Код: GitHub
Qwen3.8 NVFP4 prefillers: HF Hub
Новая статья. Процессим LLM префилл и генерацию разными квантизациями одной модели. Дообучаем обе вместе с учетом того какой токен процессится какой моделью. Чекпоинт для префилла можно сгрузить на SSD, спрятав подгрузку за long-context промпт прцессиногом, чтобы память была как только у модели для генерации.
Статья: arxiv.org/abs/2609.26333
Код: GitHub
Qwen3.8 NVFP4 prefillers: HF Hub
👾35👍11🔥5✍1💩1
black_samorez
Disaggregated quantization Новая статья. Процессим LLM префилл и генерацию разными квантизациями одной модели. Дообучаем обе вместе с учетом того какой токен процессится какой моделью. Чекпоинт для префилла можно сгрузить на SSD, спрятав подгрузку за long…
Накидайте лайков лютому https://huggingface.co/papers/2609.26333
huggingface.co
Paper page - Disaggregated Quantization: Specializing LLM Prefill and Decode
Join the discussion on this paper page
👍31🔥4💩3🫡1
https://cs329a.stanford.edu/
Huh? Курс стенфорда по RSI. Тут есть проблема что RSI прекрасен как концепция, но ужасен когда ты его делаешь иии он почти не работает на текущем поколении моделей.
Но сами статьи клёвые, точно стоит почитать.
Huh? Курс стенфорда по RSI. Тут есть проблема что RSI прекрасен как концепция, но ужасен когда ты его делаешь иии он почти не работает на текущем поколении моделей.
Но сами статьи клёвые, точно стоит почитать.
👍11🔥7🤗1
Love. Death. Transformers.
https://cs329a.stanford.edu/ Huh? Курс стенфорда по RSI. Тут есть проблема что RSI прекрасен как концепция, но ужасен когда ты его делаешь иии он почти не работает на текущем поколении моделей. Но сами статьи клёвые, точно стоит почитать.
По мотивам всех взломов, RSI и прочего хочется вспомнить о классике:
https://openai.com/index/measuring-goodharts-law/
https://openai.com/index/measuring-goodharts-law/
🤗4👍1 1