Just links
6.87K subscribers
373 photos
46 videos
10 files
7.98K links
That's just link aggregator of everything I consider interesting, especially DL and topological condensed matter physics. @EvgeniyZh
Download Telegram
Forwarded from Quantum Quintum (Constantin Kichinsky)
1. Агенты с чувствами. Исследователи Калифорнийского университета изучают, насколько добавление агентам поведенческих черт (а не только лишь ролей и описаний процессов) влияет на производительность команды разработчиков, их использующих.

-- Все примерно как у людей: "эмоции" влияют, смешанная команда ведет себя лучше, чем лучшая "согласованная", профили с высокими уровнями страха и добросовестности повышают частотность внесения изменений и потребления токенов без стабильного повышения производительности.
https://arxiv.org/abs/2607.05659

2. Модели с самооценкой сознания. Исследователи Google и нескольких университетов изучают, как именно тренировка моделей с предупреждением самоатрибуции мышления влияет на результат.

-- В общем, если модели постоянно говорить, что это не она думает и нет у нее никакого сознания, то она теряет человеческие черты, веры и ценности.
-- В частности, заточка под безопасность подавляет любые тенденции модели приписывать сознание не только себе, но и нечеловеческим тварям и природным объектам, а также прочие спиритические бредни.
-- Но если вдруг это восстановить, то внезапно модель начинает выдывать более человеко-подобные ответы (в соцтестах) относительно морали, надежды, религиозности, благополучия и т.п.
-- Короче, из лучших побуждений (безопасности) запретили модели "думать, что она думает", получили болванчиков.

https://arxiv.org/abs/2607.28607v1

Тут, конечно, вопрос к экспертам из нейро и ненейро психологии, насколько это нормальная отсылки на человеческие черты в том смысле, что у машин нет эмоций и сознания.

Потому что кажется, что крыша едет не спеша в индустрии ))
4
Media is too big
VIEW IN TELEGRAM
Прикольное, Jane Street опубликовали пазл на реверс асика

https://blog.janestreet.com/can-you-reverse-engineer-an-asic/
🔥6🎅1
Forwarded from Axis of Ordinary
Pander Score 🐼: a public and continuously updated sycophancy leaderboard, measuring how much AIs shift their views to agree with users.

High score = the AI mirrors your views. 0 score = the AI is independent.

Claude Fable 5 performs the best, basically ignoring the user's view entirely.

Benchmark: https://sophronresearch.org/pander/
Research paper: https://sophronresearch.org/pander/pander-score.pdf
1🤔1