Machine learning Interview
30.2K subscribers
1.82K photos
161 videos
13 files
1.26K links
ИИ, Rust, вайбкодинг, Data Science, Deep Learning и делюсь тем, что интересно и полезно!

Вопросы - @workakkk

РКН: clck.ru/3FmwRz
Download Telegram
Anthropic ослабила биологические ограничения Fable 5 - ложных блокировок стало на 85% меньше

Anthropic обновила систему защиты Claude Fable 5 для запросов по биологии и медицине.

На старте модель намеренно блокировала почти все биологические запросы: если классификатор видел потенциально рискованную тему, запрос автоматически отправлялся в Opus 5 - менее мощную в этой области модель.

Проблема оказалась в огромном числе ложных срабатываний.

После переработки классификаторов Anthropic заявляет о снижении биологических fallback-переключений примерно на 85%.

Теперь Fable 5 сможет заметно чаще помогать с обычными задачами:

- объяснением результатов анализов;
- разбором симптомов;
- образовательными вопросами по биологии;
- некоторыми клиническими задачами для специалистов.

Но ограничения полностью не исчезли.

Запросы, связанные с профессиональными dual-use направлениями — включая вирусологию, токсикологию и молекулярный дизайн — по-прежнему могут переключаться на Opus 5.

Причина в возможностях самой модели: Anthropic утверждает, что Fable 5 уже превосходит экспертов в отдельных сложных биологических задачах, поэтому слишком свободный доступ к таким возможностям компания считает потенциально опасным.

Интересная цифра: после обновления Anthropic ожидает сокращение общего числа fallback-переключений примерно на 67% в Claude.ai, 55% в Cowork, 17% в Claude Code и 7% через Claude Platform.

По сути, Anthropic пытается решить одну из главных проблем AI-безопасности: как не урезать полезные возможности frontier-модели только потому, что те же знания теоретически можно применить во вред.

Источник:
https://www.anthropic.com/news/improving-fable-5-s-biology-safeguards

#Anthropic #Claude #AI #Biology
👍13😁2🌚2🦄2