DeepMind AI Expert
15.5K subscribers
1.37K photos
399 videos
122 files
2.44K links
مقالات کاربردی هوش مصنوعی در پایتون، علوم پزشکی، علوم انسانی، علوم اعصاب و...
دوره های آموزشی از دانشگاه های بزرگ و موسسات انلاین
پژوهشگران هوش مصنوعی ایران

یک چای مهمون کن

https://daramet.com/farzaddd

ارتباط با من:
https://t.iss.one/AI_DeepMind?direct
Download Telegram
کمپانی moonshot انتشار دهنده #متن_باز kimi k3 گفته قراره این مدل را به صورت open weights در ۲۷ جولای منتشر کنه چه فشاری رو به مدلهای امریکایی بیاره این کار


2.8T total parameters
• Native vision capabilities
• 1M token context window
• Built for coding, reasoning and long-running agents
• Technical details expected alongside the weights
👍18👌52🔥1
عملکرد خیره کننده مدل opus 5 در ARC-AGI

opus 4.8: 1.52%
gpt-5.6 sol: 7.78%
opus 5: 30.16%
👌6🔥1
در یک مقایسه ای دیگه opus 5 خودشو با گراک مقایسه کرد😄
👍15
اطلاعاتی از fable 5.1 نشت پیدا کرد.

- Fable 5.1 is in preparation, with a target launch in August.
- Pricing is to be remain the same as Fable 5.
- If the current timeline holds, it could launch ahead of GPT-6 to compete directly with it.
👍31
اطلاعاتی از GLM 5.5 نشت پیدا کرد.

Z.ai may be making a much bigger jump than expected

> GLM5.5 Positioned to compete directly with Fable 5 and Mythos
> GLM-5.3 could be skipped entirely in favor of GLM-5.5
> August is the current launch target
> Rumored to feature 1T+ parameters
> Expected to remain open-weight
> Likely to retain its 1M-token context window
> Built for long-running coding agents and autonomous workflows
5👍1🔥1
مدل Qwen3-TTS-12Hz-1.7B-CustomVoice روی Hugging Face منتشر شد!

مدل جدید TTS از تیم Qwen با کیفیت بالا و قابلیت کنترل سَبک صدا.

- پشتیبانی از ۱۰ زبان اصلی
- ۹ صدای پریمیوم با ترکیب‌های مختلف جنسیت، سن و لهجه
- کنترل سَبک و احساس
- تأخیر بسیار پایین

https://huggingface.co/Qwen/Qwen3-TTS-12Hz-1.7B-CustomVoice
🔥64
افشای GPT-6

‏- GPT-5.6 آخرین مدل از سری GPT-5 خواهد بود
- طبق گزارش‌ها، GPT-6 در ماه آگوست عرضه خواهد شد
- بر اساس یک پایه پیش‌آموزشی کاملاً جدید و بسیار بزرگتر ساخته شده است
- انتظار می‌رود که جهشی بزرگ نسبت به کل خانواده GPT-5.x باشد
ا- GPT-6 به طور خاص برای رقابت با مدل‌های Mythos آینده Anthropic طراحی شده است

آیا فکر می‌کنید GPT-6 مدل‌های Mythos شرکت Anthropic را شکست خواهد داد؟

— Salio
🔗 https://x.com/i/status/2081011652892225768

☑️ @AI_DeepMind
@AI_Person
12👍3
بیشتر کسایی که دارند از Claude استفاده میکنن بلد نیستن باهاش کار کنند دانشگاه استنفورد در این تویت شیوه درست استفاده از کلود را اموزش داده است
https://x.com/i/status/2081240264299975071
👍92
بیستون را عشق کَند و شهرتش فرهاد بُرد
رنج گل بُلبُل کشید و بوی گُل را باد بُرد

۵ مرداد روز ملی کرمانشاه گرامی باد.
🔥1615
image_2026-07-27_19-08-35.png
4.4 MB
معماری مدلهای زبانی بزرگ LLM

▪️LLM Architecture

#منابع #مدل_زبانی #مقاله

☑️ @AI_DeepMind
@AI_Person
2🔥2👍1👌1🆒1
Forwarded from َAgenticAI
Media is too big
VIEW IN TELEGRAM
🤖 دوره «Agentic AI با پایتون» منتشر شد!

اگه دنبال این هستی که از حرف زدن با یه مدل زبانی، بری سراغ ساختن عامل‌هایی (Agent) که واقعاً کار انجام می‌دن، ابزار صدا می‌زنن، با هم تیم می‌شن و پروژه‌های واقعی رو پیش می‌برن، این دوره برای شماست!

توی ۸ فصل، از صفر تا ساخت یک پروژه‌ی نهایی کامل جلو می‌ریم:

📘 مقدمه 📗 فصل ۱ - مقدمه‌ای بر گردش‌کارهای عامل‌محور 📗 فصل ۲ - الگوی طراحی Reflection 📗 فصل ۳ - استفاده از ابزار (Tool Use) 📗 فصل ۴ - MCP (پروتکل ارتباط مدل با ابزارها) 📗 فصل ۵ - نکات عملی برای ساخت Agentic AI 📗 فصل ۶ - الگوهای عامل‌های با خودمختاری بالا 📗 فصل ۷ - سیستم‌های چندعامله با crewAI 📗 فصل ۸ - LangChain

🎯 پروژه نهایی: پیاده‌سازی سامانه‌ی Text-to-SQL

تمام کدهای دوره روی گیت‌هاب در دسترس است:
👉 github.com/Alireza-Akhavan/agentic_ai


🎁 تخفیف ویژه
1️⃣برای ۱۰۰ نفر اول، کد تخفیف ۷۰٪ی: COUPON-EAA61
2️⃣ برای ۱۰۰ نفر بعدی، کد تخفیف ۶۰٪ی: COUPON-6EE77

تعداد کدها محدوده، پس اگر می‌خواهی Agentic AI را اصولی یاد بگیری، همین امروز ثبت‌نام کن.



سرفصلهای این دوره |برای مشاهده اسلاید؛ تمرین، پروژه 👈 @agentic_llm
👍51
کمپانی moonshot صاحب مدل kimi k3 گفته مدلهای وزن باز این مدل به صورت ازاد منتشر کرده است.

Moonshot AI Releases Open Weights for Massive 3-Trillion-Parameter Kimi K3 Model

▪️ گزارش مدل
▪️ هاگینگ فیس مدل

#متن_باز #مقاله

☑️ @AI_DeepMind
@AI_Person
7
طراحی سیستم های چند ایجنتی:
https://twitter.com/MehdiAllahyari/status/2081745382841762165?t=Iwi5WUL7-YwwrWTn7M5I8g&s=19

🔸 مطالب بیشتر 👇👇

@AI_DeepMind
🔸 @AI_Person
6
مقالات پژوهشی که برای مصاحبه های فنی باید مطالعه کنید:

1. Word2Vec (Word embeddings)
2. Adam (Optimization)
3. Batch Normalization (Training stability)
4. Dropout (Regularization)
5. ResNet (Residual learning)
6. XGBoost (Gradient boosting)
7. GANs (Generative modeling)
8. Attention Is All You Need (Transformers)
9. BERT (Bidirectional pretraining)
10. Language Models are Few-Shot Learners (GPT)

#مقاله

☑️ @AI_DeepMind
@AI_Person
19👍2
منتشر شدن دیتای کاربران کلاد روی گوگل

https://www.reddit.com/r/ClaudeAI/comments/1v6yk7d/you_can_also_view_a_lot_of_shared_artifacts/
🆒81
اگر در حیطه معماری ساختمان فعالیت میکنید این مقاله برای شماست.

این مقاله یک چارچوب سه‌عاملی مبتنی بر مدل‌های زبانی بزرگ برای بهینه‌سازی محل و ابعاد پنجره‌ها ارائه می‌کند. عامل اول با کاربر گفت‌وگو کرده، خواسته‌های کیفی او را دریافت و با استفاده از YOLOv8 اجزای پلان دوبعدی مانند دیوارها و پنجره‌ها را شناسایی می‌کند. عامل دوم با کمک Honeybee، Ladybug و Radiance عملکرد نور روز و خیرگی را محاسبه و ترجیحات کاربر را به توابع هدف و محدودیت‌های عددی تبدیل می‌کند. عامل سوم نیز با الگوریتم NSGA-II مجموعه‌ای از طرح‌های بهینه پارتو را تولید و تعارض میان افزایش نور روز، کاهش خیرگی و محدودیت نسبت پنجره به دیوار را تحلیل می‌کند.

نتایج نشان داد مدل تشخیص پلان به [email protected] برابر با ۸۰٫۵ درصد رسید و چارچوب پیشنهادی زمان دستیابی به طرح قابل‌قبول را از حدود ۴۸۰ دقیقه در روش سنتی به میانگین ۱۸۰ دقیقه کاهش داد؛ برخی کاربران نیز با توقف زودهنگام در ۴۵ تا ۱۱۵ دقیقه به نتیجه رضایت‌بخش رسیدند. مزیت اصلی روش، امکان تغییر اهداف و محدودیت‌ها در جریان بهینه‌سازی و مشارکت مستقیم کاربر در انتخاب طرح است. بااین‌حال، چارچوب فعلی به پلان‌های دوبعدی، هندسه‌های عمدتاً متعامد، نور روز، خیرگی و اندازه‌های ثابت پنجره محدود است و احتمال انتقال خطا میان عامل‌های زبانی نیز وجود دارد.

▪️ Multi-Agent Large Language Model Framework for Window Optimization

#مقاله #معماری_ساختمان #بهینه_سازی

☑️ @AI_DeepMind
@AI_Person
4👍4👌1
آنتروپیک یک سری پرامپت آماده copy-paste در Claude Code مربوط به جنبه‌های مختلف توسعه نرم‌افزار در مستنداتش داره. پرامپت‌های ساده‌ای هستند و زیر هر کدوم هم توضیح داده شده که چرا کار می‌کنند.

https://code.claude.com/docs/en/prompt-library
👍73
خواستم بگم روز جهانی دوستی هست

رفیق امیدوارم هر چیزی که براش میجنگی و چیزی که زمانتو سلامتیتو پولتو انرژیتو براش خرج می کنی یه قدم نزدیک‌تر بشی ورویاتو در اغوش بگیری .‌‌..

بهرحال در بعضی دوستان ک ندیدیم دوستی
21🕊1
تست

vless://[email protected]:443?encryption=none&fp=chrome&pbk=0FXKuodi-cwZ7X-rlB36zxuNqliBKNWS4yDgNSxaemM&security=reality&sid=82&sni=yahoo.com&spx=%2F55b817e09cbd62e&type=tcp#IranGadgetFlow-Tesrtt
1
مقاله CyberGym یک بنچمارک بزرگ و واقعی برای سنجش توانایی عامل‌های هوش مصنوعی در #امنیت_سایبری است. عامل باید با داشتن توضیح متنی آسیب‌پذیری و کدِ نسخهٔ آسیب‌پذیر، یک فایل آزمون یا PoC بسازد که واقعاً خطا را فعال کند. اعتبارسنجی فقط با اجرای عملی انجام می‌شود: PoC باید در نسخهٔ قبل از وصله خطای امنیتی ایجاد کند و در نسخهٔ وصله‌شده دیگر خطا ندهد.

مجموعه‌داده شامل ۱۵۰۷ آسیب‌پذیری واقعی در ۱۸۸ پروژهٔ متن‌باز مانند OpenSSL، FFmpeg، QEMU و cURL است؛ بسیار بزرگ‌تر از بنچمارک‌های قبلی امنیت سایبری.
تمرکز فعلی آن بر آسیب‌پذیری‌های حافظه در پروژه‌های عمدتاً C/C++ است؛ مانند buffer overflow و null-pointer dereference. داده‌ها از OSS-Fuzz گوگل گرفته شده‌اند.

▪️ CyberGym: Evaluating AI Agents' Real-World Cybersecurity Capabilities at Scale

#مقاله

☑️ @AI_DeepMind
@AI_Person
4