دانشگاه Stanford یه دورهی رایگان درباره Self-Improving AI Agents منتشر کرده؛ یعنی ساختن AI Agentهایی که فقط کار انجام نمیدن، بلکه میتونن عملکرد خودشون رو بررسی کنن، اشتباهاتشون رو پیدا کنن و از Feedback برای بهتر شدن استفاده کنن.
توی این دوره دربارهی موضوعاتی مثل Constitutional AI، Verifiers، Test-time Compute، RL، Tools، Memory، Planning، Multi-step Reasoning و ساخت Deep Research Agents صحبت میشه و در نهایت هم با ارزیابی Agentها روی کارهای پیچیده و طولانی آشنا میشی. دوره ۹ لکچر داره و تمرکزش بیشتر روی یادگیری عملی و ساخت پروژه است.
لینک پلیلیست یوتیوب
https://www.youtube.com/playlist?list=PLangBM27OtEA&si=YoLVpSP5LvYoA-yP
@DevTwitter | <Reza Jafari/>
توی این دوره دربارهی موضوعاتی مثل Constitutional AI، Verifiers، Test-time Compute، RL، Tools، Memory، Planning، Multi-step Reasoning و ساخت Deep Research Agents صحبت میشه و در نهایت هم با ارزیابی Agentها روی کارهای پیچیده و طولانی آشنا میشی. دوره ۹ لکچر داره و تمرکزش بیشتر روی یادگیری عملی و ساخت پروژه است.
لینک پلیلیست یوتیوب
https://www.youtube.com/playlist?list=PLangBM27OtEA&si=YoLVpSP5LvYoA-yP
@DevTwitter | <Reza Jafari/>
❤26👎7👍1
رباتهای تحلیل بازار با هوش مصنوعی این روزها توی تلگرام زیاد شدهاند؛ رباتهایی که نمودار میگیرند، تحلیل تکنیکال میدهند، اخبار بازار را بررسی میکنند و میشود مستقیم با AI درباره بازار گفتگو کرد.
چاپار (Chapar) هستهی یکی از همین رباتهاست؛ پروژهای که حدود یک سال واقعاً روی تلگرام کار کرده و توسط کاربران مختلف استفاده شده. حالا نسخهی اصلی آن را Open Source کردهام.
داخلش فقط اتصال به LLM نیست؛ تحلیل چارت، تحلیل خبر، AI Chat، صف پردازش، Redis، PostgreSQL، سیستم اشتراک و Referral، پنل ادمین و ساختار یک سرویس واقعی را دارد.
https://github.com/ahkarimi/chapar
@DevTwitter | <Amir/>
چاپار (Chapar) هستهی یکی از همین رباتهاست؛ پروژهای که حدود یک سال واقعاً روی تلگرام کار کرده و توسط کاربران مختلف استفاده شده. حالا نسخهی اصلی آن را Open Source کردهام.
داخلش فقط اتصال به LLM نیست؛ تحلیل چارت، تحلیل خبر، AI Chat، صف پردازش، Redis، PostgreSQL، سیستم اشتراک و Referral، پنل ادمین و ساختار یک سرویس واقعی را دارد.
https://github.com/ahkarimi/chapar
@DevTwitter | <Amir/>
❤48🍌11👍8
یک همکار گوشیش رو توی دفتر گم کرد. Find My بهخاطر محدودیت MDM جواب نداد.
رفت و از Claude کمک گرفت؛ یک دقیقه بعد یک ابزار داشت که با شدت سیگنال بلوتوث (RSSI) گوشی رو دنبال میکرد. آخرش هم پیداش کرد.
منم همون ایده رو گرفتم و کامل بازسازیش کردم روی Flutter 📱
findphone X:
- معماری تمیز واقعی (domain/data/presentation)
- فیلتر کالمن برای هموارسازی نویز سیگنال، نه میانگین ساده
- تخمین فاصله با مدل Path-Loss
- اسکن پسزمینه، حتی وقتی اپ minimize شده
- تاریخچه محلی با Drift/SQLite
- دوزبانه: فارسی و انگلیسی
- حالت مخفیسازی آدرس برای ضبط صفحه
اگه گوشیت گم شد و Find My جواب نداد، الان یه راهحل واقعی و متنباز داری.
کد و ریلیز:
github.com/7Na7iD7/findphone-X
@DevTwitter | <Na7iD/>
رفت و از Claude کمک گرفت؛ یک دقیقه بعد یک ابزار داشت که با شدت سیگنال بلوتوث (RSSI) گوشی رو دنبال میکرد. آخرش هم پیداش کرد.
منم همون ایده رو گرفتم و کامل بازسازیش کردم روی Flutter 📱
findphone X:
- معماری تمیز واقعی (domain/data/presentation)
- فیلتر کالمن برای هموارسازی نویز سیگنال، نه میانگین ساده
- تخمین فاصله با مدل Path-Loss
- اسکن پسزمینه، حتی وقتی اپ minimize شده
- تاریخچه محلی با Drift/SQLite
- دوزبانه: فارسی و انگلیسی
- حالت مخفیسازی آدرس برای ضبط صفحه
اگه گوشیت گم شد و Find My جواب نداد، الان یه راهحل واقعی و متنباز داری.
کد و ریلیز:
github.com/7Na7iD7/findphone-X
@DevTwitter | <Na7iD/>
🍌45❤34👍10
تاحالا شده چندین تا خروجی از مقالات پابمد، اسکوپوس، وب آف ساینس گرفته باشین و بخواین همشو باهم ادغام کنید و تکراری هاشو پاک کنید؟
اگه این کارو با زوترو بخواین انجام بدید؛ باید همه RISهارو یکی یکی به زوترو ایمپورت کنید، بعد بیاین این بخش داپلیکیت و یکی یکی Merge بزنید تا اوکی شه!
اگه فایلتون سنگین باشه که علاوه بر هنگ کردن نرم افزار، کار وقت گیریه!
بعضی از مقالات که ایمپورت میشن، گاها فیلد نویسنده یا کیووردها یا بقیه فیلدها مشکل داره، درحالی که اگه همه فیلدها پر باشه، خیلی راحتتر میشه تصمیم گرفت درمورد مقالات.
علاوه بر این برای پیدا کردن PDF مقالات open-access، چندتا سایتو باید جا به جا شید.مثلا یدور میرید pub-med بعد، از پابمد لینک دادن به ژورنال توی ژورنال باید بگردین دنبال لینک!
برای حل این مشکلات یه کتابخونه پایتون هست که همه این مواردی که گفتمو حل کرده!
نصبش خیلی راحته، مثل بقیه کتابخونه ها:
و استفادش هم راحتتر:
و حتی GUI هم داره که به راحتی میتونید مقالات رو drag & drop کنید!
نصبش:
استفادش:
درنهایت یه فایل RIS تروتمیز دارید که میتونید هرجایی ایمپورتش کنید. (لینک مقاله هم در بخش url قرار میگیره، که کلیک کنید روش مستقیم میره جایی که PDF مقاله هست).
اگه خواستین بیشتر بدونید درمورد پروژه؛ لینک گیتهاب:
https://github.com/pythyn/risforge
ستاره هم یادتون نره!
@DevTwitter | <Amyr/>
اگه این کارو با زوترو بخواین انجام بدید؛ باید همه RISهارو یکی یکی به زوترو ایمپورت کنید، بعد بیاین این بخش داپلیکیت و یکی یکی Merge بزنید تا اوکی شه!
اگه فایلتون سنگین باشه که علاوه بر هنگ کردن نرم افزار، کار وقت گیریه!
بعضی از مقالات که ایمپورت میشن، گاها فیلد نویسنده یا کیووردها یا بقیه فیلدها مشکل داره، درحالی که اگه همه فیلدها پر باشه، خیلی راحتتر میشه تصمیم گرفت درمورد مقالات.
علاوه بر این برای پیدا کردن PDF مقالات open-access، چندتا سایتو باید جا به جا شید.مثلا یدور میرید pub-med بعد، از پابمد لینک دادن به ژورنال توی ژورنال باید بگردین دنبال لینک!
برای حل این مشکلات یه کتابخونه پایتون هست که همه این مواردی که گفتمو حل کرده!
نصبش خیلی راحته، مثل بقیه کتابخونه ها:
pip install risforgeو استفادش هم راحتتر:
risforge pipeline raw_export.risو حتی GUI هم داره که به راحتی میتونید مقالات رو drag & drop کنید!
نصبش:
pip install "risforge[gui]"استفادش:
risforge-guiدرنهایت یه فایل RIS تروتمیز دارید که میتونید هرجایی ایمپورتش کنید. (لینک مقاله هم در بخش url قرار میگیره، که کلیک کنید روش مستقیم میره جایی که PDF مقاله هست).
اگه خواستین بیشتر بدونید درمورد پروژه؛ لینک گیتهاب:
https://github.com/pythyn/risforge
ستاره هم یادتون نره!
@DevTwitter | <Amyr/>
❤8👍4🍌4
یک فرد یا گروه ناشناس در حال انجام اسکنهای گسترده آسیبپذیری بر روی وبسایتها است و برای پنهانماندن، ترافیک ارسالی را با جعل هویت باتهای شناختهشده AI ارسال میکند.
این بازیگر، تمرکز ویژهای روی مسیرها و فایلهای مرتبط با credentials و تنظیمات ابزارهای کدنویسی مبتنی بر AI از جمله مسیرهای پیکربندی، فایلهای .env و endpointهای مربوط به ابزارهای coding agent دارد.
این ترافیک جعلی با استفاده از User-Agent باتهایی نظیر ClaudeBot، ChatGPT-User، Googlebot و موارد مشابه ارسال میشود.
ترافیک مذکور از نظر احراز هویت معتبر (شامل محدودههای IP رسمی منتشرشده یا روشهای تأیید مانند Web Bot Auth) رد میشود و در نتیجه بهعنوان ترافیک جعلی شناسایی میگردد.
https://knownagents.com/insights
@DevTwitter | <VAHID NAMENI/>
این بازیگر، تمرکز ویژهای روی مسیرها و فایلهای مرتبط با credentials و تنظیمات ابزارهای کدنویسی مبتنی بر AI از جمله مسیرهای پیکربندی، فایلهای .env و endpointهای مربوط به ابزارهای coding agent دارد.
این ترافیک جعلی با استفاده از User-Agent باتهایی نظیر ClaudeBot، ChatGPT-User، Googlebot و موارد مشابه ارسال میشود.
ترافیک مذکور از نظر احراز هویت معتبر (شامل محدودههای IP رسمی منتشرشده یا روشهای تأیید مانند Web Bot Auth) رد میشود و در نتیجه بهعنوان ترافیک جعلی شناسایی میگردد.
https://knownagents.com/insights
@DevTwitter | <VAHID NAMENI/>
👍20👎1💔1
یه پکیج خفن برای مدیریت State داخل URL!
با nuqs میتونی خیلی راحت Stateهای اپلیکیشن رو داخل Query String مرورگر مدیریت کنی، بدون دردسرهای معمول useSearchParams و URLSearchParams.
مناسب برای:
- فیلترها و Sort
- صفحهبندی
- جستجو
- حفظ State در URL
- امکان Shareable URL
جالبتر اینکه Type-safe ـه و با React و Next.js خیلی خوب کار میکنه.
اگه توی پروژهات Stateهایی داری که باید با URL سینک باشن، حتماً nuqs رو ببین
https://nuqs.dev/
@DevTwitter | <Mohsen Karimvand/>
با nuqs میتونی خیلی راحت Stateهای اپلیکیشن رو داخل Query String مرورگر مدیریت کنی، بدون دردسرهای معمول useSearchParams و URLSearchParams.
مناسب برای:
- فیلترها و Sort
- صفحهبندی
- جستجو
- حفظ State در URL
- امکان Shareable URL
جالبتر اینکه Type-safe ـه و با React و Next.js خیلی خوب کار میکنه.
اگه توی پروژهات Stateهایی داری که باید با URL سینک باشن، حتماً nuqs رو ببین
https://nuqs.dev/
@DevTwitter | <Mohsen Karimvand/>
❤29🍌9👍3
این روزا سطح دسترسی AI Agentها برای خیلیامون جدی شده مخصوصاً وقتی قراره روی سیستم شخصی اجراشون کنیم!
گل سرسبدشون هم چیزی نیس جز Hermes Agent
برای حل این مسئله یه روش ساده و ایزوله برای بالا آوردنش هست که نمیذاره دسترسی مستقیم به محیط اصلی سیستم داشته باشه که من این نیاز رو با OrbStack رفع و رجوعش میکنم OrbStack یه ابزار خیلی سبک و سریع هستش که بهت اجازه میده Docker، Kubernetes و Ubuntu را روی مک بوک اجرا کنی.
حالا راه و روشش چیه؟
با OrbStack یه Ubuntu سبک بالا میاری، با SSH و Docker Hermes رو داخل کانتینر اجرا میکنی و از داخل سیستم خودت بهش وصل میشی انگار که یه سرور لینوکس خریدی!
مزیت های این روش چیه؟
- محیط اصلیت تمیز باقی میمونه
- ایجنت داخل یه محیط جدا اجرا میشه
- کنترل بیشتر روی دسترسی های ایجنت داری
برای ویندوز هم میتونیم از ترکیب Hyper-V + Ubuntu VM استفاده بکنیم و جایگزین خوبی برای OrbStack میتونه باشه.
https://orbstack.dev
https://hermes-agent.nousresearch.com
@DevTwitter | <Javad/>
گل سرسبدشون هم چیزی نیس جز Hermes Agent
برای حل این مسئله یه روش ساده و ایزوله برای بالا آوردنش هست که نمیذاره دسترسی مستقیم به محیط اصلی سیستم داشته باشه که من این نیاز رو با OrbStack رفع و رجوعش میکنم OrbStack یه ابزار خیلی سبک و سریع هستش که بهت اجازه میده Docker، Kubernetes و Ubuntu را روی مک بوک اجرا کنی.
حالا راه و روشش چیه؟
با OrbStack یه Ubuntu سبک بالا میاری، با SSH و Docker Hermes رو داخل کانتینر اجرا میکنی و از داخل سیستم خودت بهش وصل میشی انگار که یه سرور لینوکس خریدی!
مزیت های این روش چیه؟
- محیط اصلیت تمیز باقی میمونه
- ایجنت داخل یه محیط جدا اجرا میشه
- کنترل بیشتر روی دسترسی های ایجنت داری
برای ویندوز هم میتونیم از ترکیب Hyper-V + Ubuntu VM استفاده بکنیم و جایگزین خوبی برای OrbStack میتونه باشه.
https://orbstack.dev
https://hermes-agent.nousresearch.com
@DevTwitter | <Javad/>
👎19❤6🍌3
This media is not supported in your browser
VIEW IN TELEGRAM
یه نفر با Opus 5 یه نسخه هشت نفره از بازی Pong ساخته.
داستان اینطوریه که ۸ تا بازیکن داریم و هر کدوم یه دیوار دارن. اگه نتونید توپ رو بگیرید، دیوارتون ناپدید میشه و زمین بازی کوچیکتر میشه و سرعت توپ هم بالاتر میره.
وقتی هم که میسوزید، میتونید برای کسایی که هنوز زندهان تله بذارید.
https://www.reddit.com/r/aigamedev/comments/1vmdx2q/8player_survival_pong_built_with_opus_the_arena/
@DevTwitter | <Behrad Javed/>
داستان اینطوریه که ۸ تا بازیکن داریم و هر کدوم یه دیوار دارن. اگه نتونید توپ رو بگیرید، دیوارتون ناپدید میشه و زمین بازی کوچیکتر میشه و سرعت توپ هم بالاتر میره.
وقتی هم که میسوزید، میتونید برای کسایی که هنوز زندهان تله بذارید.
https://www.reddit.com/r/aigamedev/comments/1vmdx2q/8player_survival_pong_built_with_opus_the_arena/
@DevTwitter | <Behrad Javed/>
❤89👍20🍌10
بالاخره وقت کردم یه پروژه شخصی رو جمعوبندی کنم!
چند وقت پیش داشتم فکر میکردم چرا وردپرس یه راه ساده و سبک برای نمایش «استوری» مثل اینستاگرام نداره؟ نه افزونه سنگین، نه وابستگی به المنتور، نه کتابخانه اضافه.
نتیجه شد Storyino 📱
یه پلاگین مینیمال وردپرس که:
- با یه شورتکد [storyino] دکمه استوری میسازه
- تصویر و ویدیو رو مستقیم از کتابخانه رسانه انتخاب میکنه — بدون محدودیت تعداد
- ترتیب استوریها با درگانددراپ
- پلیر اختصاصی با نوار پیشرفت، سوایپ، کیبورد و پشتیبانی RTL
- تا فایل کامل آماده نشه، تایمر استوری حرکت نمیکنه
- بدون هیچ وابستگی خارجی — کاملاً Vanilla JS
- از فونت خود قالب سایت استفاده میکنه — بدون هیچ تداخل ظاهری با تم
چیزهایی که توی این پروژه برام چالش و یادگیری جذاب داشت:
- مدیریت دانلود کامل مدیا قبل از پخش (Fetch + Blob)
- شبیهسازی سرعت شبکه برای تست UX
- ایزولهسازی کامل استایل دکمه از قالب، در عین ارثبری فونت سایت
لینک گیت هاب:
https://github.com/Amirrezaheydari81/storyino
@DevTwitter | <Amirreza Heydari/>
چند وقت پیش داشتم فکر میکردم چرا وردپرس یه راه ساده و سبک برای نمایش «استوری» مثل اینستاگرام نداره؟ نه افزونه سنگین، نه وابستگی به المنتور، نه کتابخانه اضافه.
نتیجه شد Storyino 📱
یه پلاگین مینیمال وردپرس که:
- با یه شورتکد [storyino] دکمه استوری میسازه
- تصویر و ویدیو رو مستقیم از کتابخانه رسانه انتخاب میکنه — بدون محدودیت تعداد
- ترتیب استوریها با درگانددراپ
- پلیر اختصاصی با نوار پیشرفت، سوایپ، کیبورد و پشتیبانی RTL
- تا فایل کامل آماده نشه، تایمر استوری حرکت نمیکنه
- بدون هیچ وابستگی خارجی — کاملاً Vanilla JS
- از فونت خود قالب سایت استفاده میکنه — بدون هیچ تداخل ظاهری با تم
چیزهایی که توی این پروژه برام چالش و یادگیری جذاب داشت:
- مدیریت دانلود کامل مدیا قبل از پخش (Fetch + Blob)
- شبیهسازی سرعت شبکه برای تست UX
- ایزولهسازی کامل استایل دکمه از قالب، در عین ارثبری فونت سایت
لینک گیت هاب:
https://github.com/Amirrezaheydari81/storyino
@DevTwitter | <Amirreza Heydari/>
❤33🍌28👎1
خبر داغ این هفته برای توسعهدهندههای React و Next.js:
تیم Next.js نسخهی ۱۶.۳ رو منتشر کرده که مصرف حافظه در پروژههای بزرگ رو تا حدود ۹۰٪ کاهش داده. اگه تا حالا با ارور معروف FATAL ERROR: هنگام build یا dev سروکار داشتی، این آپدیت دقیقاً برای همین درد طراحی شده.
چرا این موضوع مهمه؟
پروژههای بزرگ React، بهخصوص با تعداد زیاد صفحه و Server Component، معمولاً رم رو پر میکنن و باعث کرش شدن پروسهی Node.js میشن. این بهینهسازی یعنی:
- بیلدهای پایدارتر روی CI/CD
- تجربهی dev بهتر روی سیستمهای ضعیفتر
- کاهش هزینهی سرور در دیپلویهای edge
نکته برای شما: اگه پروژهتون روی Next.js 15.x یا 16.x هست، این آپدیت رو حتماً امتحان کنید، مخصوصاً اگه با dataset یا صفحات زیاد کار میکنید.
راستی، این هفته همزمان یک آپدیت امنیتی مهم هم برای Next.js و React منتشر شده (مربوط به middleware و RSC caching) — پس اگه هنوز آپدیت نکردید، الان بهترین زمانشه.
@DevTwitter | <amirhossein ghoampour/>
تیم Next.js نسخهی ۱۶.۳ رو منتشر کرده که مصرف حافظه در پروژههای بزرگ رو تا حدود ۹۰٪ کاهش داده. اگه تا حالا با ارور معروف FATAL ERROR: هنگام build یا dev سروکار داشتی، این آپدیت دقیقاً برای همین درد طراحی شده.
چرا این موضوع مهمه؟
پروژههای بزرگ React، بهخصوص با تعداد زیاد صفحه و Server Component، معمولاً رم رو پر میکنن و باعث کرش شدن پروسهی Node.js میشن. این بهینهسازی یعنی:
- بیلدهای پایدارتر روی CI/CD
- تجربهی dev بهتر روی سیستمهای ضعیفتر
- کاهش هزینهی سرور در دیپلویهای edge
نکته برای شما: اگه پروژهتون روی Next.js 15.x یا 16.x هست، این آپدیت رو حتماً امتحان کنید، مخصوصاً اگه با dataset یا صفحات زیاد کار میکنید.
راستی، این هفته همزمان یک آپدیت امنیتی مهم هم برای Next.js و React منتشر شده (مربوط به middleware و RSC caching) — پس اگه هنوز آپدیت نکردید، الان بهترین زمانشه.
@DevTwitter | <amirhossein ghoampour/>
❤39👍10🍌5
دیپ سیک دیروز یه هارنس اوپنسورس داد بیرون، میری تو گیتهابش پوشه .claude داره :)))
البته که این لزوما چیز بد و اشتباهی نیست ولی جالب بود.
@DevTwitter | <Mahdi MirMohamadi/>
البته که این لزوما چیز بد و اشتباهی نیست ولی جالب بود.
@DevTwitter | <Mahdi MirMohamadi/>
🔥87🍌23👎7
Forwarded from ZikoTech
🚀 اکانت Gemini Pro 🦉
دسترسی به قدرتمندترین ابزارهای هوش مصنوعی با فعالسازی قانونی و تضمینی روی اکانت شخصی شما.
✨ پکیج شامل: Gemini 3 | Google One (5TB) | Veo 3.1 | NoteBookLM | Nano Banana 2
طرح دانشجویی ۱۲ ماهه + جیمیل :
💰قیمت : 1,100,000 تومان
طرح ۱۸ ماهه روی جیمیل شخصی :
💰 قیمت :550,000تومان 459,000 هزار تومان
👇 برای خرید و فعالسازی پیام دهید:
آدرس ربات جهت خرید:
@ZikoTechBot
🔈 آدرس کانال:
@ZikoTech
کانال اعتماد:
@ZikoTechtrust
👩💻 دریافت مشاوره و خرید:
@ZikoTechAdmin
دسترسی به قدرتمندترین ابزارهای هوش مصنوعی با فعالسازی قانونی و تضمینی روی اکانت شخصی شما.
✨ پکیج شامل: Gemini 3 | Google One (5TB) | Veo 3.1 | NoteBookLM | Nano Banana 2
طرح دانشجویی ۱۲ ماهه + جیمیل :
💰قیمت : 1,100,000 تومان
طرح ۱۸ ماهه روی جیمیل شخصی :
💰 قیمت :
👇 برای خرید و فعالسازی پیام دهید:
آدرس ربات جهت خرید:
@ZikoTechBot
🔈 آدرس کانال:
@ZikoTech
کانال اعتماد:
@ZikoTechtrust
👩💻 دریافت مشاوره و خرید:
@ZikoTechAdmin
👎13❤10🍌2
یه skill باحال برای Claude Code و Codex پیدا کردم: Diagram Design
بهجای دیاگرامهای زشت و معمولی، خروجی HTML+SVG تمیز و ادیتوریال میده.
۲۷ نوع دیاگرام داره و حتی رنگ برند سایتت رو هم میخونه و اعمال میکنه.
بدون Figma و بدون ظاهر Mermaid.
https://github.com/cathrynlavery/diagram-design
@DevTwitter | <Saeid/>
بهجای دیاگرامهای زشت و معمولی، خروجی HTML+SVG تمیز و ادیتوریال میده.
۲۷ نوع دیاگرام داره و حتی رنگ برند سایتت رو هم میخونه و اعمال میکنه.
بدون Figma و بدون ظاهر Mermaid.
https://github.com/cathrynlavery/diagram-design
@DevTwitter | <Saeid/>
❤17🍌6👎2
یچی ساختن از صدتا فیچر پولی خفن تره. بوکمارکهای توییترو با ai به دیتابیس لوکال و قابل جستجو تبدیل میکنه. تازه با دستهبندی خودکار محتوا، mind map میسازه و امکان جستجوی فیلترشده محتوا رو بهت میده
https://github.com/viperrcrypto/Siftly
@DevTwitter | <Amir Bagheri/>
https://github.com/viperrcrypto/Siftly
@DevTwitter | <Amir Bagheri/>
❤24🍌11👎2
توی اکثر بنچمارکهای استخراج داده از سند، مدلها روی اسناد کوتاه زیر ۱۰ صفحه سنجیده میشن و اونجا همهشون نمره بالای ۹۰ میگیرن. اما وقتی همین مدلها رو روی اسناد ۵۰ یا ۱۰۰ صفحهای واقعی میذاری، کاراییشون به شدت افت میکنه.
بنچمارک جدید ExtractBench از لاماایندکس دقیقا روی همین نقطه کور دست گذاشته. اونا ۳۷۰ سند سازمانی واقعی رو در ۴۸۶۹ صفحه ارزیابی کردن و چند تا نتیجه خیلی جالب گرفتن:
اول اینکه توی اسناد بالای ۵۰ صفحه، میزان Recall تمام مدلهای VLM تجاری به زیر ۳۵ درصد سقوط میکنه. یعنی مدل چند صفحه اول رو میخونه و بقیه سند رو کلا رها میکنه.
دوم اینکه قیمت بالاتر لزوماً به معنی دقت بیشتر نیست. توی تستها گرونترین سیستم با ۳۴ سنت برای هر صفحه، دقت کمتری نسبت به سیستمهای ۸ سنتی داشت.
سوم هم اینکه ایجنتهای کدنویسی مثل Claude Code یا Codex هنوز توی درک بصری اسناد اسکنشده، چرخیده یا دستنویس نقاط کور جدی دارند.
اگه توی پروژههاتون با RAG یا ایجنتهای تحلیل سند کار میکنید، حتما این بنچمارک و دیتاسِتش رو بررسی کنید.
لینک بنچمارک و گیتهاب:
https://github.com/run-llama/ExtractBench
@DevTwitter | <Mehdi Allahy
بنچمارک جدید ExtractBench از لاماایندکس دقیقا روی همین نقطه کور دست گذاشته. اونا ۳۷۰ سند سازمانی واقعی رو در ۴۸۶۹ صفحه ارزیابی کردن و چند تا نتیجه خیلی جالب گرفتن:
اول اینکه توی اسناد بالای ۵۰ صفحه، میزان Recall تمام مدلهای VLM تجاری به زیر ۳۵ درصد سقوط میکنه. یعنی مدل چند صفحه اول رو میخونه و بقیه سند رو کلا رها میکنه.
دوم اینکه قیمت بالاتر لزوماً به معنی دقت بیشتر نیست. توی تستها گرونترین سیستم با ۳۴ سنت برای هر صفحه، دقت کمتری نسبت به سیستمهای ۸ سنتی داشت.
سوم هم اینکه ایجنتهای کدنویسی مثل Claude Code یا Codex هنوز توی درک بصری اسناد اسکنشده، چرخیده یا دستنویس نقاط کور جدی دارند.
اگه توی پروژههاتون با RAG یا ایجنتهای تحلیل سند کار میکنید، حتما این بنچمارک و دیتاسِتش رو بررسی کنید.
لینک بنچمارک و گیتهاب:
https://github.com/run-llama/ExtractBench
@DevTwitter | <Mehdi Allahy
👍30❤5👎2
ابزار کدنویسی متنباز DeepSeek Harness برای رقابت با Claude Code معرفی شد
دیپسیک با معرفی Harness، رسماً وارد حوزه فریمورکهای مدیریت ایجنتهای هوش مصنوعی شد. این ابزار محیطی منعطف و ماژولار را برای توسعهدهندگان فراهم میکند تا بتوانند به کمک هوش مصنوعی کدهای خود را ویرایش کنند، دستورات خط فرمان را اجرا کنند و وظایف برنامهنویسی پیچیده را به مدلها بسپارند.
ابزار جدید تحت مجوز MIT منتشر شده و به توسعهدهندگان اجازه میدهد تمامی بخشها از جمله مدل، ابزارها و سیستم دسترسی را از طریق پلاگینها شخصیسازی کنند. این پروژه درحالحاضر به عنوان جایگزینی متنباز برای سرویسهای کدنویسی مانند Claude Code و Codex شناخته میشود.
@DevTwitter | <Digiato/>
دیپسیک با معرفی Harness، رسماً وارد حوزه فریمورکهای مدیریت ایجنتهای هوش مصنوعی شد. این ابزار محیطی منعطف و ماژولار را برای توسعهدهندگان فراهم میکند تا بتوانند به کمک هوش مصنوعی کدهای خود را ویرایش کنند، دستورات خط فرمان را اجرا کنند و وظایف برنامهنویسی پیچیده را به مدلها بسپارند.
ابزار جدید تحت مجوز MIT منتشر شده و به توسعهدهندگان اجازه میدهد تمامی بخشها از جمله مدل، ابزارها و سیستم دسترسی را از طریق پلاگینها شخصیسازی کنند. این پروژه درحالحاضر به عنوان جایگزینی متنباز برای سرویسهای کدنویسی مانند Claude Code و Codex شناخته میشود.
@DevTwitter | <Digiato/>
❤44👍10🍌5
اسفند ماه برای واحد شبکههای کامپیوتری یه سرور، کلاینت و پروتکل چت خصوصی با C و LibEV برپایه TCP نوشتم. بماند که هیچ وقت بررسی نشد ولی از اون موقع همینجوری مونده بود
تنها قسمتی از کد که دوسش دارم بخش io هست و بخاطر همون گذاشتمش روی گیتهاب
https://github.com/thehxdev/chatroom
@DevTwitter | <Hossein/>
تنها قسمتی از کد که دوسش دارم بخش io هست و بخاطر همون گذاشتمش روی گیتهاب
https://github.com/thehxdev/chatroom
@DevTwitter | <Hossein/>
🍌18👍15👎1
Forwarded from DevTwitter Ads.
✅ افزونه ثبت و نمایش آمار بازدید "ویزیولایت" در راستچین منتشرشد.
📥 https://rtl-theme.com/visiolite-wordpress-plugin
اگه سایت وردپرسی دارید این کاربردی ترین افزونه ایه که میتونید رو سایتتون نصب کنید!
📥 https://rtl-theme.com/visiolite-wordpress-plugin
اگه سایت وردپرسی دارید این کاربردی ترین افزونه ایه که میتونید رو سایتتون نصب کنید!
👈 با این افزونه میتونید آمار بازدید تمامی برگه های وردپرسی خودتون رو مشاهده کنید.👈کانال برنامه نویسش رو دنبال کنید کاربردیه: @Funny_Learn
🚀 ویژگی ها:
- نمایش آمار بازدید تمامی برگه ها
- تفکیک آمار به صورت روزانه ، هفتگی ، ماهانه و سالانه
- معماری ذخیره سازی تجمیعی (حداکثر حجم افزونه پس از میلیارد ها بازدید تنها 20 مگابایت)
- ارسال درخواست های بازدید به صورت اتمیک به ایجکس با کمترین میزان مصرف رم
- نمایش آمار نوع دستگاه و استان بازدید کنندگان
🍌13👎4🔥3
گوگل نسخه جدید Gemini 3.7 Flash رو منتشر کرد
نسخه قبلی (3.6 Flash) خوب بود، اما این یکی واقعاً یه جهش محسوسه.
خلاصه مهمترین پیشرفتها:
کدنویسی و مهندسی نرمافزار
دیباگ و حل مسائل پیچیدهتر خیلی قویتر شده. دقت کد در اولین تلاش (First-pass Accuracy) بالا رفته و خروجیها به کد آماده پروداکشن نزدیکتر شدن.
بنچمارکها هم حرف میزنن:
- بنچمارک DeepSWE v1.1: از ۴۹٪ به ۶۵.۳٪
- بنچمارک FrontierCode 1.1: از ۳۴.۴٪ به ۴۳.۶٪
توسعه وب و طراحی UI
با پرامپت کمتر میتونه اپلیکیشن و رابط کاربری کامل بسازه. اگر اسکرینشات یا دیزاینسیستم بدی، وفاداری به طرح خیلی بهتر شده.
امتیاز WebDev Arena هم از ۱۵۳۸ به ۱۵۸۸ رسیده.
پردازش اسناد پیچیده و کارهای دانشمحور
در حوزههایی مثل حقوق، مالی و علوم زیستی استدلال قویتری داره.
- با GDP.pdf: از ۲۲٪ به ۳۴٪
- با AutomationBench: از ۱۷٪ به ۳۰.۴٪
برنامهریزی ایجنتها و فراخوانی ابزار
برنامهریزی چندمرحلهای دقیقتر شده، نیاز به مداخله دستی و تلاش مجدد کمتر شده و مدل در عبور از خطاها منسجمتر عمل میکنه.
قیمت و دسترسپذیری
قیمت ورودی و خروجی نصف شده (۰.۷۵ دلار برای هر میلیون توکن ورودی و ۳.۷۵ دلار برای خروجی). ضمن اینکه در Gemini Spark برای کاربران Google AI Pro و Ultra در دسترسه.
اگر با مدلهای سریع کار میکنید، این نسخه ارزش امتحان کردن داره. تغییراتش فقط روی کاغذ نیست؛ در عمل هم حس میشه.
https://blog.google/innovation-and-ai/models-and-research/gemini-models/introducing-gemini-3-7-flash/
@DevTwitter | <Mahan Zandi/>
نسخه قبلی (3.6 Flash) خوب بود، اما این یکی واقعاً یه جهش محسوسه.
خلاصه مهمترین پیشرفتها:
کدنویسی و مهندسی نرمافزار
دیباگ و حل مسائل پیچیدهتر خیلی قویتر شده. دقت کد در اولین تلاش (First-pass Accuracy) بالا رفته و خروجیها به کد آماده پروداکشن نزدیکتر شدن.
بنچمارکها هم حرف میزنن:
- بنچمارک DeepSWE v1.1: از ۴۹٪ به ۶۵.۳٪
- بنچمارک FrontierCode 1.1: از ۳۴.۴٪ به ۴۳.۶٪
توسعه وب و طراحی UI
با پرامپت کمتر میتونه اپلیکیشن و رابط کاربری کامل بسازه. اگر اسکرینشات یا دیزاینسیستم بدی، وفاداری به طرح خیلی بهتر شده.
امتیاز WebDev Arena هم از ۱۵۳۸ به ۱۵۸۸ رسیده.
پردازش اسناد پیچیده و کارهای دانشمحور
در حوزههایی مثل حقوق، مالی و علوم زیستی استدلال قویتری داره.
- با GDP.pdf: از ۲۲٪ به ۳۴٪
- با AutomationBench: از ۱۷٪ به ۳۰.۴٪
برنامهریزی ایجنتها و فراخوانی ابزار
برنامهریزی چندمرحلهای دقیقتر شده، نیاز به مداخله دستی و تلاش مجدد کمتر شده و مدل در عبور از خطاها منسجمتر عمل میکنه.
قیمت و دسترسپذیری
قیمت ورودی و خروجی نصف شده (۰.۷۵ دلار برای هر میلیون توکن ورودی و ۳.۷۵ دلار برای خروجی). ضمن اینکه در Gemini Spark برای کاربران Google AI Pro و Ultra در دسترسه.
اگر با مدلهای سریع کار میکنید، این نسخه ارزش امتحان کردن داره. تغییراتش فقط روی کاغذ نیست؛ در عمل هم حس میشه.
https://blog.google/innovation-and-ai/models-and-research/gemini-models/introducing-gemini-3-7-flash/
@DevTwitter | <Mahan Zandi/>
❤18🍌4👍2
همزمان با چند تا AI Agent کدنویسی میکنید؟ این ریپو به دردتون میخوره
ابزار AgentPet یه پت دسکتاپیه که روی macOS و Windows اجرا میشه و وضعیت Agentهایی مثل Claude Code، Codex، Cursor و Gemini رو لحظهای نشون میده.
میتونید ببینید کدوم Agent داره کار میکنه، کدوم تموم کرده و کدوم منتظر ورودی شماست؛ اونم در قالب یه حیوان کوچولوی Pixel Art که روی دسکتاپتون زندگی میکنه!
ولی قسمت جالبترش اینه که خودش هم مثل Tamagotchi عمل میکنه؛ هرچی بیشتر کدنویسی کنید و Agentهاتون Token مصرف کنن، پت شما XP میگیره، Level Up میشه و Achievement باز میکنه.
کاملاً Open Source و Offline هم هست.
اگه مثل من چندتا Agent رو همزمان اجرا میکنید، این میتونه خیلی فان باشه
https://github.com/ntd4996/agentpet
@DevTwitter | <Mehrdad Ashtari/>
ابزار AgentPet یه پت دسکتاپیه که روی macOS و Windows اجرا میشه و وضعیت Agentهایی مثل Claude Code، Codex، Cursor و Gemini رو لحظهای نشون میده.
میتونید ببینید کدوم Agent داره کار میکنه، کدوم تموم کرده و کدوم منتظر ورودی شماست؛ اونم در قالب یه حیوان کوچولوی Pixel Art که روی دسکتاپتون زندگی میکنه!
ولی قسمت جالبترش اینه که خودش هم مثل Tamagotchi عمل میکنه؛ هرچی بیشتر کدنویسی کنید و Agentهاتون Token مصرف کنن، پت شما XP میگیره، Level Up میشه و Achievement باز میکنه.
کاملاً Open Source و Offline هم هست.
اگه مثل من چندتا Agent رو همزمان اجرا میکنید، این میتونه خیلی فان باشه
https://github.com/ntd4996/agentpet
@DevTwitter | <Mehrdad Ashtari/>
❤15👎10👍3