7 Jan 2026, 09:01 UTC107 viewsread 6 August 2026 این مقاله (برنده جایزه بهترین مقاله NeurIPS 2025)، نشان میدهد که شبکههای عصبی عمیق (تا ۱۰۲۴ لایه) را میتوان به طور پایدار برای یادگیری تقویتی رباتیک (reinforcement learning) آموزش داد. این کار با استفاده از اتصالات باقیمانده (residual connections)، نرمالسازی لایه (layer normalization) و فعالسازی Swish انجام شده و بر مشکل ناپایداری قبلی ناشی از پاداشهای پراکنده غلبه کرده است.
به طور شگفتانگیزی، جهشهای عملکرد…
Signed Mohammad Saleh
7 Jan 2026, 05:43 UTC90 viewsread 6 August 2026 Forwarded from @Shirazi_AI_Search
CS224R Deep Reinforcement Learning | Spring 2025 , Stanford university (Slides, Videos)
https://cs224r.stanford.edu/
https://www.youtube.com/playlist?list=PLoROMvodv4rPwxE0ONYRa_itZFdaKCylL
https://www.youtube.com/watch?v=EvHRQhMX7_w&list=PLoROMvodv4rPwxE0ONYRa_itZFdaKCylL&index=1
#course
#youtube
Signed Mohammad Saleh
1 Jan 2026, 03:21 UTC115 viewsread 6 August 2026 Forwarded from @robotech_academyPhoto
دکتر Fie Fie Li ، استاد معروف دانشگاه استنفورد، در مورد زبان (منظور متن و کلمات نه زبان انگلیسی) صحبت جالبی رو مطرح میکنه.
ایشون میگه زبان یه سیگنال مصنوعی تولید شده است. زبان فهم ما از جهان هست. اینجور نیست که ما بریم بیرون و کلمات توی محیط نوشته شده باشه. در واقع کلمات و جملات فهم ما از جهان هست نه خود جهان. و ما باید فراتر از متون و کلمات استفاده کنیم برای یادگیری.
@robotech_academy
Signed Mohammad Saleh
31 Dec 2025, 05:49 UTC142 viewsread 6 August 2026 تحقیق جدید Google در مورد شبکههای عصبی، یعنی این همه مدت داشتیم اشتباه فکر میکردیم؟
تازگیا یه مقاله خیلی خوب از گوگل منتشر شده که توجه زیادی رو به خودش جلب کرده، و جالبتر اینکه ۳ نفر از ۴ نویسندهش ایرانی هستن: علی بهروز، میثم رضویان و وهاب میررکنی. این تحقیق با عنوان "The Illusion of Deep Learning Architecture" نکته مهم و قابلتأملی رو مطرح میکنه، مخصوصاً برای کسایی که روی continual learning کار میکنن و ارزش د…
31 Dec 2025, 03:59 UTC92 viewsread 6 August 2026 Forwarded from @MachineLearning_irVideo
🧠 وقتی فیزیک و شبکههای عصبی با هم ترکیب میشن!
👨🏻💻 یکی از جذابترین تکنیکهای یادگیری ماشین، فیزیک-آگاه / (PINN) یا همون شبکههای عصبی مبتنی بر فیزیکه.
✅ کاری که با شبکه عصبی معمولی نمیشه انجام داد، با PINN به سادگی قابل حله؛ از پیدا کردن امواج گرانشی سیاهچالهها گرفته تا پیشبینی روند کرونا!
⬅️ این حوزه توی شاخه بزرگتری به اسم Scientific ML قرار میگیره و برای شروع یادگیریش، این منابع به کارت میاد:👇
📣 Sc…
22 Jan 2025, 20:09 UTC284 viewsread 6 August 2026 Forwarded from @AI_EventsPhoto
پروژه 500 میلیارد دلاری هوش مصنوعی
پروژه استارگیت OpenAI با هدف ایجاد یک زیرساخت بزرگ هوش مصنوعی، با دسترسی انحصاری OpenAI، طراحی شده است. این طرح مستلزم بیش از 500 میلیارد دلار بودجه در طول چهار ساله که با 100 میلیارد دلار شروع میشه (یکی از بزرگترین سرمایهگذاریهای زیرساختی در تاریخ آمریکا) که حتی از پروژه منهتن و برنامه آپولو (در صورت تعدیل تورم) پیشی میگیره!!!
انتظار میره که Stargate بیش از 100000 شغل ایجاد کنه…
20 Jan 2025, 17:57 UTC216 viewsread 6 August 2026 در خصوص LLM Agents :
📗 عاملهای مبتنی بر LLMها یکی از تحولات بزرگ در هوش مصنوعی محسوب میشوند که قابلیت تصمیمگیری خودکار و حل مسائل پیچیده را دارا هستند. این تکنولوژی مورد توجه صنایع قرار گرفته و همچنین سال 2024 به عنوان عصر عاملهای AI نامیده شده است.
این مدلها توانایی استدلال، برنامهریزی، استفاده از ابزار و اجرای مستقل وظایف پیچیده را کسب میکنند.
📗 منظور از عاملهای هوش مصنوعی سیستمهایی است که میتوانند بدون…
20 Jan 2025, 17:55 UTC167 viewsread 6 August 2026 Photo
❇️ به پیشنهاد گروهی از مخاطبین کنفرانس وب پژوهی، پنل ویژه ای با عنوان
«هوش مصنوعی قابل اعتماد و وب»
Trustworthy AI and Web
تعریف شده است. از پژوهشگرانی که در این حوزه فعالیت می کنند دعوت می شود مقالات خود را به یازدهمین کنفرانس بینالمللی وب پژوهی ارسال نمایند.
همچنین از اساتید و اعضای هیات علمی که در این حوزه فعالیت دارند جهت مشارکت در این پنل دعوت بعمل می آید.
❇️ مقالات پذیرفته شده انگلیسی مانند سال های قبل جهت …
14 Sept 2024, 07:51 UTC258 viewsread 6 August 2026 Forwarded from @AI_360
مدل o1 و معرفی پارادایم جدید برای مقیاس Inference
تا الان روال این بوده که بودجه محاسباتی و پردازشی LLM ها، عمدتا صرف مرحله Pre-train یا همون ساخت LLM ها میشه و بودجه عجیبی برای Inference در نظر گرفته نمیشه. چرا که به ازای هر پرامپتی که سمت LLM میاد، یک بار یک جنریشن رخ میده و پاسخ تحویل کاربر داده میشه. این روال فعلی تمام LLM ها چه Open و چه Close source هست. هرچند که خود جنریت کردن رو اگر بعنوان تسک پیشبینی ت…
13 Sept 2024, 10:03 UTC181 viewsread 6 August 2026 Forwarded from @Machine_LearningsPhoto
دیروز شرکت OpenAI جدیدترین مدل خود را که پیشنمایشی از مدل o1 است معرفی کرد. این مدل که قبلا با نامهای *Q و توتفرنگی در رسانهها مطرح شده بود، قدرت استنتاج و استدلال پیشرفتهتری از مدلهای قبلی ارائه میدهد. البته این فرآیند استدلال باعث کندتر بودن تولید پاسخ شده است. برای بررسی این مدل، یک سوال سادهی استدلالی را از دو مدل ChatGPT o1-preview و ChatGPT 4o پرسیدیم. همانطور که مشاهده میکنید مدل جدید برخلاف مدل قبلی …
4 Sept 2024, 17:30 UTC222 viewsread 6 August 2026 سلام به همه!
اگه دنبال شغلهای بینالمللی با امکان دورکاری، ریلوکیشن یا Visa Sponsorship هستید، پیشنهاد میکنم حتماً یه سر به وبسایت جابزکیت بزنید.
معرفی این سایت رو به این صورت از لینکدین دیدم گفتم به شما هم معرفی کنم
https://jobs-kit.com/
7 Jul 2024, 08:24 UTC270 viewsread 6 August 2026 Forwarded from @nlp_stuffPhoto
معرفی دوره آموزشی و مسابقه rayan
• دانشگاه شریف، مسابقه و دوره پیشرفته و جالبی با نام RAYAN AI در زمینه اعتمادپذیری در یادگیری عمیق (Trustworthiness in Deep Learning) برگزار میکنه. این مسابقه ۳۵ هزار دلار جایزه نقدی داره (درست خوندید) و پاییز برگزار میشه.
• دو تا دوره با اساتید خفن (مثل دکتر رهبان، دکتر سلیمانی و دکتر نجفی و ...) هم برگزار میکنه؛ یکی دوره مقدمه یادگیری ماشین و یادگیری عمیق و دومی هم اعتمادپذیری د…
Showing the 12 most recent of 18 posts we hold for @ml_nlp_cv. View and reaction counts are the latest single reading for each post, not a live figure, and a recent post is still accumulating both. A view count marked ≈ was rounded by Telegram before we ever saw it — t.me prints views in full below 1,000 and to three significant figures above, so ≈1,200,000 means somewhere between 1,150,000 and 1,249,999. Unmarked counts are exact. Text is reproduced from the public post preview and truncated for length.