Video yükleniyor...

Video Yüklenemedi

Ana Sayfaya Dön

ترا مافيها شيء تعترف بالدعم الملياري اللي جاءكم وحتى قبل الرئيس الحالي جاكم دعم

56,221 görüntüleme • 9 ay önce •via X (Twitter)

0 Yorum

Yorum bulunmuyor

Orijinal gönderinin yorumları burada görünecek

Benzer Videolar

شفتوا تأثير جيهان على علياء بالمشهد؟ كيف النظره والكلمه منه تقلب موازينها! قلتها قبل وارجع أقولها، جيهان وعلياء واقعين لبعض بنفس العمق وبنفس القوة، وتأثيرهم على بعض يتجاوز بمراحل أي منطق ممكن نتخيله… لكن الفرق الوحيد هو إن علياء عندها دينيز، هو اللي دائماً يمسك يدها باللحظه الأخيرة، هو اللي يرجعها لواقعها ومنطقها كل ما غلبها تأثير جيهان، لولا وجود دينيز كبوصلة في حياتها، كان شفتوا علياء مندفعة ورا مشاعرها لدرجه تخوف وممكن تروح لأبعد مما يروح جيهان نفسه….دينيز هو اللي يخليها متماسكة، ولا القلب غرقان ومنتهي… وهذا مو أول مشهد يثبت هالشيء ترى، فيه مشاهد كثيرة مرت توضح لنا ليه علياء دائماً تحاول تحط مسافة وتبعد، حتى في الحوارات العادية والمواساة، لأنها عارفه إن تأثيره عليها قوي لدرجة مرعبة، هي تدرك إن اللحظه اللي بتعطي فيها لنفسها مجال، ممكن تنسى كل شيء…تنسى منطقها، ونفسها، وحتى قضيتها، تماماً مثل ما صار في سالفة الشقة أول مره

🍒

38,063 görüntüleme • 5 ay önce

من الخوارزميات الأساسية وراء تدريب نماذج الذكاء الاصطناعي الحديثة مثل DeepSeek و GPT-5 و Qwen هي خوارزميات التعلم التعزيزي (RL)، خصوصًا خوارزميات مثل PPO و GRPO ورغم انتشار الحديث عنها، فهم الفرق بينهم أو كيف يتعلّم الوكيل فعليًا داخل البيئة يظل صعب ومعقد لهذا قدّم فريق alphaXiv أداة تفاعلية جديدة رهيبة اسمها RL Playground وهي بيئة تعليمية بسيطة توضّح خطوة بخطوة كيف يتعلّم الوكيل من خلال التجربة والخطأ داخل متاهة صغيرة: كيف يتجنب العقبات، ما هي قيمة كل خطوة، وكيف تتغيّر السياسة (Policy) أثناء التدريب الأداة تسمح لك بتجربة عدة خوارزميات مثل: - Q-Learning (الأساسيات) - PPO (Proximal Policy Optimization) - GRPO (Group Relative Policy Optimization) وتشاهد كل شيء بشكل بصري: المكافآت، القرارات، مسارات الحركة، وتحديث القيم وكلها مباشرة في المتصفح وبدون تثبيت أي شيء الأداة ممتازة للمبتدئين والباحثين وحتى للممارسين اللي يحبون الفهم والتعلم بشكل مصور كيف تعمل خوارزميات RL الحديثة اللي يتم استخدامها اليوم في تدريب الوكلاء والنماذج اللغوية من قبل الباحثين أنصح بتجربتها مفيدة جدًا، الرابط:

Saad

13,597 görüntüleme • 10 ay önce