Zhaochen Yu، Yingcheng Wu، Zhenfei Yin، Kaiyuan Chen و 4 نفر دیگر
بهبود خود‑بازگشتی (RSI) در وظایف افقطولانی دشوار میماند؛ جایی که سابقههای رشدگی وضعیت وظیفه را مبهم میسازند و فراخوانی مهارت را نامتناسب میکنند. ما Recuris را معرفی میکنیم، یک معماری حافظه تجربی‑کار بازگشتی برای وظ…
Kai Ruan، Jinghao Lin، Qianshan Wei، Ziqi Zhou و 1 نفر دیگر
یادگیری تقویتی نسبی به گروه، منتظر بازپخشهای همزاد یکسان از یک پیام میماند که برای مسیرهای ابزی طولانی و هزینهبر متغیر است. بهینهسازی سیاست تکجریانی (SPO) با حذف این وابستگی، با استفاده از یک برآورد ارزش سطحی از پیا…
Andreas Hochlehnert، Marianna Nezhurina، Mehdi Cherti، Andrej Radonjic و 8 نفر دیگر
We present LAION-BVD, a large-scale open video dataset for multimodal learning, which contains 1.3B platform-specific video URLs collected from CommonCrawl. From these, we download 80M videos with a total duration of 10…
مدلهای زبانی بزرگ (LLM) بهطور فزایندهای بهعنوان تحلیلگران هوش مصنوعی برای پردازش گزارشهای مالی و پشتیبانی از تصمیمهای سرمایهگذاری مبتنی بر هوش مصنوعی بهکار گرفته میشوند. بااینحال، این سیستمها معمولاً بر اساس آ…
گسترش سریع ارزیابیهای مقیاس بزرگ و پذیرش رو به رشد تولید خودکار آیتمها، نگرانیهای مربوط به تکرار تصادفی محتوا را تشدید کرده است، به طوری که عناصر غیر مرتبط با ساختار (مانند قالببندی یا تزریق زمینهای) بهطور تصادفی د…
بزرگترین مدلهای زبانی بزرگ بهصورت فزایندهای برای پاسخدهی به سوالات بر پایهٔ دانشگراف (KGQA) به کار میروند، اما ممکن است در جایگذاری پاسخها بر روی گراف زیربنایی شکست بخورند. رویکردهای فعلی KGQA مبتنی بر LLM یا به…
کارهای اخیر، مدلهای فضای حالت (SSMs) سبک مامْبا را برای کاربردهای تشخیص ناهنجاری در ویدیو بهکار گرفتهاند؛ بااینحال، رویکردهای موجود همچنان بهطور ضمنی از بافر کردن کلیپها یا پنجرهها استفاده میکنند، رابطهای نظری د…
کارتهای مدل، اسنادی ساختاریافته هستند که اطلاعات کلیدی درباره مدلهای یادگیری ماشین را بهطور خلاصه ارائه میکنند تا شفافیت، قابلیت استفاده و پاسخگویی را ارتقا دهند. بااینحال، این کارتها اغلب فاقد ساختاری یکپارچهاند…
Esakkivel Esakkiraja، Denis Akhiyarov، Vikas Yadav، Sai Rajeswar و 3 نفر دیگر
**StarHarness** را معرفی میکنیم، چارچوبی برای تکامل مهارهای (harness) اختصاصیافته به محیط، با حفظ ثابت بودن وزنهای مدل. مهار تکاملیافته میتواند شامل چارچوببندی وظیفه و دستور (prompt)، واسطهای ابزاری، مهارتها، ارا…