راهکار جدید انویدیا برای افزایش سرعت جابهجایی حافظه مکالمه میان مدلهای هوش مصنوعی
محققان انویدیا روشی معرفی کردهاند که با استفاده از ریاضیات خطی، انتقال KV Cache میان مدلهای هوش مصنوعی را سریعتر و کمهزینهتر میکند.

به گزارش ونچربیت، محققان انویدیا راهکاری ابداع کردهاند که میتواند انتقال حافظه مکالمه یا KV Cache را میان مدلهای مختلف هوش مصنوعی ممکن کند؛ قابلیتی که برای سیستمهایی با جابهجایی میان مدلهای کوچک و بزرگ اهمیت دارد.
بر اساس این گزارش، در سیستمهای هوشمند هنگام تغییر از یک مدل به مدل دیگر، مدل جدید معمولاً ناچار است کل گفتوگو را از ابتدا بازسازی کند. این فرایند میتواند هزینهبر و کند باشد، بهویژه زمانی که گفتوگو طولانیتر شده یا جابهجایی میان مدلها بیشتر رخ دهد.
روش جدید انویدیا بهجای تکیه بر فرایندهای سنگین یادگیری، از محاسبات ریاضی ساده و ریاضیات خطی استفاده میکند. طبق یادداشت منتشرشده، این رویکرد توانسته عملیات انتقال را بین ۲.۷ تا ۲۵ برابر سریعتر کند و هزینهها را بهشدت کاهش دهد.
این دستاورد در صورت بهکارگیری در سامانههای هوش مصنوعی، میتواند مسیر استفاده کارآمدتر از مدلهای کوچک و بزرگ را هموارتر کند؛ بدون آنکه در هر جابهجایی، بازسازی کامل تاریخچه گفتوگو لازم باشد.
مطالب مرتبط
برای ادامه مطالعه
این یادداشتها بر اساس موضوع مشترک، همپوشانی برچسبها و تازگی انتشار انتخاب میشوند.

معرفی meigen.ai؛ سایتی با بیش از ۱۰ هزار پرامپت برای تولید تصویر
وبسایت meigen.ai بهعنوان مجموعهای با بیش از ۱۰ هزار پرامپت تولید تصویر معرفی شده که برای Nano Banana، GPT Image 2 و مدلهای دیگر قابل استفاده است.

ساخت پخش زنده نامحدود در توییچ با مدل ویدیویی مینیمکس H3
یک کاربر خلاق با استفاده از مدل ویدیویی مینیمکس H3، پخش زندهای نامحدود و شبیه کانال تلویزیونی در توییچ ساخته که به گفته خبرنگار مخاطبان زیادی جذب کرده است.

Perplexity AI و NVIDIA ابزار هوش مصنوعی محلی Portable Computer را معرفی کردند
Perplexity AI و NVIDIA ابزار Portable Computer را معرفی کردند؛ ابزاری محلی که با هدف حفظ حریم خصوصی، بخش عمده پردازشها را روی دستگاه کاربر انجام میدهد.