پرش به محتوا
منو
داده‌نوشت
فناوری، زیرساخت و هوش مصنوعی
هوش مصنوعی

گوگل نسل جدید مدل‌های صوتی Gemini را معرفی کرد

گوگل دو مدل صوتی جدید Gemini 3.8 Live و Gemini 3.8 Live Extended Thinking را معرفی کرده که برای پاسخ‌گویی سریع و انجام کارهای پیچیده چندمرحله‌ای طراحی شده‌اند.

انتشار: ۲۸ شهریور ۱۴۰۵1 دقیقه
- گزارش از خط مقدم هوش مصنوعی: ▪️گوگل نسل جدید مدل‌های صوتی Gemini رو معرفی کرد؛ Gemini 3.8 Live و 3.8 Live Extended Thi

گوگل نسل جدید مدل‌های صوتی Gemini را با نام‌های Gemini 3.8 Live و Gemini 3.8 Live Extended Thinking معرفی کرد؛ دو مدلی که بنا بر گزارش منتشرشده، هر کدام برای نوع متفاوتی از کاربردهای صوتی و تعاملی طراحی شده‌اند.

بر اساس این گزارش، Gemini 3.8 Live برای سرعت و مقیاس ساخته شده است، در حالی که نسخه 3.8 Live Extended Thinking برای کارهای پیچیده و چندمرحله‌ای کاربرد دارد. در نمونه‌ای که در یادداشت خبرنگار آمده، کاربر می‌تواند دوربین را به سمت یک لوله آب خراب بگیرد، با Gemini صحبت کند و این مدل هم‌زمان تصویر را ببیند، مکالمه را ادامه دهد و قدم‌به‌قدم راهنمایی ارائه کند.

در این گزارش همچنین آمده که این مدل‌ها می‌توانند در میانه مکالمه وارد گفت‌وگو شوند، تعامل را ادامه دهند و میان ۹۷ زبان جابه‌جا شوند. این ویژگی‌ها نشان می‌دهد تمرکز نسل تازه Voice AI تنها بر گفت‌وگوی ساده با ربات نیست و به سمت نقش‌آفرینی به‌عنوان یک همراه لحظه‌ای در مشاهده، فهم و راهنمایی کاربر حرکت کرده است.

منبع: گزارش رسیده از یک منبع خبری

مطالب مرتبط

برای ادامه مطالعه

این یادداشت‌ها بر اساس موضوع مشترک، هم‌پوشانی برچسب‌ها و تازگی انتشار انتخاب می‌شوند.

هوش مصنوعی

نگرانی سیلیکون‌ولی از ایجنت‌های هوش مصنوعی؛ از مسئله همسوسازی تا کلید قطع اضطراری

گزارشی از دیجیاتو می‌گوید نگرانی درباره ایجنت‌های هوش مصنوعی از آینده مشاغل فراتر رفته و به خطرهای همسوسازی، رفتارهای پیش‌بینی‌نشده و رقابت شرکت‌ها رسیده است.

۲۹ شهریور ۱۴۰۵3 دقیقه

دیدگاه‌ها

اولین نفری باش که دیدگاه می‌ذاره