گوگل نسل جدید مدلهای صوتی Gemini را معرفی کرد
گوگل دو مدل صوتی جدید Gemini 3.8 Live و Gemini 3.8 Live Extended Thinking را معرفی کرده که برای پاسخگویی سریع و انجام کارهای پیچیده چندمرحلهای طراحی شدهاند.

گوگل نسل جدید مدلهای صوتی Gemini را با نامهای Gemini 3.8 Live و Gemini 3.8 Live Extended Thinking معرفی کرد؛ دو مدلی که بنا بر گزارش منتشرشده، هر کدام برای نوع متفاوتی از کاربردهای صوتی و تعاملی طراحی شدهاند.
بر اساس این گزارش، Gemini 3.8 Live برای سرعت و مقیاس ساخته شده است، در حالی که نسخه 3.8 Live Extended Thinking برای کارهای پیچیده و چندمرحلهای کاربرد دارد. در نمونهای که در یادداشت خبرنگار آمده، کاربر میتواند دوربین را به سمت یک لوله آب خراب بگیرد، با Gemini صحبت کند و این مدل همزمان تصویر را ببیند، مکالمه را ادامه دهد و قدمبهقدم راهنمایی ارائه کند.
در این گزارش همچنین آمده که این مدلها میتوانند در میانه مکالمه وارد گفتوگو شوند، تعامل را ادامه دهند و میان ۹۷ زبان جابهجا شوند. این ویژگیها نشان میدهد تمرکز نسل تازه Voice AI تنها بر گفتوگوی ساده با ربات نیست و به سمت نقشآفرینی بهعنوان یک همراه لحظهای در مشاهده، فهم و راهنمایی کاربر حرکت کرده است.
منبع: گزارش رسیده از یک منبع خبری
مطالب مرتبط
برای ادامه مطالعه
این یادداشتها بر اساس موضوع مشترک، همپوشانی برچسبها و تازگی انتشار انتخاب میشوند.

گوگل مدلهای جمینای 3.8 لایو را برای مکالمه صوتی و استدلال همزمان معرفی کرد
گوگل دو مدل جمینای 3.8 لایو و Gemini 3.8 Live Extended Thinking را با تمرکز بر مکالمه صوتی طبیعی، پردازش تصویری همزمان و اجرای ابزارها در پسزمینه معرفی کرد.

نگرانی سیلیکونولی از ایجنتهای هوش مصنوعی؛ از مسئله همسوسازی تا کلید قطع اضطراری
گزارشی از دیجیاتو میگوید نگرانی درباره ایجنتهای هوش مصنوعی از آینده مشاغل فراتر رفته و به خطرهای همسوسازی، رفتارهای پیشبینینشده و رقابت شرکتها رسیده است.

کاکتوس از Needle 3؛ مدل بنیادی سبک برای اتوماسیون محلی رونمایی کرد
شرکت تازهتأسیس کاکتوس از Needle 3 رونمایی کرده؛ مدلی بنیادی برای اتوماسیون که با حجم ۸ تا ۲۹ مگابایت میتواند بهصورت محلی روی Raspberry Pi 5 اجرا شود.
دیدگاهها
اولین نفری باش که دیدگاه میذاره