پرش به محتوا
منو
داده‌نوشت
فناوری، زیرساخت و هوش مصنوعی
هوش مصنوعی

Gemini App؛ دستیار پیش‌فعال با اجازه دسترسی به زندگی شخصی

گوگل در I/O ۲۰۲۶ مسیر Gemini app را به سمت دستیار پیش‌فعال توضیح داد؛ دستیار باید بتواند با اجازه کاربر از Gmail، Calendar، Maps، Photos، YouTube و Search زمینه جمع کند و به‌جای انتظار برای یک سؤال کامل، به برنامه‌ریزی و انجام کار کمک کند. این تجربه وقتی مفید

انتشار: ۲۹ اردیبهشت ۱۴۰۵به‌روزرسانی: ۲۶ مرداد ۱۴۰۵3 دقیقه
تصویر رسمی Google برای Gemini App؛ دستیار پیش‌فعال با اجازه دسترسی به زندگی شخصی
تصویر رسمی Google؛ منبع تصویر: https://blog.google/innovation-and-ai/products/gemini-app/next-evolution-gemini-app/

Gemini App؛ دستیار پیش‌فعال با اجازه دسترسی به زندگی شخصی

گوگل در I/O ۲۰۲۶ مسیر Gemini app را به سمت دستیار پیش‌فعال توضیح داد؛ دستیار باید بتواند با اجازه کاربر از Gmail، Calendar، Maps، Photos، YouTube و Search زمینه جمع کند و به‌جای انتظار برای یک سؤال کامل، به برنامه‌ریزی و انجام کار کمک کند. این تجربه وقتی مفید است که کاربر مجبور نباشد همه جزئیات زندگی خود را دوباره در prompt بنویسد.

#زمینه شخصی، قابلیت و ریسک

فرض کنید کاربر برای سفر برنامه می‌خواهد. Gemini می‌تواند پیام‌های پرواز، تقویم کاری، مکان هتل و علاقه‌های قبلی را در یک پیشنهاد کنار هم بگذارد. نتیجه شخصی‌تر از یک جست‌وجوی عمومی است، اما داده بیشتری نیز درگیر می‌شود. اتصال اپ‌ها باید opt-in باشد و کاربر بتواند هر منبع را جداگانه فعال، غیرفعال یا مرور کند.

پیش‌فعال بودن با خودمختاری کامل تفاوت دارد. Gemini می‌تواند پیشنهاد بسازد یا چند گزینه را مرتب کند، اما رزرو، ارسال پیام و تغییر تقویم باید پیش از اجرا به تأیید برسد. محصول باید نشان دهد پاسخ بر اساس کدام داده ساخته شده و اگر یک منبع قدیمی یا ناقص است، عدم قطعیت را پنهان نکند.

#از app تا اکوسیستم

گوگل Gemini app را به Android، Search، Workspace و ابزارهای توسعه‌دهنده نزدیک می‌کند. این اتصال مزیت context دارد و هم‌زمان یک سطح حمله بزرگ‌تر می‌سازد. prompt injection در ایمیل یا صفحه وب می‌تواند تلاش کند عامل را به افشای داده یا انجام اقدام وادار کند. permission جداگانه، sandbox و فیلتر محتوای بیرونی برای هر connector لازم است.

برای خانواده و سازمان، مرزهای account مهم‌اند. اطلاعات شخصی نباید از مسیر work profile به محیط کاری برود و داده شرکت نباید در پاسخ شخصی ظاهر شود. تیم باید data boundary، log دسترسی و سیاست نگهداری را پیش از فعال کردن personal intelligence مشخص کند.

#rollout و ارزیابی

قابلیت‌های اعلام‌شده در I/O معمولاً rollout تدریجی، beta یا محدود به کشور و نوع اشتراک دارند. بنابراین «Gemini می‌تواند» با «برای حساب من فعال است» یکسان نیست. developer و مدیر محصول باید status مستند هر API و سطح حساب را جداگانه ثبت کنند.

Gemini App در این مسیر از یک chatbot به رابطی برای اقدام تبدیل می‌شود. معیار موفقیت فقط پاسخ بهتر نیست؛ باید دید آیا کاربر کنترل خود را حفظ می‌کند، داده درست انتخاب می‌شود و اقدام نهایی بدون غافلگیری انجام می‌گیرد. دستیار شخصی خوب، بیشتر از آنکه پیش‌فعال باشد، قابل پیش‌بینی است.

در چنین محصولی، تاریخچه تصمیم به اندازه پاسخ نهایی اهمیت دارد. کاربر باید بتواند ببیند کدام اتصال، پیام یا فایل در پیشنهاد دخالت داشته و آن زمینه را حذف یا اصلاح کند. برای اقدام‌هایی که اثر بیرونی دارند، پیش‌نمایش تغییر و امکان لغو باید بخشی از رابط باشد. این جزئیات تجربه را از یک چت هوشمند به یک سیستم قابل اعتماد نزدیک می‌کند.

مطالب مرتبط

برای ادامه مطالعه

این یادداشت‌ها بر اساس موضوع مشترک، هم‌پوشانی برچسب‌ها و تازگی انتشار انتخاب می‌شوند.

تصویر رسمی OpenAI برای Health در ChatGPT؛ اتصال داده سلامت با مرز روشن میان کمک و درمان
هوش مصنوعی

Health در ChatGPT؛ اتصال داده سلامت با مرز روشن میان کمک و درمان

OpenAI در ۲۳ ژوئیه ۲۰۲۶ گسترش Health در ChatGPT را برای کاربران واجد شرایط آمریکا آغاز کرد. کاربران Free، Go، Plus و Pro که وارد حساب شده‌اند و ۱۸ سال یا بیشتر دارند، می‌توانند در وب و iOS داده‌های پشتیبانی‌شده health records و Apple Health را به‌صورت امن متصل

۱ مرداد ۱۴۰۵3 دقیقه
تصویر رسمی OpenAI برای Multi-agent در Responses API؛ تقسیم کار پیش از زیاد کردن عامل‌ها
هوش مصنوعی

Multi-agent در Responses API؛ تقسیم کار پیش از زیاد کردن عامل‌ها

OpenAI قابلیت multi-agent را در Responses API به‌صورت beta معرفی کرده است. در این الگو، یک نمونه GPT‑۵.۶ می‌تواند چند زیرعامل را برای بخش‌های مستقل یک مسئله هماهنگ کند و نتیجه‌ها را ترکیب کند. وعده اصلی، کاهش زمان wall-clock و بهتر شدن کارهای پیچیده‌ای است که

۱۸ تیر ۱۴۰۵3 دقیقه
تصویر رسمی Anthropic برای واترمارک متنی Claude؛ نشانه‌گذاری آماری به‌جای ادعای تشخیص قطعی
هوش مصنوعی

واترمارک متنی Claude؛ نشانه‌گذاری آماری به‌جای ادعای تشخیص قطعی

Anthropic در ۱۴ اوت ۲۰۲۶ درباره سازوکار واترمارک متنی Claude توضیح داد. ایده این است که مدل در هنگام انتخاب tokenها، الگوی آماری بسیار ظریفی ایجاد کند که بعداً بتوان آن را با یک detector بررسی کرد. این روش با واترمارک تصویری که پیکسل یا metadata را تغییر می‌ده

۲۳ مرداد ۱۴۰۵3 دقیقه