پرش به محتوا
منو
داده‌نوشت
فناوری، زیرساخت و هوش مصنوعی
هوش مصنوعی

Gemini برای سفر؛ برنامه‌ای که از Gmail و Calendar زمینه می‌گیرد

نمونه‌ای که گوگل در ۲۶ ژوئن ۲۰۲۶ درباره Gemini منتشر کرد، یک قابلیت کوچک اما مهم را نشان می‌دهد: دستیار می‌تواند با اجازه کاربر از Gmail و Calendar برای ساخت برنامه سفر و کاهش jet lag استفاده کند. به‌جای آنکه کاربر شماره پرواز، زمان جلسه و آدرس هتل را دوباره و

انتشار: ۵ تیر ۱۴۰۵به‌روزرسانی: ۲۶ مرداد ۱۴۰۵3 دقیقه
تصویر رسمی Google برای Gemini برای سفر؛ برنامه‌ای که از Gmail و Calendar زمینه می‌گیرد
تصویر رسمی Google؛ منبع تصویر: https://blog.google/products-and-platforms/products/gemini/gemini-help-avoid-jetlag/

Gemini برای سفر؛ برنامه‌ای که از Gmail و Calendar زمینه می‌گیرد

نمونه‌ای که گوگل در ۲۶ ژوئن ۲۰۲۶ درباره Gemini منتشر کرد، یک قابلیت کوچک اما مهم را نشان می‌دهد: دستیار می‌تواند با اجازه کاربر از Gmail و Calendar برای ساخت برنامه سفر و کاهش jet lag استفاده کند. به‌جای آنکه کاربر شماره پرواز، زمان جلسه و آدرس هتل را دوباره وارد کند، Gemini اطلاعات مرتبط را از سرویس‌های متصل پیدا می‌کند و پیشنهاد را در زمینه شخصی می‌سازد.

#عامل دقیقاً چه می‌کند؟

گام اول استخراج واقعیت است: پرواز چه زمانی می‌رسد، جلسه در کدام روز است و محل اقامت چقدر با مقصد فاصله دارد. گام بعد می‌تواند پیشنهاد خواب، نور و زمان‌بندی فعالیت باشد. این دو مرحله باید از هم جدا دیده شوند. اگر مدل در استخراج زمان پرواز اشتباه کند، توصیه بعدی هرقدر روان باشد بر پایه غلط ساخته شده است.

Gemini برای اقدام در Gmail و Calendar نیز می‌تواند workflow بسازد؛ اما خواندن، پیشنهاد و نوشتن یکسان نیستند. مشاهده یک رویداد ریسک کمی دارد، تغییر تقویم یا ارسال دعوت‌نامه اقدام بیرونی است. رابط باید پیش از write خلاصه کند چه چیزی تغییر خواهد کرد و از کاربر تأیید بگیرد.

#اتصال داده و حریم خصوصی

ارزش این تجربه از داده شخصی می‌آید و همین داده حساس‌ترین بخش آن است. اتصال Gmail و Calendar باید opt-in باشد و کاربر بتواند آن را در تنظیمات قطع کند. پاسخ نباید اطلاعات یک سفر خصوصی را به کاربر یا فضای دیگری منتقل کند. permission اپ و مرز حساب شخصی/کاری باید جدا بماند.

در یک تیم محصول، prompt injection از ایمیل یا event هم باید سناریوی آزمون باشد. یک پیام می‌تواند متن مخربی داشته باشد که از مدل بخواهد اطلاعات دیگری را فاش کند. connector نباید محتوای ایمیل را به دستور معتبر تبدیل کند؛ داده بیرونی باید untrusted تلقی شود.

#تجربه در برابر اتوماسیون

نمونه سفر گوگل بیشتر یک demonstration از context شخصی است تا اعلام یک آژانس خودکار کامل. دسترسی ممکن است به کشور، حساب و rollout وابسته باشد. توسعه‌دهنده‌ای که همین تجربه را در محصول خود می‌سازد باید تقویم، ایمیل و action log را با سیاست حذف و رضایت همراه کند.

Gemini در این سناریو کاربر را از ورود دستی نجات می‌دهد، اما نباید تصمیم را از او بگیرد. دستیار خوب اطلاعات مرتبط را جمع می‌کند، ابهام را آشکار می‌سازد و پیش از اقدام بیرونی فرصت بازبینی می‌دهد.

نمونه رسمی گوگل می‌گوید پس از اجازه دسترسی، Gemini می‌تواند اطلاعات پرواز را در Gmail پیدا کند، برنامه‌ای برای سازگاری با اختلاف زمانی بسازد و آن را به Calendar اضافه کند. این زنجیره سه نقطه قابل بررسی دارد: تشخیص درست پرواز، پیشنهاد قابل قبول و ثبت رویداد بدون تغییر ناخواسته در تقویم. طراحی محصول باید هر مرحله را جداگانه قابل مشاهده و قابل لغو نگه دارد.

مطالب مرتبط

برای ادامه مطالعه

این یادداشت‌ها بر اساس موضوع مشترک، هم‌پوشانی برچسب‌ها و تازگی انتشار انتخاب می‌شوند.

تصویر رسمی OpenAI برای Health در ChatGPT؛ اتصال داده سلامت با مرز روشن میان کمک و درمان
هوش مصنوعی

Health در ChatGPT؛ اتصال داده سلامت با مرز روشن میان کمک و درمان

OpenAI در ۲۳ ژوئیه ۲۰۲۶ گسترش Health در ChatGPT را برای کاربران واجد شرایط آمریکا آغاز کرد. کاربران Free، Go، Plus و Pro که وارد حساب شده‌اند و ۱۸ سال یا بیشتر دارند، می‌توانند در وب و iOS داده‌های پشتیبانی‌شده health records و Apple Health را به‌صورت امن متصل

۱ مرداد ۱۴۰۵3 دقیقه
تصویر رسمی OpenAI برای Multi-agent در Responses API؛ تقسیم کار پیش از زیاد کردن عامل‌ها
هوش مصنوعی

Multi-agent در Responses API؛ تقسیم کار پیش از زیاد کردن عامل‌ها

OpenAI قابلیت multi-agent را در Responses API به‌صورت beta معرفی کرده است. در این الگو، یک نمونه GPT‑۵.۶ می‌تواند چند زیرعامل را برای بخش‌های مستقل یک مسئله هماهنگ کند و نتیجه‌ها را ترکیب کند. وعده اصلی، کاهش زمان wall-clock و بهتر شدن کارهای پیچیده‌ای است که

۱۸ تیر ۱۴۰۵3 دقیقه
تصویر رسمی Anthropic برای واترمارک متنی Claude؛ نشانه‌گذاری آماری به‌جای ادعای تشخیص قطعی
هوش مصنوعی

واترمارک متنی Claude؛ نشانه‌گذاری آماری به‌جای ادعای تشخیص قطعی

Anthropic در ۱۴ اوت ۲۰۲۶ درباره سازوکار واترمارک متنی Claude توضیح داد. ایده این است که مدل در هنگام انتخاب tokenها، الگوی آماری بسیار ظریفی ایجاد کند که بعداً بتوان آن را با یک detector بررسی کرد. این روش با واترمارک تصویری که پیکسل یا metadata را تغییر می‌ده

۲۳ مرداد ۱۴۰۵3 دقیقه