پرش به محتوا
منو
داده‌نوشت
فناوری، زیرساخت و هوش مصنوعی
هوش مصنوعی

Microsoft Foundry؛ مدل، runtime و مسیر انتشار عامل در یک سکوی سازمانی

اعلامیه ۹ ژوئیه ۲۰۲۶ Microsoft Foundry فقط خبر اضافه شدن یک مدل به کاتالوگ نیست. Microsoft هم‌زمان از دسترسی عمومی GPT-۵.۶ در Foundry، Data Zone آسیا-اقیانوسیه و عمومی شدن hosted agents در Foundry Agent Service خبر داد. ترکیب این سه تغییر، مسئله‌ای را هدف می‌گ

انتشار: ۱۸ تیر ۱۴۰۵به‌روزرسانی: ۲۶ مرداد ۱۴۰۵3 دقیقه
تصویر رسمی Microsoft Azure برای Microsoft Foundry؛ مدل، runtime و مسیر انتشار عامل در یک سکوی سازمانی
تصویر رسمی Microsoft Azure؛ منبع تصویر: https://azure.microsoft.com/en-us/blog/gpt-5-6-now-available-in-microsoft-foundry/

Microsoft Foundry؛ مدل، runtime و مسیر انتشار عامل در یک سکوی سازمانی

اعلامیه ۹ ژوئیه ۲۰۲۶ Microsoft Foundry فقط خبر اضافه شدن یک مدل به کاتالوگ نیست. Microsoft هم‌زمان از دسترسی عمومی GPT-۵.۶ در Foundry، Data Zone آسیا-اقیانوسیه و عمومی شدن hosted agents در Foundry Agent Service خبر داد. ترکیب این سه تغییر، مسئله‌ای را هدف می‌گیرد که بسیاری از تیم‌ها بعد از ساخت نمونه اولیه با آن روبه‌رو می‌شوند: چگونه مدل، اجرای عامل، هویت سازمانی و انتشار به کاربر را در یک مسیر عملیاتی نگه داریم؟

#سه لایه یک محصول واقعی

Foundry مدل‌های مختلف را در یک سطح ارائه می‌کند تا تیم مجبور نباشد برای هر انتخاب مدل، pipeline جدا بسازد. در اعلامیه، خانواده GPT-۵.۶ شامل Sol، Terra و Luna است. Sol برای استدلال دشوار و کارهای agentic معرفی شده، Terra انتخاب متعادل‌تری است و Luna برای بارهای پرتعداد و حساس به تأخیر جای می‌گیرد. این تفکیک، انتخاب مدل را به نوع کار نزدیک می‌کند؛ اما نیاز به ارزیابی داخلی را از بین نمی‌برد.

لایه دوم runtime است. Hosted agents در Foundry Agent Service قرار است عامل‌های ساخته‌شده با چارچوب‌های مختلف را اجرا کنند و ابزار، حافظه، هویت و شبکه را در محیطی کنترل‌شده قرار دهند. برای workloadهای طولانی، پشتیبانی resilient task در private preview معرفی شده است. این وضعیت مهم است: قابلیت preview را نباید مثل تضمین رفتار پایدار در production در قرارداد عملیاتی فرض کرد.

لایه سوم، distribution است. Microsoft می‌گوید عامل‌ها می‌توانند به Microsoft 365 Copilot و Teams منتشر شوند. برای تیم محصول، این یعنی مقصد خروجی فقط endpoint نیست؛ همان عامل باید با هویت و تجربه‌ای کار کند که کاربر سازمان قبلاً می‌شناسد.

#منطقه داده و هزینه

Asia-Pacific Data Zone برای سازمان‌هایی طراحی شده که می‌خواهند پردازش داده در همان منطقه انجام شود. این قابلیت به‌تنهایی همه الزامات حاکمیت داده را حل نمی‌کند. تیم باید مسیر backup، لاگ، ابزارهای متصل و داده‌ای را که برای inference ارسال می‌شود جداگانه بررسی کند.

Foundry همچنین گزینه‌های مختلف پردازش و پرداخت، از Standard و Priority تا Provisioned Throughput و Batch، و ابزارهایی مانند prompt caching و model router را کنار هم می‌گذارد. در جدول اعلامی Microsoft، هزینه هر یک میلیون توکن برای Sol در ورودی ۵ و در خروجی ۳۰ دلار است؛ Terra با ۲٫۵۰ و ۱۵ دلار و Luna با ۱ و ۶ دلار عرضه می‌شوند. این ارقام به deployment و نرخ جاری وابسته‌اند و باید پیش از قرارداد دوباره بررسی شوند.

نتیجه معماری این است که «مدل قوی» تنها یک جزء از محصول است. سازمانی که می‌خواهد عامل را منتشر کند، باید از ابتدا مسیر ارزیابی، کنترل شبکه، ثبت هزینه و rollback را در کنار انتخاب مدل طراحی کند.

مطالب مرتبط

برای ادامه مطالعه

این یادداشت‌ها بر اساس موضوع مشترک، هم‌پوشانی برچسب‌ها و تازگی انتشار انتخاب می‌شوند.

تصویر رسمی OpenAI برای GPT-۵.۶ ارزان‌تر شد؛ Fast Mode برای کدام بار کاری است؟
هوش مصنوعی

GPT-۵.۶ ارزان‌تر شد؛ Fast Mode برای کدام بار کاری است؟

اعلامیه ۳۰ ژوئیه ۲۰۲۶ OpenAI دو تغییر جداگانه را کنار هم گذاشت: قیمت Terra و Luna پایین آمد و Fast Mode در API جای Priority Processing را گرفت. این خبر درباره عرضه مدل تازه نیست؛ درباره اقتصادی‌تر شدن استفاده مستمر از خانواده GPT-۵.۶ و ایجاد مسیر سریع‌تر برای

۸ مرداد ۱۴۰۵3 دقیقه
تصویر رسمی OpenAI برای سیستم‌کارت GPT‑۵.۶؛ رشد توان عاملی و آزمون‌های سخت‌تر ایمنی
هوش مصنوعی

سیستم‌کارت GPT‑۵.۶؛ رشد توان عاملی و آزمون‌های سخت‌تر ایمنی

سیستم‌کارت GPT‑۵.۶ که OpenAI در ۹ ژوئیه ۲۰۲۶ منتشر کرد، به‌جای تمرکز صرف بر امتیاز benchmark، مسیر ریسک مدل را تا محیط اجرا دنبال می‌کند. GPT‑۵.۶ خانواده‌ای از Sol، Terra و Luna است و در ارزیابی‌های OpenAI در امنیت سایبری و زیست‌شناسی در سطح High capability قر

۱۸ تیر ۱۴۰۵3 دقیقه
تصویر رسمی OpenAI برای GPT-۵.۶؛ خانواده‌ای برای کار طولانی، نه فقط پاسخ سریع
هوش مصنوعی

GPT-۵.۶؛ خانواده‌ای برای کار طولانی، نه فقط پاسخ سریع

OpenAI در ۹ ژوئیه ۲۰۲۶ GPT-۵.۶ را به‌عنوان یک خانواده عرضه کرد، نه یک مدل منفرد با نام تازه. سه سطح Sol، Terra و Luna قرار است انتخاب مدل را به شکل عملی‌تری به نوع کار و بودجه وصل کنند. Sol پرچم‌دار است، Terra برای کار روزمره و Luna برای هزینه و سرعت پایین‌تر

۱۸ تیر ۱۴۰۵3 دقیقه