API جدید Interactions گوگل، ایجنت‌های هوش مصنوعی را سریع‌تر و کارآمدتر می‌کند

گوگل دیپ‌مایند با عرضه نسخه بتای عمومی Interactions API، رویکرد توسعه‌دهندگان در کار با مدل‌های هوش مصنوعی را از معماری بدون‌حالت به معماری حالت‌دار با مدیریت کانتکست در سمت سرور تغییر داده است؛ مسیری که پیش‌تر OpenAI با API پاسخ‌ها (Responses API) در پیش گرفته بود.

هفته گذشته، Google DeepMind نسخه بتای عمومی Interactions API را در دسترس قرار داد. این API جدید نشان‌دهنده تغییری بنیادین در نحوه تعامل توسعه‌دهندگان با مدل‌های هوش مصنوعی است: گذار از معماری بدون‌حالت (stateless) به معماری حالت‌دار (stateful) با مدیریت کانتکست در سمت سرور. با این اقدام، گوگل در مسیری حرکت می‌کند که OpenAI در مارس ۲۰۲۵ با معرفی Responses API آغاز کرده بود.

در دو سال گذشته، توسعه‌دهندگان معمولاً با مدل‌های مولد هوش مصنوعی از طریق الگوی موسوم به «completion» کار می‌کردند؛ الگویی که در آن یک پرامپت ارسال می‌شود، پاسخ دریافت می‌شود و تعامل به پایان می‌رسد. در صورت طرح پرسش‌های بعدی، کل تاریخچه مکالمه باید هر بار دوباره ارسال شود؛ به همین دلیل این معماری بدون‌حالت محسوب می‌شود. با این حال، چنین رویکردی برای عامل‌های پیچیده هوش مصنوعی که نیاز به استفاده از ابزارهای مختلف، نگه‌داری کانتکست گسترده و انجام استدلال‌های طولانی دارند، کارآمد نیست.

Interactions API با پشتیبانی از حالت‌داری در سمت سرور، این مشکل را هدف قرار داده است. توسعه‌دهندگان دیگر نیازی به مدیریت و ارسال کامل تاریخچه مکالمه ندارند. در عوض، آن‌ها یک شناسه به نام previous_interaction_id ارسال می‌کنند و گوگل بر اساس این شناسه، تاریخچه مکالمه را از سرورهای خود بازیابی می‌کند؛ تاریخی که شامل نتایج قبلی ابزارها و مدل‌های هوش مصنوعی نیز می‌شود.

اجرای پس‌زمینه برای وظایف طولانی‌مدت

یکی دیگر از تغییرات مهم، امکان اجرای پس‌زمینه است. زمانی که با گردش‌کارهای پیچیده‌ای سروکار دارید که بیش از چند دقیقه طول می‌کشند، معمولاً با خطاهای timeout مواجه می‌شوید. یک درخواست وب استاندارد، بسته به پیکربندی سرور، اغلب فقط می‌تواند بین ۶۰ تا ۶۰۰ ثانیه ادامه داشته باشد. بنابراین اگر یک فرایند یا عامل هوش مصنوعی نیاز داشته باشد ده‌ها صفحه وب را جست‌وجو کند یا گزارش‌های متعدد را تحلیل کند، به‌سرعت به محدودیت‌های HTTP برمی‌خورید.

Interactions API به توسعه‌دهندگان اجازه می‌دهد عامل‌ها را با گزینه background=true اجرا کنند. با این کار، اتصال بلافاصله قطع می‌شود و نتیجه می‌تواند در زمان دیگری بازیابی شود.

علی چویک و فیلیپ اشمید از DeepMind در پست رسمی وبلاگ نوشتند: «مدل‌ها در حال تبدیل شدن به سیستم هستند و در گذر زمان حتی ممکن است خودشان به عامل تبدیل شوند. تلاش برای جا دادن این قابلیت‌ها در generateContent، به API‌ای بیش‌ازحد پیچیده و شکننده منجر می‌شد.»

گوگل در برابر OpenAI؛ شفافیت یا بهره‌وری؟

گوگل مسیری مشابه OpenAI را انتخاب کرده، اما با رویکردی متفاوت. OpenAI در مارس ۲۰۲۵ با Responses API از معماری بدون‌حالت فاصله گرفت. هر دو شرکت به‌دنبال در دسترس‌تر کردن کانتکست هستند، اما مسیرهای متفاوتی را برگزیده‌اند.

Responses API در OpenAI قابلیتی به نام Compaction معرفی کرد که تاریخچه مکالمه را فشرده می‌کند. این ویژگی بر خروجی تمرکز دارد و خروجی ابزارها و زنجیره‌های استدلال را حذف می‌کند؛ رویکردی که بهره‌وری توکنی را افزایش می‌دهد، اما به یک «جعبه سیاه» منجر می‌شود که استدلال‌های قبلی مدل را پنهان می‌کند.

در مقابل، Interactions API گوگل کل تاریخچه را به‌صورت کامل و قابل ترکیب نگه می‌دارد. مدل داده‌ای آن به توسعه‌دهندگان اجازه می‌دهد پیام‌ها را دیباگ، دستکاری، استریم و تحلیل کنند. در اینجا، اولویت گوگل شفافیت و قابلیت جست‌وجوی کامل است، نه فشرده‌سازی.

پشتیبانی بومی از MCP و مدل‌های در دسترس

گوگل همچنین با پشتیبانی بومی از Model Context Protocol (MCP) به سمت اکوسیستم باز حرکت کرده است. این قابلیت به مدل‌های Gemini اجازه می‌دهد مستقیماً ابزارهای خارجی میزبانی‌شده روی سرورهای راه دور را فراخوانی کنند، بدون آن‌که توسعه‌دهندگان نیاز به نوشتن کد اضافی داشته باشند. به این ترتیب، اطلاعات مختلف می‌توانند سریع‌تر بازیابی شوند و کانتکست بهبود یابد.

Interactions API اکنون از طریق Google AI Studio و در قالب بتای عمومی در دسترس است و از طیف کامل مدل‌های نسل جدید گوگل پشتیبانی می‌کند؛ از جمله Gemini 3.0 (نسخه پیش‌نمایش Gemini 3 Pro)، Gemini 2.5 (Flash، Flash-lite و Pro) و عامل Deep Research Preview.

ساختار قیمت‌گذاری تغییری نکرده و همان نرخ‌های استاندارد توکن‌های ورودی و خروجی مدل‌ها اعمال می‌شود. با این حال، مدت نگه‌داری تاریخچه تعاملات به سطح سرویس بستگی دارد: در لایه رایگان، این مدت یک روز است و در لایه پولی، تعاملات تا ۵۵ روز نگه‌داری می‌شوند.