هوش مصنوعی

عامل ChatGPT: گامی بلند در تکامل عامل AI و خودکارسازی (ChatGPT Agent Mode)

جهان هوش مصنوعی با معرفی عامل ChatGPT، گامی بلند به سوی آینده‌ای خودمختار و هوشمند برداشته است. این فناوری نوین، که در ۱۷ ژوئیه ۲۰۲۵ توسط شرکت OpenAI رونمایی شد، نه‌تنها توانایی‌های گفت‌وگوی پیشرفته ChatGPT را حفظ کرده، بلکه با ادغام قابلیت‌های حالت عاملی ChatGPT، امکان انجام وظایف پیچیده از تحقیق عمیق تا تعامل پویا با وب را فراهم آورده است. تصور کنید ابزاری که می‌تواند جلسات شما را برنامه‌ریزی کند، رقبا را تحلیل نماید، یا حتی یک صبحانه اصیل ایرانی برای چهار نفر طراحی کند، همه در حالی که کنترل کامل در دستان شماست؛ این وعده ChatGPT Agent است که با ترکیب هوشمندی و خودمختاری، تجربه‌ای بی‌سابقه برای کاربران حرفه‌ای و روزمره به ارمغان می‌آورد.

این ChatGPT Agent Mode، با تکیه بر محیط رایانه‌ای مجازی و ابزارهای پیشرفته، پلی میان ایده و عمل می‌سازد و به کاربران اجازه می‌دهد تا با اطمینان و امنیت، وظایف خود را به این عوامل هوش مصنوعی بسپارند. از تولید اسلایدهای ارائه تا پالایش داده‌های پیچیده، این گام بلند، نه تنها کارایی فردی و سازمانی را به سطح جدیدی ارتقاء می‌دهد، بلکه به کاربران امکان می‌دهد تا با تمرکز بر خلاقیت و تصمیم‌گیری‌های استراتژیک، از پیچیدگی‌های اجرایی رهایی یابند. آماده‌اید تا با نسل جدیدی از تعامل هوش مصنوعی آشنا شوید که نه تنها فکر می‌کند، بلکه عمل می‌کند؟

در حال حاضر، مدل زبانی بزرگ ChatGPT این قابلیت را یافته است که با بهره‌گیری از محیط رایانه‌ای خود، وظایف پیچیده را به صورت کامل و از ابتدا تا انتها به انجام رساند. این پیشرفت، توانمندی‌های این مدل را در حل مسائل کاربردی به میزان چشمگیری افزایش داده است.

این توسعه جدید به کاربران امکان می‌دهد تا درخواست‌های گوناگونی را به ChatGPT محول کنند. به عنوان مثال، می‌توان از آن خواست که “تقویم را بررسی کرده و بر اساس اخبار اخیر، جلسات آتی با کارمندان را اطلاع‌رسانی کند”، یا “برنامه‌ریزی صبحانه ایرانی برای چهار نفر و خرید مواد اولیه آن را انجام دهد”، و همچنین “سه رقیب را تحلیل کرده و یک اسلاید ارائه (پرزنتیشن) تولید کند”. این مدل با هوشمندی در وب‌سایت‌ها به جستجو می‌پردازد، نتایج مرتبط را پالایش می‌کند، در صورت لزوم از کاربران می‌خواهد به صورت امن وارد شوند، کدهای مورد نیاز را اجرا می‌کند، تحلیل‌های لازم را انجام می‌دهد و حتی اسلایدها و صفحات گسترده (اکسل) قابل ویرایشی را ارائه می‌دهد که یافته‌هایش را به طور خلاصه نمایش می‌دهند.

قابلیت‌های جدیدی که در ChatGPT مشاهده می‌شود، بر پایه یک سیستم عامل یکپارچه بنا شده است. این سیستم، سه جنبه کلیدی از پیشرفت‌های قبلی را به صورت هماهنگ ترکیب می‌کند: توانایی تعامل با وب‌سایت‌ها که از قابلیت‌های “Operator” نشأت می‌گیرد، مهارت عمیق در ترکیب اطلاعات برای انجام تحقیقات گسترده، و هوش و روانی مکالمه که از ویژگی‌های برجسته ChatGPT است.

این مدل وظایف محوله را با استفاده از رایانه مجازی اختصاصی خود به انجام می‌رساند. این رویکرد به آن امکان می‌دهد که به صورت پویا بین استدلال و عمل جابجا شود تا گردش‌کارهای پیچیده را از آغاز تا پایان، و تماماً بر اساس دستورالعمل‌های ارائه شده توسط کاربران، مدیریت کند.

از مهم‌ترین جنبه‌های این سیستم، حفظ کنترل کامل توسط کاربر است. ChatGPT پیش از انجام هرگونه اقدام مهم، اجازه کاربر را درخواست می‌کند. علاوه بر این، کاربران می‌توانند به سادگی در هر نقطه‌ای از فرآیند مداخله کرده، کنترل مرورگر را به دست بگیرند یا وظایف را متوقف نمایند.

از تاریخ 17 جولای 2025، کاربران با اشتراک‌های Pro، Plus و Team می‌توانند قابلیت‌های عاملی جدید ChatGPT را فعال کنند. این امکان به سادگی از طریق منوی کشویی ابزارها در بخش “کامپوزر (composer)” و با انتخاب “حالت عاملی (agent mode)” در هر نقطه‌ای از مکالمه، قابل دسترسی است.

با وجود اینکه عامل هوشمند ChatGPT در حال حاضر ابزاری توانمند برای مدیریت وظایف پیچیده محسوب می‌شود، راه‌اندازی فعلی تنها گام نخست در توسعه آن به شمار می‌رود. شرکت OpenAI متعهد است که به صورت منظم بهبودهای چشمگیری را به این سیستم اضافه کند تا به مرور زمان، این قابلیت‌ها قدرتمندتر شده و برای طیف وسیع‌تری از افراد سودمندتر واقع شوند.

تکامل طبیعی اپراتور و تحقیقات عمیق

پیش از این، قابلیت‌های مجزای “Operator” و “تحقیقات عمیق (deep research)” هر کدام ویژگی‌های متمایزی را ارائه می‌دادند. “Operator” قادر به پیمایش در وب، کلیک کردن و تایپ نمودن بود، در حالی که “تحقیقات عمیق” در تحلیل و خلاصه‌سازی اطلاعات کارایی بالایی داشت. با این حال، هر یک از این قابلیت‌ها در سناریوهای متفاوتی بهینه‌ترین عملکرد را از خود نشان می‌دادند. به عنوان مثال، “Operator” محدودیت‌هایی در انجام تحلیل‌های عمیق یا نگارش گزارش‌های تفصیلی داشت و “تحقیقات عمیق” نمی‌توانست برای پالایش نتایج یا دسترسی به محتوایی که نیاز به احراز هویت کاربر داشت، با وب‌سایت‌ها تعامل مستقیم برقرار کند. در واقع، مشاهده شد که بسیاری از درخواست‌هایی که کاربران از طریق “Operator” مطرح می‌کردند، برای قابلیت “تحقیقات عمیق” مناسب‌تر بودند. در نتیجه، برای رفع این محدودیت‌ها، بهترین ویژگی‌های هر دو قابلیت در یک سیستم واحد ترکیب شده‌اند.

با ادغام این نقاط قوت مکمل در ChatGPT و افزودن ابزارهای بیشتر، قابلیت‌های کاملاً جدیدی در یک مدل یکپارچه فعال شده است. این مدل اکنون می‌تواند به صورت فعال و هوشمندانه با وب‌سایت‌ها تعامل داشته باشد؛ به این معنا که قادر است بر روی عناصر مختلف کلیک کند، نتایج را فیلتر نماید و در نهایت اطلاعات دقیق‌تر و کارآمدتری را گردآوری کند. علاوه بر این، کاربران می‌توانند به سادگی و به صورت طبیعی، از یک مکالمه ساده به درخواست انجام وظایف پیچیده منتقل شوند و تمامی این فرآیندها مستقیماً در همان محیط گفتگوی جاری انجام می‌پذیرد.

عامل ChatGPT نماینده‌ای که برای شما و با شما کار می‌کند

عامل هوشمند ChatGPT به مجموعه‌ای از ابزارهای پیشرفته مجهز شده است که شامل یک مرورگر بصری برای تعامل از طریق رابط کاربری گرافیکی با وب، یک مرورگر متنی برای جستجوهای وب ساده‌تر و مبتنی بر استدلال، یک ترمینال و دسترسی مستقیم به API می‌شود. این عامل همچنین می‌تواند از کانکتورهای ChatGPT بهره‌برداری کند که به کاربران امکان می‌دهد برنامه‌های کاربردی مانند جیمیل و گیت‌هاب را متصل کنند. این اتصال به ChatGPT اجازه می‌دهد تا اطلاعات مرتبط با درخواست‌های کاربران را یافته و در پاسخ‌های خود مورد استفاده قرار دهد. علاوه بر این، کاربران قادرند با در دست گرفتن کنترل مرورگر، در هر وب‌سایتی وارد شوند، که این قابلیت به مدل اجازه می‌دهد تا هم در تحقیقات و هم در اجرای وظایف خود، به عمق و گستره بیشتری دست یابد. تجهیز ChatGPT به این مسیرهای متنوع برای دسترسی و تعامل با اطلاعات وب بدین معناست که این مدل می‌تواند مسیر بهینه را برای کارآمدترین انجام وظایف انتخاب کند. به عنوان مثال، می‌تواند اطلاعات تقویم کاربران را از طریق API جمع‌آوری کند، به طور کارآمد روی حجم زیادی از متن با استفاده از مرورگر متنی استدلال کند و در عین حال توانایی تعامل بصری با وب‌سایت‌هایی که عمدتاً برای انسان‌ها طراحی شده‌اند را نیز حفظ نماید.

تمام این عملیات در رایانه مجازی اختصاصی این مدل به انجام می‌رسد، که زمینه (context) لازم برای انجام وظیفه را حتی در زمان استفاده از ابزارهای متعدد نیز حفظ می‌کند. این بدان معناست که مدل می‌تواند انتخاب کند که یک صفحه را با استفاده از مرورگر متنی یا مرورگر بصری باز کند، یک فایل را از وب دانلود کند، با اجرای یک فرمان در ترمینال آن را دستکاری نماید و سپس خروجی حاصل را مجدداً در مرورگر بصری مشاهده کند. این قابلیت به مدل امکان می‌دهد تا رویکرد خود را برای انجام وظایف با سرعت، دقت و کارایی بالا تطبیق دهد.

عامل هوشمند ChatGPT برای گردش‌کارهای تعاملی و مشارکتی تکرارشونده طراحی شده است، که در مقایسه با مدل‌های پیشین، بسیار تعاملی‌تر و انعطاف‌پذیرتر عمل می‌کند. در طول فرآیند اجرای وظیفه توسط ChatGPT، کاربران می‌توانند در هر لحظه مداخله کرده تا دستورالعمل‌های خود را روشن کنند، مدل را به سمت نتایج مطلوب هدایت نمایند، یا حتی کل وظیفه را تغییر دهند. این مدل قادر است کار را از همان نقطه‌ای که متوقف شده است، از سر بگیرد؛ با اطلاعات جدید اما بدون از دست دادن پیشرفت‌های قبلی. به همین ترتیب، ChatGPT ممکن است در صورت نیاز به طور پیش‌گیرانه جزئیات بیشتری را از کاربران درخواست کند تا اطمینان حاصل شود که وظیفه با اهداف آن‌ها همسو باقی می‌ماند. اگر انجام وظیفه‌ای بیشتر از حد انتظار طول کشید یا به نظر رسید که مدل درگیر مشکلی شده است، کاربران می‌توانند آن را متوقف کنند، درخواست خلاصه‌ای از پیشرفت کنند، یا به طور کامل آن را متوقف کرده و نتایج جزئی را دریافت نمایند. همچنین، اگر اپلیکیشن ChatGPT بر روی گوشی کاربران نصب شده باشد، پس از اتمام کار، اعلان (نوتیفیکیشن) مربوطه برایشان ارسال خواهد شد.

گسترش کاربرد حالت عاملی ChatGPT در دنیای واقعی

قابلیت‌های عاملی یکپارچه در ChatGPT به طور چشمگیری کارایی این مدل را در هر دو زمینه‌های روزمره و حرفه‌ای ارتقاء می‌بخشند. در محیط کار، می‌توان وظایف تکراری را خودکارسازی کرد؛ به عنوان مثال، تبدیل اسکرین‌شات‌ها یا داشبوردها به ارائه‌هایی با عناصر برداری قابل ویرایش، جابجایی جلسات، برنامه‌ریزی و رزرو رویدادهای خارج از محل کار، و به‌روزرسانی صفحات گسترده با داده‌های مالی جدید همراه با حفظ قالب‌بندی پیشین. در زندگی شخصی، کاربران قادرند از این مدل برای برنامه‌ریزی و رزرو بدون دردسر برنامه‌های سفر، طراحی و رزرو کامل مهمانی‌های شام، یا یافتن متخصصان و زمان‌بندی قرار ملاقات‌ها با پزشکان استفاده کنند.

قابلیت‌های ارتقا یافته این مدل در عملکرد پیشرفته (State-of-the-Art – SOTA) آن، که در ارزیابی‌های مربوط به مرور وب و توانایی تکمیل وظایف دنیای واقعی اندازه‌گیری شده است، به وضوح منعکس می‌شود. این نتایج نشان‌دهنده پیشرفت چشمگیر در توانایی مدل برای انجام کارهای پیچیده و کاربردی است.

در معیار “آخرین امتحان بشریت (Humanity’s Last Exam – HLE)”، که به منظور ارزیابی عملکرد هوش مصنوعی در گستره وسیعی از موضوعات با پرسش‌های در سطح تخصصی طراحی شده است، مدلی که عامل هوشمند ChatGPT را تغذیه می‌کند، به امتیاز جدید و پیشرفته 41.6 در معیار pass@1 دست یافته است. از آنجا که این عامل به صورت پویا برنامه‌ریزی کرده و ابزارهای مورد نیاز خود را انتخاب می‌کند، می‌تواند یک وظیفه را به روش‌های مختلفی در اجراهای متفاوت حل کند. زمانی که این قابلیت با یک استراتژی ساده اجرای موازی مقیاس‌بندی شد (یعنی با اجرای همزمان تا هشت تلاش و انتخاب بهترین نتیجه با بالاترین سطح اطمینان گزارش‌شده خودکار) امتیاز HLE این عامل به 44.4 افزایش یافت که نشان‌دهنده بهبود قابل توجهی در عملکرد آن است.

Humanity's Last Exam (Full Set) Expert Level Questions Across Subjects (ChatGPT Agent Mode vs. others)

FrontierMath به عنوان یکی از سخت‌ترین معیارهای ریاضی شناخته شده مطرح است که شامل مسائل جدید و منتشرنشده‌ای می‌شود. حل این مسائل اغلب ساعت‌ها یا حتی روزها از ریاضی‌دانان خبره زمان می‌برد. با بهره‌گیری از ابزارهایی نظیر دسترسی به ترمینال برای اجرای کد، عامل هوشمند ChatGPT به دقت 27.4% دست یافته است و با اختلاف قابل توجهی از مدل‌های قبلی پیشی می‌گیرد. این دستاورد، توانایی‌های چشمگیر مدل را در حل مسائل پیچیده ریاضی به اثبات می‌رساند.

FrontierMath- Tier 1-3 Expert Level Math (ChatGPT Agent vs. others)

علاوه بر این، عملکرد این مدل با استفاده از معیارهایی که بر پایه وظایف پیچیده دنیای واقعی طراحی شده‌اند، مورد ارزیابی قرار گرفت. در یک معیار داخلی که به منظور سنجش عملکرد مدل در وظایف پیچیده و دارای ارزش اقتصادی مرتبط با کارهای دانشی توسعه یافته است، خروجی عامل هوشمند ChatGPT در تقریباً نیمی از موارد و در بازه‌های زمانی مختلف برای انجام وظایف، قابل مقایسه یا حتی بهتر از عملکرد انسان‌ها است، در حالی که عملکرد آن به طور قابل توجهی بالاتر از مدل‌های o3 و o4-mini قرار دارد. خروجی‌های مدل توسط کارشناسان بر اساس استانداردهای پایه انسانی با کیفیت بالا که توسط برترین متخصصان در هر زمینه تدوین شده‌اند، مورد قضاوت قرار می‌گیرند. این وظایف، که از کارشناسان در مشاغل و صنایع گوناگون گردآوری شده‌اند، بازتاب‌دهنده کارهای حرفه‌ای واقعی هستند؛ به عنوان مثال، آماده‌سازی تحلیل رقابتی ارائه‌دهندگان مراقبت‌های فوری درخواستی (on-demand)، ساخت جداول استهلاک دقیق و شناسایی چاه‌های آب مناسب برای یک تأسیسات جدید هیدروژن سبز.

Economically important tasks (ChatGPT Agent Mode vs. others)

در معیار DSBench، که برای ارزیابی عوامل هوشمند در وظایف واقع‌گرایانه علم داده شامل تحلیل و مدل‌سازی داده‌ها طراحی شده است، عامل هوشمند ChatGPT به طور قابل توجهی از عملکرد انسان‌ها پیشی می‌گیرد. این نتیجه نشان‌دهنده برتری قابل ملاحظه مدل در انجام امور پیچیده مربوط به علم داده است.

DSBench Data Analysis
DSBench Data Modeling (ChatGPT Agent Mode vs. others)

در معیار SpreadsheetBench، که توانایی مدل‌ها را در ویرایش صفحات گسترده برگرفته از سناریوهای دنیای واقعی ارزیابی می‌کند، عامل هوشمند ChatGPT با اختلاف قابل توجهی از مدل‌های موجود پیشی گرفته است. زمانی که به این عامل قابلیت ویرایش مستقیم صفحات گسترده داده می‌شود، امتیاز آن به 45.5% افزایش می‌یابد، در مقایسه با 20.0% که Copilot در اکسل به دست آورده است. این نشان‌دهنده برتری چشمگیر عامل هوشمند ChatGPT در مدیریت و ویرایش دقیق داده‌ها در صفحات گسترده است.

SpreadsheetBench

روش‌شناسی مورد استفاده در ارزیابی‌های مربوط به SpreadsheetBench، در برخی جزئیات با آزمایش‌های اولیه متفاوت است. نویسندگان معیار SpreadsheetBench، از محیط ویندوز به همراه مایکروسافت اکسل برای ارزیابی صفحات گسترده ( مانند اکسل) استفاده کردند. اما در آزمایشات فعلی، از محیط OSX و نرم‌افزار LibreOffice بهره گرفته شده است، که ممکن است منجر به تفاوت‌های جزئی در نمره‌دهی نهایی شود. به عنوان مثال، در حالی که نویسندگان معیار، محدودیت کلی دشواری (Overall Hard) را برای GPT-4o برابر با 15.02% گزارش کرده‌اند، در این ارزیابی این مقدار 13.38% به دست آمد. در تمامی این آزمایش‌ها، مجموعه کامل 912 سوالی معیار SpreadsheetBench مورد استفاده قرار گرفت.

در یک معیار داخلی که برای سنجش توانایی یک مدل در انجام وظایف مدل‌سازی تحلیل‌گر بانکداری سرمایه‌گذاری (در سطوح سال اول تا سوم) طراحی شده است (مواردی نظیر ترتیب دادن یک مدل مالی سه صورته برای یک شرکت Fortune 500 با قالب‌بندی و منابع مناسب، یا ساخت مدل خرید اهرمی (LBO) برای خصوصی‌سازی یک شرکت) مدلی که عامل هوشمند ChatGPT را تغذیه می‌کند، به طور قابل توجهی بهتر از deep research و o3 عمل می‌کند. هر وظیفه بر اساس صدها معیار مرتبط با صحت و استفاده از فرمول‌ها نمره‌گذاری می‌شود، که نشان‌دهنده دقت و پیچیدگی ارزیابی‌ها است.

Investment Banking Modeling Tasks

علاوه بر این، عامل هوشمند ChatGPT در BrowseComp نیز مورد ارزیابی قرار گرفت. BrowseComp یک معیار است که پیش از این توسط شرکت OpenAI منتشر شده و توانایی عامل‌های مرورگر را در یافتن اطلاعات دشوار بر روی وب می‌سنجد. در این ارزیابی، این مدل با کسب 68.9%، یک استاندارد جدید (SOTA) را ثبت کرد که 17.4 درصد بالاتر از deep research است. این نتیجه نشان‌دهنده قابلیت بالای عامل هوشمند ChatGPT در جستجو و بازیابی اطلاعات پیچیده از وب است.

BrowseCompAgentic Browsing (ChatGPT Agent Mode vs. others)

در نهایت، در معیار WebArena، که برای ارزیابی عملکرد عامل‌های مرورگر وب در تکمیل وظایف واقعی وب طراحی شده است، این مدل نسبت به o3 مجهز به CUA (مدلی که Operator را تغذیه می‌کرد) پیشرفت قابل توجهی داشته است. این نشان‌دهنده توانایی ارتقا یافته عامل هوشمند ChatGPT در انجام وظایف کاربردی و پیچیده در محیط وب است.

WebArenaAgentic Browser Use

نحوه استفاده از ChatGPT Agent

کاربران اکنون قادرند قابلیت‌های جدید عاملی ChatGPT را به طور مستقیم فعال کنند. این فعال‌سازی از طریق منوی کشویی ابزارها در بخش “نوشتار (composer)” و با انتخاب “حالت عاملی (agent mode)” در هر مرحله‌ای از مکالمات امکان‌پذیر است. پس از فعال‌سازی، کافی است وظیفه مورد نظر، اعم از انجام تحقیقات عمیق، ساخت یک اسلاید، یا ارسال هزینه‌ها، به صورت متنی توصیف شود. همزمان با انجام وظیفه توسط ChatGPT، یک روایت بصری بر روی صفحه نمایش، جزئیات دقیق فعالیت‌های در حال انجام را به کاربر نمایش می‌دهد. این امکان وجود دارد که در هر زمان که لازم باشد، کاربر مداخله کرده و کنترل مرورگر را به دست گیرد تا از همسویی وظایف با اهداف اصلی اطمینان حاصل شود.

عامل هوشمند ChatGPT می‌تواند به کانکتورهای کاربران دسترسی یابد و بدین ترتیب با گردش‌کارهای موجود ادغام شده و به اطلاعات مرتبط و قابل اقدام دسترسی پیدا کند. پس از انجام احراز هویت امن، این کانکتورها به ChatGPT امکان می‌دهند تا اطلاعاتی نظیر خلاصه‌ی ایمیل‌های روزانه کاربران یا زمان‌های خالی آن‌ها برای یک جلسه را مشاهده نماید. با این حال، برای انجام هرگونه اقدامی بر روی این سایت‌ها، همچنان از کاربران خواسته می‌شود که با در دست گرفتن کنترل مرورگر، به صورت دستی وارد سیستم شوند. این رویکرد، ضمن افزایش قابلیت‌های مدل، امنیت و کنترل کاربر را حفظ می‌کند.

علاوه بر قابلیت‌های فوق، این امکان نیز فراهم شده است که وظایف تکمیل‌شده برای تکرار خودکار زمان‌بندی شوند. به عنوان مثال، می‌توان تعیین کرد که یک گزارش هفتگی معیارها به صورت خودکار هر دوشنبه صبح تولید و ارائه شود. این ویژگی به افزایش بهره‌وری و خودکارسازی فرآیندهای تکراری کمک شایانی می‌کند.

قابلیت‌های نوین و خطرات نوین در ChatGPT Agent Mode

این نسخه جدید برای نخستین بار به کاربران امکان می‌دهد تا از ChatGPT بخواهند اقدامات مستقیمی را در بستر وب انجام دهد. این قابلیت، همراه با مزایای خود، خطرات جدیدی را نیز به همراه دارد. به ویژه از آنجا که عامل هوشمند ChatGPT می‌تواند به طور مستقیم با داده‌های کاربران کار کند (چه اطلاعاتی که از طریق کانکتورها به آن‌ها دسترسی پیدا کرده و چه وب‌سایت‌هایی که کاربر از طریق حالت “تصاحب (takeover mode)” در آن‌ها وارد شده است). شرکت OpenAI کنترل‌های قدرتمندی را که از پیش‌نمایش تحقیقاتی Operator وجود داشت، تقویت کرده و اقدامات حفاظتی جدیدی را برای مقابله با چالش‌هایی نظیر مدیریت اطلاعات حساس در وب زنده، گستره وسیع‌تر کاربران و دسترسی محدود به شبکه ترمینال اضافه کرده است. با وجود اینکه این اقدامات کاهش‌دهنده ریسک، به طور قابل توجهی خطر را کاهش می‌دهند، اما ابزارهای گسترده‌تر و دسترسی وسیع‌تر عامل هوشمند ChatGPT به کاربران به این معناست که پروفایل ریسک کلی آن بالاتر است.

تاکید ویژه‌ای بر حفاظت از عامل هوشمند ChatGPT در برابر دستکاری‌های مخرب از طریق تزریق پرامپت (prompt injection) صورت گرفته است، که به طور کلی یک تهدید مهم برای سیستم‌های عاملی محسوب می‌شود. بر این اساس، اقدامات کاهش‌دهنده گسترده‌ای برای مقابله با این حملات آماده شده است. تزریق پرامپت به تلاش‌هایی اطلاق می‌شود که توسط اشخاص ثالث برای دستکاری رفتار عامل هوشمند ChatGPT از طریق دستورالعمل‌های مخرب انجام می‌گیرد؛ این دستورالعمل‌ها ممکن است در حین انجام یک وظیفه در وب، توسط این عامل با آن‌ها مواجه شود. به عنوان مثال، یک پرامپت مخرب که به صورت پنهان در یک صفحه وب، مثلاً در عناصر نامرئی یا فراداده (metadata)، جاسازی شده باشد، می‌تواند عامل هوشمند را فریب دهد تا اقدامات ناخواسته‌ای انجام دهد. این اقدامات ناخواسته می‌تواند شامل به اشتراک گذاشتن داده‌های خصوصی از یک کانکتور با مهاجم، یا انجام یک عمل مضر در سایتی که کاربر در آن وارد شده است، باشد. از آنجا که عامل هوشمند ChatGPT قابلیت انجام اقدامات مستقیم را دارد، حملات موفقیت‌آمیز می‌توانند تأثیر بیشتر و خطرات بالاتری داشته باشند.

این عامل هوشمند برای شناسایی و مقاومت در برابر تزریق پرامپت آموزش دیده و آزمایش شده است. علاوه بر این، از نظارت مداوم برای تشخیص سریع و پاسخگویی به حملات تزریق پرامپت استفاده می‌شود. درخواست تأیید صریح کاربر پیش از انجام اقدامات مهم، خطر آسیب ناشی از این حملات را بیشتر کاهش می‌دهد و کاربران می‌توانند در صورت نیاز با در دست گرفتن کنترل یا توقف، در کارها مداخله کنند. لازم است کاربران هنگام تصمیم‌گیری درباره اینکه چه اطلاعاتی را در اختیار این عامل قرار دهند، این بده‌بستان‌ها را در نظر بگیرند و همچنین اقداماتی را برای به حداقل رساندن قرار گرفتن در معرض این خطرات انجام دهند، مانند غیرفعال کردن کانکتورها زمانی که برای یک کار خاص مورد نیاز نیستند.

علاوه بر موارد فوق، اقدامات کاهشی برای خطاهای مدل نیز پیاده‌سازی شده است، به ویژه اکنون که مدل می‌تواند وظایفی را انجام دهد که به طور مستقیم بر دنیای واقعی تأثیر می‌گذارند.

  • تأیید صریح کاربر: ChatGPT به گونه‌ای آموزش دیده است که پیش از انجام هرگونه اقدامی که دارای پیامدهای دنیای واقعی است، نظیر انجام خرید، به طور صریح از کاربر اجازه بگیرد.
  • نظارت فعال (حالت تماشا): برخی از وظایف حیاتی، مانند ارسال ایمیل، نیازمند نظارت فعال کاربر هستند تا از اجرای صحیح و مطابق با اهداف اطمینان حاصل شود.
  • کاهش فعال ریسک: ChatGPT به گونه‌ای آموزش داده شده است که از انجام وظایف با ریسک بالا، مانند انتقال وجه بانکی، به طور فعال امتناع کند تا از بروز خسارات مالی یا امنیتی جلوگیری شود.

در نهایت، کنترل‌های بیشتری به منظور محدود کردن دسترسی مدل به داده‌ها معرفی شده‌اند تا حریم خصوصی و امنیت کاربران تضمین شود.

  • کنترل‌های حریم خصوصی: با یک کلیک ساده در تنظیمات ChatGPT، کاربران می‌توانند تمام داده‌های مرورگر را حذف کرده و به سرعت از تمام نشست‌های فعال وب‌سایت‌ها خارج شوند. در غیر این صورت، کوکی‌ها بر اساس سیاست‌های کوکی هر وب‌سایت بازدید شده باقی می‌مانند که می‌تواند بازدیدهای مجدد از سایت‌ها را کارآمدتر کند.
  • حالت امن در دست گرفتن کنترل مرورگر (Secure browser takeover mode): هنگامی که کاربران با استفاده از مرورگر ChatGPT (که با عنوان “حالت در دست گرفتن کنترل” شناخته می‌شود) با وب تعامل می‌کنند، ورودی‌های آن‌ها خصوصی باقی می‌مانند. ChatGPT هیچ داده‌ای را که کاربر در طول این جلسات وارد می‌کند، مانند رمزهای عبور، جمع‌آوری یا ذخیره نمی‌کند. این رویکرد به این دلیل اتخاذ شده است که مدل نیازی به این اطلاعات ندارد و عدم دسترسی مدل به آن‌ها، امنیت کلی سیستم را افزایش می‌دهد.

قوی‌ترین مجموعه ایمنی شرکت OpenAI تاکنون برای خطرات بیولوژیکی

با در نظر گرفتن قابلیت‌های رو به رشد این مدل، شرکت OpenAI تصمیم گرفت که عامل هوشمند ChatGPT را در چارچوب آمادگی خود، تحت عنوان قابلیت‌های زیستی و شیمیایی بالا دسته‌بندی کرده و تدابیر حفاظتی مربوطه را فعال سازد. اگرچه شواهد قاطعی مبنی بر اینکه این مدل بتواند به طور معناداری به یک مبتدی در ایجاد آسیب‌های زیستی شدید کمک کند (که این سطح به عنوان آستانه “قابلیت بالا” در نظر گرفته می‌شود) در دسترس نیست، اما رویکرد محتاطانه در پیش گرفته شده و تدابیر حفاظتی لازم هم‌اکنون پیاده‌سازی می‌شوند. در نتیجه، این مدل در حال حاضر جامع‌ترین مجموعه ایمنی را تا به امروز دارا است که شامل تدابیر حفاظتی پیشرفته‌ای برای حوزه زیست‌شناسی می‌شود. این تدابیر شامل مدل‌سازی جامع تهدید، آموزش امتناع از کاربرد دوگانه (dual-use)، استفاده از طبقه‌بندی‌کننده‌ها و ناظران استدلال همیشگی و تعریف خطوط اجرایی واضح است.

علاوه بر تلاش‌های داخلی برای ایمن‌سازی عامل هوشمند ChatGPT، شرکت OpenAI بر این باور است که ایمنی زیستی لایه‌ای زمانی به بهترین نحو عمل می‌کند که اقدامات حفاظتی فراتر از یک آزمایشگاه خاص صورت پذیرد. به همین دلیل، برای تقویت دفاعیات، این شرکت در سراسر اکوسیستم مربوطه همکاری‌های گسترده‌ای را دنبال می‌کند. از همان ابتدا، با کارشناسان بیرونی امنیت زیستی، مؤسسات ایمنی و پژوهشگران دانشگاهی همکاری صورت گرفته تا مدل تهدید، ارزیابی‌ها و سیاست‌های ایمنی شکل گیرد. بازبینان آموزش‌دیده در حوزه زیست‌شناسی، داده‌های ارزیابی را تأیید کرده‌اند و تیم‌های “رد تیم” متخصص در این حوزه، اقدامات حفاظتی را در سناریوهای واقعی مورد آزمایش قرار داده‌اند. در اوایل ماه ژوئیه، یک کارگاه با عنوان “دفاع زیستی” با حضور متخصصانی از دولت، دانشگاه‌ها، آزمایشگاه‌های ملی و سازمان‌های غیردولتی برگزار شد تا همکاری‌ها تسریع یافته و تحقیقات دفاع زیستی مبتنی بر هوش مصنوعی پیش برده شود. شرکت OpenAI به همکاری‌های جهانی خود ادامه خواهد داد تا از خطرات نوظهور در این زمینه پیشی بگیرد.

برای کسب اطلاعات بیشتر در خصوص رویکرد ایمنی قوی که برای مدل عاملی یکپارچه اتخاذ شده است، می‌توان به [کارت سیستم] مراجعه کرد. همچنین، شرکت OpenAI در حال راه‌اندازی [برنامه پاداش اشکالات (bug bounty program)] است تا بتواند خطرات دنیای واقعی را شناسایی و به طور موثر رفع نماید. این اقدامات نشان‌دهنده تعهد این شرکت به افزایش امنیت و پایداری سیستم‌های هوش مصنوعی است.

در دسترس بودن ChatGPT Agent

عرضه عامل هوشمند ChatGPT از تاریخ 17 جولای 2025 آغاز شده است. این قابلیت ابتدا در اختیار کاربران Pro، Plus و Team قرار گرفت؛ به گونه‌ای که کاربران Pro تا پایان روز انتشار به آن دسترسی داشتند، در حالی که کاربران Plus و Team پس از چند روز این دسترسی را پیدا کردند. کاربران Enterprise و Education نیز در هفته‌های آتی به این قابلیت‌ها دسترسی خواهند داشت. سقف استفاده برای کاربران پرو، 400 پیام در ماه تعیین شده است، در حالی که سایر کاربران پولی ماهیانه 40 پیام دریافت می‌کنند و امکان استفاده بیشتر از طریق گزینه‌های اعتباری منعطف فراهم شده است.

فعال‌سازی دسترسی برای کاربران در منطقه اقتصادی اروپا (EEA) و سوئیس همچنان در دست بررسی و اجرا است.

سایت پیش‌نمایش تحقیقاتی Operator برای چند هفته آینده پس از انتشار مقاله حاضر فعال باقی خواهد ماند و پس از آن متوقف خواهد شد. لازم به ذکر است که قابلیت “تحقیق عمیق (deep research)” به عنوان بخشی از توانمندی‌های اصلی عامل هوشمند ChatGPT محسوب می‌شود. در صورتی که کاربران ویژگی اصلی “تحقیق عمیق” را ترجیح می‌دهند (که ممکن است زمان بیشتری برای اجرا نیاز داشته باشد اما به طور پیش‌فرض پاسخ‌های دقیق‌تر و عمیق‌تری ارائه می‌دهد) همچنان می‌توانند با انتخاب گزینه “deep research” از منوی کشویی در بخش نوشتار پیام، به آن دسترسی پیدا کنند.

محدودیت‌ها و نگاه به آینده

عامل هوشمند ChatGPT در حال حاضر در مراحل اولیه توسعه خود قرار دارد. با وجود قابلیت‌هایی که این مدل برای پذیرش طیف گسترده‌ای از وظایف پیچیده از خود نشان می‌دهد، همچنان احتمال بروز خطاها و اشتباهات در عملکرد آن وجود دارد.

در حالی که شرکت OpenAI پتانسیل قابل توجهی در قابلیت تولید اسلاید توسط این مدل مشاهده می‌کند، این ویژگی در حال حاضر در مرحله بتا (آزمایشی) قرار دارد. در وضعیت کنونی، خروجی‌های تولیدی گاهی اوقات از منظر قالب‌بندی و ظرافت، به ویژه زمانی که فرآیند تولید بدون یک سند موجود آغاز می‌شود، ابتدایی به نظر می‌رسند. تمرکز اصلی در توسعه قابلیت‌های اولیه این مدل بر تولید فایل‌هایی بوده است که اطلاعات را در یک جریان و فرمت مناسب برای ارائه‌ها سازماندهی می‌کنند. این فایل‌ها حاوی عناصری نظیر متن، نمودارها، تصاویر و اشکال هستند که پس از خروجی گرفتن، به صورت بومی و آسان قابل ویرایش باشند. این هدف با بهینه‌سازی ساختار و انعطاف‌پذیری در نظر گرفته شده است. در حال حاضر، گاهی اوقات اختلافاتی بین نمایش اسلایدها در نمایشگر و پاورپوینت خروجی‌گرفته‌شده مشاهده می‌شود که شرکت OpenAI در حال تلاش برای کاهش و رفع این مغایرت‌ها است. علاوه بر این، در حالی که در حال حاضر امکان آپلود یک صفحه گسترده موجود برای ویرایش یا استفاده به عنوان الگو توسط ChatGPT فراهم است، این قابلیت هنوز برای اسلایدها در دسترس نیست. این شرکت در حال آموزش نسل بعدی قابلیت ایجاد اسلاید در ChatGPT است تا خروجی‌هایی ظریف‌تر و پیچیده‌تر با قابلیت‌های گسترده‌تر و قالب‌بندی بهبود یافته تولید شود.

به طور کلی، انتظار می‌رود که کارایی، عمق و تطبیق‌پذیری عامل هوشمند ChatGPT در طول زمان به طور مستمر بهبود یابد. این بهبودها شامل تعاملات یکپارچه‌تر نیز خواهد شد، زیرا شرکت OpenAI به تنظیم میزان نظارت مورد نیاز از سوی کاربر ادامه می‌دهد تا این مدل را مفیدتر ساخته و در عین حال از ایمنی استفاده از آن اطمینان حاصل کند.

جمع بندی

با معرفی ” عامل ChatGPT یا ChatGPT Agent “، مرزهای هوش مصنوعی بیش از پیش گسترش یافته و افق‌های جدیدی از اتوماسیون و تعامل هوشمند را پیش روی ما گشوده است. این نوآوری برجسته OpenAI، با تجمیع قابلیت‌های بی‌نظیر در تحلیل، جستجو و اجرای وظایف پیچیده، نه تنها کارایی فردی و سازمانی را به سطحی نوین ارتقا می‌دهد، بلکه با ایجاد “حالت عاملی ChatGPT یا (ChatGPT Agent Mode) “، فرصتی بی‌سابقه برای آزاد کردن ذهن از درگیری‌های اجرایی روزمره فراهم می‌آورد. این تحول، تأکید ویژه‌ای بر تحقق پتانسیل کامل هوش مصنوعی در محیط‌های واقعی دارد و نشان می‌دهد که چگونه پژوهش‌های عمیق، می‌توانند مستقیماً به ابزارهایی کاربردی و قدرتمند تبدیل شوند.

در نهایت، همانطور که آینده فناوری با سرعت خیره‌کننده‌ای در حال تکامل است، ” ChatGPT Agent ” به مثابه یک نقطه عطف، نویدبخش عصری است که در آن، هوش مصنوعی نه تنها دستیاری برای انجام دستورات، بلکه شریکی فعال و قابل اعتماد در پیگیری و تکمیل خودکار اهداف پیچیده خواهد بود. این مدل، با قابلیت‌های رو به بهبود خود در تولید محتوا، سازماندهی اطلاعات و مدیریت وظایف، نه تنها ابزاری برای بهینه‌سازی فرآیندهاست، بلکه پدیده‌ای است که به ما کمک می‌کند تا با نگاهی خلاقانه و استراتژیک‌تر به چالش‌ها بنگریم و از فناوری برای ارتقاء کیفیت زندگی و کار خود بهره‌مند شویم.

سوالات متداول

عامل ChatGPT چیست؟

عامل ChatGPT یک ابزار هوش مصنوعی جدید از OpenAI است که برای انجام وظایف پیچیده آنلاین از طرف کاربر، با قابلیت استدلال و تعامل قوی‌تر، طراحی شده است.

حالت عاملی ChatGPT چگونه کار می‌کند؟

با فعال کردن “حالت عاملی (Agent Mode)”، عامل ChatGPT از یک مرورگر مجازی استفاده می‌کند، وب‌گردی می‌کند، کد اجرا می‌کند و با برنامه‌ها تعامل دارد. این ابزار از اسکرین‌شات‌ها برای دیدن رابط کاربری استفاده می‌کند و قبل از اقدامات مهم، از کاربر اجازه می‌گیرد.

عامل ChatGPT چه کارهایی می‌تواند انجام دهد؟

این ابزار می‌تواند وظایف متنوعی از جمله برنامه‌ریزی سفر، خرید آنلاین، تحلیل رقبا، تهیه گزارش و ارائه، خلاصه‌سازی ایمیل‌ها و مدیریت تقویم را انجام دهد.

آیا استفاده از عامل ChatGPT ایمن است؟

OpenAI تدابیر حفاظتی چند لایه قوی را در آن گنجانده و قبل از اقدامات حیاتی مانند خرید یا ارسال ایمیل، از کاربر اجازه می‌گیرد. با این حال، سم آلتمن، مدیرعامل OpenAI، توصیه می‌کند که آن را “آزمایشی” تلقی کرده و از آن برای کاربردهای پرخطر یا با اطلاعات شخصی زیاد استفاده نشود.

چه کسانی می‌توانند به عامل ChatGPT دسترسی داشته باشند؟

این ابزار ابتدا برای مشترکین پولی (Pro، Plus، Team) عرضه می‌شود و سپس به کاربران Enterprise و Education گسترش می‌یابد.

آیا عامل ChatGPT در همه کشورها در دسترس است؟

در حال حاضر در تمام کشورها و مناطق پشتیبانی شده به جز منطقه اقتصادی اروپا (EEA) و سوئیس در دسترس است. OpenAI قصد دارد به زودی دسترسی به این مناطق را گسترش دهد.

محدودیت‌های استفاده از عامل ChatGPT چیست؟

محدودیت‌های ماهانه بر اساس نوع طرح متفاوت است (مثلاً Pro: 400 پیام، Plus: 40 پیام). همچنین، خروجی‌ها ممکن است در قالب‌بندی ابتدایی به نظر برسند و خطرات امنیتی مانند تزریق پرامپت و افشای داده‌ها وجود دارد.

آیا می‌توان وظایف را برای تکرار خودکار برنامه‌ریزی کرد؟

بله، پس از تکمیل یک وظیفه، می‌توانید آن را برای تکرار خودکار به صورت روزانه، هفتگی یا ماهانه برنامه‌ریزی کنید.

امتیاز دهید!
0 / 0

نوشته های مشابه

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *

دکمه بازگشت به بالا