جهان هوش مصنوعی با معرفی عامل ChatGPT، گامی بلند به سوی آیندهای خودمختار و هوشمند برداشته است. این فناوری نوین، که در ۱۷ ژوئیه ۲۰۲۵ توسط شرکت OpenAI رونمایی شد، نهتنها تواناییهای گفتوگوی پیشرفته ChatGPT را حفظ کرده، بلکه با ادغام قابلیتهای حالت عاملی ChatGPT، امکان انجام وظایف پیچیده از تحقیق عمیق تا تعامل پویا با وب را فراهم آورده است. تصور کنید ابزاری که میتواند جلسات شما را برنامهریزی کند، رقبا را تحلیل نماید، یا حتی یک صبحانه اصیل ایرانی برای چهار نفر طراحی کند، همه در حالی که کنترل کامل در دستان شماست؛ این وعده ChatGPT Agent است که با ترکیب هوشمندی و خودمختاری، تجربهای بیسابقه برای کاربران حرفهای و روزمره به ارمغان میآورد.
این ChatGPT Agent Mode، با تکیه بر محیط رایانهای مجازی و ابزارهای پیشرفته، پلی میان ایده و عمل میسازد و به کاربران اجازه میدهد تا با اطمینان و امنیت، وظایف خود را به این عوامل هوش مصنوعی بسپارند. از تولید اسلایدهای ارائه تا پالایش دادههای پیچیده، این گام بلند، نه تنها کارایی فردی و سازمانی را به سطح جدیدی ارتقاء میدهد، بلکه به کاربران امکان میدهد تا با تمرکز بر خلاقیت و تصمیمگیریهای استراتژیک، از پیچیدگیهای اجرایی رهایی یابند. آمادهاید تا با نسل جدیدی از تعامل هوش مصنوعی آشنا شوید که نه تنها فکر میکند، بلکه عمل میکند؟
فهرست مطالب
- تکامل طبیعی اپراتور و تحقیقات عمیق
- عامل ChatGPT نمایندهای که برای شما و با شما کار میکند
- گسترش کاربرد حالت عاملی ChatGPT در دنیای واقعی
- نحوه استفاده از ChatGPT Agent
- قابلیتهای نوین و خطرات نوین در ChatGPT Agent Mode
- قویترین مجموعه ایمنی شرکت OpenAI تاکنون برای خطرات بیولوژیکی
- در دسترس بودن ChatGPT Agent
- محدودیتها و نگاه به آینده
- جمع بندی
- سوالات متداول
در حال حاضر، مدل زبانی بزرگ ChatGPT این قابلیت را یافته است که با بهرهگیری از محیط رایانهای خود، وظایف پیچیده را به صورت کامل و از ابتدا تا انتها به انجام رساند. این پیشرفت، توانمندیهای این مدل را در حل مسائل کاربردی به میزان چشمگیری افزایش داده است.
این توسعه جدید به کاربران امکان میدهد تا درخواستهای گوناگونی را به ChatGPT محول کنند. به عنوان مثال، میتوان از آن خواست که “تقویم را بررسی کرده و بر اساس اخبار اخیر، جلسات آتی با کارمندان را اطلاعرسانی کند”، یا “برنامهریزی صبحانه ایرانی برای چهار نفر و خرید مواد اولیه آن را انجام دهد”، و همچنین “سه رقیب را تحلیل کرده و یک اسلاید ارائه (پرزنتیشن) تولید کند”. این مدل با هوشمندی در وبسایتها به جستجو میپردازد، نتایج مرتبط را پالایش میکند، در صورت لزوم از کاربران میخواهد به صورت امن وارد شوند، کدهای مورد نیاز را اجرا میکند، تحلیلهای لازم را انجام میدهد و حتی اسلایدها و صفحات گسترده (اکسل) قابل ویرایشی را ارائه میدهد که یافتههایش را به طور خلاصه نمایش میدهند.
قابلیتهای جدیدی که در ChatGPT مشاهده میشود، بر پایه یک سیستم عامل یکپارچه بنا شده است. این سیستم، سه جنبه کلیدی از پیشرفتهای قبلی را به صورت هماهنگ ترکیب میکند: توانایی تعامل با وبسایتها که از قابلیتهای “Operator” نشأت میگیرد، مهارت عمیق در ترکیب اطلاعات برای انجام تحقیقات گسترده، و هوش و روانی مکالمه که از ویژگیهای برجسته ChatGPT است.
این مدل وظایف محوله را با استفاده از رایانه مجازی اختصاصی خود به انجام میرساند. این رویکرد به آن امکان میدهد که به صورت پویا بین استدلال و عمل جابجا شود تا گردشکارهای پیچیده را از آغاز تا پایان، و تماماً بر اساس دستورالعملهای ارائه شده توسط کاربران، مدیریت کند.
از مهمترین جنبههای این سیستم، حفظ کنترل کامل توسط کاربر است. ChatGPT پیش از انجام هرگونه اقدام مهم، اجازه کاربر را درخواست میکند. علاوه بر این، کاربران میتوانند به سادگی در هر نقطهای از فرآیند مداخله کرده، کنترل مرورگر را به دست بگیرند یا وظایف را متوقف نمایند.
از تاریخ 17 جولای 2025، کاربران با اشتراکهای Pro، Plus و Team میتوانند قابلیتهای عاملی جدید ChatGPT را فعال کنند. این امکان به سادگی از طریق منوی کشویی ابزارها در بخش “کامپوزر (composer)” و با انتخاب “حالت عاملی (agent mode)” در هر نقطهای از مکالمه، قابل دسترسی است.
با وجود اینکه عامل هوشمند ChatGPT در حال حاضر ابزاری توانمند برای مدیریت وظایف پیچیده محسوب میشود، راهاندازی فعلی تنها گام نخست در توسعه آن به شمار میرود. شرکت OpenAI متعهد است که به صورت منظم بهبودهای چشمگیری را به این سیستم اضافه کند تا به مرور زمان، این قابلیتها قدرتمندتر شده و برای طیف وسیعتری از افراد سودمندتر واقع شوند.
تکامل طبیعی اپراتور و تحقیقات عمیق
پیش از این، قابلیتهای مجزای “Operator” و “تحقیقات عمیق (deep research)” هر کدام ویژگیهای متمایزی را ارائه میدادند. “Operator” قادر به پیمایش در وب، کلیک کردن و تایپ نمودن بود، در حالی که “تحقیقات عمیق” در تحلیل و خلاصهسازی اطلاعات کارایی بالایی داشت. با این حال، هر یک از این قابلیتها در سناریوهای متفاوتی بهینهترین عملکرد را از خود نشان میدادند. به عنوان مثال، “Operator” محدودیتهایی در انجام تحلیلهای عمیق یا نگارش گزارشهای تفصیلی داشت و “تحقیقات عمیق” نمیتوانست برای پالایش نتایج یا دسترسی به محتوایی که نیاز به احراز هویت کاربر داشت، با وبسایتها تعامل مستقیم برقرار کند. در واقع، مشاهده شد که بسیاری از درخواستهایی که کاربران از طریق “Operator” مطرح میکردند، برای قابلیت “تحقیقات عمیق” مناسبتر بودند. در نتیجه، برای رفع این محدودیتها، بهترین ویژگیهای هر دو قابلیت در یک سیستم واحد ترکیب شدهاند.
با ادغام این نقاط قوت مکمل در ChatGPT و افزودن ابزارهای بیشتر، قابلیتهای کاملاً جدیدی در یک مدل یکپارچه فعال شده است. این مدل اکنون میتواند به صورت فعال و هوشمندانه با وبسایتها تعامل داشته باشد؛ به این معنا که قادر است بر روی عناصر مختلف کلیک کند، نتایج را فیلتر نماید و در نهایت اطلاعات دقیقتر و کارآمدتری را گردآوری کند. علاوه بر این، کاربران میتوانند به سادگی و به صورت طبیعی، از یک مکالمه ساده به درخواست انجام وظایف پیچیده منتقل شوند و تمامی این فرآیندها مستقیماً در همان محیط گفتگوی جاری انجام میپذیرد.
عامل ChatGPT نمایندهای که برای شما و با شما کار میکند
عامل هوشمند ChatGPT به مجموعهای از ابزارهای پیشرفته مجهز شده است که شامل یک مرورگر بصری برای تعامل از طریق رابط کاربری گرافیکی با وب، یک مرورگر متنی برای جستجوهای وب سادهتر و مبتنی بر استدلال، یک ترمینال و دسترسی مستقیم به API میشود. این عامل همچنین میتواند از کانکتورهای ChatGPT بهرهبرداری کند که به کاربران امکان میدهد برنامههای کاربردی مانند جیمیل و گیتهاب را متصل کنند. این اتصال به ChatGPT اجازه میدهد تا اطلاعات مرتبط با درخواستهای کاربران را یافته و در پاسخهای خود مورد استفاده قرار دهد. علاوه بر این، کاربران قادرند با در دست گرفتن کنترل مرورگر، در هر وبسایتی وارد شوند، که این قابلیت به مدل اجازه میدهد تا هم در تحقیقات و هم در اجرای وظایف خود، به عمق و گستره بیشتری دست یابد. تجهیز ChatGPT به این مسیرهای متنوع برای دسترسی و تعامل با اطلاعات وب بدین معناست که این مدل میتواند مسیر بهینه را برای کارآمدترین انجام وظایف انتخاب کند. به عنوان مثال، میتواند اطلاعات تقویم کاربران را از طریق API جمعآوری کند، به طور کارآمد روی حجم زیادی از متن با استفاده از مرورگر متنی استدلال کند و در عین حال توانایی تعامل بصری با وبسایتهایی که عمدتاً برای انسانها طراحی شدهاند را نیز حفظ نماید.
تمام این عملیات در رایانه مجازی اختصاصی این مدل به انجام میرسد، که زمینه (context) لازم برای انجام وظیفه را حتی در زمان استفاده از ابزارهای متعدد نیز حفظ میکند. این بدان معناست که مدل میتواند انتخاب کند که یک صفحه را با استفاده از مرورگر متنی یا مرورگر بصری باز کند، یک فایل را از وب دانلود کند، با اجرای یک فرمان در ترمینال آن را دستکاری نماید و سپس خروجی حاصل را مجدداً در مرورگر بصری مشاهده کند. این قابلیت به مدل امکان میدهد تا رویکرد خود را برای انجام وظایف با سرعت، دقت و کارایی بالا تطبیق دهد.
عامل هوشمند ChatGPT برای گردشکارهای تعاملی و مشارکتی تکرارشونده طراحی شده است، که در مقایسه با مدلهای پیشین، بسیار تعاملیتر و انعطافپذیرتر عمل میکند. در طول فرآیند اجرای وظیفه توسط ChatGPT، کاربران میتوانند در هر لحظه مداخله کرده تا دستورالعملهای خود را روشن کنند، مدل را به سمت نتایج مطلوب هدایت نمایند، یا حتی کل وظیفه را تغییر دهند. این مدل قادر است کار را از همان نقطهای که متوقف شده است، از سر بگیرد؛ با اطلاعات جدید اما بدون از دست دادن پیشرفتهای قبلی. به همین ترتیب، ChatGPT ممکن است در صورت نیاز به طور پیشگیرانه جزئیات بیشتری را از کاربران درخواست کند تا اطمینان حاصل شود که وظیفه با اهداف آنها همسو باقی میماند. اگر انجام وظیفهای بیشتر از حد انتظار طول کشید یا به نظر رسید که مدل درگیر مشکلی شده است، کاربران میتوانند آن را متوقف کنند، درخواست خلاصهای از پیشرفت کنند، یا به طور کامل آن را متوقف کرده و نتایج جزئی را دریافت نمایند. همچنین، اگر اپلیکیشن ChatGPT بر روی گوشی کاربران نصب شده باشد، پس از اتمام کار، اعلان (نوتیفیکیشن) مربوطه برایشان ارسال خواهد شد.
گسترش کاربرد حالت عاملی ChatGPT در دنیای واقعی
قابلیتهای عاملی یکپارچه در ChatGPT به طور چشمگیری کارایی این مدل را در هر دو زمینههای روزمره و حرفهای ارتقاء میبخشند. در محیط کار، میتوان وظایف تکراری را خودکارسازی کرد؛ به عنوان مثال، تبدیل اسکرینشاتها یا داشبوردها به ارائههایی با عناصر برداری قابل ویرایش، جابجایی جلسات، برنامهریزی و رزرو رویدادهای خارج از محل کار، و بهروزرسانی صفحات گسترده با دادههای مالی جدید همراه با حفظ قالببندی پیشین. در زندگی شخصی، کاربران قادرند از این مدل برای برنامهریزی و رزرو بدون دردسر برنامههای سفر، طراحی و رزرو کامل مهمانیهای شام، یا یافتن متخصصان و زمانبندی قرار ملاقاتها با پزشکان استفاده کنند.
قابلیتهای ارتقا یافته این مدل در عملکرد پیشرفته (State-of-the-Art – SOTA) آن، که در ارزیابیهای مربوط به مرور وب و توانایی تکمیل وظایف دنیای واقعی اندازهگیری شده است، به وضوح منعکس میشود. این نتایج نشاندهنده پیشرفت چشمگیر در توانایی مدل برای انجام کارهای پیچیده و کاربردی است.
در معیار “آخرین امتحان بشریت (Humanity’s Last Exam – HLE)”، که به منظور ارزیابی عملکرد هوش مصنوعی در گستره وسیعی از موضوعات با پرسشهای در سطح تخصصی طراحی شده است، مدلی که عامل هوشمند ChatGPT را تغذیه میکند، به امتیاز جدید و پیشرفته 41.6 در معیار pass@1 دست یافته است. از آنجا که این عامل به صورت پویا برنامهریزی کرده و ابزارهای مورد نیاز خود را انتخاب میکند، میتواند یک وظیفه را به روشهای مختلفی در اجراهای متفاوت حل کند. زمانی که این قابلیت با یک استراتژی ساده اجرای موازی مقیاسبندی شد (یعنی با اجرای همزمان تا هشت تلاش و انتخاب بهترین نتیجه با بالاترین سطح اطمینان گزارششده خودکار) امتیاز HLE این عامل به 44.4 افزایش یافت که نشاندهنده بهبود قابل توجهی در عملکرد آن است.

FrontierMath به عنوان یکی از سختترین معیارهای ریاضی شناخته شده مطرح است که شامل مسائل جدید و منتشرنشدهای میشود. حل این مسائل اغلب ساعتها یا حتی روزها از ریاضیدانان خبره زمان میبرد. با بهرهگیری از ابزارهایی نظیر دسترسی به ترمینال برای اجرای کد، عامل هوشمند ChatGPT به دقت 27.4% دست یافته است و با اختلاف قابل توجهی از مدلهای قبلی پیشی میگیرد. این دستاورد، تواناییهای چشمگیر مدل را در حل مسائل پیچیده ریاضی به اثبات میرساند.

علاوه بر این، عملکرد این مدل با استفاده از معیارهایی که بر پایه وظایف پیچیده دنیای واقعی طراحی شدهاند، مورد ارزیابی قرار گرفت. در یک معیار داخلی که به منظور سنجش عملکرد مدل در وظایف پیچیده و دارای ارزش اقتصادی مرتبط با کارهای دانشی توسعه یافته است، خروجی عامل هوشمند ChatGPT در تقریباً نیمی از موارد و در بازههای زمانی مختلف برای انجام وظایف، قابل مقایسه یا حتی بهتر از عملکرد انسانها است، در حالی که عملکرد آن به طور قابل توجهی بالاتر از مدلهای o3 و o4-mini قرار دارد. خروجیهای مدل توسط کارشناسان بر اساس استانداردهای پایه انسانی با کیفیت بالا که توسط برترین متخصصان در هر زمینه تدوین شدهاند، مورد قضاوت قرار میگیرند. این وظایف، که از کارشناسان در مشاغل و صنایع گوناگون گردآوری شدهاند، بازتابدهنده کارهای حرفهای واقعی هستند؛ به عنوان مثال، آمادهسازی تحلیل رقابتی ارائهدهندگان مراقبتهای فوری درخواستی (on-demand)، ساخت جداول استهلاک دقیق و شناسایی چاههای آب مناسب برای یک تأسیسات جدید هیدروژن سبز.

در معیار DSBench، که برای ارزیابی عوامل هوشمند در وظایف واقعگرایانه علم داده شامل تحلیل و مدلسازی دادهها طراحی شده است، عامل هوشمند ChatGPT به طور قابل توجهی از عملکرد انسانها پیشی میگیرد. این نتیجه نشاندهنده برتری قابل ملاحظه مدل در انجام امور پیچیده مربوط به علم داده است.


در معیار SpreadsheetBench، که توانایی مدلها را در ویرایش صفحات گسترده برگرفته از سناریوهای دنیای واقعی ارزیابی میکند، عامل هوشمند ChatGPT با اختلاف قابل توجهی از مدلهای موجود پیشی گرفته است. زمانی که به این عامل قابلیت ویرایش مستقیم صفحات گسترده داده میشود، امتیاز آن به 45.5% افزایش مییابد، در مقایسه با 20.0% که Copilot در اکسل به دست آورده است. این نشاندهنده برتری چشمگیر عامل هوشمند ChatGPT در مدیریت و ویرایش دقیق دادهها در صفحات گسترده است.

روششناسی مورد استفاده در ارزیابیهای مربوط به SpreadsheetBench، در برخی جزئیات با آزمایشهای اولیه متفاوت است. نویسندگان معیار SpreadsheetBench، از محیط ویندوز به همراه مایکروسافت اکسل برای ارزیابی صفحات گسترده ( مانند اکسل) استفاده کردند. اما در آزمایشات فعلی، از محیط OSX و نرمافزار LibreOffice بهره گرفته شده است، که ممکن است منجر به تفاوتهای جزئی در نمرهدهی نهایی شود. به عنوان مثال، در حالی که نویسندگان معیار، محدودیت کلی دشواری (Overall Hard) را برای GPT-4o برابر با 15.02% گزارش کردهاند، در این ارزیابی این مقدار 13.38% به دست آمد. در تمامی این آزمایشها، مجموعه کامل 912 سوالی معیار SpreadsheetBench مورد استفاده قرار گرفت.
در یک معیار داخلی که برای سنجش توانایی یک مدل در انجام وظایف مدلسازی تحلیلگر بانکداری سرمایهگذاری (در سطوح سال اول تا سوم) طراحی شده است (مواردی نظیر ترتیب دادن یک مدل مالی سه صورته برای یک شرکت Fortune 500 با قالببندی و منابع مناسب، یا ساخت مدل خرید اهرمی (LBO) برای خصوصیسازی یک شرکت) مدلی که عامل هوشمند ChatGPT را تغذیه میکند، به طور قابل توجهی بهتر از deep research و o3 عمل میکند. هر وظیفه بر اساس صدها معیار مرتبط با صحت و استفاده از فرمولها نمرهگذاری میشود، که نشاندهنده دقت و پیچیدگی ارزیابیها است.

علاوه بر این، عامل هوشمند ChatGPT در BrowseComp نیز مورد ارزیابی قرار گرفت. BrowseComp یک معیار است که پیش از این توسط شرکت OpenAI منتشر شده و توانایی عاملهای مرورگر را در یافتن اطلاعات دشوار بر روی وب میسنجد. در این ارزیابی، این مدل با کسب 68.9%، یک استاندارد جدید (SOTA) را ثبت کرد که 17.4 درصد بالاتر از deep research است. این نتیجه نشاندهنده قابلیت بالای عامل هوشمند ChatGPT در جستجو و بازیابی اطلاعات پیچیده از وب است.

در نهایت، در معیار WebArena، که برای ارزیابی عملکرد عاملهای مرورگر وب در تکمیل وظایف واقعی وب طراحی شده است، این مدل نسبت به o3 مجهز به CUA (مدلی که Operator را تغذیه میکرد) پیشرفت قابل توجهی داشته است. این نشاندهنده توانایی ارتقا یافته عامل هوشمند ChatGPT در انجام وظایف کاربردی و پیچیده در محیط وب است.

نحوه استفاده از ChatGPT Agent
کاربران اکنون قادرند قابلیتهای جدید عاملی ChatGPT را به طور مستقیم فعال کنند. این فعالسازی از طریق منوی کشویی ابزارها در بخش “نوشتار (composer)” و با انتخاب “حالت عاملی (agent mode)” در هر مرحلهای از مکالمات امکانپذیر است. پس از فعالسازی، کافی است وظیفه مورد نظر، اعم از انجام تحقیقات عمیق، ساخت یک اسلاید، یا ارسال هزینهها، به صورت متنی توصیف شود. همزمان با انجام وظیفه توسط ChatGPT، یک روایت بصری بر روی صفحه نمایش، جزئیات دقیق فعالیتهای در حال انجام را به کاربر نمایش میدهد. این امکان وجود دارد که در هر زمان که لازم باشد، کاربر مداخله کرده و کنترل مرورگر را به دست گیرد تا از همسویی وظایف با اهداف اصلی اطمینان حاصل شود.
عامل هوشمند ChatGPT میتواند به کانکتورهای کاربران دسترسی یابد و بدین ترتیب با گردشکارهای موجود ادغام شده و به اطلاعات مرتبط و قابل اقدام دسترسی پیدا کند. پس از انجام احراز هویت امن، این کانکتورها به ChatGPT امکان میدهند تا اطلاعاتی نظیر خلاصهی ایمیلهای روزانه کاربران یا زمانهای خالی آنها برای یک جلسه را مشاهده نماید. با این حال، برای انجام هرگونه اقدامی بر روی این سایتها، همچنان از کاربران خواسته میشود که با در دست گرفتن کنترل مرورگر، به صورت دستی وارد سیستم شوند. این رویکرد، ضمن افزایش قابلیتهای مدل، امنیت و کنترل کاربر را حفظ میکند.
علاوه بر قابلیتهای فوق، این امکان نیز فراهم شده است که وظایف تکمیلشده برای تکرار خودکار زمانبندی شوند. به عنوان مثال، میتوان تعیین کرد که یک گزارش هفتگی معیارها به صورت خودکار هر دوشنبه صبح تولید و ارائه شود. این ویژگی به افزایش بهرهوری و خودکارسازی فرآیندهای تکراری کمک شایانی میکند.
قابلیتهای نوین و خطرات نوین در ChatGPT Agent Mode
این نسخه جدید برای نخستین بار به کاربران امکان میدهد تا از ChatGPT بخواهند اقدامات مستقیمی را در بستر وب انجام دهد. این قابلیت، همراه با مزایای خود، خطرات جدیدی را نیز به همراه دارد. به ویژه از آنجا که عامل هوشمند ChatGPT میتواند به طور مستقیم با دادههای کاربران کار کند (چه اطلاعاتی که از طریق کانکتورها به آنها دسترسی پیدا کرده و چه وبسایتهایی که کاربر از طریق حالت “تصاحب (takeover mode)” در آنها وارد شده است). شرکت OpenAI کنترلهای قدرتمندی را که از پیشنمایش تحقیقاتی Operator وجود داشت، تقویت کرده و اقدامات حفاظتی جدیدی را برای مقابله با چالشهایی نظیر مدیریت اطلاعات حساس در وب زنده، گستره وسیعتر کاربران و دسترسی محدود به شبکه ترمینال اضافه کرده است. با وجود اینکه این اقدامات کاهشدهنده ریسک، به طور قابل توجهی خطر را کاهش میدهند، اما ابزارهای گستردهتر و دسترسی وسیعتر عامل هوشمند ChatGPT به کاربران به این معناست که پروفایل ریسک کلی آن بالاتر است.
تاکید ویژهای بر حفاظت از عامل هوشمند ChatGPT در برابر دستکاریهای مخرب از طریق تزریق پرامپت (prompt injection) صورت گرفته است، که به طور کلی یک تهدید مهم برای سیستمهای عاملی محسوب میشود. بر این اساس، اقدامات کاهشدهنده گستردهای برای مقابله با این حملات آماده شده است. تزریق پرامپت به تلاشهایی اطلاق میشود که توسط اشخاص ثالث برای دستکاری رفتار عامل هوشمند ChatGPT از طریق دستورالعملهای مخرب انجام میگیرد؛ این دستورالعملها ممکن است در حین انجام یک وظیفه در وب، توسط این عامل با آنها مواجه شود. به عنوان مثال، یک پرامپت مخرب که به صورت پنهان در یک صفحه وب، مثلاً در عناصر نامرئی یا فراداده (metadata)، جاسازی شده باشد، میتواند عامل هوشمند را فریب دهد تا اقدامات ناخواستهای انجام دهد. این اقدامات ناخواسته میتواند شامل به اشتراک گذاشتن دادههای خصوصی از یک کانکتور با مهاجم، یا انجام یک عمل مضر در سایتی که کاربر در آن وارد شده است، باشد. از آنجا که عامل هوشمند ChatGPT قابلیت انجام اقدامات مستقیم را دارد، حملات موفقیتآمیز میتوانند تأثیر بیشتر و خطرات بالاتری داشته باشند.
این عامل هوشمند برای شناسایی و مقاومت در برابر تزریق پرامپت آموزش دیده و آزمایش شده است. علاوه بر این، از نظارت مداوم برای تشخیص سریع و پاسخگویی به حملات تزریق پرامپت استفاده میشود. درخواست تأیید صریح کاربر پیش از انجام اقدامات مهم، خطر آسیب ناشی از این حملات را بیشتر کاهش میدهد و کاربران میتوانند در صورت نیاز با در دست گرفتن کنترل یا توقف، در کارها مداخله کنند. لازم است کاربران هنگام تصمیمگیری درباره اینکه چه اطلاعاتی را در اختیار این عامل قرار دهند، این بدهبستانها را در نظر بگیرند و همچنین اقداماتی را برای به حداقل رساندن قرار گرفتن در معرض این خطرات انجام دهند، مانند غیرفعال کردن کانکتورها زمانی که برای یک کار خاص مورد نیاز نیستند.
علاوه بر موارد فوق، اقدامات کاهشی برای خطاهای مدل نیز پیادهسازی شده است، به ویژه اکنون که مدل میتواند وظایفی را انجام دهد که به طور مستقیم بر دنیای واقعی تأثیر میگذارند.
- تأیید صریح کاربر: ChatGPT به گونهای آموزش دیده است که پیش از انجام هرگونه اقدامی که دارای پیامدهای دنیای واقعی است، نظیر انجام خرید، به طور صریح از کاربر اجازه بگیرد.
- نظارت فعال (حالت تماشا): برخی از وظایف حیاتی، مانند ارسال ایمیل، نیازمند نظارت فعال کاربر هستند تا از اجرای صحیح و مطابق با اهداف اطمینان حاصل شود.
- کاهش فعال ریسک: ChatGPT به گونهای آموزش داده شده است که از انجام وظایف با ریسک بالا، مانند انتقال وجه بانکی، به طور فعال امتناع کند تا از بروز خسارات مالی یا امنیتی جلوگیری شود.
در نهایت، کنترلهای بیشتری به منظور محدود کردن دسترسی مدل به دادهها معرفی شدهاند تا حریم خصوصی و امنیت کاربران تضمین شود.
- کنترلهای حریم خصوصی: با یک کلیک ساده در تنظیمات ChatGPT، کاربران میتوانند تمام دادههای مرورگر را حذف کرده و به سرعت از تمام نشستهای فعال وبسایتها خارج شوند. در غیر این صورت، کوکیها بر اساس سیاستهای کوکی هر وبسایت بازدید شده باقی میمانند که میتواند بازدیدهای مجدد از سایتها را کارآمدتر کند.
- حالت امن در دست گرفتن کنترل مرورگر (Secure browser takeover mode): هنگامی که کاربران با استفاده از مرورگر ChatGPT (که با عنوان “حالت در دست گرفتن کنترل” شناخته میشود) با وب تعامل میکنند، ورودیهای آنها خصوصی باقی میمانند. ChatGPT هیچ دادهای را که کاربر در طول این جلسات وارد میکند، مانند رمزهای عبور، جمعآوری یا ذخیره نمیکند. این رویکرد به این دلیل اتخاذ شده است که مدل نیازی به این اطلاعات ندارد و عدم دسترسی مدل به آنها، امنیت کلی سیستم را افزایش میدهد.
قویترین مجموعه ایمنی شرکت OpenAI تاکنون برای خطرات بیولوژیکی
با در نظر گرفتن قابلیتهای رو به رشد این مدل، شرکت OpenAI تصمیم گرفت که عامل هوشمند ChatGPT را در چارچوب آمادگی خود، تحت عنوان قابلیتهای زیستی و شیمیایی بالا دستهبندی کرده و تدابیر حفاظتی مربوطه را فعال سازد. اگرچه شواهد قاطعی مبنی بر اینکه این مدل بتواند به طور معناداری به یک مبتدی در ایجاد آسیبهای زیستی شدید کمک کند (که این سطح به عنوان آستانه “قابلیت بالا” در نظر گرفته میشود) در دسترس نیست، اما رویکرد محتاطانه در پیش گرفته شده و تدابیر حفاظتی لازم هماکنون پیادهسازی میشوند. در نتیجه، این مدل در حال حاضر جامعترین مجموعه ایمنی را تا به امروز دارا است که شامل تدابیر حفاظتی پیشرفتهای برای حوزه زیستشناسی میشود. این تدابیر شامل مدلسازی جامع تهدید، آموزش امتناع از کاربرد دوگانه (dual-use)، استفاده از طبقهبندیکنندهها و ناظران استدلال همیشگی و تعریف خطوط اجرایی واضح است.
علاوه بر تلاشهای داخلی برای ایمنسازی عامل هوشمند ChatGPT، شرکت OpenAI بر این باور است که ایمنی زیستی لایهای زمانی به بهترین نحو عمل میکند که اقدامات حفاظتی فراتر از یک آزمایشگاه خاص صورت پذیرد. به همین دلیل، برای تقویت دفاعیات، این شرکت در سراسر اکوسیستم مربوطه همکاریهای گستردهای را دنبال میکند. از همان ابتدا، با کارشناسان بیرونی امنیت زیستی، مؤسسات ایمنی و پژوهشگران دانشگاهی همکاری صورت گرفته تا مدل تهدید، ارزیابیها و سیاستهای ایمنی شکل گیرد. بازبینان آموزشدیده در حوزه زیستشناسی، دادههای ارزیابی را تأیید کردهاند و تیمهای “رد تیم” متخصص در این حوزه، اقدامات حفاظتی را در سناریوهای واقعی مورد آزمایش قرار دادهاند. در اوایل ماه ژوئیه، یک کارگاه با عنوان “دفاع زیستی” با حضور متخصصانی از دولت، دانشگاهها، آزمایشگاههای ملی و سازمانهای غیردولتی برگزار شد تا همکاریها تسریع یافته و تحقیقات دفاع زیستی مبتنی بر هوش مصنوعی پیش برده شود. شرکت OpenAI به همکاریهای جهانی خود ادامه خواهد داد تا از خطرات نوظهور در این زمینه پیشی بگیرد.
برای کسب اطلاعات بیشتر در خصوص رویکرد ایمنی قوی که برای مدل عاملی یکپارچه اتخاذ شده است، میتوان به [کارت سیستم] مراجعه کرد. همچنین، شرکت OpenAI در حال راهاندازی [برنامه پاداش اشکالات (bug bounty program)] است تا بتواند خطرات دنیای واقعی را شناسایی و به طور موثر رفع نماید. این اقدامات نشاندهنده تعهد این شرکت به افزایش امنیت و پایداری سیستمهای هوش مصنوعی است.
در دسترس بودن ChatGPT Agent
عرضه عامل هوشمند ChatGPT از تاریخ 17 جولای 2025 آغاز شده است. این قابلیت ابتدا در اختیار کاربران Pro، Plus و Team قرار گرفت؛ به گونهای که کاربران Pro تا پایان روز انتشار به آن دسترسی داشتند، در حالی که کاربران Plus و Team پس از چند روز این دسترسی را پیدا کردند. کاربران Enterprise و Education نیز در هفتههای آتی به این قابلیتها دسترسی خواهند داشت. سقف استفاده برای کاربران پرو، 400 پیام در ماه تعیین شده است، در حالی که سایر کاربران پولی ماهیانه 40 پیام دریافت میکنند و امکان استفاده بیشتر از طریق گزینههای اعتباری منعطف فراهم شده است.
فعالسازی دسترسی برای کاربران در منطقه اقتصادی اروپا (EEA) و سوئیس همچنان در دست بررسی و اجرا است.
سایت پیشنمایش تحقیقاتی Operator برای چند هفته آینده پس از انتشار مقاله حاضر فعال باقی خواهد ماند و پس از آن متوقف خواهد شد. لازم به ذکر است که قابلیت “تحقیق عمیق (deep research)” به عنوان بخشی از توانمندیهای اصلی عامل هوشمند ChatGPT محسوب میشود. در صورتی که کاربران ویژگی اصلی “تحقیق عمیق” را ترجیح میدهند (که ممکن است زمان بیشتری برای اجرا نیاز داشته باشد اما به طور پیشفرض پاسخهای دقیقتر و عمیقتری ارائه میدهد) همچنان میتوانند با انتخاب گزینه “deep research” از منوی کشویی در بخش نوشتار پیام، به آن دسترسی پیدا کنند.
محدودیتها و نگاه به آینده
عامل هوشمند ChatGPT در حال حاضر در مراحل اولیه توسعه خود قرار دارد. با وجود قابلیتهایی که این مدل برای پذیرش طیف گستردهای از وظایف پیچیده از خود نشان میدهد، همچنان احتمال بروز خطاها و اشتباهات در عملکرد آن وجود دارد.
در حالی که شرکت OpenAI پتانسیل قابل توجهی در قابلیت تولید اسلاید توسط این مدل مشاهده میکند، این ویژگی در حال حاضر در مرحله بتا (آزمایشی) قرار دارد. در وضعیت کنونی، خروجیهای تولیدی گاهی اوقات از منظر قالببندی و ظرافت، به ویژه زمانی که فرآیند تولید بدون یک سند موجود آغاز میشود، ابتدایی به نظر میرسند. تمرکز اصلی در توسعه قابلیتهای اولیه این مدل بر تولید فایلهایی بوده است که اطلاعات را در یک جریان و فرمت مناسب برای ارائهها سازماندهی میکنند. این فایلها حاوی عناصری نظیر متن، نمودارها، تصاویر و اشکال هستند که پس از خروجی گرفتن، به صورت بومی و آسان قابل ویرایش باشند. این هدف با بهینهسازی ساختار و انعطافپذیری در نظر گرفته شده است. در حال حاضر، گاهی اوقات اختلافاتی بین نمایش اسلایدها در نمایشگر و پاورپوینت خروجیگرفتهشده مشاهده میشود که شرکت OpenAI در حال تلاش برای کاهش و رفع این مغایرتها است. علاوه بر این، در حالی که در حال حاضر امکان آپلود یک صفحه گسترده موجود برای ویرایش یا استفاده به عنوان الگو توسط ChatGPT فراهم است، این قابلیت هنوز برای اسلایدها در دسترس نیست. این شرکت در حال آموزش نسل بعدی قابلیت ایجاد اسلاید در ChatGPT است تا خروجیهایی ظریفتر و پیچیدهتر با قابلیتهای گستردهتر و قالببندی بهبود یافته تولید شود.
به طور کلی، انتظار میرود که کارایی، عمق و تطبیقپذیری عامل هوشمند ChatGPT در طول زمان به طور مستمر بهبود یابد. این بهبودها شامل تعاملات یکپارچهتر نیز خواهد شد، زیرا شرکت OpenAI به تنظیم میزان نظارت مورد نیاز از سوی کاربر ادامه میدهد تا این مدل را مفیدتر ساخته و در عین حال از ایمنی استفاده از آن اطمینان حاصل کند.
جمع بندی
با معرفی ” عامل ChatGPT یا ChatGPT Agent “، مرزهای هوش مصنوعی بیش از پیش گسترش یافته و افقهای جدیدی از اتوماسیون و تعامل هوشمند را پیش روی ما گشوده است. این نوآوری برجسته OpenAI، با تجمیع قابلیتهای بینظیر در تحلیل، جستجو و اجرای وظایف پیچیده، نه تنها کارایی فردی و سازمانی را به سطحی نوین ارتقا میدهد، بلکه با ایجاد “حالت عاملی ChatGPT یا (ChatGPT Agent Mode) “، فرصتی بیسابقه برای آزاد کردن ذهن از درگیریهای اجرایی روزمره فراهم میآورد. این تحول، تأکید ویژهای بر تحقق پتانسیل کامل هوش مصنوعی در محیطهای واقعی دارد و نشان میدهد که چگونه پژوهشهای عمیق، میتوانند مستقیماً به ابزارهایی کاربردی و قدرتمند تبدیل شوند.
در نهایت، همانطور که آینده فناوری با سرعت خیرهکنندهای در حال تکامل است، ” ChatGPT Agent ” به مثابه یک نقطه عطف، نویدبخش عصری است که در آن، هوش مصنوعی نه تنها دستیاری برای انجام دستورات، بلکه شریکی فعال و قابل اعتماد در پیگیری و تکمیل خودکار اهداف پیچیده خواهد بود. این مدل، با قابلیتهای رو به بهبود خود در تولید محتوا، سازماندهی اطلاعات و مدیریت وظایف، نه تنها ابزاری برای بهینهسازی فرآیندهاست، بلکه پدیدهای است که به ما کمک میکند تا با نگاهی خلاقانه و استراتژیکتر به چالشها بنگریم و از فناوری برای ارتقاء کیفیت زندگی و کار خود بهرهمند شویم.
سوالات متداول
عامل ChatGPT یک ابزار هوش مصنوعی جدید از OpenAI است که برای انجام وظایف پیچیده آنلاین از طرف کاربر، با قابلیت استدلال و تعامل قویتر، طراحی شده است.
با فعال کردن “حالت عاملی (Agent Mode)”، عامل ChatGPT از یک مرورگر مجازی استفاده میکند، وبگردی میکند، کد اجرا میکند و با برنامهها تعامل دارد. این ابزار از اسکرینشاتها برای دیدن رابط کاربری استفاده میکند و قبل از اقدامات مهم، از کاربر اجازه میگیرد.
این ابزار میتواند وظایف متنوعی از جمله برنامهریزی سفر، خرید آنلاین، تحلیل رقبا، تهیه گزارش و ارائه، خلاصهسازی ایمیلها و مدیریت تقویم را انجام دهد.
OpenAI تدابیر حفاظتی چند لایه قوی را در آن گنجانده و قبل از اقدامات حیاتی مانند خرید یا ارسال ایمیل، از کاربر اجازه میگیرد. با این حال، سم آلتمن، مدیرعامل OpenAI، توصیه میکند که آن را “آزمایشی” تلقی کرده و از آن برای کاربردهای پرخطر یا با اطلاعات شخصی زیاد استفاده نشود.
این ابزار ابتدا برای مشترکین پولی (Pro، Plus، Team) عرضه میشود و سپس به کاربران Enterprise و Education گسترش مییابد.
در حال حاضر در تمام کشورها و مناطق پشتیبانی شده به جز منطقه اقتصادی اروپا (EEA) و سوئیس در دسترس است. OpenAI قصد دارد به زودی دسترسی به این مناطق را گسترش دهد.
محدودیتهای ماهانه بر اساس نوع طرح متفاوت است (مثلاً Pro: 400 پیام، Plus: 40 پیام). همچنین، خروجیها ممکن است در قالببندی ابتدایی به نظر برسند و خطرات امنیتی مانند تزریق پرامپت و افشای دادهها وجود دارد.
بله، پس از تکمیل یک وظیفه، میتوانید آن را برای تکرار خودکار به صورت روزانه، هفتگی یا ماهانه برنامهریزی کنید.
اگر محتوای ما برایتان جذاب بود و چیزی از آن آموختید، لطفاً لحظهای وقت بگذارید و این چند خط را بخوانید:
ما گروهی کوچک و مستقل از دوستداران علم و فناوری هستیم که تنها با حمایتهای شما میتوانیم به راه خود ادامه دهیم. اگر محتوای ما را مفید یافتید و مایلید از ما حمایت کنید، سادهترین و مستقیمترین راه، کمک مالی از طریق لینک دونیت در پایین صفحه است.
اما اگر به هر دلیلی امکان حمایت مالی ندارید، همراهی شما به شکلهای دیگر هم برای ما ارزشمند است. با معرفی ما به دوستانتان، لایک، کامنت یا هر نوع تعامل دیگر، میتوانید در این مسیر کنار ما باشید و یاریمان کنید. ❤️





