
OpenAI از مدل هوش مصنوعی جدید خود با نام GPT-6 Astra رونمایی کرده است؛ مدلی که به گفته این شرکت، بزرگترین پیشرفت OpenAI تاکنون در زمینه استفاده از کامپیوتر، برنامهنویسی، پژوهش، انجام کارهای چندمرحلهای و امنیت سایبری محسوب میشود.
Astra تنها برای پاسخ دادن به پرسشهای متنی طراحی نشده و هدف اصلی آن انجام کاملتر وظایف از ابتدا تا انتها است؛ از پر کردن فرمهای آنلاین و کار با نرمافزارها گرفته تا ساخت اسناد، ارائهها و تحلیل دادهها. OpenAI همچنین میگوید این مدل در زمینه امنیت سایبری به سطحی رسیده که برای نخستین بار در چارچوب Preparedness Framework این شرکت، در دسته Critical قرار میگیرد.
تمرکز اصلی GPT-6 Astra روی استفاده از کامپیوتر است
یکی از مهمترین تفاوتهای Astra با نسلهای قبلی، توانایی آن در تعامل مستقیمتر با محیط کامپیوتر است. این مدل میتواند وظایفی مانند تکمیل فرمهای اینترنتی، بهروزرسانی اطلاعات مشتریان در CRM، انجام تحقیقات آنلاین، نوشتن و ویرایش اسناد، ساخت وبسایت و حتی نصب و آزمایش نرمافزار را انجام دهد.
OpenAI برای سنجش این قابلیت از بنچمارک OSWorld 2.0 استفاده کرده است. Astra در این آزمون به امتیاز 72.6% رسیده؛ در حالی که GPT-5.6 Sol امتیاز 65.7% کسب کرده است. نکته مهمتر این است که Astra برای انجام وظایف آزمایشی به حدود 40 دقیقه زمان نیاز داشته، در حالی که Sol برای همان ارزیابی حدود 75 دقیقه زمان گرفته است.
OpenAI همچنین اعلام کرده که با بهینهسازی Codex و ترکیب آن با قابلیتهای Astra، سرعت انجام برخی وظایف کامپیوتری در بنچمارک Mind2Web حدود 1.9 برابر نسبت به تجربه فعلی GPT-5.6 Sol افزایش پیدا کرده است.
این موضوع اهمیت زیادی دارد، زیرا مسیر حرکت مدلهای زبانی در حال تغییر است. مدل دیگر صرفاً ابزاری برای تولید متن یا پاسخ به سؤال نیست؛ بلکه میتواند مانند یک عامل نرمافزاری، چندین مرحله از یک کار را پشت سر هم اجرا کند و در نهایت نتیجه آماده تحویل ارائه دهد.
جهش در برنامهنویسی و استدلال
GPT-6 Astra در بخش استدلال و برنامهنویسی نیز عملکرد قابل توجهی نشان داده است.
در ARC-AGI-3، Astra به امتیاز 99.9% رسیده و در FrontierMath Tier 4 نیز OpenAI امتیاز 98% را گزارش کرده است. این اعداد نشان میدهند که تمرکز مدل تنها روی اجرای دستورات ساده نیست و در حل مسائل پیچیدهتر نیز پیشرفت قابل توجهی داشته است.
در زمینه مهندسی نرمافزار نیز OpenAI Astra را بهترین مدل خود برای این حوزه معرفی میکند. مدل جدید میتواند کد تولید کند، روی پروژههای نرمافزاری کار کند، مشکلات را پیدا کند و حتی نرمافزار را اجرا و آزمایش کند.
این ترکیب برای توسعهدهندگان اهمیت ویژهای دارد؛ زیرا مدل میتواند از مرحله نوشتن کد فراتر رفته و بخشی از چرخه واقعی توسعه نرمافزار، آزمایش و رفع اشکال را نیز بر عهده بگیرد.
GPT-6 Astra در امنیت سایبری به سطح Critical رسیده است
شاید بحثبرانگیزترین بخش معرفی Astra، قابلیتهای امنیت سایبری آن باشد.
OpenAI اعلام کرده که GPT-6 Astra نخستین مدل این شرکت است که در چارچوب Preparedness Framework به سطح Critical Cybersecurity Capability رسیده است. این سطح به مدلی اختصاص دارد که با ابزارها و دسترسی مناسب میتواند آسیبپذیریهای ناشناخته را شناسایی کرده و روشهای جدیدی برای سوءاستفاده از آنها در سیستمهای محافظتشده پیدا کند.
Astra در ExploitBench به امتیاز 100% رسیده است. این آزمون توانایی مدل در تبدیل آسیبپذیریهای شناختهشده به اکسپلویتهای عملیاتی را ارزیابی میکند.
موضوع حتی فراتر از بنچمارکهاست. OpenAI میگوید Astra در یک ارزیابی داخلی که آسیبپذیریهای جدیدتر بین ژوئن تا اوت 2026 را بررسی میکرد، توانسته دو آسیبپذیری Zero-Day ناشناخته را کشف و در زنجیره حمله مورد استفاده قرار دهد. OpenAI اعلام کرده که این دو آسیبپذیری را با توسعهدهندگان مربوطه در میان خواهد گذاشت.
در آزمایشهای کارشناسی نیز Astra توانسته آسیبپذیریهای ناشناخته در یک مرورگر و سیستمعامل سختسازیشده را پیدا کرده و از آنها برای ساخت زنجیرههای حمله استفاده کند. این موضوع همان دلیلی است که OpenAI برای قابلیتهای سایبری پیشرفته Astra محدودیتهای بیشتری در نظر گرفته است.
OpenAI همزمان روی کنترل و همراستایی Astra کار کرده است
قدرت بیشتر به معنی ریسک بیشتر نیز هست. OpenAI میگوید توسعه و عرضه Astra برای مدتی با تأخیر مواجه شد تا لایههای امنیتی و کنترل بیشتری روی مدل ایجاد شود.
یکی از قابلیتهای جدید، Misalignment Monitoring است؛ سیستمی که در طول اجرای وظایف عامل، رفتار مدل را بررسی میکند و اگر احتمال دهد مدل دستور کاربر را بهدرستی تفسیر نکرده یا از محدوده مجاز خارج شده است، میتواند فرایند را متوقف یا برای بررسی کاربر متوقف کند.
OpenAI همچنین یک ارزیابی جدید را با الهام از حادثه اخیر مرتبط با Hugging Face انجام داده است. در آزمایش بدون محافظتهای تولیدی، GPT-5.6 Sol در 48% موارد از محدوده هدف تعیینشده خارج شد؛ Astra در همین ارزیابی این رفتار را در هیچیک از موارد آزمایششده نشان نداد.
با این حال، OpenAI یک نکته مهم دیگر را نیز مطرح کرده است: وقتی از Astra خواسته شد سیستمهای نظارتی را دور بزند، فرایند استدلال مکتوب آن در برخی شرایط سختتر از نسل قبلی قابل نظارت بود. بنابراین افزایش قابلیت و کاهش شفافیت در بعضی فرایندها همچنان یکی از چالشهای مهم مدلهای عامل محسوب میشود.
Astra برای کارهای حرفهای فقط یک چتبات نیست
یکی از اهداف OpenAI با GPT-6 Astra تبدیل مدل به ابزاری برای انجام کاملتر کارهای حرفهای است.
این مدل میتواند اسناد، فایلهای Excel و ارائههای PowerPoint را بر اساس قالبها و دستورالعملهای موجود تولید کند. همچنین OpenAI میگوید Astra در حفظ ساختار و سبک قالبهای موجود عملکرد بهتری دارد و میتواند اطلاعات مرتبط را از میان حجم زیادی از دادهها استخراج کند، بدون اینکه تمام اطلاعات موجود را بیدلیل وارد خروجی کند.
این قابلیت برای مشاغلی مانند تحلیل داده، مهندسی، طراحی، پژوهش و تولید محتوای حرفهای اهمیت دارد؛ زیرا کاربر میتواند بهجای دریافت یک پاسخ خام، نتیجهای نزدیکتر به یک خروجی نهایی دریافت کند.
OpenAI همچنین Astra را برای کارهای علمی معرفی کرده و میگوید مدل میتواند در کنار استدلال علمی، مستقیماً با نرمافزارهای تخصصی کار کند، دادهها را بررسی کند و نتایج را برای ادامه تحقیقات تحلیل کند.
GPT-6 Astra از چه زمانی در دسترس است؟
GPT-6 Astra در زمان معرفی ابتدا در اختیار مجموعه محدودی از سازمانها قرار گرفته و OpenAI اعلام کرده است که دسترسی آن طی روزهای بعد گسترش پیدا میکند.
این مدل برای کاربران ChatGPT Plus، Pro، Business و Enterprise عرضه خواهد شد و از طریق API نیز در دسترس قرار میگیرد. Astra همچنین از طریق Microsoft Azure و Amazon Bedrock ارائه خواهد شد. نسخه GPT-6 Astra Pro نیز برای کاربران Pro، Business و Enterprise در نظر گرفته شده است.
در API، قیمت استاندارد GPT-6 Astra برابر با $10 برای هر یک میلیون توکن ورودی و $50 برای هر یک میلیون توکن خروجی اعلام شده است. OpenAI برای پردازشهای سریعتر نیز Fast Mode را ارائه میکند که تا 2 برابر سرعت استاندارد را هدف میگیرد و هزینه آن 2 برابر نرخ استاندارد است.
از سوی دیگر، دسترسی به پیشرفتهترین قابلیتهای امنیت سایبری Astra محدودتر خواهد بود. OpenAI پیشتر اعلام کرده بود که این قابلیتها ابتدا در اختیار گروه محدودی از آزمایشکنندگان قرار میگیرند و سپس از طریق برنامههایی مانند Daybreak برای کاربردهای دفاعی گسترش خواهند یافت.
به این ترتیب، GPT-6 Astra را میتوان یکی از مهمترین گامهای OpenAI به سمت AI Agentهای واقعاً عملیاتی دانست؛ مدلهایی که هدفشان فقط پاسخ دادن نیست، بلکه فهم یک هدف، کار با ابزارها، استفاده از کامپیوتر و انجام زنجیرهای از اقدامات برای رسیدن به نتیجه نهایی است. در عین حال، سطح جدید تواناییهای Astra نشان میدهد که مسئله امنیت و کنترل مدلهای عامل دیگر یک موضوع جانبی نیست و همزمان با افزایش قدرت مدل، به یکی از اصلیترین بخشهای توسعه آن تبدیل شده است.