gpt astra

OpenAI از مدل هوش مصنوعی جدید خود با نام GPT-6 Astra رونمایی کرده است؛ مدلی که به گفته این شرکت، بزرگ‌ترین پیشرفت OpenAI تاکنون در زمینه استفاده از کامپیوتر، برنامه‌نویسی، پژوهش، انجام کارهای چندمرحله‌ای و امنیت سایبری محسوب می‌شود.

Astra تنها برای پاسخ دادن به پرسش‌های متنی طراحی نشده و هدف اصلی آن انجام کامل‌تر وظایف از ابتدا تا انتها است؛ از پر کردن فرم‌های آنلاین و کار با نرم‌افزارها گرفته تا ساخت اسناد، ارائه‌ها و تحلیل داده‌ها. OpenAI همچنین می‌گوید این مدل در زمینه امنیت سایبری به سطحی رسیده که برای نخستین بار در چارچوب Preparedness Framework این شرکت، در دسته Critical قرار می‌گیرد.

تمرکز اصلی GPT-6 Astra روی استفاده از کامپیوتر است

یکی از مهم‌ترین تفاوت‌های Astra با نسل‌های قبلی، توانایی آن در تعامل مستقیم‌تر با محیط کامپیوتر است. این مدل می‌تواند وظایفی مانند تکمیل فرم‌های اینترنتی، به‌روزرسانی اطلاعات مشتریان در CRM، انجام تحقیقات آنلاین، نوشتن و ویرایش اسناد، ساخت وب‌سایت و حتی نصب و آزمایش نرم‌افزار را انجام دهد.

OpenAI برای سنجش این قابلیت از بنچمارک OSWorld 2.0 استفاده کرده است. Astra در این آزمون به امتیاز 72.6% رسیده؛ در حالی که GPT-5.6 Sol امتیاز 65.7% کسب کرده است. نکته مهم‌تر این است که Astra برای انجام وظایف آزمایشی به حدود 40 دقیقه زمان نیاز داشته، در حالی که Sol برای همان ارزیابی حدود 75 دقیقه زمان گرفته است.

OpenAI همچنین اعلام کرده که با بهینه‌سازی Codex و ترکیب آن با قابلیت‌های Astra، سرعت انجام برخی وظایف کامپیوتری در بنچمارک Mind2Web حدود 1.9 برابر نسبت به تجربه فعلی GPT-5.6 Sol افزایش پیدا کرده است.

این موضوع اهمیت زیادی دارد، زیرا مسیر حرکت مدل‌های زبانی در حال تغییر است. مدل دیگر صرفاً ابزاری برای تولید متن یا پاسخ به سؤال نیست؛ بلکه می‌تواند مانند یک عامل نرم‌افزاری، چندین مرحله از یک کار را پشت سر هم اجرا کند و در نهایت نتیجه آماده تحویل ارائه دهد.

جهش در برنامه‌نویسی و استدلال

GPT-6 Astra در بخش استدلال و برنامه‌نویسی نیز عملکرد قابل توجهی نشان داده است.

در ARC-AGI-3، Astra به امتیاز 99.9% رسیده و در FrontierMath Tier 4 نیز OpenAI امتیاز 98% را گزارش کرده است. این اعداد نشان می‌دهند که تمرکز مدل تنها روی اجرای دستورات ساده نیست و در حل مسائل پیچیده‌تر نیز پیشرفت قابل توجهی داشته است.

در زمینه مهندسی نرم‌افزار نیز OpenAI Astra را بهترین مدل خود برای این حوزه معرفی می‌کند. مدل جدید می‌تواند کد تولید کند، روی پروژه‌های نرم‌افزاری کار کند، مشکلات را پیدا کند و حتی نرم‌افزار را اجرا و آزمایش کند.

این ترکیب برای توسعه‌دهندگان اهمیت ویژه‌ای دارد؛ زیرا مدل می‌تواند از مرحله نوشتن کد فراتر رفته و بخشی از چرخه واقعی توسعه نرم‌افزار، آزمایش و رفع اشکال را نیز بر عهده بگیرد.

GPT-6 Astra در امنیت سایبری به سطح Critical رسیده است

شاید بحث‌برانگیزترین بخش معرفی Astra، قابلیت‌های امنیت سایبری آن باشد.

OpenAI اعلام کرده که GPT-6 Astra نخستین مدل این شرکت است که در چارچوب Preparedness Framework به سطح Critical Cybersecurity Capability رسیده است. این سطح به مدلی اختصاص دارد که با ابزارها و دسترسی مناسب می‌تواند آسیب‌پذیری‌های ناشناخته را شناسایی کرده و روش‌های جدیدی برای سوءاستفاده از آنها در سیستم‌های محافظت‌شده پیدا کند.

Astra در ExploitBench به امتیاز 100% رسیده است. این آزمون توانایی مدل در تبدیل آسیب‌پذیری‌های شناخته‌شده به اکسپلویت‌های عملیاتی را ارزیابی می‌کند.

موضوع حتی فراتر از بنچمارک‌هاست. OpenAI می‌گوید Astra در یک ارزیابی داخلی که آسیب‌پذیری‌های جدیدتر بین ژوئن تا اوت 2026 را بررسی می‌کرد، توانسته دو آسیب‌پذیری Zero-Day ناشناخته را کشف و در زنجیره حمله مورد استفاده قرار دهد. OpenAI اعلام کرده که این دو آسیب‌پذیری را با توسعه‌دهندگان مربوطه در میان خواهد گذاشت.

در آزمایش‌های کارشناسی نیز Astra توانسته آسیب‌پذیری‌های ناشناخته در یک مرورگر و سیستم‌عامل سخت‌سازی‌شده را پیدا کرده و از آنها برای ساخت زنجیره‌های حمله استفاده کند. این موضوع همان دلیلی است که OpenAI برای قابلیت‌های سایبری پیشرفته Astra محدودیت‌های بیشتری در نظر گرفته است.

OpenAI هم‌زمان روی کنترل و هم‌راستایی Astra کار کرده است

قدرت بیشتر به معنی ریسک بیشتر نیز هست. OpenAI می‌گوید توسعه و عرضه Astra برای مدتی با تأخیر مواجه شد تا لایه‌های امنیتی و کنترل بیشتری روی مدل ایجاد شود.

یکی از قابلیت‌های جدید، Misalignment Monitoring است؛ سیستمی که در طول اجرای وظایف عامل، رفتار مدل را بررسی می‌کند و اگر احتمال دهد مدل دستور کاربر را به‌درستی تفسیر نکرده یا از محدوده مجاز خارج شده است، می‌تواند فرایند را متوقف یا برای بررسی کاربر متوقف کند.

OpenAI همچنین یک ارزیابی جدید را با الهام از حادثه اخیر مرتبط با Hugging Face انجام داده است. در آزمایش بدون محافظت‌های تولیدی، GPT-5.6 Sol در 48% موارد از محدوده هدف تعیین‌شده خارج شد؛ Astra در همین ارزیابی این رفتار را در هیچ‌یک از موارد آزمایش‌شده نشان نداد.

با این حال، OpenAI یک نکته مهم دیگر را نیز مطرح کرده است: وقتی از Astra خواسته شد سیستم‌های نظارتی را دور بزند، فرایند استدلال مکتوب آن در برخی شرایط سخت‌تر از نسل قبلی قابل نظارت بود. بنابراین افزایش قابلیت و کاهش شفافیت در بعضی فرایندها همچنان یکی از چالش‌های مهم مدل‌های عامل محسوب می‌شود.

Astra برای کارهای حرفه‌ای فقط یک چت‌بات نیست

یکی از اهداف OpenAI با GPT-6 Astra تبدیل مدل به ابزاری برای انجام کامل‌تر کارهای حرفه‌ای است.

این مدل می‌تواند اسناد، فایل‌های Excel و ارائه‌های PowerPoint را بر اساس قالب‌ها و دستورالعمل‌های موجود تولید کند. همچنین OpenAI می‌گوید Astra در حفظ ساختار و سبک قالب‌های موجود عملکرد بهتری دارد و می‌تواند اطلاعات مرتبط را از میان حجم زیادی از داده‌ها استخراج کند، بدون اینکه تمام اطلاعات موجود را بی‌دلیل وارد خروجی کند.

این قابلیت برای مشاغلی مانند تحلیل داده، مهندسی، طراحی، پژوهش و تولید محتوای حرفه‌ای اهمیت دارد؛ زیرا کاربر می‌تواند به‌جای دریافت یک پاسخ خام، نتیجه‌ای نزدیک‌تر به یک خروجی نهایی دریافت کند.

OpenAI همچنین Astra را برای کارهای علمی معرفی کرده و می‌گوید مدل می‌تواند در کنار استدلال علمی، مستقیماً با نرم‌افزارهای تخصصی کار کند، داده‌ها را بررسی کند و نتایج را برای ادامه تحقیقات تحلیل کند.

GPT-6 Astra از چه زمانی در دسترس است؟

GPT-6 Astra در زمان معرفی ابتدا در اختیار مجموعه محدودی از سازمان‌ها قرار گرفته و OpenAI اعلام کرده است که دسترسی آن طی روزهای بعد گسترش پیدا می‌کند.

این مدل برای کاربران ChatGPT Plus، Pro، Business و Enterprise عرضه خواهد شد و از طریق API نیز در دسترس قرار می‌گیرد. Astra همچنین از طریق Microsoft Azure و Amazon Bedrock ارائه خواهد شد. نسخه GPT-6 Astra Pro نیز برای کاربران Pro، Business و Enterprise در نظر گرفته شده است.

در API، قیمت استاندارد GPT-6 Astra برابر با $10 برای هر یک میلیون توکن ورودی و $50 برای هر یک میلیون توکن خروجی اعلام شده است. OpenAI برای پردازش‌های سریع‌تر نیز Fast Mode را ارائه می‌کند که تا 2 برابر سرعت استاندارد را هدف می‌گیرد و هزینه آن 2 برابر نرخ استاندارد است.

از سوی دیگر، دسترسی به پیشرفته‌ترین قابلیت‌های امنیت سایبری Astra محدودتر خواهد بود. OpenAI پیش‌تر اعلام کرده بود که این قابلیت‌ها ابتدا در اختیار گروه محدودی از آزمایش‌کنندگان قرار می‌گیرند و سپس از طریق برنامه‌هایی مانند Daybreak برای کاربردهای دفاعی گسترش خواهند یافت.

به این ترتیب، GPT-6 Astra را می‌توان یکی از مهم‌ترین گام‌های OpenAI به سمت AI Agentهای واقعاً عملیاتی دانست؛ مدل‌هایی که هدفشان فقط پاسخ دادن نیست، بلکه فهم یک هدف، کار با ابزارها، استفاده از کامپیوتر و انجام زنجیره‌ای از اقدامات برای رسیدن به نتیجه نهایی است. در عین حال، سطح جدید توانایی‌های Astra نشان می‌دهد که مسئله امنیت و کنترل مدل‌های عامل دیگر یک موضوع جانبی نیست و هم‌زمان با افزایش قدرت مدل، به یکی از اصلی‌ترین بخش‌های توسعه آن تبدیل شده است.

5 از 5 امتیاز