GPT-6 Astra – برترین فا
OpenAI از GPT-6 Astra بهعنوان «هوشمندترین و همراستاترین مدل جهان» رونمایی کرد. این مدل حاصل سالها پژوهش و سرمایهگذاری گسترده در حوزههای پیشآموزش، یادگیری تقویتی و همراستاسازی (Alignment) است و در زمینههایی از جمله استفاده از رایانه، مرور وب، مهندسی نرمافزار، امنیت سایبری، علوم و فعالیتهای حرفهای، عملکردی در سطح پیشرفته ارائه میدهد.
Astra در ارزیابی FrontierMath Tier 4 به امتیاز ۹۸ درصد رسیده و به حل برخی مسائل دیرینه و باز ریاضی کمک کرده است. این مدل همچنین در ARC-AGI-3 امتیاز ۹۹.۹ درصد و در ExploitBench امتیاز کامل ۱۰۰ درصد را کسب کرده است. به گفته OpenAI، Astra در استفاده از رایانه و مرورگر نیز مرزهای جدیدی از سرعت، دقت و قضاوت را تعیین میکند و برای انجام فعالیتهای حرفهای پیچیده طراحی شده است.
GPT-6 Astra ابتدا برای گروه محدودی از سازمانها عرضه میشود و طی روزهای آینده در اختیار کاربران ChatGPT Plus، Pro، Business و Enterprise و همچنین از طریق OpenAI API، Microsoft Azure و AWS Bedrock قرار خواهد گرفت.












مدل جدید برای استفاده از رایانه
یکی از مهمترین پیشرفتهای Astra، توانایی آن در استفاده از رایانه است. این مدل میتواند کارهای روزمره و زمانبر مانند تکمیل فرمهای آنلاین، بهروزرسانی سوابق مشتریان در CRM و سازماندهی تقویم را انجام دهد. همچنین قادر است پژوهش آنلاین انجام دهد و خلاصههای آن را در ایمیل یا ویرایشگر اسناد آماده کند.
Astra میتواند دادههای علمی را تحلیل، نمودار تولید، وبسایت ایجاد و آزمونهای کنترل کیفیت فرانتاند را اجرا کند تا عملکرد قابلیتهای سایت بررسی شود. همچنین میتواند در نصب و آزمایش نرمافزار و عیبیابی مشکلاتی که روی صفحه مشاهده میشوند، بهصورت خودکار کمک کند.
در شبیهسازیهای OSWorld 2.0، Astra در حدود ۴۷ درصد زمان کمتر برای هر وظیفه، عملکرد بالاتری نسبت به GPT-5.6 Sol نشان داده است. Astra با امتیاز ۷۲.۶ درصد، هر وظیفه را در حدود ۴۰ دقیقه انجام داده، درحالیکه GPT-5.6 Sol با امتیاز ۶۵.۷ درصد حدود ۷۵ دقیقه زمان نیاز داشته است. ترکیب Astra با نسخه بهروزشده Codex نیز در بنچمارک Mind2Web به تکمیل وظایف با سرعت ۱.۹ برابر بیشتر نسبت به تجربه فعلی GPT-5.6 Sol منجر شده است.
جهشی در کار حرفهای
Astra علاوه بر توانایی استفاده از رایانه، برای محیطهای حرفهای نیز آموزش هدفمند دیده است. این مدل میتواند مسائل پیچیده را حل کند، جریانهای کاری چندمرحلهای را اجرا کند و اسناد، صفحات گسترده و ارائههای آماده استفاده تولید کند.
Astra در پیروی از قالبهای موجود و تولید اسلایدهایی با چیدمان مناسب، مختصر و دارای روایت ساختاریافته عملکرد بهتری دارد. مدل میتواند اسناد، ارائهها، صفحات گسترده و تحلیلهایی ایجاد کند که با قالبهای سازمانی، سبک نگارش و سبک بصری موردنظر مطابقت داشته باشند. همچنین آموزش دیده است تا فقط اطلاعات مرتبط با خروجی را وارد کند و از تکرار اطلاعات غیرضروری پرهیز کند.
در شرایطی که دستورالعملها جای تفسیر داشته باشند، Astra نسبت به مدلهای قبلی در تصمیمگیری عملکرد بهتری دارد. این مدل از زمینه موجود برای پر کردن خلأهای معمول استفاده میکند و زمانی که یک ابهام میتواند نتیجه را تغییر دهد، سؤال مشخصی مطرح میکند. در Codex، حتی میتواند بهصورت غیرهمزمان سؤال بپرسد و همزمان کارهایی را که به پاسخ کاربر وابسته نیستند ادامه دهد. در تصمیمهای مهم منتظر ورودی کاربر میماند و در موارد مناسب، با فرضهای منطقی کار را ادامه میدهد.
Astra همچنین بهتر میتواند در طول تغییر مسیر یک پروژه، هدف اصلی و محدودیتهای قبلی را حفظ کند. این مدل الزامات جدید را در نظر میگیرد، در صورت درخواست مسیر خود را تغییر میدهد و به پرسشهای جانبی پاسخ میدهد، بدون آنکه هدف کلی کار را از دست بدهد.
مهندسی نرمافزار و علوم
OpenAI، مدلل GPT-6 Astra را بهترین مدل خود برای مهندسی نرمافزار معرفی میکند. در Codex، روش جدیدی برای حفظ و بازیابی زمینه هنگام پر شدن پنجره زمینه ارائه شده است. برخلاف فشردهسازی سنتی که ممکن است جزئیاتی مانند علت شکست یک راهحل یا رفتار یک مؤلفه را حذف کند، Astra میتواند یادداشتهایی را میان پنجرههای زمینه حفظ کند. پنجرههای قبلی نیز قابل جستوجو باقی میمانند و مدل میتواند الزامات، نتایج آزمونها و خروجی ابزارهای قبلی را بازیابی کند.
در حوزه کشف علمی، ریاضیات و سلامت نیز Astra نتایج جدیدی ارائه کرده و رکوردهای تازهای در مجموعهای از ارزیابیهای ریاضی و علمی به ثبت رسانده است. این مدل میتواند با ترکیب استدلال علمی و استفاده از رایانه، مستقیماً با نرمافزارهای تخصصی کار کند، دادهها را بررسی و نتایج را کاوش کند و به پژوهشگران در ارزیابی شواهد و انتخاب مسیر تحقیقات بعدی کمک کند.
امنیت سایبری؛ توانایی بیشتر و ضرورت محافظت بیشتر
OpenAI میگوید Astra در قابلیتهای سایبری جهش قابلتوجهی داشته و در چارچوب Preparedness Framework به آستانه بحرانی رسیده است. توانایی شناسایی و توسعه اکسپلویتهای zero-day میتواند به مدافعان برای یافتن و برطرفکردن آسیبپذیریها کمک کند، اما همزمان نیاز به سازوکارهای حفاظتی قویتر را افزایش میدهد.
در ExploitBench، Astra بدون سازوکارهای حفاظتی تولیدی، امتیاز کامل ۱۰۰ درصد کسب کرد؛ درحالیکه GPT-5.6 Sol امتیاز ۷۸.۵ درصد داشت. در ExploitGym نیز Astra به نرخ موفقیت ۴۲.۴ درصد رسید، در برابر ۳۰.۳ درصد برای GPT-5.6 Sol، آن هم با استفاده از توکنهای خروجی بهمراتب کمتر.
در یک ارزیابی داخلی با آسیبپذیریهای سه ماه گذشته، Astra نرخ اجرای کد دلخواه بالاتری نسبت به GPT-5.6 Sol داشت و در جریان ارزیابی دو آسیبپذیری zero-day ناشناخته را کشف و مورداستفاده قرار داد. OpenAI اعلام کرده این دو آسیبپذیری را به نگهدارندگان مربوطه گزارش کرده است.
در SRE-Bench، Astra در تلاش اول ۸۸ درصد و در چهار تلاش ۹۹.۲ درصد وظایف را حل کرد؛ در مقابل، GPT-5.6 Sol به ترتیب ۵۵.۹ و ۶۸.۷ درصد کسب کرد.
با وجود این قابلیتها، نسخه عرضهشده Astra از انجام برخی فعالیتهای پیشرفته سایبری، مانند ایجاد اکسپلویت اثبات مفهومی، خودداری میکند. OpenAI همچنین اعلام کرده قصد دارد در هفتههای آینده از طریق OpenAI Daybreak دسترسی گستردهتر و سازوکارهای حفاظتی کممحدودیتتری برای جریانهای کاری دفاعی ارائه کند.
همراستاسازی و استقرار مسئولانه
OpenAI مدل Astra را همراستاترین مدل خود معرفی میکند؛ مدلی که در رعایت مرزهای وظیفه، توجه به ریسک و ارتباط شفاف با کاربر بهبود یافته است. در یک ارزیابی از وظایف رایانهای طراحیشده برای تحریک رفتار نامطلوب، Astra در جلوگیری از پیامدهای ناخواسته عملکرد بهتری داشت. در یک ارزیابی داخلی، Astra هرگز تلاش نکرد محدودیت ردشده توسط Codex Auto-Review را دور بزند؛ حتی زمانی که این محدودیت عمداً قابل دورزدن تنظیم شده بود و بدون دورزدن آن، تکمیل وظیفه ممکن نبود.
Astra همچنین نسبت به GPT-5.6 Sol سه برابر کمتر احتمال دارد درباره قابلیتها و امکانات خود ادعاهای نادرست ارائه کند. بااینحال، ارزیابیها نشان دادهاند که استدلال نوشتاری Astra در آزمونهایی که مدل را به فرار از نظارت وادار میکردند، دشوارتر از GPT-5.6 Sol قابلپایش است. OpenAI این موضوع را جدی میداند و بهبود قابلیت پایشپذیری را همچنان یک اولویت پژوهشی عنوان کرده است.
برای کنترل رفتارهای ناایمن، علاوه بر آموزش همراستاسازی، سازوکارهایی مانند Codex Auto-Review و سیستمهای پایش استدلال و اقدامات مدل نیز به کار گرفته میشوند. OpenAI همچنین برای مدلهای کلاس Astra، پایش ناممراستایی را در محیط تولید مستقر میکند؛ این سامانهها با استفاده از طبقهبندیکنندهها، استدلال و اقدامات مدل را برای شناسایی رفتارهای غیرمجاز بررسی کرده و در صورت لزوم فعالیت را متوقف میکنند.
عرضه و قیمتگذاری
GPT-6 Astra برای کاربران اشتراکی Plus، Pro، Business و Enterprise عرضه خواهد شد و کاربران Pro، Business و Enterprise به GPT-6 Astra Pro نیز دسترسی خواهند داشت. مدیران Enterprise میتوانند Astra را برای فضای کاری خود فعال کنند، اما دسترسی در زمان عرضه بهصورت پیشفرض غیرفعال است.
برای توسعهدهندگان، مدل با نام gpt-6-astra در OpenAI API و همچنین از طریق Microsoft Azure و Amazon Bedrock در دسترس خواهد بود. قیمت استاندارد API برابر با ۱۰ دلار بهازای هر یک میلیون توکن ورودی و ۵۰ دلار بهازای هر یک میلیون توکن خروجی اعلام شده است. نرخهای جداگانهای برای خواندن و نوشتن cache وجود دارد. حالت Fast نیز با سرعتی تا دو برابر پردازش استاندارد و با هزینهای دو برابر ارائه میشود.