OpenAI در DevDay روز ۲۹ سپتامبر ۲۰۲۶، دسترسی به GPT-6 Astra Ultrafast را معرفی کرد؛ سطح پردازشی سریعتری برای کارهایی که زمان انتظار در آنها اهمیت دارد. در جمعبندی رسمی رویداد، سرعت تولید توکن در Codex تا ۸ برابر و تا ۳۰۰ توکن در ثانیه اعلام شده است. این عدد دربارهٔ تولید توکن است، نه تضمین پایانیافتن هر پروژه با سرعت هشتبرابری.
Ultrafast چیست و چه تفاوتی با Fast دارد؟
Ultrafast یک سطح سرعت برای مدل است؛ مدل مستقلی به نام «Ultra Fast» نیست. راهنمای سرعت OpenAI آن را جدا از Fast mode توضیح میدهد. انتخاب سطح سرعت هم با انتخاب میزان استدلال تفاوت دارد: سریعتر رسیدن توکنها لزوماً به معنی فکرکردن بیشتر یا پاسخ دقیقتر نیست.
همچنین نباید Ultrafast را با گزینهٔ Ultra در تنظیمات استدلال یکسان گرفت. برای تشخیص اینکه چه چیزی را تغییر میدهید، نام مدل، سطح سرعت و تنظیم استدلال را جداگانه بررسی کنید. این تفکیک هنگام مقایسهٔ مصرف و نتیجه اهمیت دارد؛ دو اجرای ظاهراً مشابه ممکن است تنظیمات متفاوتی داشته باشند.
چه حسابهایی به Astra Ultrafast دسترسی دارند؟
راهنمای Work و Codex، دسترسی را برای Pro ماهانهٔ ۵۰۰ دلاری و فضاهای واجد شرایط Enterprise و Edu ذکر میکند. پلنهای سلفسرویس دیگر در شروع عرضه با خرید اعتبار هم Ultrafast نمیگیرند. در Enterprise، دسترسی بهطور پیشفرض خاموش است و مدیر باید آن را برای افراد یا فضای کاری فعال کند.
برای Astra، مصرف Ultrafast از سهمیهٔ اشتراک با ضریب ۸ برابر Standard محاسبه میشود؛ اعتبار خریداریشده و مصرف پرداختبهمیزاناستفادهٔ Enterprise ضریب ۶ برابر دارند، با لحاظ قرارداد سازمان. این ضرایب مربوط به مصرف و صورتحساباند و نباید بهعنوان ضریب افزایش سرعت خوانده شوند.
وضعیت API چگونه است؟
طبق مستندات Ultrafast در API، این سطح برای GPT-6 Astra بهصورت گسترده با محدودیت نرخ اولیه ارائه شده است. شناسهٔ مدل همان gpt-6-astra میماند و سطح سرویس با service_tier: ultrafast انتخاب میشود. OpenAI برای گردشکارهای ایجنتی با فراخوانی ابزارهای پیاپی، استفاده از اتصال پایدار WebSocket را توصیه میکند.
پشتیبانی اقامت داده نیز محدود است: پردازش جهانی و اقامت دادهٔ آمریکا پشتیبانی میشوند، اما endpointهای پردازش منطقهای اتحادیهٔ اروپا و دیگر مناطق خارج از آمریکا پشتیبانی نمیشوند. هزینهٔ API باید از جدول تعرفهٔ خودش خوانده شود؛ ضرایب اعتبار ChatGPT را نباید مستقیماً روی API اعمال کرد.
چه زمانی سرعت بیشتر ارزش دارد؟
در یک سناریوی پیشنهادی، توسعهدهندهای که منتظر چند دور اصلاح کد است ممکن است از کوتاهشدن زمان تولید پاسخ سود ببرد. اما اگر بیشتر زمان کار صرف جستوجو، اجرای تست یا پاسخ ابزار بیرونی شود، افزایش سرعت توکن تمام آن تأخیرها را حذف نمیکند. معیار مناسب، زمان رسیدن به نتیجهٔ درست همراه با هزینهٔ آن است.
نسخهٔ Ultrafast برای GPT-6.1 Sol در زمان خبر «بهزودی» اعلام شده است. ارائهٔ Ultrafast برای Astra هم به معنی عرضهٔ یک Astra جدید یا فعالشدن آن در گپجیپیتی نیست. این مطلب گزارش قابلیت رسمی OpenAI است.
مطالعهٔ مرتبط: راهنمای GPT-6 Astra و قابلیتهای آن.
از دیگر معرفیهای DevDay: GPT-6.1 Sol معرفی شد؛ نزدیک به Astra با قیمت توکن کمتر.
منابع خبر
تاریخ انتشار منبع اصلی:
ناشر: گپجیپیتی · سیاست تحریریه و اصلاحات · تماس با تحریریه
سوالی درباره این مقاله دارید؟
همین موضوع را با هوش مصنوعی فارسی ادامه دهید و جواب شخصیتر بگیرید.