به گزارش ایسنا، شرکت اوپنایآی کمی کمتر از دو ماه پس از انتشار عمومی آخرین خانواده مدل اصلی خود موسوم به GPT-5.6 Sol، Terra و Luna، حالا با یک مدل کاملاً جدید به نام «GPT-6 Astra» بازگشته است؛ مدلی که ادعا میکند «باهوشترین و همسوترین مدل در جهان» است.
پس از تصمیم این شرکت برای کند کردن توسعه این مدل پیشگام در ماه اوت، پس از هک شدن پلتفرم هوش مصنوعی Hugging Face توسط یکی از مدلهایش، این مدل ممکن است آخرین مدل اصلی هوش مصنوعی باشد که تا مدتی منتشر میکند.
به گفته OpenAI، مدل «GPT-6 Astra» در استفاده از کامپیوتر و مرور وب و انجام وظایف در حوزههای مهندسی نرمافزار، امنیت سایبری، علوم و کارهای حرفهای عمومی عالی است.
یک ویدیوی نمایشی پر زرق و برق که این شرکت همزمان با رونمایی منتشر کرد، نشان میدهد که Astra همه چیز را از مدلسازی سهبعدی گرفته تا ساخت اسلایدشوها انجام میدهد و اغلب چندین کار را در حوزههای مختلف، مانند سفارش غذا هنگام کدنویسی یک بازی به طور همزمان انجام میدهد.
کلید جذابیت آسترا، توانایی آن در مدیریت این گردشهای کاری چند مرحلهای روی رایانه و داخل و خارج از مرورگر است. OpenAI میگوید که این سیستم همچنین قادر است این وظایف پیچیده را با «قضاوت بصری قوی» و بدون انحراف از مسیر یا دستورالعمل اصلی خود انجام دهد.
مانند سایر مدلهای عرضه شده، این شرکت مجموعهای جدید از معیارها را برای توجیه تواناییهای بهبودیافته آسترا ارائه کرده است، از جمله امتیاز ۹۸.۶ درصد در ARC-AGI-3 که یکی از معیارهای صنعت هوش مصنوعی برای اندازهگیری توانایی هوش مصنوعی در حل مسائل ناآشنا است.
پیشرفتهای دیگر واضحتر هستند؛ آسترا در Terminal Bench 4.0 که یک معیار کدنویسی است، امتیاز ۵۷.۷ درصد و در Agent's Last Exam که معیاری برای اندازهگیری قابلیتهای عامل هوش مصنوعی است، امتیاز ۵۹.۳ درصد را کسب کرد که به طور قابل توجهی بالاتر از GPT-5.6 Sol است.
اوپنایآی معیارهای بیشتری را در اطلاعیه خود گنجانده است، اما به طور خلاصه، آسترا اکنون از نظر عملکرد در صدر اکثر جدولهای رتبهبندی قرار دارد.
این موضوع سوال بزرگتری را مطرح میکند که آیا میتوان از این مدل هوش مصنوعی به طور مسئولانه استفاده کرد یا خیر. به عنوان مثال، آسترا به طور خاص در امنیت سایبری مهارت دارد. اوپنایآی میگوید که این مدل در ExploitBench، معیاری برای تعیین توانایی یک مدل در بهرهبرداری از آسیبپذیریهای نرمافزاری، امتیاز کاملی کسب کرده است که جهش بزرگی نسبت به امتیاز ۷۸.۵ درصدی GPT-5.6 Sol است.
این شرکت همچنین آسترا را روی SRE-Bench، معیاری که توانایی مدل را در مهندسی معکوس فایلهای باینری نرمافزار بدون کد منبع خام اندازهگیری میکند، آزمایش کرد و دریافت که «آسترا ۸۸ درصد از وظایف را در یک تلاش و ۹۹.۲ درصد را در چهار تلاش حل کرد، در حالی که این مقادیر برای GPT-5.6 Sol به ترتیب ۵۵.۹ و ۶۸.۷ درصد بود.
همترازی بهبود یافته آسترا که همه چیز را از توانایی آن در دنبال کردن الگوها گرفته تا توانایی آن در صحبت شفافتر پوشش میدهد، باید ایمنی را نیز بهبود بخشد، اما اوپنایآی میگوید که این مدل را طوری ساخته است که با وظایف پیشرفته امنیت سایبری مطابقت نداشته باشد. این شرکت میگوید که محافظتهای قویتر به آسترا کمک میکنند تا در برابر درخواستهای جیلبریک بهتر مقاومت کند و در عین حال توانایی شرکت را در نظارت بر سوءاستفاده بهبود بخشد.
اوپنایآی میگوید که آسترا امروز برای تعداد محدودی از سازمانها عرضه میشود و طی روزهای آینده برای همه کاربران ChatGPT Plus، Pro، Business و Enterprise و همچنین از طریق OpenAI API و AWS در دسترس قرار خواهد گرفت.
هزینه آسترا برای توسعهدهندگانی که از API اوپنایآی استفاده میکنند، برای هر میلیون توکن ورودی ۱۰ دلار و برای هر میلیون توکن خروجی ۵۰ دلار است.
این موضوع، آسترا را در رده مدلهای گرانقیمت هوش مصنوعی قرار میدهد، اگرچه اوپنایآی معتقد است که توکنها ممکن است بهترین معیار برای کسبوکارهایی که به دنبال خرید دسترسی هستند، نباشند.
گرگ بروکمن(Greg Brockman)، رئیس اوپنایآی گفت: موضوع این است که آیا میتوانید کار را با هزینه مناسب و سرعت مناسب انجام دهید؟ وعده بزرگ اوپنایآی این است که «آسترا» برای طیف گستردهای از کسبوکارها میتواند این کار را انجام دهد.
انتهای پیام