xAI از Grok 4.5، قویترین مدل خود، با پنجره زمینه ۵۰۰,۰۰۰ Token رونمایی کرد

xAI در ۸ جولای ۲۰۲۶ از Grok 4.5 رونمایی کرد و آن را قویترین مدل خود تا به امروز خواند. این مدل با آموزش بر روی دهها هزار GPU Nvidia GB300 و بر اساس مدل پایه جدیدی با ۱.۵ تریلیون پارامتر که xAI آن را V9 مینامد، ساخته شده است. این مدل اکنون در Grok Build، تمام طرحهای Cursor و از طریق کنسول API xAI در دسترس است.
قابلیتهای مدل
Grok 4.5 از پنجره زمینه ۵۰۰,۰۰۰ Token به همراه ورودی متن و تصویر، فراخوانی تابع، خروجی ساختاریافته، جستجوی وب و X، اجرای کد و عمق استدلال قابل تنظیم پشتیبانی میکند. xAI آن را با سرعت تقریبی ۸۰ Token در ثانیه ارائه میدهد و این شرکت ادعا میکند بازده Token آن در وظایف مشابه دو برابر مدلهای پیشرو رقیب است — به این معنا که میتواند نتایج معادل را با مصرف Token کمتر تولید کند، که هزینه مؤثر یک وظیفه مشخص را حتی قبل از در نظر گرفتن قیمت اسمی کاهش میدهد.
قیمتگذاری به صورت ۲ دلار به ازای هر میلیون Token ورودی و ۶ دلار به ازای هر میلیون Token خروجی تعیین شده است، با تخفیف ۰.۵۰ دلار به ازای هر میلیون Token برای ورودی ذخیرهشده در حافظه پنهان و نرخهای بالاتر پس از عبور درخواست از ۲۰۰,۰۰۰ Token.
نتایج بنچمارک، با برخی ملاحظات
xAI مدل Grok 4.5 را عمدتاً به عنوان یک مدل کدنویسی و کار عاملی (Agentic) معرفی میکند. در بنچمارک SWE Marathon — آزمونی برای وظایف پایدار و چندمرحلهای مهندسی نرمافزار — Grok 4.5 نرخ حل ۲۹.۰% (Pass@1) ثبت کرده است که بالاتر از Opus 4.8 شرکت Anthropic با ۲۶.۰% و مدل قبلی خود xAI یعنی Fable با ۲۴.۰% است. این مدل همچنین در بنچمارکهای DeepSWE 1.0 (۶۲.۰%) و Terminal-Bench 2.1 (۸۳.۳%) پیشتاز است.
با این حال، این پیشتازی فراگیر نیست. از چهار بنچمارکی که xAI همزمان با عرضه منتشر کرده است، Grok 4.5 دو مورد را میبرد و دو مورد را به Opus 4.8 واگذار میکند — شکافی که نشان میدهد این مدل در گردشهای کاری خاص کدنویسی یک گام رو به جلو است، نه بهبودی همهجانبه بر تمام رقبا در همه وظایف.
شکاف دردسترسبودن در اتحادیه اروپا
Grok 4.5 هنوز برای کاربران اروپایی، چه از طریق محصولات خود xAI و چه از طریق کنسول API آن، در دسترس نیست. xAI اعلام کرده است دسترسی در اتحادیه اروپا انتظار میرود در اواسط جولای فراهم شود، بدون ذکر تاریخ دقیق. این تأخیر Grok 4.5 را در کنار الگوی عرضه مدلهای هوش مصنوعی در سال ۲۰۲۶ قرار میدهد که در آن بررسیهای نظارتی — چه بررسیهای انطباق با قانون هوش مصنوعی اتحادیه اروپا و چه فرآیندهای مشابه — تاریخ عرضه اولیه مدل را از زمان دردسترسبودن آن در اروپا به میزان چند روز تا چند هفته جدا کرده است.
زمینه رقابتی
این انتشار در همان هفتهای انجام میشود که OpenAI در حال تکمیل عرضه تدریجی خانواده GPT-5.6 خود (Sol, Terra, Luna) است و بر Anthropic فشار وارد میکند، زیرا Opus 4.8 همچنان در دو بنچمارک از چهار بنچمارک انتخابشده توسط xAI رقابتی باقی مانده است. برای توسعهدهندگانی که بین مدلهای کدنویسی پیشرو انتخاب میکنند، نتیجه عملی این است که در حال حاضر هیچ مدل واحدی در همه زمینهها پیشتاز نیست — نتایج Grok 4.5 در SWE Marathon و Terminal-Bench آن را برای وظایف خاص کدنویسی عاملی گزینهای قوی میسازد، در حالی که Opus 4.8 در بنچمارکهایی که xAI برنده نشده است همچنان جلوتر است.
Originally reported by xAI. Read the original article for additional details.
View original source