xAI از Grok 4.5، قوی‌ترین مدل خود، با پنجره زمینه ۵۰۰,۰۰۰ Token رونمایی کرد

xAI
اشتراک‌گذاری:
xAI از Grok 4.5، قوی‌ترین مدل خود، با پنجره زمینه ۵۰۰,۰۰۰ Token رونمایی کرد

xAI در ۸ جولای ۲۰۲۶ از Grok 4.5 رونمایی کرد و آن را قوی‌ترین مدل خود تا به امروز خواند. این مدل با آموزش بر روی ده‌ها هزار GPU Nvidia GB300 و بر اساس مدل پایه جدیدی با ۱.۵ تریلیون پارامتر که xAI آن را V9 می‌نامد، ساخته شده است. این مدل اکنون در Grok Build، تمام طرح‌های Cursor و از طریق کنسول API xAI در دسترس است.

قابلیت‌های مدل

Grok 4.5 از پنجره زمینه ۵۰۰,۰۰۰ Token به همراه ورودی متن و تصویر، فراخوانی تابع، خروجی ساختاریافته، جستجوی وب و X، اجرای کد و عمق استدلال قابل تنظیم پشتیبانی می‌کند. xAI آن را با سرعت تقریبی ۸۰ Token در ثانیه ارائه می‌دهد و این شرکت ادعا می‌کند بازده Token آن در وظایف مشابه دو برابر مدل‌های پیشرو رقیب است — به این معنا که می‌تواند نتایج معادل را با مصرف Token کمتر تولید کند، که هزینه مؤثر یک وظیفه مشخص را حتی قبل از در نظر گرفتن قیمت اسمی کاهش می‌دهد.

قیمت‌گذاری به صورت ۲ دلار به ازای هر میلیون Token ورودی و ۶ دلار به ازای هر میلیون Token خروجی تعیین شده است، با تخفیف ۰.۵۰ دلار به ازای هر میلیون Token برای ورودی ذخیره‌شده در حافظه پنهان و نرخ‌های بالاتر پس از عبور درخواست از ۲۰۰,۰۰۰ Token.

نتایج بنچمارک، با برخی ملاحظات

xAI مدل Grok 4.5 را عمدتاً به عنوان یک مدل کدنویسی و کار عاملی (Agentic) معرفی می‌کند. در بنچمارک SWE Marathon — آزمونی برای وظایف پایدار و چندمرحله‌ای مهندسی نرم‌افزار — Grok 4.5 نرخ حل ۲۹.۰% (Pass@1) ثبت کرده است که بالاتر از Opus 4.8 شرکت Anthropic با ۲۶.۰% و مدل قبلی خود xAI یعنی Fable با ۲۴.۰% است. این مدل همچنین در بنچمارک‌های DeepSWE 1.0 (۶۲.۰%) و Terminal-Bench 2.1 (۸۳.۳%) پیشتاز است.

با این حال، این پیشتازی فراگیر نیست. از چهار بنچمارکی که xAI هم‌زمان با عرضه منتشر کرده است، Grok 4.5 دو مورد را می‌برد و دو مورد را به Opus 4.8 واگذار می‌کند — شکافی که نشان می‌دهد این مدل در گردش‌های کاری خاص کدنویسی یک گام رو به جلو است، نه بهبودی همه‌جانبه بر تمام رقبا در همه وظایف.

شکاف دردسترس‌بودن در اتحادیه اروپا

Grok 4.5 هنوز برای کاربران اروپایی، چه از طریق محصولات خود xAI و چه از طریق کنسول API آن، در دسترس نیست. xAI اعلام کرده است دسترسی در اتحادیه اروپا انتظار می‌رود در اواسط جولای فراهم شود، بدون ذکر تاریخ دقیق. این تأخیر Grok 4.5 را در کنار الگوی عرضه مدل‌های هوش مصنوعی در سال ۲۰۲۶ قرار می‌دهد که در آن بررسی‌های نظارتی — چه بررسی‌های انطباق با قانون هوش مصنوعی اتحادیه اروپا و چه فرآیندهای مشابه — تاریخ عرضه اولیه مدل را از زمان دردسترس‌بودن آن در اروپا به میزان چند روز تا چند هفته جدا کرده است.

زمینه رقابتی

این انتشار در همان هفته‌ای انجام می‌شود که OpenAI در حال تکمیل عرضه تدریجی خانواده GPT-5.6 خود (Sol, Terra, Luna) است و بر Anthropic فشار وارد می‌کند، زیرا Opus 4.8 همچنان در دو بنچمارک از چهار بنچمارک انتخاب‌شده توسط xAI رقابتی باقی مانده است. برای توسعه‌دهندگانی که بین مدل‌های کدنویسی پیشرو انتخاب می‌کنند، نتیجه عملی این است که در حال حاضر هیچ مدل واحدی در همه زمینه‌ها پیشتاز نیست — نتایج Grok 4.5 در SWE Marathon و Terminal-Bench آن را برای وظایف خاص کدنویسی عاملی گزینه‌ای قوی می‌سازد، در حالی که Opus 4.8 در بنچمارک‌هایی که xAI برنده نشده است همچنان جلوتر است.

Originally reported by xAI. Read the original article for additional details.

View original source
اشتراک‌گذاری: