Anthropic مدل Claude Sonnet 5 را عرضه کرد؛ مدلی ارزان‌تر که در وظایف عاملی با Opus برابری می‌کند

TechCrunch
اشتراک‌گذاری:
Anthropic مدل Claude Sonnet 5 را عرضه کرد؛ مدلی ارزان‌تر که در وظایف عاملی با Opus برابری می‌کند

Anthropic روز سه‌شنبه مدل Claude Sonnet 5 را عرضه کرد و آن را به‌عنوان توانمندترین مدل میان‌رده خود و جایگزینی مقرون‌به‌صرفه برای Opus 4.8، برای توسعه‌دهندگانی که عامل‌های AI می‌سازند، معرفی کرد.

مدل جدید با محوریت عملکرد عاملی طراحی شده است؛ می‌تواند برنامه‌ریزی کند، از ابزارهایی مانند مرورگرهای وب و ترمینال‌های کد استفاده کند، خروجی‌های خود را راستی‌آزمایی کند و وظایف طولانی چندمرحله‌ای را با حداقل نظارت انسانی به پایان برساند. Anthropic می‌گوید Sonnet 5 به قابلیت‌هایی دست یافته که «تنها چند ماه پیش، نیازمند مدل‌های بزرگ‌تر و گران‌تر بودند.»

عملکرد Benchmark

در benchmarkهای کدنویسی عاملی، Sonnet 5 امتیاز ۶۳٫۲٪ را کسب کرده، در حالی که Opus 4.8 به ۶۹٫۲٪ رسیده است. در وظایف دانش‌محور، Sonnet 5 در واقع از Opus 4.8 پیشی می‌گیرد. این شکاف به‌طور قابل‌توجهی کاهش یافته است؛ سؤال کلیدی برای توسعه‌دهندگان سازمانی اکنون این است که آیا این تفاوت باقی‌مانده، پرداخت قیمت بالاتر برای Opus را توجیه می‌کند یا خیر.

قیمت‌گذاری

تا ۳۱ اوت ۲۰۲۶، Sonnet 5 با قیمت ۲ دلار به‌ازای هر میلیون Token ورودی و ۱۰ دلار به‌ازای هر میلیون Token خروجی عرضه می‌شود. پس از آن، قیمت‌ها به ترتیب به ۳ و ۱۵ دلار افزایش می‌یابند. هر دو ردیف قیمتی به‌طور قابل‌توجهی ارزان‌تر از Opus 4.8، GPT-5.5 و Gemini 3.1 Pro هستند و Sonnet 5 را به گزینه‌ای جذاب برای بارهای کاری عاملی با حجم بالا تبدیل می‌کنند که در آن‌ها کنترل هزینه در مقیاس اهمیت دارد.

بهبودهای ایمنی

Anthropic همچنین گزارش می‌دهد که Sonnet 5 نرخ توهم کمتری، عملکرد بهتری در رد درخواست‌های مخرب و رفتار کلی بهتری نسبت به Sonnet 4.6 دارد. این بهبودهای ایمنی زمانی اهمیت بیشتری پیدا می‌کنند که Agentها به‌طور خودمختار توالی‌های طولانی‌تری از وظایف را انجام می‌دهند؛ چراکه در چنین شرایطی، یک خطا می‌تواند اثر آبشاری داشته باشد.

معنای این عرضه

این عرضه یک روند گسترده‌تر را تأیید می‌کند: قابلیت عاملی دیگر یک ویژگی ممتاز نیست. میدان رقابت از «آیا این مدل می‌تواند از ابزارها استفاده کند؟» به «چقدر قابل اعتماد و ارزان می‌تواند گردش کار کامل را بدون مداخله تکمیل کند؟» تغییر کرده است. Sonnet 5 مرز را دقیقاً در همین فضا ترسیم می‌کند؛ مدلی که قادر است اکثر بارهای کاری عاملی سازمانی را با کسری از هزینه مدل‌های پیشرو انجام دهد.

همان‌طور که اولین بار توسط TechCrunch گزارش شد، Claude Sonnet 5 بلافاصله از طریق API Anthropic در دسترس است.

Originally reported by TechCrunch. Read the original article for additional details.

View original source
اشتراک‌گذاری: