حالت Ultrafast اوپن‌ای‌آی مدل GPT-5.6 Sol را با ۷۵۰ Token در ثانیه اجرا می‌کند

TechCrunch
اشتراک‌گذاری:
حالت Ultrafast اوپن‌ای‌آی مدل GPT-5.6 Sol را با ۷۵۰ Token در ثانیه اجرا می‌کند

اوپن‌ای‌آی سرویس Ultrafast را راه‌اندازی کرده است؛ یک سطح جدید از API که GPT-5.6 Sol را با سرعت حداکثر ۷۵۰ Token در ثانیه اجرا می‌کند — یعنی ۱۴ برابر سرعت حالت Standard فعلی که میانگین آن حدود ۵۳ Token در ثانیه است. این حالت از ۱۳ اوت به صورت پیش‌نمایش محدود برای مشتریان منتخب API در دسترس است.

این افزایش سرعت حاصل همکاری با Cerebras، استارتاپ تراشه هوش مصنوعی است که به خاطر پردازنده‌های wafer-scale خود شناخته شده است. Ultrafast اولین محصول تجاری این همکاری است و از سخت‌افزار Cerebras برای شتاب‌دهی چشمگیر به Inference روی مدل پرچمدار اوپن‌ای‌آی استفاده می‌کند — بدون آنکه به گفته این شرکت، کیفیت خروجی کاهش یابد.

۷۵۰ Token در ثانیه یعنی چه؟

تفاوت بین ۵۳ و ۷۵۰ Token در ثانیه مانند تفاوت بین مدلی است که همزمان با خواندن شما تایپ می‌کند و مدلی است که پاسخ کامل را تقریباً فوری تحویل می‌دهد. یک مقاله معمولی ۱۰۰۰ کلمه‌ای در حالت Standard حدود ۱۸ ثانیه طول می‌کشد و در Ultrafast کمتر از ۲ ثانیه. برای برنامه‌های بلادرنگ، این فاصله بسیار بزرگ است.

اوپن‌ای‌آی می‌گوید Ultrafast برای جریان‌های کاری طراحی شده که تاریخاً یک معاوضه بین سرعت و هوش را تحمیل می‌کردند — جایی که توسعه‌دهندگان مدل‌های کوچک‌تر و سریع‌تر را انتخاب می‌کردند چون مدل‌های پیشرو خیلی کند بودند. ایده اصلی این است که حالا می‌توان GPT-5.6 Sol را با سرعت‌هایی اجرا کرد که پیش از این فقط با مدل‌های ساده‌تر قابل دستیابی بود.

موارد استفاده

اوپن‌ای‌آی چهار کاربرد اصلی را برجسته می‌کند که در آن‌ها Inference زیر ثانیه‌ای امکانات جدیدی می‌گشاید: واکنش به حوادث امنیتی (تحلیلگران که در میانه تحقیقات پاسخ زنده می‌گیرند)، خدمات مشتری (Agentهایی با سرعت مکالمه تلفنی)، تحلیل بازارهای مالی (تفسیر بلادرنگ حرکات قیمت)، و تجارت الکترونیک (پیشنهادات پویای محصول در حین مرور).

شرکت‌های بزرگ در حال حاضر به دلیل محدودیت تأخیر، درخواست‌ها را از مدل‌های پیشرو دور می‌کنند. اگر Ultrafast ادعاهای کیفی خود را در مقیاس حفظ کند، این محدودیت از بین می‌رود.

ارتباط با Cerebras

Cerebras سال‌هاست تراشه‌های wafer-scale می‌سازد تا جایگزینی برای رویکرد GPU شرکت Nvidia ارائه دهد. پردازنده CS-3 آن یک دای ۹۰۰ میلی‌متر مربعی یکپارچه است — نه مجموعه‌ای از تراشه‌های کوچک‌تر — و پیچیدگی ساخت را با توان خروجی خام Inference معاوضه می‌کند. این همکاری برجسته‌ترین استقرار تجاری سخت‌افزار Cerebras تا به امروز است.

اوپن‌ای‌آی قیمت جداگانه‌ای برای حالت Ultrafast اعلام نکرده و با رشد ظرفیت، دسترسی را گسترش خواهد داد. این اعلامیه، به گزارش TechCrunch، مستقیماً از وبلاگ توسعه‌دهندگان اوپن‌ای‌آی منتشر شد.

در ابتدا توسط TechCrunch گزارش شده است. برای جزئیات بیشتر مقالهٔ اصلی را بخوانید.

مشاهدهٔ منبع اصلی
اشتراک‌گذاری: