تراشه Jalapeño شرکت OpenAI در توان عبور استنتاج به ازای هر وات از Nvidia Blackwell پیشی میگیرد

OpenAI تراشه Inference هوش مصنوعی اختصاصی خود را ساخته که با نام Jalapeño شناخته میشود. بر اساس تحلیل فنی دقیق SemiAnalysis که در ۲۵ آگوست منتشر شد، این تراشه در Inference مدلهای زبانی بزرگ از نظر توان عبور به ازای هر مگاوات از شتابدهندههای Blackwell شرکت Nvidia بهتر عمل میکند.
Jalapeño چیست و چه میتواند بکند
این تراشه روی فرآیند N3P شرکت TSMC ساخته شده، یک آرایه سیستولیک با وزن ثابت با مصرف ۷۰۰ وات، پهنای باند حافظه HBM4 به میزان ۱۵.۴ ترابایت بر ثانیه، و ۱۳.۴ پتافلاپ محاسبات MXFP4 است. هر رک دارای ۱۲۸ تراشه است و سیستم تا ۲،۰۴۸ تراشه در ۱۶ رک مقیاسپذیری دارد.
SemiAnalysis نمونههای مهندسی A0 را روی چند مدل بزرگ آزمایش کرد. روی DeepSeek R1، Jalapeño بیش از ۷۰۰ توکن در ثانیه به ازای یک کاربر ارائه داد. روی Kimi K2.5، تقریباً ۷۰۰ توکن در ثانیه به ازای هر کاربر — که برتری ۹ برابری نسبت به Blackwell ادعا میشود. روی GPT-OSS، ۱،۴۰۰ توکن در ثانیه به ازای هر کاربر به دست آمد.
خندق CUDA ممکن است در حال ترک خوردن باشد
SemiAnalysis اشاره میکند که «پیشرفت نرمافزاری OpenAI سریعتر از Nvidia» بوده و «خندق CUDA به طور بالقوه از بین رفته» است. کارایی Kernel در کمتر از دو هفته دو برابر شد و تیم در هشت روز از پیکربندیهای تکسیستمی به عملیات در مقیاس رک رسید.
طراحی از اواسط ۲۰۲۴ آغاز شد و tape-out در نوامبر ۲۰۲۵ تکمیل شد — یک چرخه ۱۶ ماهه سریع برای Silicon سفارشی در این مقیاس. تولید انبوه در انتهای ۲۰۲۷ برنامهریزی شده است.
محدودیتها
مقایسه با Blackwell به گفته خود SemiAnalysis «تا حدی ناقص و ناعادلانه» است. آزمایشها تنها روی Context 8k و خروجی 1k انجام شد و مدلهای بزرگتری مثل DeepSeek V4 Pro آزمایش نشدند. با این حال، ظهور یک تراشه سفارشی رقابتی از OpenAI محاسبات استراتژیک کل بازار سختافزار هوش مصنوعی را تغییر میدهد.
در ابتدا توسط SemiAnalysis گزارش شده است. برای جزئیات بیشتر مقالهٔ اصلی را بخوانید.
مشاهدهٔ منبع اصلی