بایت‌دنس در حال پیش‌آموزش مدل ۱۰ تریلیون پارامتری برای رقابت با هوش مصنوعی مرزی است

The Decoder / Financial Times
اشتراک‌گذاری:
بایت‌دنس در حال پیش‌آموزش مدل ۱۰ تریلیون پارامتری برای رقابت با هوش مصنوعی مرزی است

بایت‌دنس در حال پیش‌آموزش مدل هوش مصنوعی با تا ۱۰ تریلیون پارامتر است، طبق گزارش فایننشال تایمز که به سه نفر آشنا با این پروژه استناد کرده است. این مقیاس، شرکت مادر TikTok را در فاصله‌ای کوتاه از قدرتمندترین سیستم‌های هوش مصنوعی جهان قرار می‌دهد و از هر مدل شناخته‌شده چینی بسیار پیش می‌برد.

این مدل تقریباً سه برابر بزرگ‌تر از Kimi K3 شرکت Moonshot AI با ۲.۸ تریلیون پارامتر است — که در حال حاضر بزرگ‌ترین مدل شناخته‌شده چینی است. همچنین از نظر ابعاد به Mythos 5 آنتروپیک نزدیک است که برآوردهای صنعتی آن را حدود ۸ تریلیون پارامتر می‌دانند. آنتروپیک هرگز این عدد را به‌طور رسمی تأیید نکرده است.

پیش‌آموزش از قبل آغاز شده است

این مدل در حال حاضر در مرحله پیش‌آموزش است، فرایندی که معمولاً در این مقیاس سه تا شش ماه طول می‌کشد. بایت‌دنس نه نامی و نه برنامه انتشاری را به‌صورت عمومی فاش نکرده است. تنها ابعاد این مدل نشان می‌دهد که این یک شرط‌بندی بلندمدت مرزی است، نه یک به‌روزرسانی تدریجی محصول.

یک جزئیات قابل توجه: بایت‌دنس از تقطیر — آموزش بر اساس خروجی‌های مدل‌های شرکت‌های دیگر — بیش از یک سال است که خودداری کرده است. تقطیر یک میانبر رایج برای سریع رسیدن است، اما اصالت را محدود می‌کند و ریسک مالکیت فکری ایجاد می‌کند. پرهیز از آن نشان می‌دهد که بایت‌دنس در حال سرمایه‌گذاری در پیش‌آموزش اصیل و کامل از صفر است، که به‌طور قابل‌توجهی گران‌تر است اما نتایج قدرتمندتر و قابل دفاع‌تری تولید می‌کند.

مدیرعامل شکاف را می‌پذیرد

بلندپروازی این دوره آموزشی در تضاد با یک اعتراف صادقانه داخلی است. در یک جلسه میان‌سال همه کارکنان در ۶ اوت ۲۰۲۶، مدیرعامل بایت‌دنس لیانگ روبو به کارکنان گفت که مدل‌های زبانی بزرگ شرکت در حال حاضر از رقبای پیشرو خارجی عقب هستند. روبو بر تعهد بلندمدت به تحقیق و توسعه داخلی تأکید کرد.

بنیان‌گذار بایت‌دنس ژانگ ییمینگ گفته که به تیم ۲۰۰۰ نفری Seed — بخش مسئول این مدل — گفته است که هدف دستیابی به قابلیت‌های پیشرو جهانی در بلندمدت را دنبال کنند. این شرکت سرمایه‌گذاری در هوش مصنوعی را در سال ۲۰۲۶ به‌طور قابل‌توجهی افزایش می‌دهد و بخش عمده‌ای از آن برای هزینه‌های نیمه‌هادی اختصاص یافته است.

تنها این مقیاس نیست

بایت‌دنس در دنبال کردن مقیاس تریلیون پارامتری تنها نیست. گزارش‌ها حاکی است که xAI ایلان ماسک در حال آموزش نسخه‌های Grok با ۶ تریلیون و ۱۰ تریلیون پارامتر روی خوشه Colossus 2 است. OpenAI و Google تعداد پارامترهای سیستم‌های فعلی خود را فاش نکرده‌اند، اما رقابت در مقیاس چند تریلیون پارامتری به معیار پنهان نسل بعدی آزمایشگاه‌های هوش مصنوعی تبدیل شده است.

تعداد پارامترها تنها متغیر نیست — کیفیت داده، روش‌های آموزش، و معماری به همان اندازه اهمیت دارند — اما پیام گزارش فایننشال تایمز روشن است: بایت‌دنس دیگر راضی به دنبال کردن مرز از فاصله نیست.

در ابتدا توسط The Decoder / Financial Times گزارش شده است. برای جزئیات بیشتر مقالهٔ اصلی را بخوانید.

مشاهدهٔ منبع اصلی
اشتراک‌گذاری: