بایتدنس در حال پیشآموزش مدل ۱۰ تریلیون پارامتری برای رقابت با هوش مصنوعی مرزی است

بایتدنس در حال پیشآموزش مدل هوش مصنوعی با تا ۱۰ تریلیون پارامتر است، طبق گزارش فایننشال تایمز که به سه نفر آشنا با این پروژه استناد کرده است. این مقیاس، شرکت مادر TikTok را در فاصلهای کوتاه از قدرتمندترین سیستمهای هوش مصنوعی جهان قرار میدهد و از هر مدل شناختهشده چینی بسیار پیش میبرد.
این مدل تقریباً سه برابر بزرگتر از Kimi K3 شرکت Moonshot AI با ۲.۸ تریلیون پارامتر است — که در حال حاضر بزرگترین مدل شناختهشده چینی است. همچنین از نظر ابعاد به Mythos 5 آنتروپیک نزدیک است که برآوردهای صنعتی آن را حدود ۸ تریلیون پارامتر میدانند. آنتروپیک هرگز این عدد را بهطور رسمی تأیید نکرده است.
پیشآموزش از قبل آغاز شده است
این مدل در حال حاضر در مرحله پیشآموزش است، فرایندی که معمولاً در این مقیاس سه تا شش ماه طول میکشد. بایتدنس نه نامی و نه برنامه انتشاری را بهصورت عمومی فاش نکرده است. تنها ابعاد این مدل نشان میدهد که این یک شرطبندی بلندمدت مرزی است، نه یک بهروزرسانی تدریجی محصول.
یک جزئیات قابل توجه: بایتدنس از تقطیر — آموزش بر اساس خروجیهای مدلهای شرکتهای دیگر — بیش از یک سال است که خودداری کرده است. تقطیر یک میانبر رایج برای سریع رسیدن است، اما اصالت را محدود میکند و ریسک مالکیت فکری ایجاد میکند. پرهیز از آن نشان میدهد که بایتدنس در حال سرمایهگذاری در پیشآموزش اصیل و کامل از صفر است، که بهطور قابلتوجهی گرانتر است اما نتایج قدرتمندتر و قابل دفاعتری تولید میکند.
مدیرعامل شکاف را میپذیرد
بلندپروازی این دوره آموزشی در تضاد با یک اعتراف صادقانه داخلی است. در یک جلسه میانسال همه کارکنان در ۶ اوت ۲۰۲۶، مدیرعامل بایتدنس لیانگ روبو به کارکنان گفت که مدلهای زبانی بزرگ شرکت در حال حاضر از رقبای پیشرو خارجی عقب هستند. روبو بر تعهد بلندمدت به تحقیق و توسعه داخلی تأکید کرد.
بنیانگذار بایتدنس ژانگ ییمینگ گفته که به تیم ۲۰۰۰ نفری Seed — بخش مسئول این مدل — گفته است که هدف دستیابی به قابلیتهای پیشرو جهانی در بلندمدت را دنبال کنند. این شرکت سرمایهگذاری در هوش مصنوعی را در سال ۲۰۲۶ بهطور قابلتوجهی افزایش میدهد و بخش عمدهای از آن برای هزینههای نیمههادی اختصاص یافته است.
تنها این مقیاس نیست
بایتدنس در دنبال کردن مقیاس تریلیون پارامتری تنها نیست. گزارشها حاکی است که xAI ایلان ماسک در حال آموزش نسخههای Grok با ۶ تریلیون و ۱۰ تریلیون پارامتر روی خوشه Colossus 2 است. OpenAI و Google تعداد پارامترهای سیستمهای فعلی خود را فاش نکردهاند، اما رقابت در مقیاس چند تریلیون پارامتری به معیار پنهان نسل بعدی آزمایشگاههای هوش مصنوعی تبدیل شده است.
تعداد پارامترها تنها متغیر نیست — کیفیت داده، روشهای آموزش، و معماری به همان اندازه اهمیت دارند — اما پیام گزارش فایننشال تایمز روشن است: بایتدنس دیگر راضی به دنبال کردن مرز از فاصله نیست.
در ابتدا توسط The Decoder / Financial Times گزارش شده است. برای جزئیات بیشتر مقالهٔ اصلی را بخوانید.
مشاهدهٔ منبع اصلی