علیبابا برای ساخت مدل هوش مصنوعی ۱۰ تریلیون پارامتری آماده میشود
سهشنبه، 31 شهریور
شرکت علیبابا برنامههای جدید و بلندپروازانهای برای توسعه هوش مصنوعی اعلام کرده است. این شرکت قصد دارد نسل بعدی مدلهای هوش مصنوعی خود را با ۵ تا ۱۰ تریلیون پارامتر آموزش دهد؛ مقیاسی که میتواند مدلهای آینده این شرکت را چند برابر بزرگتر از مدل پرچمدار فعلی آن کند.
علیبابا همچنین در کنفرانس سالانه Apsara در شهر هانگژو، از تراشه جدید هوش مصنوعی خود با نام Zhenwu V900 رونمایی کرد. این شرکت میگوید تراشه جدید سه برابر عملکرد بیشتری نسبت به نسل قبلی دارد و برای آموزش و اجرای مدلهای بسیار بزرگ هوش مصنوعی طراحی شده است.
مدل جدید علیبابا تا ۱۰ تریلیون پارامتر خواهد داشت
مدل پرچمدار فعلی علیبابا، Qwen 3.8 Max، حدود ۲.۴ تریلیون پارامتر دارد. این شرکت اعلام کرده مدلهای آینده خانواده Qwen میتوانند به محدوده ۵ تا ۱۰ تریلیون پارامتر برسند.
مدیرعامل علیبابا، ادی وو، گفت تیم Qwen در حال حرکت به سمت مدلهایی است که بتوانند وظایف پیچیدهتر و بلندمدتتری را انجام دهند. طبق برنامه اعلامشده، Qwen 4 در حال آموزش است و مدلهای بعدی مانند Qwen 4.5 و Qwen 5 میتوانند در مقیاس ۵ تا ۱۰ تریلیون پارامتر توسعه پیدا کنند.
پارامترها یکی از معیارهای اندازه مدلهای هوش مصنوعی هستند، هرچند تعداد بیشتر پارامترها بهتنهایی به معنای عملکرد بهتر یک مدل نیست. کیفیت دادههای آموزشی، معماری مدل، روش آموزش و میزان محاسبات نیز نقش مهمی در توانایی مدل دارند.
تراشه Zhenwu V900 برای مدلهای بزرگتر معرفی شد
علیبابا همزمان از تراشه جدید Zhenwu V900 رونمایی کرد که توسط واحد نیمهرسانای T-Head این شرکت توسعه یافته است.
به گفته علیبابا، V900 حدود سه برابر سریعتر از تراشه نسل قبلی M890 است و میتوان حداکثر ۵۰۰ هزار تراشه از این نوع را در قالب خوشههای بزرگ به یکدیگر متصل کرد. این قابلیت برای آموزش و اجرای مدلهای بسیار بزرگ هوش مصنوعی اهمیت دارد، زیرا چنین مدلهایی به حجم عظیمی از توان پردازشی نیاز دارند.
علیبابا اعلام کرده تولید انبوه و عرضه تجاری Zhenwu V900 برای سهماهه نخست سال ۲۰۲۷ برنامهریزی شده است. این شرکت همچنین انتظار دارد تعداد تراشههای هوش مصنوعی ارسالی آن در سالهای آینده به شکل قابل توجهی افزایش پیدا کند.
رقابت چین با انویدیا وارد مرحله جدیدی شده است
اقدامات علیبابا بخشی از تلاش گسترده شرکتهای فناوری چین برای توسعه زیرساخت هوش مصنوعی داخلی است. محدودیتهای صادراتی آمریکا دسترسی شرکتهای چینی به برخی تراشههای پیشرفته انویدیا را دشوارتر کرده و همین مسئله فشار بیشتری برای توسعه پردازندههای داخلی ایجاد کرده است.
علیبابا در حال تلاش برای ساخت یک زنجیره کامل هوش مصنوعی است که تنها به مدلهای زبانی محدود نمیشود. این شرکت همزمان روی مدلهای پایه، تراشههای هوش مصنوعی، خدمات ابری و مراکز داده سرمایهگذاری میکند.
این رویکرد شباهت زیادی به استراتژی شرکتهای بزرگ آمریکایی دارد که برای کاهش وابستگی به تأمینکنندگان خارجی، بخشی از سختافزار و زیرساخت محاسباتی مورد نیاز خود را نیز توسعه میدهند.
ظرفیت مراکز داده علیبابا از ۲۰ گیگاوات عبور میکند
علیبابا همچنین هدفگذاری کرده است ظرفیت جهانی مراکز داده Alibaba Cloud تا سال ۲۰۳۲ به بیش از ۲۰ گیگاوات برسد.
ادی وو گفته تقاضای مشتریان برای خدمات هوش مصنوعی به شکل قابل توجهی افزایش یافته و همین موضوع به رشد درآمد Alibaba Cloud کمک کرده است. با این حال، محدودیتهای زنجیره تأمین سرعت توسعه زیرساختها را محدود کردهاند.
به گفته مدیرعامل علیبابا، تقاضای میانمدت و بلندمدت صنعت هوش مصنوعی همچنان بسیار بیشتر از ظرفیت فعلی این شرکت است. علیبابا همچنین اعلام کرده ابررایانهها و زیرساختهای موسوم به AI Supernode را در مقیاس تجاری از همین فصل وارد مدار خواهد کرد.
سهام علیبابا پس از اعلام برنامههای جدید رشد کرد
اعلام برنامههای جدید هوش مصنوعی واکنش مثبت بازار را به همراه داشت. سهام علیبابا در بورس هنگکنگ روز سهشنبه حدود ۵.۱ درصد افزایش یافت و به بالاترین سطح خود در یک ماه اخیر رسید.
رشد سهام نشان میدهد سرمایهگذاران به برنامههای علیبابا برای توسعه مدلهای هوش مصنوعی، تراشههای اختصاصی و زیرساخت ابری توجه ویژهای دارند. با این حال، تحقق اهدافی مانند مدلهای چند تریلیون پارامتری و ظرفیت بالای مراکز داده به سرمایهگذاری سنگین در تراشه، انرژی و زیرساخت محاسباتی نیاز خواهد داشت.
علیبابا به دنبال ساخت یک اکوسیستم کامل هوش مصنوعی است
برنامههای جدید علیبابا نشان میدهد این شرکت قصد دارد حضور خود را در صنعت هوش مصنوعی از سطح توسعه مدل فراتر ببرد و بخشهای مختلف زنجیره فناوری را تحت پوشش قرار دهد.
از توسعه مدلهای Qwen و تراشههای Zhenwu گرفته تا گسترش مراکز داده و خدمات ابری، علیبابا در حال ساخت زیرساختی یکپارچه برای توسعه و اجرای مدلهای بزرگ هوش مصنوعی است.
البته مدل ۵ تا ۱۰ تریلیون پارامتری هنوز در مرحله برنامهریزی و توسعه قرار دارد و موفقیت آن به توانایی علیبابا در تأمین محاسبات، داده و زیرساخت لازم بستگی خواهد داشت. در صورت تحقق این برنامه، رقابت میان شرکتهای چینی و آمریکایی برای ساخت مدلهای بزرگتر و زیرساختهای قدرتمندتر هوش مصنوعی وارد مرحله تازهای خواهد شد.


