به گزارش جامجمآنلاین، در روزهای گذشته، جامعه هوش مصنوعی درباره هویت آزمایشگاه سازنده مدل مرموز Ox Alpha گمانهزنیهای زیادی داشت. این مدل با وزنهای باز و بهصورت ناشناس در پلتفرم OpenRouter عرضه شده بود و خیلی زود توانست در برخی بنچمارکها و جدولهای رتبهبندی، عملکردی در سطح مدلهای پیشرفته بازار از خود نشان دهد.
اکنون مشخص شده است که پشت این مدل مرموز، Z.ai، شرکت چینی سازنده خانواده مدلهای GLM، قرار داشته است. بلومبرگ پیشتر این موضوع را گزارش کرده بود و Z.ai نیز آن را تأیید کرده است.
Ox Alpha در واقع GLM-۵.۳-Flash بود
Z.ai در توضیحی که امروز منتشر کرده، اعلام کرد که پیش از عرضه رسمی، مدل GLM-۵.۳-Flash را بهصورت ناشناس با نام ox-alpha روی OpenCode و OpenRouter آزمایش کرده است.
این شرکت میگوید مدل در مدت کوتاهی به یکی از محبوبترین مدلهای هفته تبدیل شد و تمام این آزمایشها با استفاده از تراشههای هوش مصنوعی ساخت چین انجام شده است.
Z.ai، GLM-۵.۳-Flash را نخستین مدل بومی چندوجهی در خانواده GLM-۵ معرفی کرده است. این مدل در مجموع ۳۲۰ میلیارد پارامتر دارد، اما تنها حدود ۱۸ میلیارد پارامتر آن در هر مرحله فعال است؛ معماریای که به گفته شرکت برای کاهش هزینه پردازش و افزایش بهرهوری طراحی شده است.
تمرکز بر برنامهنویسی و عاملهای هوش مصنوعی
GLM-۵.۳-Flash بهطور ویژه برای برنامهنویسی، فعالیتهای عاملمحور و استفادههای حرفهای طراحی شده است.
Z.ai میگوید این مدل برای پروژههای نرمافزاری طولانیمدت، استدلال پیچیده و کارهایی که نیازمند ترکیب متن و اطلاعات بصری هستند، عملکرد مناسبی دارد.
یکی از ویژگیهای مهم مدل، معماری ترکیبی آن است که از توجه خطی و توجه تنک استفاده میکند. هدف این معماری کاهش هزینه پردازش در هنگام کار با متنهای بسیار طولانی است.
Z.ai همچنین اعلام کرده است که GLM-۵.۳-Flash میتواند در زمینههایی مانند توسعه رابطهای کاربری، بازیسازی و شبیهسازیهای سهبعدی از اطلاعات بصری برای ارزیابی خروجی خود استفاده کند و در صورت نیاز آن را اصلاح کند.
رقابت با مدلهای گرانقیمت آمریکایی
عرضه این مدل را میتوان بخشی از روند گستردهتر رشد مدلهای چینی دانست؛ مدلهایی که تلاش میکنند با هزینه کمتر، عملکردی نزدیک به مدلهای پیشرفته شرکتهایی مانند OpenAI و Anthropic ارائه دهند.
Z.ai مدعی است GLM-۵.۳-Flash در برخی آزمونهای برنامهنویسی و عاملهای هوش مصنوعی به عملکرد Claude Opus ۴.۸ نزدیک شده و در برخی آزمونها حتی از آن عبور کرده است. البته این ارقام، نتایج اعلامشده از سوی خود Z.ai هستند و مانند همه نتایج بنچمارکهای شرکتی، باید با احتیاط و در کنار ارزیابیهای مستقل بررسی شوند.
در یکی از آزمونهای برنامهنویسی موسوم به DeepSWE v۱.۱، امتیاز GLM-۵.۳-Flash برابر با ۶۳.۴ اعلام شده، در حالی که امتیاز GLM-۵.۲ برابر با ۴۶.۲ و Claude Opus ۴.۸ برابر با ۵۸.۰ بوده است.
کاهش هزینه؛ برگ برنده مدل جدید
یکی از نکات مهم درباره GLM-۵.۳-Flash، تمرکز شدید بر کاهش هزینه استفاده از مدل است.
Z.ai اعلام کرده این مدل در شاخص Artificial Analysis Intelligence Index امتیاز ۵۷ را با هزینهای حدود ۰.۰۴۵ دلار برای هر وظیفه به دست آورده است. این شرکت ادعا میکند سطحی مشابه از توانایی هوش مصنوعی پیش از این با هزینهای حدود ۱۰ برابر بیشتر در دسترس بوده است.
به گفته Z.ai، ترکیب معماری جدید، دادههای آموزشی چندوجهی گستردهتر و بهینهسازی زیرساخت باعث شده است این مدل بتواند با محاسبات کمتر، توانایی بیشتری ارائه کند.
آزمایش روی تراشههای چینی
یکی دیگر از بخشهای قابل توجه این پروژه، استفاده از سختافزارهای ساخت چین است.
Z.ai اعلام کرده طی هفته گذشته GLM-۵.۳-Flash را روی یک خوشه بزرگ از تراشههای هوش مصنوعی چینی اجرا کرده و با بهینهسازی موتور استنتاج، توانسته عملکرد سیستم را نسبت به خط پایه اولیه روی همان سختافزار سه برابر افزایش دهد.
این شرکت این دستاورد را نشانهای از امکان اجرای مدلهای پیشرفته روی شتابدهندههای داخلی چین و کاهش وابستگی به سختافزارهای آمریکایی میداند.
وزنهای مدل منتشر میشود
Z.ai اعلام کرده وزنهای GLM-۵.۳-Flash بهصورت عمومی در دسترس قرار گرفته و توسعهدهندگان میتوانند آن را برای استفادههای مختلف به کار بگیرند. این مدل از چارچوبهایی مانند SGLang و vLLM برای اجرای محلی پشتیبانی میکند.
به این ترتیب، ماجرای Ox Alpha که ابتدا بهعنوان یک مدل ناشناس و مرموز توجه جامعه هوش مصنوعی را جلب کرده بود، اکنون به یکی از تازهترین نمایشهای توانایی شرکتهای چینی در ساخت مدلهای قدرتمند، ارزان و قابل استفاده توسط توسعهدهندگان تبدیل شده است.
منبع: TechCrunch و Z.ai
رئیس کل بانک مرکزی: با تدبیر رئیسجمهور مقرر شده کسری منابع پیشین کالابرگ از منبع دیگری تامین و مطالبات فروشگاهها هرچهسریعتر تسویه شود
جمالیان در گفتوگو با جامجم آنلاین:
مهدی پاشازاده: من غر زدن مربیان را دوست ندارم
گفتوگوی جام جم با مدیر اکتشاف شرکت ملی نفت ایران