
در میان توجه فزاینده به مدلهای متنباز چینی، شرکت انویدیا (Nvidia)، یکی از بزرگترین تولیدکنندگان سختافزار هوش مصنوعی، از جدیدترین مدل متنباز خود با نام Nemotron 3.5 Lightning رونمایی کرد. این مدل در تاریخ ۱۱ اوت منتشر شد و بهعنوان یک مدل ترکیبی از متخصصان (Mixture-of-Experts) طراحی شده تا وظایف تخصصی را در سیستمهای چندعامله (Multi-Agent) بزرگتر انجام دهد.
به گفته انویدیا، این مدل قادر است کارهایی مانند بازبینی کد، استفاده از ابزارها، پایش هشدارهای امنیتی و پاسخگویی به سؤالات مربوط به صورتحساب را انجام دهد. نکته قابل توجه اینکه انویدیا وزنهای مدل، کدها، دستورالعملهای آموزش و همچنین دادههای آموزشی را تحت مجوز OpenMDW 1.1 از بنیاد لینوکس منتشر کرده که این مدل را به یک مدل کاملاً متنباز تبدیل میکند.
جایگاه در خانواده Nemotron 3
Nemotron 3.5 Lightning بخشی از خانواده مدلهای متنباز Nemotron 3 است که اولین بار در دسامبر سال گذشته معرفی شد. این مدل با ۳۰ میلیارد پارامتر، از نسخه Nano با ۸ میلیارد پارامتر بزرگتر و از نسخه Ultra با ۵۵۰ میلیارد پارامتر کوچکتر است. هدف اصلی از طراحی این مدل، کمک به شرکتها برای ساخت اپلیکیشنهای عاملمحور (Agentic) روی دستگاههای محلی است، از جمله رایانههای RTX، سیستم DGX Spark و پلتفرم Jetson. همزمان با این مدل، انویدیا کتابخانه متنباز دیگری به نام NeMo Switchyard را نیز منتشر کرد که به مسیریابی درخواستها در اپلیکیشنهای عاملمحور محبوب کمک میکند. شرکتها میتوانند با استفاده از Switchyard، هر درخواست را به مناسبترین مدل چه متنباز، چه اختصاصی و چه از خود انویدیا هدایت کنند.

رقابت با مدلهای چینی
انتشار این مدل کمتر از یک ماه پس از آن صورت میگیرد که جنسن هوانگ، مدیرعامل انویدیا، اعلام کرد این شرکت به جمع گستردهای از شرکتهای فناوری پیوسته که از مدلهای متنباز در برابر محدودیتهای احتمالی دولت ترامپ بر مدلهای چینی دفاع میکنند. هوانگ در پستی در شبکه X گفته بود مدلهای متنباز به حاکمیت فناوری کمک کرده و امنیت سایبری را تقویت میکنند.
این مدل، اولین مدل متنباز انویدیا از زمان اوجگیری بحث درباره پیشرفت مدلهای چینی است؛ زمانی که شرکتهای علیبابا و مونشات AI مدلهای متنباز ارزان و قدرتمندی را منتشر کردند. جالب اینکه انتشار Nemotron 3.5 Lightning تنها یک روز پس از انتشار جدیدترین مدل متنباز متا صورت گرفت. بردلی شیمین، تحلیلگر مؤسسه Futurum Group، این موضوع را نشانه تأثیرگذاری عمیق مدلهای چینی دانست و گفت بسیاری مدل Qwen 3.8 Max علیبابا را معیار سنجش توسعه عاملمحور محلی میدانند.
استراتژی تجاری انویدیا
به گفته آرون چاندراسکاران، تحلیلگر گارتنر، ارائه مدلهای متنباز برای انویدیا تنها یک استراتژی رقابتی در برابر چین نیست، بلکه راهی برای فروش بهتر تراشهها و سختافزارهای این شرکت نیز محسوب میشود؛ چرا که اجرای هر مدلی نیازمند زیرساخت شبکه، نرمافزار استنتاج و آموزش داده است. شیمین همچنین انتشار دادههای آموزشی مدل را ستود و گفت شرکتهای معدودی مانند IBM بهطور جدی بر اهمیت شفافیت در دادههای آموزشی تأکید داشتهاند. او افزود اندازه نسبتاً کوچک این مدل نشان میدهد شرکتهایی مانند انویدیا اکنون به اهمیت «اندازه مناسب» مدلها پی بردهاند، چرا که هزینه بالای استفاده از مدلها بر اساس مصرف توکن، بسیاری از شرکتها را به سمت اجرای محلی مدلها سوق داده است.
منبع خبر: aibusiness

شاهین آقامعلی


پاسخ :