انویدیا در رویداد CES 2025 از پلتفرم جدید Cosmos WFM رونمایی کرد که شامل سه مدل هوش مصنوعی جهانی است. این مدلها دنیای اطراف خود را با فیزیک بسیار واقعی شبیهسازی کرده و درک جامعی از نحوه کارکرد آن به دست میآورند.
به گفته انویدیا همانطور که مدلهای زبانی بزرگ (llm چیست؟) تحول عظیمی در پردازش زبان طبیعی ایجاد کردند، مدلهای جهانی نیز هوش مصنوعی فیزیکی را دگرگون خواهند کرد.

مشخصات مدلهای Cosmos WFMs انویدیا
توسعه مدلهای هوش مصنوعی (هوش مصنوعی چیست؟) فیزیکی هزینهبر بوده و نیازمند حجم عظیمی از دادههای دنیای واقعی و آزمایشهای گسترده است. «جنسن هوانگ»، مدیرعامل انویدیا در جریان رونمایی تاکید کرد که این مدلها با ۲۰ میلیون ساعت ویدیو آموزش دیدهاند و تحولی اساسی در توسعه رباتها و سیستمهای هوش مصنوعی فیزیکی ایجاد خواهند کرد.
مدلهای جدید انویدیا به سه دسته نانو، سوپر و اولترا تقسیم میشوند که هر یک برای کاربردهای مختلف طراحی شدهاند. مدلهای نانو با تاخیر اندک برای کاربردهای بلادرنگ مناسب هستند، در حالی که مدلهای اولترا بالاترین کیفیت و دقت را ارائه میکنند. اندازه این مدلها از ۴ تا ۱۴ میلیارد پارامتر متغیر است و هرچه تعداد پارامترهای یک مدل بیشتر باشد، توانایی حل مسائل پیچیدهتر نیز افزایش مییابد.
انتشار مدلهای انویدیا با مجوز متنباز
انویدیا برای فراهم کردن دسترسی آسان توسعهدهندگان و شرکتها به مدلهای خود آنها را تحت مجوز متنباز عرضه کرده است. پلتفرم Cosmos به توسعهدهندگان این امکان را میدهد که با تغذیه ورودیهای مختلف مانند متن، تصویر، ویدیو و دادههای حسگر رباتها، ویدیوهای فیزیکمحور تولید کنند.
این ویدیوها میتواند حرکت ربات در انبار و کارخانه یا حرکت خودرو در جادهها و مسیرهای کوهستانی، بیابانی، شهر و غیره را در شرایط مختلف به دقت شبیهسازی کنند.

مدلهای بنیادی Cosmos WFM راهکاری آسان را برای تولید انبوه دادههای واقعگرایانه و مبتنی بر فیزیک برای آموزش و ارزیابی مدلهای موجود در اختیار توسعهدهندگان قرار میدهند. توسعهدهندگان حتی میتوانند با تنظیم دقیق مدلهای Cosmos WFM مدلهای سفارشی خود را ایجاد کنند.
ابزارهای پیشرفته برای توسعه مدلهای فیزیکی
ساخت مدلهای هوش مصنوعی فیزیکی نیازمند دهها پتابایت داده ویدیویی و دهها هزار ساعت محاسبه برای پردازش، سازماندهی و برچسبگذاری دادهها است.
انویدیا با استفاده از تکنولوژیهای پیشرفته مانند Nvidia NeMo و CUDA، یک پایپلاین پردازش سریع ایجاد کرده که توانایی پردازش ۲۰ میلیون ساعت ویدیو را در کمتر از دو هفته دارد؛ فرآیندی که در حالت عادی بیش از سه سال زمان میبرد.
این شرکت همچنین یک توکنساز بصری پیشرفته را برای تبدیل تصاویر و ویدیوها به توکن معرفی کرده است. خروجی این توکنساز در مقایسه با نمونههای فعلی ۸ برابر فشردهتر و ۱۲ برابر سریعتر است.
پذیرش گسترده در صنعت
بسیاری از شرکتهای پیشرو در صنایع رباتیک و ماشینهای خودران از جمله Waabi، Foretellix و Uber از پلتفرم Cosmos برای توسعه و آزمایش مدلهای هوش مصنوعی خود استفاده میکنند. Uber با همکاری انویدیا قصد دارد از دادههای عظیم خود در زمینه رانندگی، برای توسعه مدلهای هوش مصنوعی خودران بهره بگیرد.
«دارا خسروشاهی» مدیرعامل Uber میگوید: «هوش مصنوعی مولد آینده حملونقل را متحول خواهد کرد اما نیاز به دادههای غنی و قدرت پردازشی بالا دارد. ما با همکاری انویدیا میتوانیم توسعه مدلهای هوش مصنوعی خودران را با سرعت بیشتری پیش ببریم.»
دسترسی و استفاده از پلتفرم
مدلهای Cosmos WFM تحت مجوز متنباز انویدیا و از طریق Hugging Face و کاتالوگ NGC انویدیا قابل دسترسی هستند. همچنین توسعهدهندگان میتوانند از پلتفرم ابری Nvidia DGX Cloud برای استقرار سریع این مدلها استفاده کنند.
انویدیا این پلتفرم را بهگونهای توسعه داده که علاوه بر کارایی بالا، اصول «هوش مصنوعی قابل اعتماد» را هم رعایت کند. بدین منظور پلتفرم شامل ابزارهایی برای کاهش محتوای مضر و بهبود دقت درخواستهای متنی است و از واترمارکهای نامرئی برای شناسایی محتوای تولید شده توسط هوش مصنوعی استفاده میکند.
اهورا، اولین اپراتور هوش مصنوعی راهبردی ایران، خدمات متنوعی در حوزه هوش مصنوعی ارائه میدهد. این خدمات شامل دسکتاپ ابری هوشمند، فضای ذخیرهسازی ابری هوشمند، ماشین گرافیکی ابری سرور gpu ، پلتفرم پردازش گرافیکی اهورا کولب، سرویس AI Serverless و مجموعه دیتاستهای هوش مصنوعی میباشد.
منبع:
