پلتفرم GPU بهعنوان سرویس
شتابدهندههایی را که هماکنون در اختیار دارید به سرویسی با مصرف اندازهگیریشده تبدیل کنید.
Sovereign GPaaS یک لایه کنترل است که شتابدهندههای سراسر مجموعه شما را در قالب یک منبع واحد و قابل زمانبندی یکپارچه میکند. تیمها از طریق یک API کسری از یک GPU، یک کارت کامل یا یک گروه چندنودی درخواست میدهند و پلتفرم کار را جایگذاری میکند، سهمیه را اعمال میکند و مصرف را ثبت میکند. این سرویس روی سختافزاری که همین حالا مالک آن هستید، داخل مرکز داده خودتان و بر پایه Kubernetes آپاستریم و بدون فورک اختصاصی اجرا میشود.
شتابدهندهای که بیکار مانده، همچنان فضای رک، برق و خنکسازی میگیرد و سرمایه پشت آن تا وقتی منتظر است هیچ بازدهی ندارد. یکپارچهسازی منابع، تخصیص کسری و صفبندی، بخش بیشتری از آن سرمایه را در برابر کار واقعی قرار میدهد و اندازهگیری مصرف به تفکیک هر مستأجر به شما امکان میدهد هزینه مصرف را به یک واحد کسبوکار منتقل کنید یا برای یک مستأجر بیرونی صورتحساب صادر کنید. میزان بهرهبرداری بیش از آنکه یک تصمیم سختافزاری باشد، یک تصمیم پلتفرمی است: به این بستگی دارد که کار در لایه بالای کارتها چگونه جایگذاری، تفکیک و صفبندی میشود.
معماری
یک پورتال سلفسرویس و API که تیمها از آن ظرفیت درخواست میکنند. هر تخصیص بر حسب مستأجر، پروژه و مدت زمان اندازهگیری میشود و این سوابق، ورودی صدور صورتحساب، showback یا chargeback داخلی است.
مرزهای namespace، شبکه و دستگاه، مستأجرها را از هم جدا نگه میدارند، همراه با سوابق آماده ممیزی از اینکه چه کسی، چه چیزی و چه زمانی مصرف کرده است.
صفها، اولویتها، سیاست سهم منصفانه و زمانبندی گروهی (gang scheduling) کارهای آموزش، تنظیم دقیق (fine-tune) و استنتاج را روی شتابدهنده درست مینشانند، بیآنکه تیم درخواستکننده نیاز داشته باشد بداند کار روی کدام کارت نشسته است.
برش نرمافزاری و پارتیشنبندی در سطح سختافزار، کارتهای مجزا را به یک استخر واحد از کسرها، دستگاههای کامل و گروههای چندنودی تبدیل میکند.
Kubernetes بالادستی (upstream) با شبکه آگاه از شتابدهنده، از جمله RDMA، بههمراه مشاهدهپذیری و مدیریت چرخه عمر روی میزبانهای x86 و ARM.
شتابدهندههایی از چند سازنده و چند نسل سختافزاری که از طریق یک رابط یکسان در اختیار بارهای کاری قرار میگیرند.
یک شتابدهنده را میان چند بار کاری تقسیم کنید تا کارهای کوچک دیگر کارتهای کاملی را که نمیتوانند پر کنند اشغال نکنند.
یک استخر واحد که چند سازنده و چند نسل سختافزاری را در بر میگیرد، تا تیمها ظرفیت را از کل دارایی برداشت کنند، نه از یک ماشین مشخص.
سهمیه به تفکیک مستأجر، اولویتها، صفهای سهم منصفانه و زمانبندی گروهی، استخر را پرکار نگه میدارد، بدون آنکه یک تیم بقیه را از منابع محروم کند.
هر تخصیص بر حسب مستأجر، پروژه و مدت زمان ثبت میشود و آماده chargeback، showback یا صدور صورتحساب بیرونی است.
جداسازی در سطح namespace، شبکه و دستگاه، با اعمال محدودیت حافظه و محاسبات برای هر تخصیص و سوابق دسترسی آماده ممیزی.
رانتایمهای سرویسدهی با تفکیک prefill و decode و بازاستفاده از کش attention، استخر را بهجای ظرفیت خام، بهصورت یک نقطه پایانی استنتاج اندازهگیریشده ارائه میکنند.
تیمها بهجای ثبت تیکت برای یک ماشین فیزیکی، ظرفیت را از یک API و پورتال واحد برمیدارند.
رابطهای استاندارد Kubernetes، دسترسی کامل به کد منبع و انتقال دانش، تا مهندسان خودتان بتوانند از پلتفرم بهرهبرداری کنند و اگر خواستند آن را جابهجا کنند.
آنچه در نهایت به دست میآورید
مشتری در نهایت مالک یک سرویس GPU چندمستأجری با اندازهگیری مصرف میشود، روی شتابدهندههای خودش و در مرکز داده خودش؛ سیاست زمانبندی، مرزهای جداسازی و سوابق صورتحساب در کنترل اوست و مهندسانش برای اجرای آن آموزش دیدهاند.
زیرساخت ابری
ماشینهای مجازی و کانتینرها روی یک لایه کنترل.
پلتفرم بهعنوان سرویس
سیستمعامل ابریبومی برای کل زیرساخت شما.
پلتفرم هوش مصنوعی بهعنوان سرویس
کارخانه کامل هوش مصنوعی شما، درون مرزهای خودتان.
Kubernetes بهعنوان سرویس
Kubernetes عملیاتی؛ بهرهبرداری با ما، مالکیت با شما.
محاسبات با کارایی بالا
شبیهسازی و هوش مصنوعی روی یک کلاستر واحد، درون مرزهای خودتان.
مدیریت یکپارچه چندابری
یک لایه کنترل واحد روی همهی ابرها؛ دادههای مشمول مقررات داخل کشور میماند.
تداوم و تابآوری
بازیابیای که اثباتش کردهاید، نه بازیابیای که وعدهاش را دادهاید.
از ابر تا لبه
همهی سایتها را از یک کنسول اداره کنید، حتی وقتی ارتباط قطع میشود.
به راحتی زمان موردنظر خود را برای ارتباط ۳۰ دقیقهای با تیم متخصص نئور انتخاب کنید.

طراح سیستمهای مبتنی بر فرآیند دوآپس
از تقویم زیر زمان آزاد خود را برای جلسه انتخاب کنید.