OpenShift AI 2.5: inferenza distribuita e aggiornamenti sul servizio di modelli
OpenShift AI 2.5 si concentra sulla maturità operativa per i carichi di lavoro LLM: migliore utilizzo della GPU tra i nodi, modelli semplificati che servono percorsi e una più stretta integrazione con OpenShift GitOps e policy di sicurezza.
I team della piattaforma possono ora standardizzare gli endpoint di inferenza per più modelli, isolare gli spazi dei nomi dei tenant e applicare policy di rete coerenti, mentre i team di data science mantengono familiari i flussi di lavoro di notebook e pipeline. Per gli ambienti ibridi, l'aggiornamento semplifica inoltre il collegamento dei cluster GPU on-premise alla governance centrale.
cloudstrata progetta architetture AI OpenShift per settori regolamentati, inclusi scenari cloud sovrani e air gap. Ti aiutiamo a passare da progetti pilota a modello singolo a piattaforme di inferenza multi-team con monitoraggio, gestione delle quote e controllo dei costi integrati.
Esplora di più
CONTATTO
Mettiti in contatto
Raccontaci il tuo caso d'uso: ti risponderemo con un passaggio successivo su misura.
Puntiamo a rispondere entro un giorno lavorativo.
Segui Cloudstrata su LinkedIn e Instagram per restare aggiornato sul nostro lavoro e sulle posizioni aperte.
Si apre in una nuova scheda