W chmurze OneCloudPlanet dostępne są dwie karty GPU najnowszej generacji NVIDIA Blackwell: RTX PRO 4500 Blackwell (32 GB GDDR7) i RTX PRO 6000 Blackwell (96 GB GDDR7). Obie z rozliczeniem godzinowym i preinstalowanymi sterownikami NVIDIA oraz CUDA: instancja powstaje z konsoli w minuty i jest gotowa do pracy od razu.

Optymalny punkt wejścia w najnowszą generację — $0.69/h (w trybie dnia roboczego 8×5 to ≈$121/mies.).

Do czego pasuje: inference otwartych LLM 7–8B (Llama 3.1 8B, Qwen 8B) i do ~14B po kwantyzacji — firmowe chatboty i RAG po dokumentach; generowanie obrazów (SDXL, Flux); rendering, wideo i eksperymenty ML. 32 GB szybkiej pamięci GDDR7 to komfortowy zapas tam, gdzie poprzednim generacjom kart było już ciasno.

Główna cecha — 96 GB VRAM w jednej karcie: skwantyzowane modele klasy 30–70B (Llama 3.1 70B, Qwen 72B) działają bez konfiguracji multi-GPU i związanych z nimi komplikacji. Do tego: modele multimodalne jak Qwen3-VL-32B, RAG z długim kontekstem, fine-tuning LoRA/QLoRA. Aktualne ceny — na stronie Cloud GPU.

Najszybsza droga — gotowe obrazy z Solution Marketplace: Ollama, DeepSeek, Llama albo platforma AI Dify — działający stack w minuty, bez walki ze sterownikami. Rozliczenie godzinowe: wieczorny eksperyment kosztuje kilka dolarów. Ściąga „które GPU do którego zadania” — na stronie AI / LLM hosting.