У хмарі OneCloudPlanet тепер доступні дві GPU-карти найновішого покоління NVIDIA Blackwell: RTX PRO 4500 Blackwell (32 ГБ GDDR7) та RTX PRO 6000 Blackwell (96 ГБ GDDR7). Обидві — з погодинною оплатою, передвстановленими драйверами NVIDIA і CUDA: інстанс створюється з консолі за хвилини й готовий до роботи одразу.
Оптимальна точка входу в новітнє покоління — $0.69/год (у режимі робочого дня 8×5 це ≈$121/міс).
Для чого підходить: inference відкритих LLM 7–8B (Llama 3.1 8B, Qwen 8B) і до ~14B з квантуванням — корпоративні чат-боти та RAG по внутрішніх документах; генерація зображень (SDXL, Flux); рендеринг, обробка відео та ML-експерименти. 32 ГБ швидкої GDDR7 — це комфортний запас там, де попереднім поколінням карт уже було тісно.
Головна фіча — 96 ГБ відеопамʼяті в одній карті: квантовані моделі класу 30–70B (Llama 3.1 70B, Qwen 72B) запускаються без multi-GPU конфігурацій і повʼязаних із ними складнощів шардингу. Також: мультимодальні моделі на кшталт Qwen3-VL-32B, RAG з довгим контекстом, LoRA/QLoRA fine-tuning середніх моделей.
Якщо раніше для 70B-класу потрібно було збирати кілька карт — тепер це один інстанс. Актуальні ціни — на сторінці Cloud GPU.
Найшвидший шлях — готові образи з Solution Marketplace: Ollama, DeepSeek, Llama або AI-платформа Dify — робочий стек за хвилини, без боротьби з драйверами. Оплата погодинна: експеримент на вечір коштує пару доларів, а не місячний бюджет.
Не впевнені, яка карта під вашу модель — таблиця-шпаргалка «який GPU під яку задачу» є на сторінці AI / LLM-хостинг.