Рабочая станция в облаке

NVIDIA RTX A5000 24GB

Профессиональная Ampere с 24 ГБ GDDR6 и ECC. Середина линейки: там, где 16 ГБ уже мало, а 48 ГБ ещё не нужны.

Спецификации

Характеристики Ampere

Архитектура
NVIDIA Ampere
Видеопамять
24 GB GDDR6 (ECC)
Пропускная способность
768 GB/s
CUDA Cores
8,192
FP32
27.8 TFLOPS
Потребление (TDP)
230W
Сравнение

A5000 или A6000

Карты одного поколения и с одинаковой скоростью памяти — 768 ГБ/с. A5000 экономичнее: 230 Вт против 300 и меньше вычислительных блоков. Но если упираетесь именно в объём, смотрите RTX A6000 — там те же 768 ГБ/с при вдвое большей памяти.

Пропускная способность 768 GB/s
Столько же, сколько у A6000 — шина 384 бита
FP32 27.8 TFLOPS
У A6000 — 38.7 TFLOPS при той же ширине шины памяти

RTX A5000 vs RTX A6000

ПараметрA5000A6000
Видеопамять24 GB48 GB
Пропускная способность768 GB/s768 GB/s
CUDA Cores8,19210,752
FP3227.8 TFLOPS38.7 TFLOPS
Потребление (TDP)230 W300 W
Возможности

Ключевые особенности

Мост NVLink на две карты

Две A5000 соединяются мостом на 112.5 ГБ/с. Единой памятью на 48 ГБ они не становятся: модель распределяется по картам средствами фреймворка. Наличие моста зависит от конфигурации сервера.

ECC на всей памяти

Коррекция ошибок поддерживается на всех 24 ГБ GDDR6: одиночный сбой бита исправляется и не обрывает многочасовой рендер или обучение.

Аппаратные кодеки

Один энкодер и два декодера NVENC/NVDEC, AV1 — на декодирование. Препроцессинг видео идёт мимо процессора.

Решения

Для каких задач

Инференс и дообучение

Модель на 7–8B параметров в FP16 или до 30B в 4-битной квантизации, LoRA-адаптеры для моделей поменьше.

Генерация изображений

SDXL помещается в 24 ГБ целиком, с запасом под ControlNet и апскейл. FLUX.1 [dev] запускают в FP8.

Рендер и CAD

64 RT-ядра и 54.2 TFLOPS на трассировке лучей: Blender, Octane, SolidWorks Visualize.

Этой карты сейчас нет в наличии

Наличие зависит от провайдеров. Карты, которые можно арендовать сейчас, — в каталоге.