Приобретайте графические процессоры NVIDIA в компании MillionMiner, от потребительского Blackwell до классов для дата-центров, для ИИ и профессиональных задач. В наличии карты, включая RTX 5090 32ГБ и RTX 4090 24ГБ в вариантах с воздушным охлаждением, RTX PRO 6000 Blackwell 96ГБ, а также графические процессоры A100 и H100 Tensor Core. Новые, с гарантией производителя, за исключением случаев, указанных в описании.
Каждый графический процессор доставляется бесплатно по всему миру DDP, поэтому цена при оформлении заказа является окончательной стоимостью доставки. Для сборок с несколькими картами смотрите наши предварительно собранные GPU-сервера или разместите карты в нашем хостинге в США, где обеспечивается питание и охлаждение. Ознакомьтесь с полным ассортиментом GPU ниже.
Проверенные запасы
Каждая GPU протестирована и проверена перед отправкой
Быстрая отправка
Доставка в течение 1–3 рабочих дней
Принимаемые криптовалюты
Оплата с помощью BTC, ETH, USDT и других способов
Экспертная поддержка
Специалисты по инфраструктуре AI и GPU в распоряжении
Революция искусственного интеллекта поддерживается крайне небольшим набором силиконовых чипов. Линейка GPU для дата-центров NVIDIA, от Tensor Core GPU H100 и H200 до RTX PRO 6000 Blackwell и RTX 5090, представляет собой вычислительную основу, на которой работают крупные языковые модели, диффузионные модели, научные симуляции и высокочастотныеInference pipelines. Мы располагаем полным профессиональным ассортиментом NVIDIA — ускорителями для дата-центров, GPU для рабочих станций и профессиональными картами визуализации — для корпоративных заказчиков, исследовательских лабораторий, стартапов в области искусственного интеллекта и операторов облачной инфраструктуры.
H200 Скоростной Путевой Интерфейс памяти
4.8 TB/s
HBM3e @ 141 ГБ ёмкость
H100 AI Производительность
3.9 PFLOPS
Операции расторных тензоров FP8
RTX PRO 6000 VRAM
96 GB
GDDR7 ECC — архитектура Blackwell
VRAM RTX 5090
32 GB GDDR7
Blackwell GB202 — 3352 GB/с пропускная способность
80 GB HBM2e
Рабочая лошадка корпоративного обучения AI. 3,35 ТФЛОПС FP64, NVLink 900 ГБ/с. Предпочтительна версия SXM для мульти-GPU NVSwitch сетей в системах DGX H100.
141 GB HBM3e
Преступник H100. Та же GPU-мина Hopper, но с в 1,76 раза большим объемом памяти и пропускной способностью 4,8 ТБ/с — критически важная для вывода LLM с длинными окнами контекста.
40 GB / 80 GB HBM2e
Модель предыдущего поколения всё ещё активно используется. 312 TFLOPS FP16 Tensor Core. Доступна в оригинальных и индивидуальных конфигурациях PCIe.
96 GB GDDR7 ECC
Самая мощная рабочая станция GPU, когда-либо созданная. Полный форм-фактор PCIe, поддержка NVLink, тензорные ядра 4-го поколения. Идеально подходит для локального вывода LLM и рендеринга.
32 GB GDDR7
Флагманский потребительский продукт NVIDIA на архитектуре Blackwell. 21 760 ядер CUDA, пропускная способность памяти 3 352 ГБ/с. Лучший однографический Майнер для смешанных рабочих нагрузок и инференса.
24 GB GDDR6X
Предыдущее поколение Ada. 16 384 CUDA ядра, пропускная способность 1008 ГБ/с. Всё ещё высокопроизводительный и более доступный по цене для кластеров для вывода моделей.
8 GB GDDR6
Профессиональный GPU низкопрофильного формата для задач по краевой инференции и выводу на дисплей. Минимальное энергопотребление, бесшумная работа, плотное размещение в стойке.
16 / 24 GB GDDR6
Инференс-оптимизированные GPU PCIe Ada и Ampere. Разработаны для серверных слотов с ограниченной мощностью — TDP 72 Вт — с высокой пропускной способностью INT8 для масштабного внедрения.
NVIDIA выпустила три основные микархитектуры GPU с момента начала бума в области искусственного интеллекта. Архитектура Hopper (H100, H200) представила Transformer Engine — аппаратный блок, который динамически переключает точность между FP8 и FP16 в рамках одного прохода слоя, чтобы повысить пропускную способность без существенной потери точности. Это стало прорывом в дизайне, который сделал коммерчески целесообразным обучение моделей более 70 миллиардов параметров.
Ada Lovelace (RTX 4090, L4, L40S) вывела 4-е поколение Tensor Core на рынок профессиональных и полупрофессиональных решений, а также значительно улучшила аппаратное обеспечение для трассировки лучей. Карты Ada занимают оптимальную нишу между доступностью для потребителей и профессиональными возможностями, что делает их доминирующим выбором для бутиковых развертываний для вывода и рабочих станций для креативного ИИ.
Blackwell (RTX 5090, RTX PRO 6000, GB200 NVL72) является текущим поколением. Blackwell представил дизайн GPU с двумя чипами для флагманских компонентов дата-центров, NVLink 5.0 со пропускной способностью 1,8 ТБ/с между чипами и пятое поколение Tensor Cores с поддержкой FP4. RTX PRO 6000 Blackwell обеспечивает 96 ГБ ECC памяти для уровня рабочей станции — больше, чем у H100 PCIe, что позволяет запускать ранее облачные рабочие нагрузки локально.
Три GPU, которые определяют современную инфраструктуру ИИ на уровне рабочих станций и односерверных систем.
Эталон для распределенного обучения. Вариант SXM, подключённый через NVSwitch, обязателен для узлов класса DGX с 8 GPU. Вариант PCIe подходит для стандартных серверов.
Та же GPU Hopper, что и H100, но почти в два раза больше объём памяти и значительно выше пропускная способность. Идеально подходит для обслуживания моделей с более чем 70 миллиардами параметров при масштабировании с длинными контекстами.
Больше видеопамяти, чем у H100, в стандартном PCIe-слоте. Подходит для любой рабочей станции или tower-сервера. Запускает модели объемом 70 миллиардов локально. RTX PRO 6000 Server Edition отключает видеовыходы для оптимизированного установки в стойку.
GPU, которая обучает модель, не обязательно является лучшей GPU для её сервиса. Обучение требует максимальных FLOPS и большого объема памяти для одновременного хранения параметров, градиентов и состояний оптимизатора — модель на 70 миллиардов с точной настройкой с помощью AdamW требует более 500 ГБ VRAM по всему кластеру. Для обучения в таком масштабе стандартной индустрией являются узлы H100 или H200 SXM, соединённые по NVSwitch, предлагающие сочетание вычислительной мощности и пропускной способности NVLink, необходимое для обеспечения подачи всех GPU.
Нагрузки на вывод информации меньше зависят от FLOPS и больше от объема памяти и пропускной способности. Квантованный 70-модель Б по INT4 занимает примерно 40 ГБ — это значит, что H200 может обслуживать её с запасом, а пара карт RTX PRO 6000 Blackwell, соединённых через NVLink Bridge, сделают то же самое. Для служб вывода с высокой пропускной способностью пропускная способность H200 4,8 ТБ/с позволяет поддерживать низкую задержку даже при одновременных пакетах запросов.
Использование локальной рабочей станции — исследования, креативный ИИ, локальный чат LLM, генерация изображений, синтез видео — хорошо обеспечивается RTX PRO 6000 Blackwell (96 ГБ), RTX 5090 (32 ГБ) или A100 (40/80 ГБ) в зависимости от требований к размеру модели. RTX 4090 остаётся наиболее конкурентоспособным по цене вариантом для пользователей, работающих с квантизированными моделями объемом менее 24 ГБ.
Мультиузловая кластер NVSwitch. Обязательно для крупномасштабного предварительного обучения и полного тонкой настройки.
Высокоскоростная память необходима для обработки длинных контекстов. NVLink Bridge для пар рабочих станций.
32–80 ГБ достаточно для квантованного обслуживания. Высокая пропускная способность INT8.
Большой объем VRAM на карте PCIe. Запускает модели размером 34B без квантизации. ECC для надежности.
Высокое количество ядер CUDA + быстрый пропуск GDDR7 идеально подходят для диффузионного вывода.
TDP менее 75 Вт. Одиночный слот или низкопрофильный. Плотное размещение в стойке.
ECC-память, сертифицированные драйверы, большие буферы кадров для 3D/CAD/симуляции.
Gb200 объединяет два GPU-чипа Blackwell в одном корпусе, соединённых по NVLink-C2C с пропускной способностью 1,8 ТБ/с — полностью устраняя узкое место PCIe между вычислительными блоками.
Режим высокой точности FP4 нового FP4 обеспечивает в два раза большую пропускную способность по сравнению с FP8 для задач вывода. Поддерживает точность благодаря микроскейлинговому формату NVIDIA (MXFP4).
Масштабирование пропускной способности удваивается по сравнению с Hopper — 1,8 ТБ/с двунаправленно на GPU. Важно для конфигурации стойки NVL72, которая объединяет 72 GPU Blackwell в единый логический блок.
Специализированный движок надежности, доступности и обслуживаемости для прогнозируемого обнаружения аппаратных сбоев — сокращает внеплановые простои в производственных кластерах инференса.
Отделённая аппаратным обеспечением TEE (среда доверенного выполнения) для GPU-работных нагрузок. Позволяет безопасно запускать проприетарные модели и чувствительные вычисления в общей облачной инфраструктуре.
96 GB GDDR7 ECC в стандартном форм-факторе PCIe с двумя слотами. Надежность уровня рабочей станции с памятью классом дата-центра. Server Edition исключает выводы для дисплея.
Графический процессор GeForce RTX 5090 выводит Blackwell на рынок потребительских и профессиональных устройств. Созданный на кристалле GB202 с 21 760 CUDA-ядрами и 32 ГБ памяти GDDR7, работающей с пропускной способностью 1 792 ГБ/с, он является самым мощным однопроцессорным GPU, который помещается в стандартный настольный ПК. Для исследователей и разработчиков в области AI, которым необходим локальный вывод и эксперименты без затрат на облако, RTX 5090 является рациональным выбором.
RTX PRO 6000 Blackwell принимает принципиально иной подход: вместо максимизации производительности для игр потребителей, NVIDIA разработала графический процессор для рабочих станций с 96 ГБ ECC GDDR7 памяти — больше, чем у любого предыдущего PCIe GPU от любого производителя. Варианты Server Edition и Max-Q Workstation Edition предназначены для установки в стойки и мобильного использования соответственно. Две карты RTX PRO 6000, соединённые через NVLink Bridge, обеспечивают 192 ГБ объединенной памяти — достаточной для работы с моделями с 70-миллиардными параметрами без квантования.
Для студий, исследовательских лабораторий и AI-стартапов, которые не могут или не захотят осуществлять все рабочие нагрузки в облаке, линия рабочих станций Blackwell полностью меняет ситуацию. Проектные модели остаются на месте. Задержка при выводе результатов снижается. Суверенитет данных сохраняется. Начальная стоимость оборудования амортизируется за счет счетов за облачное вывод моделей, которые в противном случае накапливались бы бесконечно.
Просмотрите наш полный ассортимент профессиональных GPU NVIDIA выше, от отдельных рабочих станций до многопроцессорных серверных конфигураций. Независимо от того, обучаете ли вы свою первую модель или масштабируете кластер для вывода, наша команда поможет вам подобрать подходящее оборудование в соответствии с вашими рабочими задачами и бюджетом.