Compre hardware de AI na MillionMiner: GPUs NVIDIA para AI, servidores GPU pré-construídos e armazenamento empresarial, tudo de um único fornecedor. Disponível para as categorias consumidor, profissional e data centre, desde a RTX 5090 e RTX 4090 até a A100, H100 e RTX PRO 6000 Blackwell, com estações de trabalho de GPU única até nós com 8 GPUs e armazenamento de alta capacidade correspondente.
Tudo é novo, com garantia do fabricante e envia grátis para todo o mundo DDP, portanto, o preço no checkout é o custo final de entrega. Cuidamos da aquisição B2B e do hospedagem de GPUs para unidades individuais ou clusters completos. Compre GPUs, servidores e armazenamento abaixo.
Navegue por Tipo
Nenhum produto encontrado para ""
Compre placas de vídeo NVIDIA na MillionMiner, desde modelos de consumo Blackwell até classes de data center, para cargas de trabalho de IA e profissionais. Os cartões disponíveis incluem o RTX 5090 32GB e RTX 4090 24GB nas variantes blower, o RTX PRO 6000 Blackwell 96GB e as GPUs Tensor Core A100 e H100. Novos, com garantia do fabricante, a menos que uma lista indique o contrário. Cada GPU é enviada gratuitamente para qualquer lugar do mundo com DDP, portanto, o preço no checkout é o custo final de entrega. Para configurações com várias placas, consulte nossos servidores GPU pré-configurados ou deixe que nossas GPUs sejam implantadas em nosso Host US, com energia e refrigeração providenciadas. Veja toda a nossa linha de GPUs abaixo.
Compre servidores GPU pré-montados e estações de trabalho AI na MillionMiner, montados de acordo com especificações, testados sob carga e enviados prontos para operar. As configurações disponíveis variam de estações de trabalho com GPU única RTX 5090 até sistemas com dual-GPU Threadripper PRO com 128 lanes PCIe 5.0, além de nós com quatro e oito GPUs, sendo um nó com 8-GPU RTX 5090 capaz de entregar aproximadamente 838 TFLOPS de FP32. Cada servidor é enviado novo, com garantia e DDP gratuita em todo o mundo, portanto, o preço no checkout é o custo final de chegada, com estabilidade validada antes de sair de nossa loja. Compre para operar por conta própria ou implante em nosso data centre nos EUA com gerenciamento remoto. Adquira servidores GPU e estações de trabalho AI abaixo.
Compre armazenamento empresarial na MillionMiner para dados de treinamento de IA, pesos de modelos e nós de blockchain. Os discos disponíveis incluem Seagate Exos de 16TB e Western Digital Ultrastar de 18TB com gás hélio, ambos gravados em CMR, além de SSDs NVMe, todos testados e completamente apagados antes da revenda e com uma classificação de cerca de 2,5 milhões de horas MTBF para uma carga de trabalho anual de 550TB. Cada disco é enviado gratuitamente para qualquer parte do mundo DDP, portanto, o preço no checkout é o custo final de chegada. Compre sozinho ou combine com GPUs e um servidor da nossa linha de Hardware de IA para uma configuração completa. Adquira armazenamento empresarial abaixo.
Cada grande modelo de linguagem, modelo de difusão, simulação científica e pipeline de inferência de alto throughput roda em um conjunto reduzido de hardware especializado. GPUs de data centre da NVIDIA, plataformas de servidores de IA projetadas especificamente e armazenamento de grau empresarial formam o substrato físico da revolução de IA.
Fornecemos a stack completa: GPUs profissionais de IA, do H100 e H200 ao RTX PRO 6000 Blackwell e RTX 5090; plataformas de servidores de IA completas, de nós de estação de trabalho com 2 GPUs a sistemas de escala rack NVIDIA DGX H200 e GB200 NVL72; e armazenamento empresarial, de HDDs nearline de alta capacidade de 20–24 TB a SSDs PCIe 5.0 NVMe de alta resistência.
GPUs de IA
H100, H200, RTX PRO 6000 Blackwell, A100, RTX 5090 e mais
Servidores de IA
DGX H100/H200, HGX, GB200 NVL72 e nós personalizados
Armazenamento Empresarial
Discos rígidos nearline de 16–32 TB e SSDs NVMe de alta resistência
Pedidos B2B e em Grande Quantidade
Preços por volume, logística de frete e faturamento empresarial
Quer você precise de uma GPU para estação de trabalho ou de uma implantação de IA em escala de rack completa, tudo é despachado do estoque com entrega DDP gratuita em todo o mundo.
Aceleradores profissionais NVIDIA para treinamento de IA, inferência e HPC. H100, H200, A100, RTX PRO 6000 Blackwell (96 GB), RTX 5090, RTX 4090, T1000, L4 e mais.
Plataformas completas de servidores AI multi-GPU. DGX H100/H200, nós OEM HGX, sistemas de escala rack GB200 NVL72 e torres personalizadas de estação de trabalho multi-GPU.
Discos rígidos de alta capacidade e SSDs NVMe empresariais para lagos de dados de treinamento de IA, armazenamento de pontos de verificação e infraestrutura de servidores. Seagate, Western Digital, Samsung.
Toda carga de trabalho de IA exige as três camadas. Compreender como elas interagem ajuda-o a adquirir o hardware adequado desde o início.
3.9 PFLOPS
H100 — Desempenho do tensor esparso FP8
900 GB/s
Banda larga por GPU do NVSwitch — DGX H100
14 GB/s
Leitura sequencial NVMe PCIe 5.0
O armazenamento fornece dados para a camada CPU/RAM, que pré-carrega lotes de treinamento na memória GPU através do PCIe. A GPU realiza passes forward e backward usando seus Tensor Cores. Os gradientes e pontos de verificação são gravados de volta no armazenamento NVMe. Múltiplas GPUs comunicam-se via NVSwitch para paralelismo de dados e modelo. Todo o ciclo funciona continuamente — a taxa de transferência de armazenamento, a largura de banda do servidor e a memória da GPU representam cada um uma potencial limitação.
A NVIDIA lançou três gerações de microarquitetura de GPU de IA desde que o boom de deep learning acelerou. Cada geração introduziu recursos a nível de hardware que mudaram fundamentalmente quais cargas de trabalho de IA são viáveis economicamente em escala.
Ampere (A100, 2020) estabeleceu o manual moderno de GPUs para centros de dados: grande capacidade de memória HBM2e, NVLink para escalabilidade multi-GPU e Núcleos Tensor de 3ª geração com TF32, FP16 e precisão INT8. O A100 de 80 GB continua sendo um dos acceleradores de IA mais amplamente implantados no mundo.
Hopper (H100, H200, 2022–2023) introduziu o Transformer Engine — hardware dedicado que seleciona dinamicamente a precisão FP8 ou FP16 por camada, entregando até 4× a taxa de transferência do Ampere para arquiteturas de transformer. Blackwell (GB200, RTX PRO 6000, RTX 5090, 2024–2025) avançou ainda mais with design duplo de GPU, FP4 Tensor Cores, NVLink 5.0 a 1,8 TB/s, e — na RTX PRO 6000 — 96 GB de ECC GDDR7 em uma placa de workstation PCIe.
312 TFLOPS FP16 · 80 GB HBM2e · 2 TB/s BW
3.9 PFLOPS FP8 · 80 GB HBM2e · 3.35 TB/s BW
3.9 PFLOPS FP8 · 141 GB HBM3e · 4.8 TB/s BW
5th-gen TC FP4 · 96 GB GDDR7 ECC · ~1.8 TB/s BW
21,760 CUDA · 32 GB GDDR7 · 3,352 GB/s BW
1.44 ExaFLOPS FP4 · 13.5 TB HBM3e · 345 TB/s total
Entrar em contato com Vendas
Solicite uma cotação para o seu projeto
GPUs de IA
H100, H200, RTX PRO 6000 e mais
Servidores AI
DGX, HGX, GB200 NVL72
Armazenamento Empresarial
HDDs, SSDs NVMe, pedidos por atacado
Hospedagem de Miner ASIC
Coloque seus Miner conosco
Perguntas Frequentes
Envio, garantia e pagamentos
Sobre a MillionMiner
Mais de 30.000 unidades enviadas globalmente
Notícias & Guias
Últimos artigos sobre hardware de IA
Fornecemos três categorias de hardware profissional de AI:GPU de IA(NVIDIA H100, H200, A100, RTX PRO 6000 Blackwell, RTX 5090, T1000, L4 e mais)Servidores de IA(DGX H100/H200, nós OEM HGX, GB200 NVL72 e estações de trabalho e plataformas de montagem em rack personalizadas com múltiplas GPU), eArmazenamento Empresarial(discos rígidos nearline Seagate EXOS 20–24 TB, WD Gold/Ultrastar, SSDs NVMe Samsung PM9A3, Seagate Nytro e série Micron 7450). Todos os itens são enviados com entrega DDP gratuita para todo o mundo.
O H100 e o H200 compartilham o mesmo die Hopper do GPU e desempenho de computação idêntico (~3,9 PFLOPS FP8 esparso). O H200 substitui o HBM2e por HBM3e, ganhando 141 GB de capacidade (vs 80 GB) e 4,8 TB/s de largura de banda (vs 3,35 TB/s) — fundamental para o serviço de inferência de modelos grandes. Tanto o H100 quanto o H200 estão disponíveis nas formas SXM (NVSwitch, multi-GPU de alta largura de banda) e PCIe (servidor padrão). O RTX PRO 6000 Blackwell é uma GPU de estação de trabalho/rack que utiliza a arquitetura Blackwell: 96 GB de ECC GDDR7 em uma placa PCIe de duplo slot, Núcleos Tensor de 5ª geração com suporte a FP4, mas menor desempenho agregado de FLOPS do que o H100/H200. É a melhor escolha quando a capacidade de memória em uma slot PCIe é prioridade.
NVSwitch é um ASIC dedicado que forma uma interconexão em malha completa entre todas as GPUs em um sistema de servidor AI. Em um DGX H100, 4 ASICs NVSwitch conectam 8 GPUs H100 de modo que cada GPU possa se comunicar com todas as outras GPUs a 900 GB/s simultaneamente — muito além do que o PCIe pode oferecer. Sem NVSwitch, o treinamento multi-GPU requer operações AllReduce via PCIe (~64 GB/s), o que se torna um gargalo severo para cargas de trabalho de tensor e paralelismo de modelo em modelos grandes. NVSwitch está disponível apenas em servidores no formato SXM (DGX, HGX).
Como referência: para ajuste fino de um Miner de 7–13B em um conjunto de dados personalizado, de 1 a 4 TB de SSD NVMe são suficientes para o conjunto de dados, pontos de verificação e pesos do modelo. Para pré-treinamento ou ajuste fino de modelos de 70B+, planeje de 10 a 100 TB de armazenamento rápido, dependendo da escala do seu conjunto de dados. Na escala de petabytes (execuções completas de pré-treinamento), um cluster de armazenamento distribuído usando HDDs Seagate EXOS ou WD Ultrastar nearline em uma configuração Ceph/Lustre é padrão. Recomendamos uma arquitetura em camadas: NVMe empresarial para I/O quente (pontos de verificação, lotes ativos) e HDDs de alta capacidade para o lago de dados.
Depende da precisão. Em FP16, um modelo de 70B requer aproximadamente 140 GB de VRAM — somente o H200 (141 GB) pode suportá-lo em uma GPU na precisão total. Com quantização INT8 (~70 GB), o H200 ou um H100 de 80 GB lidam com isso, deixando espaço para o cache KV. Em INT4 (GGUF Q4, aproximadamente 35–40 GB), o RTX PRO 6000 Blackwell (96 GB) executa com tranquilidade, oferecendo ampla margem para o cache KV. Em INT4 com quantização extrema (~20–25 GB), até um RTX 5090 (32 GB) pode servir modelos de 70B.
Sim. OferecemosEnvio DDP gratuito em todo o mundoem todos os pedidos. DDP (Delivered Duty Paid) significa que cuidamos da exportação, frete internacional, liberação aduaneira e pagamento de impostos de importação — o preço que você vê é o preço que você paga. Pedidos de GPU e armazenamento são enviados em até 1–3 dias úteis. Sistemas de servidores grandes podem requerer um tempo adicional de preparação e frete;Contate-nospara um cronograma específico.
Sim. A MillionMiner realiza a aquisição de infraestrutura empresarial, de instituições de pesquisa e de cloud. Preços por volume estão disponíveis para pedidos de múltiplas unidades de GPU, unidades de armazenamento em pallet e sistemas completos de servidores.Contate nossa equipe de vendasCom seus requisitos — modelo, quantidade, local de entrega e prazo — e forneceremos uma cotação dedicada com logística de frete incluída.
Servidores PCIe de nível de entrada com 2 GPU consomem entre 2 e 4 kW e podem usar refrigeração a ar padrão. Um DGX H100 com 8 GPU consome até 10,2 kW e requer circuitos duplos de 30A, 240V (América do Norte) ou 3 fases de 32A (Europa). O GB200 NVL72 consome até 120 kW por rack e requer refrigeração líquida direta e uma alimentação de energia trifásica dedicada — o planejamento da instalação é obrigatório antes do pedido. Para cartões GPU individuais, o RTX PRO 6000 Blackwell consome 300 W e cabe em qualquer estação de trabalho padrão com fonte de alimentação suficiente.
Nossa equipe está disponível 24/7 via WhatsApp (+49 176 777 888 33), e-mail e telefone. Assistimos na seleção de GPU para cargas de trabalho específicas, design de clusters multi-GPU, comparações de plataformas de servidores, planejamento de arquitetura de armazenamento e aquisição B2B.Contate-nosou visite nossoPerguntas Frequentespara respostas instantâneas.
Navegue pelos GPUs, servidores e armazenamento acima — ou converse com nossa equipe para uma recomendação completa de infraestrutura com base na sua carga de trabalho, escala e orçamento.