Em março de 2025, a NVIDIA anunciou a linha profissional RTX PRO 6000 baseada na arquitetura Blackwell e, pela primeira vez, lançou um mesmo modelo em três versões: Workstation Edition, Max-Q e Server Edition.
As diferenças vão além da nomenclatura. Cada versão foi desenvolvida para uma categoria específica de workload e infraestrutura.
Neste artigo, analisamos o que diferencia a RTX PRO 6000 Blackwell Server Edition das demais versões, por que os 96 GB de memória com ECC tornam essa GPU especialmente adequada para serviços de cloud e como a combinação de PCIe e refrigeração passiva pode representar uma alternativa economicamente mais eficiente aos aceleradores baseados em SXM em ambientes de locação.
NVIDIA RTX PRO 6000 Blackwell Series
Comparação das principais características das três versões da RTX PRO 6000:
| Parâmetro | Server Edition | Workstation Edition | Max-Q Edition |
| Formato | 4,4″ × 10,5″, 2 slots | 5,4″ × 12″, 2 slots | 4,4″ × 10,5″, 2 slots |
| Refrigeração | Dissipador passivo | Dois ventiladores com fluxo ativo | Um ventilador |
| Consumo de energia | 400–600 W, configurável | 600 W | 300 W |
| FP32 | 120 TFLOPS | 125 TFLOPS | 110 TFLOPS |
| Largura de banda | 1.597 GB/s | 1.792 GB/s | 1.792 GB/s |
| Aplicação | Servidores multi-GPU, locação em cloud | Workstations com uma GPU | Workstations multi-GPU de alta densidade |
ITGLOBAL.COM: soluções em cloud para empresas
ITGLOBAL.COM: soluções em cloud para empresas
O que essas diferenças representam
Server Edition: utiliza dissipador passivo em vez de ventiladores próprios. A refrigeração é realizada pelo fluxo de ar do chassi do servidor. Os dois modos de consumo, 400 W e 600 W, podem ser selecionados no hardware, permitindo reduzir geração de calor e consumo energético quando o workload não exige potência máxima.
Workstation Edition: utiliza dois ventiladores ativos e oferece a maior capacidade FP32 entre as três versões, com 125 TFLOPS. Foi desenvolvida para instalação individual em workstations. Em configurações de alta densidade com várias placas, o calor gerado por uma GPU pode afetar as demais.
Max-Q: ocupa uma posição intermediária. Utiliza um ventilador e limita o consumo a 300 W. Dessa forma, permite instalar entre duas e quatro GPUs em um único chassi sem depender de um sistema de refrigeração típico de servidores, com redução do desempenho para 110 TFLOPS.
O que é a NVIDIA RTX PRO 6000 Blackwell Server Edition
A RTX PRO 6000 Blackwell Server Edition ocupa uma posição específica no mercado de GPUs profissionais. É uma placa que combina 96 GB de memória de vídeo com ECC, refrigeração passiva e interface PCIe padrão, sem exigir a adoção de plataformas SXM de maior custo.
Esse conjunto de características levou a ITGLOBAL.COM a selecionar o modelo para sua oferta de GPU em cloud.
O cliente utiliza uma GPU voltada a servidores, com correção de erros de memória e capacidade para operação contínua. Diferentemente da H200, que requer servidores equipados com conectores SXM, a RTX PRO 6000 utiliza PCIe 5.0 x16.
A placa pode, portanto, operar em plataformas convencionais de servidores sem a necessidade de hardware especializado, contribuindo para reduzir o custo da locação e acelerar a implantação.
Principais vantagens da RTX PRO 6000 Blackwell Server Edition
96 GB de memória GDDR7 com ECC
Os 96 GB de VRAM representam o dobro da capacidade da geração anterior, a RTX 6000 Ada, equipada com 48 GB.
Esse volume de memória permite carregar modelos de linguagem de grande porte em uma única GPU sem necessariamente distribuir a carga entre vários aceleradores.
A presença de ECC acrescenta correção de erros de memória em hardware, um recurso relevante para workloads nos quais falhas pontuais nos dados podem comprometer o processamento.
A migração de GDDR6 para GDDR7 também elevou a largura de banda de memória em aproximadamente 1,7 vez.
Tensor Cores de quinta geração e FP4
O processamento em FP4 é uma das novidades introduzidas pela arquitetura Blackwell.
Quando um modelo é adaptado para FP4, o volume efetivo de memória disponível pode dobrar, enquanto a capacidade de processamento de inferência aumenta de forma significativa.
Segundo a NVIDIA, os novos Tensor Cores oferecem um ganho de aproximadamente três vezes em relação à geração anterior, passando de 1.457 TOPS para mais de 4.000 TOPS.
RT Cores de quarta geração
A nova geração oferece ganho de aproximadamente duas vezes em relação à arquitetura Ada Lovelace, chegando a 355 TFLOPS para ray tracing na versão para servidores.
A tecnologia RTX Mega Geometry permite processar até 100 vezes mais triângulos com ray tracing.
Para aplicações de simulação de engenharia, visualização arquitetônica e processamento de efeitos visuais, esse avanço amplia consideravelmente a capacidade gráfica disponível.
Confiabilidade para ambientes de servidor
A refrigeração passiva elimina ventiladores próprios na placa e reduz componentes mecânicos que exigem manutenção direta.
Em uma infraestrutura de cloud, o provedor assume a gestão do sistema de refrigeração e das condições operacionais do hardware.
A memória ECC adiciona controle de erros em hardware, enquanto a placa foi projetada para workloads contínuos em regime 24/7.
Tecnologias para compartilhamento de GPU: MIG e vGPU
A RTX PRO 6000 suporta dois mecanismos para distribuir os recursos de GPU entre vários usuários: MIG, baseado em particionamento de hardware, e vGPU, baseado em virtualização por software.
Na infraestrutura da ITGLOBAL.COM, as duas tecnologias estão disponíveis e o licenciamento NVIDIA é gerenciado pelo provedor.
MIG — Multi-Instance GPU
O MIG realiza o particionamento físico da GPU em instâncias isoladas com volumes definidos de memória, cache e núcleos de processamento.
É indicado para workloads previsíveis, nos quais uma mesma GPU deve atender vários usuários mantendo isolamento de recursos e evitando interferência direta entre as cargas.
vGPU
O vGPU adiciona uma camada de software no hipervisor por meio da qual as máquinas virtuais recebem acesso aos recursos da GPU.
A tecnologia pode operar em dois modos.
Time-slicing: várias máquinas virtuais compartilham uma GPU ou uma instância MIG por intervalos de tempo.
O modelo oferece maior flexibilidade, porém sem garantias rígidas de desempenho. É adequado para VDI, CAD e aplicações corporativas com cargas variáveis.
MIG-backed: cada máquina virtual recebe uma partição MIG dedicada, com volume garantido de memória e recursos computacionais.
Esse modelo oferece isolamento mais rígido e desempenho previsível. É indicado para workloads de IA, inferência e ambientes de desenvolvimento nos quais a estabilidade da capacidade computacional é um requisito.
Ambos os modos estão disponíveis para clientes da ITGLOBAL.COM por meio da licença NVIDIA AI Enterprise mantida pelo provedor.
A escolha depende do perfil da aplicação: para maior flexibilidade e número de usuários, o time-slicing pode ser mais adequado; quando o workload exige desempenho garantido sob carga, o MIG-backed oferece maior previsibilidade.
Especificações técnicas
Comparação da RTX PRO 6000 Server Edition com as gerações anteriores de GPUs profissionais NVIDIA:
| Parâmetro | RTX PRO 6000 Server Edition | RTX 6000 Ada — geração anterior | RTX A6000 — geração anterior |
| Arquitetura | Blackwell | Ada Lovelace | Ampere |
| CUDA Cores | 24.064 | 18.176 | 10.752 |
| Tensor Cores | 5ª geração, FP4 | 4ª geração, FP8 | 3ª geração |
| RT Cores | 4ª geração | 3ª geração | 2ª geração |
| Memória de vídeo | 96 GB GDDR7 ECC | 48 GB GDDR6 | 48 GB GDDR6 |
| Barramento de memória | 512-bit | 384-bit | 384-bit |
| Largura de banda | 1.597 GB/s | 960 GB/s | 768 GB/s |
| FP32 | 120 TFLOPS | 91 TFLOPS | 39 TFLOPS |
| Desempenho de IA | 4.000+ TOPS | 1.457 TOPS | 310 TOPS |
| Consumo de energia | 400–600 W | 300 W | 300 W |
| Interface | PCIe 5.0 x16 | PCIe 4.0 x16 | PCIe 4.0 x16 |
| Refrigeração | Dissipador passivo | Ativa | Ativa |
| Blocos de mídia | NVENC de 9ª geração, NVDEC de 6ª geração | NVENC de 8ª geração | NVENC de 7ª geração |
Em relação à RTX A6000 baseada em Ampere, os principais ganhos são:
- aproximadamente 3 vezes em FP32;
- aproximadamente 13 vezes em desempenho de IA, comparando FP4 com INT8;
- aproximadamente 2 vezes em largura de banda de memória.
Aplicações em servidores e GPU Cloud
O que a RTX PRO 6000 Server Edition oferece às empresas no modelo de locação
Acesso à GPU sem aquisição de hardware.
Não é necessário comprar a placa, o servidor, sistemas de armazenamento ou implementar a infraestrutura de refrigeração. A ITGLOBAL.COM fornece esses recursos como serviço e o cliente utiliza a capacidade por meio de pagamento mensal.
Pagamento mensal sem investimento inicial em hardware.
O orçamento não fica imobilizado em equipamentos sujeitos a ciclos rápidos de atualização tecnológica. A capacidade pode ser ampliada conforme a evolução do projeto.
vGPU para estações de trabalho remotas.
O suporte a NVIDIA vGPU permite criar ambientes acelerados por GPU para engenheiros e designers que utilizam aplicações de CAD, BIM e edição de vídeo sem depender de uma workstation física localizada no escritório.
Como funciona na ITGLOBAL.COM
A ITGLOBAL.COM disponibiliza a NVIDIA RTX PRO 6000 Blackwell Server Edition para locação.
São oferecidas configurações com 12, 24, 48 e 96 GB de memória de vídeo por GPU, com suporte a até quatro placas por servidor.
Principais aplicações na cloud da ITGLOBAL.COM
- Inferência de LLM: execução de modelos de linguagem sem aquisição de um cluster próprio de GPUs.
- Estações de trabalho virtuais: ambientes acelerados por GPU com vGPU para engenheiros e designers.
- Desenvolvimento de IA: ambientes previamente configurados com CUDA, PyTorch e Docker para experimentação e prototipagem.
- Renderização e processamento de vídeo: processamento em lote utilizando várias GPUs, inclusive fora do horário comercial.
Da solicitação ao primeiro experimento, a implantação pode ser concluída em poucas horas.
Os servidores são operados com SLA de 99,95% e suporte técnico 24/7.
Comparação com outras GPUs de alta capacidade de memória
Para posicionar a RTX PRO 6000 em relação a outras opções destinadas a IA e HPC, é possível compará-la com dois aceleradores amplamente utilizados nesse segmento: NVIDIA H200 e NVIDIA A100.
Os três modelos possuem pelo menos 80 GB de memória:
| Parâmetro | RTX PRO 6000 SE | H200 — SXM | A100 — 80 GB |
| Memória | 96 GB GDDR7 ECC | 141 GB HBM3e | 80 GB HBM2e |
| Largura de banda | 1.597 GB/s | 4.800 GB/s | 2.039 GB/s |
| FP32 | 120 TFLOPS | 67 TFLOPS | 19,5 TFLOPS |
| Preço de uma placa nova, US$ | a partir de 18.000 | 40.000–50.000 | 10.000–15.000, usada |
| Refrigeração | Passiva | Passiva, SXM | Passiva, SXM |
| ECC | Sim | Sim | Sim |
| NVLink | Não | Sim, 900 GB/s | Sim, 600 GB/s |
| Transformer Engine | Não | Sim, FP8 nativo | Não |
| Interface | PCIe 5.0 x16 | SXM5 | SXM4 |
A RTX PRO 6000 Server Edition apresenta o maior desempenho FP32 entre as três placas comparadas, com 120 TFLOPS, além do menor custo por gigabyte de memória segundo os valores utilizados nesta comparação.
Em largura de banda de memória, fica abaixo da H200 e da A100. Essa diferença está ligada, entre outros fatores, ao uso da interface PCIe padrão em lugar da arquitetura especializada SXM.
Quando a aplicação não depende de NVLink nem exige centenas de gigabytes de memória HBM, a RTX PRO 6000 pode oferecer uma relação entre capacidade, desempenho e custo mais favorável.
Quando considerar a locação da RTX PRO 6000
- inferência de LLM e modelos de IA, incluindo modelos 70B+ em uma única placa com INT4;
- estações de trabalho virtuais com vGPU ou MIG para CAD, BIM e 3D;
- renderização, processamento de vídeo e cálculos de engenharia;
- desenvolvimento de IA e projetos-piloto sem CAPEX inicial.
Quando a H200 pode ser mais adequada
- treinamento de LLM do zero, com 141 GB HBM3e e NVLink;
- inferência de alta carga com centenas de solicitações simultâneas;
- execução de modelos 70B+ em FP16 sem quantização.
Conclusão
A RTX PRO 6000 Blackwell Server Edition é uma GPU profissional NVIDIA com 96 GB de memória, ECC e refrigeração passiva.
Esse volume de memória permite executar workloads de inferência de LLM da classe 70B em uma única GPU em configurações compatíveis com essa capacidade. Em relação à RTX 6000 Ada da geração anterior, a memória disponível foi duplicada.
Para empresas, o modelo também permite implementar projetos de IA sem necessidade de adquirir de imediato um cluster próprio de GPUs, servidores e infraestrutura de refrigeração.
A ITGLOBAL.COM disponibiliza essa capacidade em modelo de locação, com pagamento mensal e possibilidade de iniciar projetos-piloto em poucas horas.
Para inferência, aplicações gráficas e desenvolvimento de IA em cloud, a RTX PRO 6000 Server Edition reúne alta capacidade de memória, virtualização de GPU e compatibilidade com plataformas de servidor baseadas em PCIe.