Por que escolher a Heavy V para IA?
Para treino, fine-tuning e inferência local em escala, a
Heavy V IA combina
Threadripper PRO Zen 5 (até 96 núcleos) na CPU
com RTX PRO 6000 Blackwell (96 GB GDDR7 ECC) ou RTX 6000 Ada (48 GB ECC) na GPU.
A GPU é o componente mais crítico; a CPU evita gargalo de dataloaders; RAM ECC e NVMe Gen5 completam o pipeline.
Você configura no site e recebe workstation montada, testada sob carga de IA e com suporte Rocketz.
Quanta memória de vídeo preciso?
Llama 3 8B em INT4 (GGUF) roda em 6–8 GB; em FP16, ~16 GB. Mistral 7B segue perfil similar.
Mixtral 8×7B pede ~26 GB quantizado ou ~90 GB FP16. Llama 3 70B em Q4 cabe em ~40 GB com offload parcial;
FP16 exige 96 GB+ (RTX PRO 6000 Blackwell). Fine-tuning LoRA de 8B pede mínimo 24 GB de VRAM.
Quanta memória RAM preciso?
Regra prática: RAM ≥ 2× a VRAM total da GPU. Para Heavy V com 96 GB de VRAM, recomenda-se 256 GB DDR5 ECC;
workloads RAG + LLM + ETL simultâneos podem exigir 512 GB. Menos que isso causa thrashing e subutilização da GPU.
Preciso de mais de uma placa de vídeo?
Uma GPU basta para inferência e fine-tuning LoRA/QLoRA de modelos até ~13B (FP16) ou ~70B (Q4).
Multi-GPU (2–4× RTX PRO 6000) faz sentido para Llama 3 70B FP16, treino distribuído (DeepSpeed, FSDP),
serving multi-modelo com MIG ou throughput de inferência acima de ~200 tokens/s em batch.
Qual processador é o ideal?
Para workstation desktop, Threadripper PRO Zen 5 (Heavy V) oferece mais núcleos por watt e 128 lanes PCIe 5.0 —
ideal para multi-GPU e dataloaders agressivos. Intel Xeon W compete em single-thread e ecossistema corporativo;
para ML local com PyTorch, Threadripper PRO 9995WX lidera benchmarks multi-thread relevantes para data loading.
Preciso de SSD super rápido?
NVMe Gen4 (~7.000 MB/s) é suficiente para datasets médios e inferência. Gen5 (~14.000 MB/s) reduz gargalo de I/O
em treinos com imagem/vídeo de alta resolução — pode elevar utilização da GPU de ~60% para 90%+.
Evite SATA SSD como volume primário de treino.
Qual fonte de energia usar?
RTX PRO 6000 Blackwell consome até 600 W TDP. Sistema com 1× GPU + Threadripper PRO: fonte mínima 1.000 W, 80 Plus Platinum.
2× GPU: 1.600 W; 4× GPU: 2.200 W com cabos 12V-2x6 dedicados. A Heavy V dimensiona no configurador.
Preciso de water cooler?
Air cooling adequado sustenta 1× GPU workstation em carga contínua. Com 2+ GPUs de 600 W ou treinos 24/7,
water cooling (AIO ou custom loop) mantém temperaturas abaixo do thermal throttle — essencial para estabilidade de treinos longos.
Threadripper ou Ryzen comum?
Ryzen 9 ou Core Ultra bastam para IA leve com GeForce e Q4 (Heavy I/II). Com RTX PRO 6000 ou RTX 6000 Ada,
quantizações Q8/FP16 empurram pesos para RAM do sistema — dual-channel vira gargalo.
Threadripper PRO Zen 5 na Heavy V: oito canais DDR5 ECC, 128 lanes PCIe 5.0, até 4× GPU sem gargalo.
Funciona no Windows?
Ambos funcionam. Linux (Ubuntu 22.04/24.04 LTS) é referência para PyTorch, CUDA e Docker em produção.
Windows 11 + WSL2 cobre 95% dos fluxos de desenvolvimento; Ollama, ComfyUI e LM Studio rodam nativamente no Windows.
Para serving enterprise (Triton, Kubernetes), prefira Linux.
WSL2 resolve para desenvolvimento?
Sim, para desenvolvimento e experimentação. WSL2 expõe GPU NVIDIA via CUDA com performance próxima ao Linux nativo (~95%).
Limitações: I/O de disco cross-filesystem e networking avançado para clusters. Para treino multi-GPU intensivo, Linux nativo ou dual-boot é preferível.
Ollama roda na minha placa NVIDIA?
Sim, em GPUs com compute capability ≥ 7.0 (GTX 1660+). Performance escala com VRAM e bandwidth.
RTX PRO 6000 Blackwell entrega ~2–3× tokens/s vs. RTX 4070 Ti em Llama 3 8B Q4 (estimativa; varia por driver e build).
Qual a diferença para um PC gamer?
PC gamer: GeForce com 16–32 GB, drivers Game Ready, picos de consumo, sem ECC. PC para IA: GPU workstation (RTX PRO/RTX Ada)
com 48–96 GB ECC, drivers ISV estáveis, dissipação 24/7, CPU multichannel, RAM ECC e PSU dimensionada para carga contínua.
Qual o prazo de entrega e frete?
Frete gratuito para todo o Brasil com transportadora especializada e seguro.
Produção: até 15 dias úteis dias úteis após confirmação de pagamento.
Transporte: até 3 dias úteis (capitais) ou 7 dias (interior).
Qual a garantia?
2 anos em todos os componentes, 3 anos em processador e placa de vídeo, suporte técnico vitalício.