NVIDIA GeForce RTX 3060 3840SP

NVIDIA GeForce RTX 3060 3840SP
Análise da placa de vídeo NVIDIA GeForce RTX 3060 3840SP

NVIDIA GeForce RTX 3060 3840SP: uma rara versão OEM com GA106 completo

GeForce RTX 3060 3840SP é uma das versões mais incomuns da família RTX 3060. Ela não teve um lançamento varejista separado e foi encontrada predominantemente em sistemas OEM prontos. A principal diferença em relação à RTX 3060 padrão é o cristal GA106 completamente ativo com 3840 núcleos CUDA em vez de 3584.

Como ela se diferencia da RTX 3060 padrão

A RTX 3060 padrão utiliza 28 SM ativos, enquanto a versão 3840SP possui todos os 30 ativos. Juntamente com isso, o número de núcleos Tensor foi aumentado para 120, núcleos RT para 30, e blocos de texture para 120.

Versão CUDA SM Núcleos RT Núcleos Tensor
RTX 3060 3584 28 28 112
RTX 3060 3840SP 3840 30 30 120

As frequências na versão rara também são mais altas: o Boost atinge cerca de 1852 MHz, portanto, o desempenho teórico em FP32 está em torno de 14,2 TFLOPS, contra aproximadamente 12,7 TFLOPS da RTX 3060 padrão.

Por que ela tem apenas 6 GB de memória

A configuração OEM básica da RTX 3060 3840SP possui 6 GB GDDR6, um barramento de 192 bits e uma largura de banda de cerca de 336 GB/s.

Isso torna o modelo bastante curioso: ela tem mais blocos de computação do que a RTX 3060 padrão, mas metade da memória. Também existem versões com 12 GB, portanto, as características de uma placa OEM específica podem variar.

Quão mais rápida ela é

Os núcleos CUDA adicionais e as frequências mais altas oferecem um pequeno aumento de desempenho em relação à RTX 3060 padrão, mas não há uma revolução aqui. A versão 3840SP ainda é um representante da arquitetura Ampere e seu nível de desempenho fica significativamente abaixo da RTX 3060 Ti.

Na prática, é mais interessante considerá-la não como um produto separado, mas como uma rara revisão de hardware da RTX 3060.

Conclusão

GeForce RTX 3060 3840SP - uma rara versão OEM com GA106 completamente ativo.

Ela tem mais núcleos CUDA, RT e Tensor do que a RTX 3060 padrão, mas na maioria das vezes vinha apenas com 6 GB de memória. Não houve um lançamento massivo separado, portanto, hoje essa placa é interessante principalmente como uma variedade incomum da Ampere e um exemplar raro da família RTX 3060.

Básico

Nome do rótulo
NVIDIA
Plataforma
Desktop
Data de lançamento
January 2021
Nome do modelo
GeForce RTX 3060 3840SP
Geração
GeForce 30
Relógio Base
1627MHz
Relógio Boost
1852MHz
Interface de ônibus
PCIe 4.0 x16
Transistores
12,000 million
Núcleos RT
30
Núcleos Tensor
?
Os Tensor Cores são unidades de processamento especializadas projetadas especificamente para aprendizado profundo, oferecendo maior desempenho de treinamento e inferência em comparação ao treinamento FP32.
120
TMUs
?
As Unidades de Mapeamento de Textura (TMUs) servem como componentes da GPU, capazes de girar, dimensionar e distorcer imagens binárias.
120
Fundição
Samsung
Tamanho do Processo
8 nm
Arquitetura
Ampere

Especificações de memória

Tamanho da Memória
6GB
Tipo de Memória
GDDR6
Barramento de Memória
?
A largura do barramento de memória se refere ao número de bits de dados que a memória de vídeo pode transferir em um ciclo de clock. Quanto maior a largura do barramento, maior a quantidade de dados que pode ser transmitida instantaneamente.
192bit
Relógio de Memória
1750MHz
Largura de Banda
?
A largura de banda da memória se refere à taxa de transferência de dados entre o chip gráfico e a memória de vídeo. É medida em bytes por segundo.
336.0 GB/s

Tela e multimídia

Saídas
1x HDMI 2.1
3x DisplayPort 1.4a

Desempenho Teórico

Taxa de Pixel
?
A taxa de preenchimento de pixels refere-se ao número de pixels que uma unidade de processamento gráfico (GPU) pode renderizar por segundo, medida em MPixels/s ou GPixels/s.
88.90 GPixel/s
Taxa de Textura
?
A taxa de preenchimento de textura se refere ao número de elementos do mapa de textura (texels) que uma GPU pode mapear para pixels em um único segundo.
222.2 GTexel/s
FP16 (metade)
?
Uma métrica importante para medir o desempenho da GPU é a capacidade de computação de ponto flutuante. Números de ponto flutuante de meia precisão (16 bits) são usados em aplicações como aprendizado de máquina.
14.22 TFLOPS
FP64 (duplo)
?
Uma métrica importante para medir o desempenho da GPU é a capacidade de computação de ponto flutuante. Números de ponto flutuante de precisão dupla (64 bits) são necessários para computação científica.
222.2 GFLOPS
FP32 (flutuante)
?
Uma métrica importante para medir o desempenho da GPU é a capacidade de computação de ponto flutuante. Números de ponto flutuante de precisão simples (32 bits) são usados para tarefas comuns de processamento multimídia e gráfico, enquanto números de ponto flutuante de precisão dupla (64 bits) são necessários para computação científica que exige uma ampla faixa numérica e alta precisão. Números de ponto flutuante de meia precisão (16 bits) são usados para aplicações como aprendizado de máquina, onde uma precisão menor é aceitável.
14.504 TFLOPS

Diversos

Contagem de SM
?
Vários Processadores de Streaming (SPs), juntamente com outros recursos, formam um Multiprocessador de Streaming (SM), que também é referido como um núcleo principal da GPU.
30
Unidades de Sombreamento
?
A unidade de processamento mais fundamental é o Processador de Streaming (SP), onde instruções e tarefas específicas são executadas. GPUs realizam computação paralela.
3840
Cache L1
128 KB (per SM)
Cache L2
3MB
TDP
185W
Versão Vulkan
?
Vulkan é uma API gráfica e de computação multiplataforma do Khronos Group, que oferece alto desempenho e baixa sobrecarga de CPU. Ele permite que os desenvolvedores controlem a GPU diretamente, reduz a sobrecarga de renderização e oferece suporte a processadores multi-threading e multi-core.
1.3
Versão OpenCL
3.0
OpenGL
4.6
CUDA
8.6
DirectX
12 Ultimate (12_2)
Conectores de Energia
1x 12-pin
ROPs
?
O Raster Operations Pipeline (ROPs) é responsável por lidar com cálculos de iluminação e reflexão em jogos, além de gerenciar efeitos como anti-aliasing (AA), alta resolução, fumaça e fogo.
48
Modelo de Shader
6.7
PSU Sugerido
450W

Classificações

FP32 (flutuante)
Pontuação
14.504 TFLOPS

Comparado com outra GPU

FP32 (flutuante) / TFLOPS
15.045 +3.7%
13.847 -4.5%