NVIDIA GeForce RTX 4090 vs Intel Data Center GPU Max Subsystem

GPU 사양 비교

그래픽 카드

출시일
Sep 2022
Jan 2023
세대
GeForce 40
Data Center GPU
유형
Desktop
Professional
버스 인터페이스
PCIe 4.0 x16
PCIe 5.0 x16

클럭 속도

기본 클럭
2235 MHz
900 MHz
부스트 클럭
2520 MHz
1600 MHz
메모리 클럭
1313 MHz
1565 MHz

메모리

메모리 크기
24GB
128GB
메모리 타입
GDDR6X
HBM2e
메모리 버스
384bit
8192bit
대역폭
1.01TB/s
3205GB/s

렌더링 설정

스트림 프로세서 개수
128
-
새딩 유닛
16384
16384
텍스처 매핑 유닛
512
1024
렌더 출력 파이프라인
176
0
텐서 코어
512
1024
레이 트레이싱 코어
128
128
L1 캐시
128 KB (per SM)
64 KB (per EU)
L2 캐시
72 MB
408 MB

이론적 성능

픽셀 속도
443.5 GPixel/s
0 MPixel/s
텍스처 속도
1290.2 GTexel/s
1638 GTexel/s
FP16 (반 정밀도)
82.58 TFLOPS
52.43 TFLOPS
FP32 (단 정밀도)
82.58 TFLOPS
52.43 TFLOPS
FP64 (배 정밀도)
1290.2 GFLOPS
52.43 TFLOPS

그래픽 프로세서

GPU 이름
AD102
Ponte Vecchio
GPU 변형
AD102-300-A1
-
아키텍처
Ada Lovelace
Generation 12.5
파운드리
TSMC
Intel
제조 공정 크기
5 nm
10 nm
트랜지스터
76.3 billion
100 billion
다이 크기
609 mm²
1280 mm²

보드 디자인

TDP
450W
2400W
권장 전원 공급 장치
850 W
2800 W
출력 포트
1x HDMI 2.13x DisplayPort 1.4a
No outputs
전원 연결자
1x 16-pin
1x 16-pin

그래픽 기능

DirectX
12 Ultimate (12_2)
12 (12_1)
OpenGL
4.6
4.6
OpenCL
3.0
3.0
Vulkan
1.4
N/A
CUDA
8.9
-
쉐이더 모델
6.8
6.6