Intel Data Center GPU Max Subsystem vs NVIDIA GeForce RTX 4090

GPU 사양 비교

그래픽 카드

출시일
Jan 2023
Sep 2022
세대
Data Center GPU
GeForce 40
유형
Professional
Desktop
버스 인터페이스
PCIe 5.0 x16
PCIe 4.0 x16

클럭 속도

기본 클럭
900 MHz
2235 MHz
부스트 클럭
1600 MHz
2520 MHz
메모리 클럭
1565 MHz
1313 MHz

메모리

메모리 크기
128GB
24GB
메모리 타입
HBM2e
GDDR6X
메모리 버스
8192bit
384bit
대역폭
3205GB/s
1.01TB/s

렌더링 설정

새딩 유닛
16384
16384
텍스처 매핑 유닛
1024
512
렌더 출력 파이프라인
0
176
텐서 코어
1024
512
레이 트레이싱 코어
128
128
L1 캐시
64 KB (per EU)
128 KB (per SM)
L2 캐시
408 MB
72 MB
스트림 프로세서 개수
-
128

이론적 성능

픽셀 속도
0 MPixel/s
443.5 GPixel/s
텍스처 속도
1638 GTexel/s
1290.2 GTexel/s
FP16 (반 정밀도)
52.43 TFLOPS
82.58 TFLOPS
FP32 (단 정밀도)
52.43 TFLOPS
82.58 TFLOPS
FP64 (배 정밀도)
52.43 TFLOPS
1290.2 GFLOPS

그래픽 프로세서

GPU 이름
Ponte Vecchio
AD102
아키텍처
Generation 12.5
Ada Lovelace
파운드리
Intel
TSMC
제조 공정 크기
10 nm
5 nm
트랜지스터
100 billion
76.3 billion
다이 크기
1280 mm²
609 mm²
GPU 변형
-
AD102-300-A1

보드 디자인

TDP
2400W
450W
권장 전원 공급 장치
2800 W
850 W
출력 포트
No outputs
1x HDMI 2.13x DisplayPort 1.4a
전원 연결자
1x 16-pin
1x 16-pin

그래픽 기능

DirectX
12 (12_1)
12 Ultimate (12_2)
OpenGL
4.6
4.6
OpenCL
3.0
3.0
Vulkan
N/A
1.4
쉐이더 모델
6.6
6.8
CUDA
-
8.9