라벨이 Hopper 비교인 게시물 표시

NVIDIA Blackwell 아키텍처 총정리 — 2,080억 트랜지스터, FP4 시대 개막, AI 팩토리의 엔진

2024년 3월 GTC에서 젠슨 황 CEO가 직접 공개한 NVIDIA Blackwell 아키텍처는, Hopper 세대를 계승하며 생성형 AI와 가속 컴퓨팅의 새로운 기준을 제시했습니다. 2025~2026년 현재 본격적으로 양산에 들어간 Blackwell은 OpenAI의 GPT-5.3-Codex부터 주요 클라우드 사업자의 차세대 인프라까지, AI 산업 전반의 핵심 엔진으로 자리잡고 있습니다. NVIDIA 공식 페이지를 바탕으로 Blackwell 아키텍처의 핵심 기술과 제품 라인업을 정리합니다. 핵심 설계: 2,080억 트랜지스터의 듀얼 다이 GPU Blackwell 아키텍처의 가장 근본적인 혁신은 칩 설계 자체에 있습니다. NVIDIA는 TSMC의 맞춤형 4NP 공정으로 제조되는 2개의 레티클 한계 다이(die)를 칩 간 초당 10TB의 인터커넥트로 연결 하여 하나의 통합 GPU로 작동하게 만들었습니다. 총 2,080억 개의 트랜지스터 를 탑재했으며, 이는 이전 세대 Hopper(H100)의 800억 개 대비 약 2.6배에 달합니다. 단일 반도체 노광(리소그래피)의 물리적 한계를 듀얼 칩렛 설계로 돌파한 것으로, GPU 설계의 새로운 패러다임을 열었다는 평가를 받고 있습니다. 6가지 핵심 기술 혁신 1. 2세대 Transformer 엔진 & FP4 Tensor 코어 Blackwell의 2세대 Transformer 엔진은 맞춤형 Tensor 코어 기술과 TensorRT-LLM 및 NeMo 프레임워크의 혁신을 결합하여, LLM과 MoE(Mixture of Experts) 모델의 추론·학습을 가속화합니다. 가장 중요한 변화는 FP4(4비트 부동소수점) 정밀도의 도입 입니다. "마이크로 텐서 스케일링"이라는 정교한 스케일링 기법을 통해, FP8 대비 사...