증권사 리포트&코멘트
엔비디아 블랙웰 울트라, DeepSeek-V3 사전학습에서 GPU당 처리량 3배 달성
💻 엔비디아 블랙웰 울트라, DeepSeek-V3 사전학습에서 GPU당 처리량 3배 달성
📌 벤치마크 결과
・DeepSeek-V3 671B 사전학습(Pre-Training) 기준, GPU당 처리량이 GB300 NVL72에서 1,648 TFLOPS 기록
・직전 세대 GB200 NVL72(Megatron-Core 2025년 초 기준) 606 TFLOPS 대비 약 3배 향상
・GB300은 2026년 하반기 Megatron-Core 기준
📌 성능 향상의 배경
・하드웨어-소프트웨어 익스트림 코디자인(extreme co-design)이 핵심 동력
・Megatron-Core, TorchTitan, JAX 등 주요 프레임워크 전반에 걸친 지속적 소프트웨어 최적화가 병행
GPU당 처리량이 세대 간 3배 뛰었다는 것은 단순 스펙 경쟁이 아니라, 동일 전력·랙 공간당 학습 처리 능력이 그만큼 개선됐다는 의미
💻반도체 소부장💻[그로쓰리서치]
https://t.me/growth_semi
Telegram
💻반도체 소부장💻[그로쓰리서치]
✅“AI 반도체 시대, 소재·부품·장비의 리서치 채널”✅ 채널이 다루는 핵심 영역 ① 소재 (Materials) ② 부품 (Components) ③ 장비 (Equipment) “복잡한 반도체 공급망을 쉽게 번역한다”
외부 자료를 정리한 참고자료이며 투자 권유가 아닙니다. 기사·리포트의 저작권은 원저작자에게 있습니다. · 게시중단 요청