증권사 리포트&코멘트
엔비디아, 구글 '디퓨전젬마' 전격 가속화...로컬 AI 4배 빨라진다
✅엔비디아, 구글 '디퓨전젬마' 전격 가속화...로컬 AI 4배 빨라진다
https://www.edaily.co.kr/News/Read?newsId=02863446645481064&media
📌구글 오픈 모델 최적화
엔비디아, 구글 딥마인드의 DiffusionGemma 최적화 기술 공개
지포스 RTX, RTX PRO, DGX Spark 등 하드웨어 전반에서 지원
로컬 PC부터 클라우드까지 저지연 AI 구동을 겨냥
📌텍스트 생성 방식 변화
DiffusionGemma는 이미지 생성 AI의 디퓨전 방식을 텍스트에 적용
기존 LLM처럼 토큰을 순차 생성하지 않고 최대 256개 토큰을 병렬 처리
대화형 AI, 에이전트, 온디바이스 어시스턴트에 유리한 구조
📌최대 4배 빠른 추론
단일 H100에서는 초당 1000개 토큰 처리
DGX Spark는 초당 150개, DGX Station은 최대 2000개 토큰 기록
동급 자기회귀 모델 대비 약 4배 빠른 성능을 제시
📌로컬 AI 생태계 확대
DiffusionGemma는 아파치 2.0 기반 오픈 웨이트 모델
허깅페이스, vLLM, 언슬로스에서 기본 지원
클라우드 비용 없이 로컬에서 테스트·파인튜닝이 가능
✅독립리서치 그로쓰리서치
https://t.me/growthresearch
이데일리
엔비디아, 구글 '디퓨전젬마' 전격 가속화…로컬 AI 4배 빨라진다
엔비디아(NVIDIA)가 구글 딥마인드의 차세대 오픈 웨이트 모델 ‘디퓨전젬마(DiffusionGemma)’를 자사 하드웨어 전반에서 최적화하며 로컬 AI 시장 공략에 속도를 낸다. 순차적으로 단어를 생성하는 기존 방식과 달리 텍스트 블록 전체를 한 번에 출력하는 혁...
외부 자료를 정리한 참고자료이며 투자 권유가 아닙니다. 기사·리포트의 저작권은 원저작자에게 있습니다. · 게시중단 요청