NVIDIA Technical Blog
-
AI Platforms / DeploymentNVIDIA Rubin CPX, 100만 토큰 이상 컨텍스트 워크로드의 추론 성능과 효율을 가속하다
-
Generative AINVFP4, 16비트 정밀도와 4비트 성능으로 학습 가속
-
Content Creation / Rendering오픈 소스로 공개된 NVIDIA Audio2Face 애니메이션 모델
-
AI Platforms / DeploymentDynamo 0.4, 4배 더 빠른 성능과 SLO 기반 오토스케일링, 실시간 가시성 제공
-
Simulation / Modeling / Design슈퍼컴퓨터 없이도 수분 만에 극한 기상 예측하기
최신

2025년 9월 25일
NVIDIA Rubin CPX, 100만 토큰 이상 컨텍스트 워크로드의 추론 성능과 효율을 가속하다
AI에서 추론은 이제 가장 복잡한 과제에 당면한 영역이 되었습니다. 최신 모델은 에이전틱 AI로 진화하며, 다단계 추론과 지속적인 메모리…
3 MIN READ

2025년 9월 25일
NVFP4, 16비트 정밀도와 4비트 성능으로 학습 가속
최근 몇 년간 AI 워크로드는 폭발적으로 증가했습니다. 이는 거대 언어 모델(LLM)의 배포는 물론, 사전 학습과 후속 학습 과정에서 점점 더 많은…
6 MIN READ

2025년 9월 25일
오픈 소스로 공개된 NVIDIA Audio2Face 애니메이션 모델
생성형 AI는 거대 언어 모델(LLM)과 음성 모델을 활용해 비디오 게임부터 고객 서비스에 이르기까지 자연스러운 대화를 지원하는 지능형 3D…
4 MIN READ

2025년 9월 24일
Dynamo 0.4, 4배 더 빠른 성능과 SLO 기반 오토스케일링, 실시간 가시성 제공
최근 몇 주간 OpenAI의 gpt-oss와 Moonshot AI의 Kimi K2를 비롯한 새로운 오픈소스 모델들이 등장하면서 거대 언어…
6 MIN READ

2025년 9월 19일
슈퍼컴퓨터 없이도 수분 만에 극한 기상 예측하기
NVIDIA는 로렌스 버클리 국립연구소(Lawrence Berkeley National Laboratory, Berkeley Lab)와 협력하여…
3 MIN READ

2025년 9월 19일
AI 추론 지연 시간을 줄이기 위한 Speculative Decoding 소개
거대 언어 모델(LLM)로 텍스트를 생성할 때는 구조적인 한계로 인해 성능을 제대로 끌어내기 어려운 경우가 많습니다. GPU는 뛰어난 연산 성능을…
7 MIN READ

2025년 9월 17일
Python GPU 가속 비디오 처리를 위한 PyNvVideoCodec 2.0의 새로운 기능
Python에서 강력한 하드웨어 가속 비디오 처리가 더욱 간단해졌습니다. PyNvVideoCodec은 GPU 기반 비디오 인코딩, 디코딩…
3 MIN READ

2025년 9월 10일
NVIDIA RTX PRO 6000 Blackwell Server Edition으로 단백질 구조 추론 100배 이상 가속
단백질 구조를 이해하기 위한 경쟁은 그 어느 때보다 중요해졌습니다. 신약 개발을 앞당기고 미래 팬데믹에 대비하기 위해서는…
4 MIN READ