NVIDIA Technical Blog
-
Agentic AI / Generative AINVIDIA Open Agent Safety Platform: 실리콘 수준 지속 에이전트 모니터링 레퍼런스
-
Agentic AI / Generative AINVIDIA OpenShell로 AI 에이전트에 런타임 제어 추가하기
-
Agentic AI / Generative AISWE-Serve가 밝혀낸 로컬 테스트와 실제 서버 제공 간의 격차
-
Agentic AI / Generative AINVIDIA 컨피덴셜 컴퓨팅을 통한 사역 환경에서의 고성능 프라이빗 프로덕션 AI 추론 구현
-
Agentic AI / Generative AINVIDIA Dynamo-Triton의 NVIDIA TensorRT Multi-Device 연동을 통한 다중 GPU 모델 서빙 단순화
최신
2026년 9월 28일
NVIDIA Open Agent Safety Platform: 실리콘 수준 지속 에이전트 모니터링 레퍼런스
NVIDIA Open Agent Safety Platform은 OpenShell 런타임과 BlueField-4 기반 NVIDIA Sentry를 결합해 AI 에이전트를 실리콘 수준에서 지속 모니터링합니다. 에이전트 안전을 위한 5가지 원칙과 3계층 구조를 확인하세요.
4 MIN READ
2026년 9월 28일
NVIDIA OpenShell로 AI 에이전트에 런타임 제어 추가하기
NVIDIA OpenShell 0.1.0으로 기존 AI 에이전트를 수정하지 않고 런타임 제어를 적용하는 방법을 소개합니다. 샌드박스 실행, 읽기 전용 API 정책, 자격 증명 보호, 형식적 정책 검증까지 예제와 함께 확인하세요.
5 MIN READ
2026년 9월 25일
SWE-Serve가 밝혀낸 로컬 테스트와 실제 서버 제공 간의 격차
AI 코딩 에이전트가 작성한 패치가 단위 테스트를 통과하더라도, 실제 모델을 로드해 요청을 처리하는 서버 실행 단계에서는 오작동을 일으킬 수…
5 MIN READ
2026년 9월 25일
NVIDIA 컨피덴셜 컴퓨팅을 통한 사역 환경에서의 고성능 프라이빗 프로덕션 AI 추론 구현
거대 언어 모델(LLM) 추론이 개인, 기업 및 규제 환경 전반에 걸쳐 민감한 정보와 독자적인 모델 컨텍스트를 처리하는 사례가 늘어남에 따라…
5 MIN READ
2026년 9월 23일
NVIDIA Dynamo-Triton의 NVIDIA TensorRT Multi-Device 연동을 통한 다중 GPU 모델 서빙 단순화
생성형 AI의 연산 및 메모리 요구량은 단일 GPU가 제공할 수 있는 수준을 지속적으로 뛰어넘고 있습니다.
5 MIN READ
2026년 9월 14일
에이전트 스킬로 NVIDIA Cosmos 3를 하루 만에 사후 훈련하는 방법
NVIDIA Cosmos 3 Nano를 TAO 에이전트 스킬과 코딩 에이전트로 하루 만에 사후 훈련하는 방법을 소개합니다. LoRA로 정확도 54.41%에서 87.14%로, AutoML 스윕으로 93.35%까지 끌어올린 과정을 확인하세요.
8 MIN READ
2026년 9월 11일
NVIDIA BioNeMo Inference Runtime을 활용한 고처리량 구조 예측
생체 분자 구조 예측은 이제 단백체(Proteome) 규모로 활발히 수행되고 있으며, 이 분야의 핵심 과제는 대량의 작업 목록을 파이프라인으로…
7 MIN READ
2026년 9월 11일
웨이퍼 출하부터 첫 토큰까지: Nemotron과 Palantir Foundry를 통한 공급망 전문성 코드화
NVIDIA는 세계에서 가장 크고 복잡한 공급망 네트워크 중 하나를 보유하고 있으며, 그 성능은 웨이퍼 출하(Wafer-out)부터 첫 토큰…
8 MIN READ