AI agent
2026년 8월 14일
NVIDIA Nemotron 3.5 Lightning, 장기 실행 에이전트를 위한 빠르고 정확한 특화 작업 실행 제공
장기 실행 AI 에이전트는 대부분의 시간을 툴 호출, 결과 검증, 서브 에이전트 작업 위임과 같은 고빈도 실행 단계에 소모합니다.
5 MIN READ
2026년 8월 14일
NVIDIA NeMo Switchyard로 AI 에이전트 워크로드를 여러 모델에 분산 라우팅하기
AI 에이전트를 개발할 때 단 하나의 모델만 고집할 필요는 없습니다. 작업 종류나 진행 단계에 따라 모델마다 강점, 단점…
7 MIN READ
2026년 8월 7일
NVIDIA Vera Storage 벤치마크: AI 네이티브 스토리지를 위한 더 빠른 암호화, 압축, 무결성 검사 및 복구
스토리지는 에이전틱 AI 워크플로우의 핵심 요소로 동작합니다. 에이전트가 기업 지식을 검색하고, 영구 메모리에 접근하며…
8 MIN READ
2026년 7월 27일
AI 모델 성능을 끌어올리는 에이전트 하네스스의 6가지 핵심 기능
훌륭한 AI 에이전트를 만들 때 좋은 모델을 고르는 건 시작에 불과합니다. 진짜 핵심은 모델을 감싸고 있는 아키텍처, 즉 ‘하네스(Harness)’…
6 MIN READ
2026년 7월 24일
NVIDIA Rubin GPU 아키텍처 심층 분석: 에이전틱 AI 시대를 이끄는 힘
단일 AI 모델 학습과 1:1 채팅 인터페이스로 시작했던 AI는 이제 대규모 인텔리전스를 끊임없이 생산해 내는 상시 가동형 AI 팩토리로…
10 MIN READ
2026년 7월 13일
NVIDIA Nemotron 3 Ultra, 장기 실행 에이전트를 위한 더 빠르고 효율적인 추론 지원
단순한 단일 턴 챗봇이 복잡한 워크플로우를 완수하기 위해 추론하고, 맥락을 유지하고, 도구를 사용하며 여러 턴에 걸쳐 효율적으로 실행되는 장기 실행…
6 MIN READ
2026년 7월 3일
NVIDIA Nemotron으로 검색 증강 생성(RAG) 에이전트 구축하기
학습 데이터에만 제한되는 기존 LLM 기반 시스템과 달리, 검색 증강 생성(RAG)은 관련 외부 정보를 통합하여 텍스트 생성 품질을 향상시킵니다.
10 MIN READ
2026년 7월 3일
OpenRouter에서 NVIDIA Nemotron으로 보고서 생성 AI 에이전트 구축하기
사전에 정의된 경로만 따르는 전통적인 시스템과 달리, AI 에이전트는 거대 언어 모델(LLM)을 활용해 스스로 의사결정을 내리고…
9 MIN READ
2026년 7월 1일
NVIDIA Nemotron으로 1시간 만에 나만의 Bash 컴퓨터 사용 에이전트 만들기
단 하나의 명령어도 직접 입력하지 않고, 컴퓨터와 대화하는 것만으로 Bash 터미널 작업을 수행할 수 있다면 어떨까요?
8 MIN READ
2026년 6월 26일
DFlash 추론 가속 디코딩으로 NVIDIA Blackwell에서 최대 15배 추론 성능 향상하기
AI 시스템이 단일 대화형 상호작용에서 조율된 멀티 에이전트 워크플로우로 진화함에 따라 저지연 추론의 중요성이 더욱 커지고 있습니다.
5 MIN READ
2026년 6월 12일
NVIDIA, 첫 에이전트 AI 벤치마크에서 선도적인 에이전트 코딩 성능 달성
AI 에이전트는 추론 워크로드의 복잡성을 근본적으로 바꿔 놓았습니다. 지금까지 업계는 이러한 조건에서 추론 시스템이 어떻게 동작하는지를 측정할…
4 MIN READ
2026년 3월 18일
NVIDIA OpenShell로 자율적인 자기 진화형 에이전트를 더욱 안전하게 구동하세요
AI는 단순히 지시를 따르는 어시스턴트를 넘어, 스스로 행동하는 에이전트로 진화했습니다. ‘클로(claws)’라 불리는 이 에이전트들은 목표를…
4 MIN READ
2026년 2월 27일
차세대 지식 시스템의 핵심: 멀티모달 RAG를 구축하는 5가지 필수 역량
기업 데이터는 본질적으로 복잡합니다. 실제 비즈니스 문서는 텍스트를 넘어 표, 차트, 그래프, 이미지, 스캔된 페이지…
6 MIN READ
2026년 2월 25일
NVIDIA GPU 가속 엔드포인트와 Qwen3.5 VLM을 활용한 네이티브 멀티모달 에이전트 개발
Alibaba가 네이티브 멀티모달 에이전트 구축을 위해 설계한 새로운 오픈 소스 시리즈, Qwen3.5를 공개했습니다. 이 시리즈의 첫 번째 모델은…
2 MIN READ
2026년 2월 3일
NVIDIA TensorRT Edge-LLM을 활용한 오토모티브 및 로보틱스용 LLM/VLM 추론 가속화
거대 언어 모델(LLM)과 멀티모달 추론 시스템이 데이터 센터의 경계를 넘어 빠르게 확장되고 있습니다. 오토모티브 및 로보틱스 개발자들 사이에서는…
4 MIN READ
2026년 1월 14일
NVIDIA Blackwell 기반 MoE 추론 성능의 획기적 도약
AI 모델이 점점 더 똑똑해짐에 따라, 사용자들이 AI를 활용하는 업무의 범위도 비약적으로 넓어지고 있습니다. 일반 소비자부터 기업에 이르기까지…
4 MIN READ