Peter Kisfaludi

Peter Kisfaludi는 TensorRT Multi-Device 팀의 시니어 소프트웨어 엔지니어입니다. 확장 가능한 런타임 아키텍처를 개발하고 통신 오버헤드를 최적화해, 멀티 GPU 모델 서빙 환경에서 낮은 지연 시간으로 실행할 수 있도록 지원합니다. 2022년 NVIDIA에 합류하기 전에는 실시간 임베디드 시스템을 위한 저지연·미션 크리티컬 소프트웨어를 설계하는 독립 컨설턴트로 활동했습니다.

Posts by Peter Kisfaludi

Agentic AI / Generative AI

NVIDIA Dynamo-Triton의 NVIDIA TensorRT Multi-Device 연동을 통한 다중 GPU 모델 서빙 단순화

생성형 AI의 연산 및 메모리 요구량은 단일 GPU가 제공할 수 있는 수준을 지속적으로 뛰어넘고 있습니다. 5 MIN READ