Harry Kim

Harry Kim 是 NVIDIA 的首席产品经理,通过 Triton 实现高性能和可扩展的 AI/ML 推理。他在 Meta 的推荐系统、Intel AI 的 AI 基础架构以及 Google 的广告排名和推荐系统方面拥有丰富的工作经验。他拥有加州大学伯克利分校的统计学博士学位。

Posts by Harry Kim

数据中心/云端

隆重推出 NVIDIA Dynamo:用于扩展推理AI模型的低延迟分布式推理框架

NVIDIA 今天在 GTC 2025 宣布发布 NVIDIA Dynamo 。NVIDIA Dynamo 是一个高吞吐量、 4 MIN READ
数据中心/云端

使用 NVIDIA GenAI-Perf 和 OpenAI 兼容 API 测量生成式 AI 模型性能

NVIDIA 提供 Perf Analyzer 和 Model Analyzer 等工具,帮助机器学习工程师测量和平衡延迟与吞吐量之间的权衡, 2 MIN READ