← 返回日程
算力与基础设施专家

vLLM 与 TensorRT-LLM 推理加速方案深度对比

10:00 - 11:45分会场 C2026/10/20

演讲摘要

从 PagedAttention 出发,拆解高吞吐推理框架的选型原则和工程坑点。

演讲嘉宾

刘洋
NVIDIA 解决方案架构师

负责大模型推理生态技术支持与极致加速优化。

报名参加活动