算力与基础设施专家vLLM 与 TensorRT-LLM 推理加速方案深度对比10:00 - 11:45分会场 C2026/10/20演讲摘要从 PagedAttention 出发,拆解高吞吐推理框架的选型原则和工程坑点。演讲嘉宾刘洋NVIDIA 解决方案架构师负责大模型推理生态技术支持与极致加速优化。报名参加活动