8月28日(周五),“训推融通 全栈协同——PyTorch 生态共建”MeetUp 将在上海举办。本次活动邀请了来自壁仞科技、PyTorch、龙蜥社区、阿里云、上海交通大学、密瓜智能等产学研领域顶尖技术专家,围绕框架适配、编译器优化、云端推理系统、新后端集成等核心议题展开深度分享。
活动时间:2026年8月28日13:30–16:30
活动地点:浦东新区中科路1750号张江科学之门模力社区T1栋35F大会议室(学林路地铁站2号口步行200米)
本次MeetUp演讲亮点一览:
演讲主题:Device-Agnostic PyTorch: Abstracting Across Accelerators
嘉宾:于广业,Intel工程师,PyTorch Accelerator Integration Working Group联合主席。
简介:从社区的角度介绍下PyTorch设备无关API的设计、类别、功能和每个accelerator该如何去集成。
演讲主题:BIRENSUPA™适配 PyTorch 概述
嘉宾:冯思博,壁仞科技基础框架高级技术专家。
简介:介绍 BIRENSUPA™ 软件平台适配 PyTorch 的相关工作。
演讲主题:Torch.compile+国产计算卡在阿里云的优化实践
嘉宾:王卓,阿里云高级技术专家。
简介:将系统介绍 Torch.compile 在阿里云的实际落地情况,涵盖其带来的性能收益、当前面临的使用限制,以及阿里云 AI 编译器团队围绕 Torch.compile 开展的针对性优化实践。进一步地,我们将结合阿里巴巴真实的业务需求,探讨如何基于 Torch.compile 深度挖掘国产计算卡的性能潜力,实现极致加速。
演讲主题:面向智能推理的低时延高吞吐云计算系统探索
嘉宾:庞浦,上海交通大学计算机学院助理研究员,龙蜥社区智算联盟成员单位代表。
简介:智能推理对云计算系统的核心诉求在用户侧和云商侧存在天然矛盾。将介绍近期在云计算系统中编排层、框架层、应用层进行的探索工作,以应对在满足用户诉求的同时最大化云平台的有效吞吐这一核心挑战。
演讲主题:LLM推理集群优化的三个阶段
嘉宾:李孟轩,密瓜智能联合创始人兼CTO,HAMi作者。
简介:围绕提升vLLM集群的算力利用率展开,由浅入深的讲解如何使用PD分离等技术,并通过llm-d等开源项目优化vLLM集群的算力利用率。
演讲主题:PyTorch新后端集成最佳实践
嘉宾:黄亚玲,壁仞科技深度学习框架高级架构师。
简介:介绍Torch SUPA 是站在 PyTorch 现有机制和 CUDA 生态资产之上,分层复用、逐步替换,从而降低新后端建设与用户迁移成本。
更多详情议程见下方海报:
.jpg)