2026年4月

2026年4月23日暂无评论

欢迎阅读 PyTorch 基金会 4 月刊通讯。本期内容包括:2026 年欧洲 PyTorch 大会的精彩回顾、Helion 和 Safetensors 加入基金会托管项目、ExecuTorch 纳入 PyTorch 核心项目、PyTorch 2.11 版本发布及网络研讨会回放、即将举行的社区活动,以及来自整个生态系统的最新技术博客。

公告

PyTorch Conference Europe 2026 in Paris2026 年欧洲 PyTorch 大会
首届欧洲 PyTorch 大会于 4 月 7 日至 8 日在巴黎举行,吸引了超过 600 名研究人员、开发人员、从业者和学者参加,进行了为期两天的基调演讲、技术会议、海报展示和社区活动。我们共同见证了生态系统的重要时刻,发布了涉及托管项目、PyTorch 核心、推理、内核编写以及生产基础设施等方面的公告。阅读回顾 >> & 观看会议视频 >>
Helion joins PyTorch FoundationPyTorch 基金会欢迎 Helion 成为基金会托管项目由 Meta 贡献的 Helion 以基金会托管项目的身份加入 PyTorch 基金会,旨在标准化开放、可移植且易于使用的 AI 内核编写方式。Helion 是一种用于机器学习内核的 Python 嵌入式 DSL,旨在简化内核开发、通过自动调优减少手动编码工作量,并提高跨后端硬件性能的可移植性。了解更多 >>
Safetensors joins PyTorch FoundationSafetensors 加入 PyTorch 基金会
由 Hugging Face 贡献的 Safetensors 加入 PyTorch 基金会,成为支持安全模型分发和受信任生产工作流的托管项目。Safetensors 避免了与传统的基于 pickle 格式相关的任意代码执行风险,同时支持在多 GPU 和多节点部署中实现快速加载。阅读更多 >>
ExecuTorch becomes part of PyTorch CoreExecuTorch 成为 PyTorch 核心的一部分
ExecuTorch 现已成为 PyTorch 核心的一部分,扩展了 PyTorch 在边缘和端侧环境(从台式机、笔记本电脑到移动手机和嵌入式设备)进行高效 AI 推理的功能。此次转型为该项目带来了中立的厂商治理结构和透明的开源架构,项目将继续在硬件、工具和部署工作流方面蓬勃发展。阅读更多 >>
PyTorch 2.11 releasePyTorch 2.11 版本发布及现场问答回放
PyTorch 2.11 增加了用于分布式训练的可微集合通信 (differentiable collectives)、针对 Hopper 和 Blackwell GPU 上 FlexAttention 的 FlashAttention-4 后端、扩展的 Apple Silicon MPS 算子支持、RNN/LSTM GPU 导出支持以及 XPU Graph。观看 Andrey Talman 和 Nikita Shulga 在网络研讨会回放中的版本演示及社区问答。观看回放 >>
媒体眼中的 PyTorch 基金会
欧洲 PyTorch 大会的发布内容受到了 ComputerWeekly、Techstrong.ai、ITdaily、diginomica、HPCwire、It’s FOSS、ITBrief 和 San Jose Today 的报道。在活动报道中,diginomica 写道,Helion 和 Safetensors 的加入标志着“一个能够在生产环境中实际运作的开放 AI 生态系统与一个仅能在实验室中运行的系统之间的区别”。阅读 diginomica 的分析 >>

近期活动

OpenEnv AI 黑客松决赛
隆重推出由 Meta 与 Hugging Face 及 PyTorch 合作举办的印度首届 OpenEnv AI 黑客松。该倡议汇集了全国各地的开发者,旨在创造而非仅仅使用驱动下一代 AI 的技术。参赛者将使用 Meta 的开源强化学习框架 OpenEnv 构建强化学习环境,直接为智能体(Intelligent agents)的训练做出贡献。决赛将于 4 月 25 日至 26 日以 48 小时线下黑客松的形式在班加罗尔举行,奖金池达 30,000 美元,并为强化学习新手提供学习资源。
PyTorch Docathon 20262026 年 PyTorch 文档马拉松 (Docathon)
2026 年 PyTorch 文档马拉松将于 5 月 5 日至 19 日举行。这一黑客松风格的活动诚邀社区成员参与,共同改进文档、降低新贡献者的入门门槛,并为项目带来实用的可用性提升。点击 RSVP >>
北美开源峰会 (Open Source Summit)
开源峰会是开源开发者和贡献者的顶级盛会。在这里,维护者、技术专家和社区领袖汇聚一堂,分享知识、协作解决方案并推动开源项目发展。与塑造开源的人们建立联系,向维护者和社区领袖学习,发现新兴技术和实用解决方案,协作构思与代码编写,并在增长技能的同时拓展人脉和职业发展。了解更多 >>
PyTorch Conference China 2026KubeCon + CloudNativeCon + OpenInfra Summit + 2026 年中国 PyTorch 大会
此次联合活动将于 9 月 8 日至 9 日在上海举行,目前报名和征稿(CFP)已开启。本次大会将云原生基础设施、开放基础设施和开源 AI 社区汇聚在同一个场地。征稿截止时间为中国标准时间(UTC+08:00)5 月 3 日(周日)晚 11:59。提交演讲申请 >>   了解更多 >>
PyTorch Conference North America 20262026 年北美 PyTorch 大会
欢迎参加 10 月 20 日至 21 日在加利福尼亚州圣何塞举行的 PyTorch 大会,开启两天的技术讲座、生态系统协作和开源 AI 工程交流。大会现已开放征稿,涵盖内核工程、训练和负责任 AI 等主题,演讲提交截止日期为太平洋夏令时间 6 月 7 日(周日)晚 11:59。提交演讲申请 >>   立即注册 >>

最新博客

Optimizing effective training timeMeta: 优化 Meta 内部推荐与排序工作负载的有效训练时间
本文介绍了有效训练时间 (Effective Training Time, ETT%),作为衡量端到端实际挂钟时间中用于高效训练比例的指标。文章详述了在训练器初始化、PT2 编译、检查点管理、停机优化和故障减少方面的工作,最终将离线训练的 ETT 提升至 90% 以上。阅读更多 >>
Faster diffusion on BlackwellMeta, Hugging Face: Blackwell 上的扩散模型加速:利用 Diffusers 和 TorchAO 实现 MXFP8 和 NVFP4
了解选择性量化和 CUDA Graphs 如何在 NVIDIA B200 GPU 上实现可重现的端到端扩散推理加速,其中 MXFP8 可获得高达 1.26 倍的性能增益,NVFP4 可获得高达 1.68 倍的增益。阅读更多 >>
Monarch API to your supercomputerMeta: Monarch:连接超级计算机的 API
Monarch 引入了一种分布式编程框架,通过简单的 Python API 使集群变得可编程。该设计针对智能体开发工作流,结合了单控制器模型、RDMA 支持的文件系统和分布式 SQL 遥测技术。阅读更多 >>
SOTA normalization performance with torch.compileMeta: 使用 torch.compile 实现 SOTA 归一化性能
本文评估了 H100 和 B200 上的 LayerNorm 和 RMSNorm,引入了 MixOrderReduction,并展示了 torch.compile 如何在超越即时模式 (eager mode) 的情况下,实现近乎最优(SOTA)的性能表现。阅读更多 >>
GEMMs with TorchInductor CuteDSL backendMeta: 使用 TorchInductor 的 CuteDSL 后端生成最先进的 GEMM
TorchInductor 的全新 CuteDSL 后端增加了 GEMM 生成的自动调优路径,在 Blackwell 硬件上为推理工作负载提供了强劲的 MXFP8 性能和显著的性能增益。阅读更多 >>
Flight Recorder NCCL watchdog timeoutsMeta: 飞行记录仪 (Flight Recorder):深入理解 NCCL 看门狗超时的新视角
飞行记录仪引入了一个诊断环形缓冲区,用于捕获集合通信元数据和调用堆栈,帮助工程师识别分布式训练作业中的 CPU 端分歧和 GPU 挂起问题。阅读更多 >>
订阅PyTorch通讯
直接订阅以获取更新:https://pytorch.ac.cn/newsletter/