返回
programming2026年8月19日1 分钟

Mojo语言开源:Modular与Qualcomm携手开启异构计算新篇章

#Mojo#开源#异构计算#AI加速器#Modular

1. ModCon 2026:开源、开放云、开放芯片

今天是ModCon大会!欢迎观看直播。2026年8月18日,ModCon 2026:开源、开放云、开放芯片。四年半前,Modular公司押下了一个赌注:AI不会永远只运行在一种芯片上,软件栈需要为异构硬件和日益复杂的AI工作负载重新架构。在今天上午的ModCon主题演讲中,我们展示了这个赌注的成果。Modular平台现已生产就绪,每分钟处理数十亿个令牌,并支持真实的企业级部署。我们正在向生态系统开放更多平台功能,将其扩展到全新类别的硬件,并吸引主要行业合作伙伴加入。具体来说,Modular和Qualcomm宣布:Mojo 1.0现已完全开源,采用Apache 2.0许可证。Modular Cloud现已公开可用,服务于MiniMax等旗舰客户。Modular平台现支持AWS Trainium、Google TPU、Qualcomm Cloud AI 100和Qualcomm Dragonfly加速器,以及CPU和GPU。有关Qualcomm Dragonfly的更多信息,请参阅我们的博客文章。Mojo将原生支持Windows,这得益于与Microsoft Windows团队的合作。MAX许可证不再包含设备使用限制,并且MAX将通过开放联盟计划提供源代码,以便更广泛的生态系统能够与我们共同构建平台。异构计算时代已经到来,它拥有一个统一、开放的软件平台。

2. Mojo🔥现已开源

上周,我们宣布Mojo达到1.0版本,为开发者提供了一个稳定、生产就绪的基础,他们可以在此基础上进行长期构建。除了各种新功能外,1.0版本最重要的部分是稳定性保证:你今天编写的代码不会突然失效。今天,我们更进一步。整个Mojo语言现在完全开源,采用不受限制的Apache 2.0许可证,这意味着编译器和所有工具链都完全开源。你可以扩展该语言,将其移植到新平台,并在其上构建任何你想要的应用程序。这延续了我们自2024年开源Mojo标准库和2025年开源MAX内核以来逐步开放技术栈的进程,并且这一进程将继续下去。要了解更多关于Mojo的信息并贡献代码,请访问mojolang.org。

3. Mojo对Windows的支持

Mojo多年来一直支持macOS和Linux,Windows开发者可以通过WSL使用它。原生Windows支持一直是开发者最常提出的需求之一。每天有数百万开发者在Windows上构建各种应用程序和工作负载。我们相信Mojo能对该生态系统产生重大影响。以正确的方式将Mojo引入Windows需要深厚的平台专业知识,因此我们很高兴Microsoft Windows团队也看到了与我们相同的机遇——我们正在合作实现这一目标。我们很高兴看到Mojo登陆Windows,以及它为跨系统和AI工作的开发者创造的机会。每天有数百万开发者在Windows上构建,我们致力于帮助他们在自己选择的平台上获得所需的技术和工具。——Logan Iyer,Windows平台+开发者部门CVP

4. 推出Modular Cloud

Modular Cloud是完整Modular技术栈作为生产服务整合的地方。它为开发者提供了直接访问Modular行业领先推理性能的途径,同时抽象化了在异构基础设施上部署、优化和运行模型的复杂性。Modular Cloud现已在console.modular.com上全面可用,通过共享端点和专用部署在Modular技术栈上提供流行的开源模型。共享端点兼容OpenAI,按令牌计费,而专用部署则在我们或您自己的计算资源上运行,使用预留的隔离实例。过去几个月,Modular Cloud一直以ModelRun的名义默默为OpenRouter流量提供服务,其端点在延迟和吞吐量方面一直位居平台前列。独立基准测试公司Artificial Analysis也证实了这一点。

5. MiniMax案例

MiniMax是Modular Cloud的旗舰企业客户,在专用Modular部署上运行M3模型,以每分钟数十亿令牌的速度处理其生产流量。高效大规模服务M3提出了独特的系统挑战。它结合了100万令牌的上下文窗口、原生多模态和MiniMax稀疏注意力(MSA)——一种新颖的稀疏注意力架构,选择性地关注相关的KV块,从而减少上下文扩展时的计算量。要实现最先进的性能,需要跨整个技术栈进行优化:在MAX中原生实现M3,构建和调优专门的MSA内核,并根据MiniMax的真实流量模式优化部署。

6. 超越GPU:Trainium、TPU和Dragonfly

Modular Cloud已经在NVIDIA和AMD GPU上服务生产工作负载。今天,我们将硬件支持扩展到GPU之外,进入定制AI加速器领域——这是对平台可移植性的更严格考验。我们增加了对AWS Trainium、Google TPU、Qualcomm Cloud AI 100 Ultra和Qualcomm Dragonfly的支持。每个都通过相同的Modular平台运行,使用相同的建模API、服务工作流、编程语言和核心抽象。开发者可以一次编写模型,然后将其带到完全不同的硬件架构上,而无需围绕它重建软件栈。同样重要的是,我们启用每个平台所需的工程工作量仅为传统AI硬件启用所需的一小部分——工程工作量减少了10倍以上。在接下来的几个月里,我们将把这些新硬件平台投入生产,并通过Modular Cloud提供。

7. MAX:与生态系统共同构建的通用基础

AI硬件创新正在加速,但好的硬件只有在开发者能够使用时才有意义。太多创新仍然被局限于为单一架构编写的软件栈所束缚。行业需要一个通用的软件基础:一次编写模型,即可覆盖所有加速器,根据性能和成本而非碰巧支持它的软件栈来选择硬件,并让供应商在芯片优势上竞争。这就是我们正在构建的Modular平台。加入Qualcomm强化了这一目标。Modular平台将继续支持和优化广泛的硬件,包括与Qualcomm Technologies平台直接竞争的硬件。生态系统面临的机会远大于任何单一供应商的路线图,只有每个人都能站在其上,基础才能发挥作用。为了构建这个基础,我们正在采取两项重要举措:我们正在开放MAX。我们正在改进MAX的许可模式并扩大源代码访问,以便开发者、企业、硬件供应商和合作伙伴能够在该平台上构建、扩展并回馈。我们正在努力为生态系统建立联盟计划。我们正在努力建立一个涵盖硬件供应商、模型提供商、云公司和数据中心运营商的行业联盟计划。目标是让合作伙伴在集成MAX、为其平台优化以及帮助塑造Modular平台未来方向方面发挥直接作用。HTEC已经展示了这在实践中的样子。他们的工程师仅用几个月时间和少数几名工程师就在Modular平台上实现了Google TPU支持,而我们只是扮演支持角色,而非主导集成。这明确验证了我们正在构建的东西:一个生态系统可以独立扩展的基础。其他初创硬件供应商也看到了市场上的同样需求。d-Matrix就是其中之一:d-Matrix和Modular对异构计算的共同承诺基于对开放标准的相互支持。随着我们进入分解式异构计算时代,开放标准可以加速GPU、CPU和XPU的协同部署,从而推动大规模效率提升,这也是我们的合作如此自然契合的原因。——Sid Sheth,d-Matrix创始人兼CEO

8. 立即尝试

开始使用开源Mojo 1.0所需的一切现在都可以在mojolang.org上获取。Modular Cloud已在console.modular.com上线。如果你今天在旧金山参加ModCon,今天下午的技术讲座将更深入地探讨以上所有内容。🎥 加入ModCon 2026直播,全天观看主舞台的精彩内容。AI发展太快,每家公司都无法不断重建其底层基础设施。模型变得更大,服务变得更加分布式,硬件变得更加异构。开放的水平平台曾多次重塑行业,但前提是生态系统共同参与构建。因此,无论你从事硬件、模型、基础设施还是应用程序开发,都请与我们共同构建这个基础——通过alliance@modular.com联系我们。


🔗 原文链接:https://www.modular.com/blog/modcon-announcements