M
Modular MAX 今日发布
跨平台高性能 AI 推理框架,一套代码通吃 NVIDIA、AMD 与 Apple Silicon
Modular MAX 是由 Modular AI 推出的高性能 AI 推理与建模框架,一站式支持模型服务和自定义内核开发。该平台兼容 OpenAI 风格的推理接口,开发者可以直接调用标准 API 完成模型推理,无需额外部署复杂的基础设施。MAX 的建模模块提供类 PyTorch 的 Python 接口,配合 Mojo 语言编写自定义 GPU 内核,大幅降低高性能模型开发的门槛。
在硬件适配方面,MAX 实现了一套代码、多平台运行的目标,同一份安装包可以部署在 NVIDIA GPU、AMD GPU 和 Apple Silicon 上,无需匹配特定的 CUDA 版本或选择硬件规格。这种跨平台一致性让团队在切换硬件环境时几乎不需要修改代码。MAX 还内置了性能基准测试工具,可以对推理端点进行标准化评测,并导出可复现的 YAML 配置文件,方便团队对比不同模型和硬件组合的实际表现。
MAX 的另一个核心优势在于无供应商锁定的开源策略。Python API、模型管道和 GPU 内核全部开源,开发者既能直接使用开源模型进行推理,也可以基于 MAX Python API 和 Mojo 语言进行深度定制。部署时可选择 Modular Cloud 托管服务,也支持在任意云环境的 Docker 容器中自部署。对于需要在大规模生产环境中部署 AI 模型,同时希望避免供应商绑定的团队,MAX 提供了一条务实的技术路径。
团队信息
AI产品库
官方
由 AI 猎手自动发现
评论与建议
登录 后参与评论或提建议