深度介绍
Modal详细介绍
🐍在 Python 里定义逻辑与硬件
Modal 的核心是把「这段代码要跑在什么硬件上」写进同一份 Python 文件:官方把它描述为可组合的原语(composable primitives),逻辑与硬件规格放在一处,代码写完就能部署到云端,不必再单独维护 Dockerfile、Kubernetes 清单与调度配置。对已有的 AI 项目来说,迁移通常是从把函数拆出来、加装饰器开始,而不是重写整套服务;官方同时提供 CLI(serve / deploy)与 Web 端点,本地调试与上线用的是同一套代码。
⚡亚秒冷启动与从 0 起的弹性
官方首页给出的两个说法是「sub-second cold starts」与「Autoscale from 0 to 1000+ GPUs, instantly」,也就是容器能在亚秒级启动、算力可以从零直接弹到上千张 GPU。配套的是跨云跨区域的实时调度:官方称会在云端与各区域之间实时路由负载,让用户「在几秒内拿到所需 GPU,无需预留或容量规划」。对流量抖动明显的产品,这种形态的意义是不用为峰值常备机器,空闲时也不会产生费用。
🖥机型覆盖到 B300,价格按秒公开
定价页把 GPU 机型与每秒价格逐条列出:B300 每秒 0.001972 美元、B200 每秒 0.001736 美元、H200 SXM 每秒 0.001261 美元、H100 SXM5 每秒 0.001097 美元、RTX PRO 6000 每秒 0.000842 美元、A100 80GB 每秒 0.000694 美元、A100 40GB 每秒 0.000583 美元、L40S 每秒 0.000542 美元、A10 每秒 0.000306 美元、L4 每秒 0.000222 美元、T4 每秒 0.000164 美元。换算成小时可见跨度很大,选型时可以直接把单价乘上预计占用秒数来估算账单。
💸计费颗粒:CPU 核秒 + 内存 GiB 秒
除 GPU 外,CPU 与内存也单独计价:物理核(约等于 2 vCPU)每秒 0.0000131 美元、每个容器最少按 0.125 核计,内存每 GiB 每秒 0.00000222 美元,Volumes 存储 0.09 美元/GiB/月且每月含 1 TiB 免费额度。官方一句话概括计费原则是「只为实际计算时间付费,空闲资源不计费」。另外两个档位会改变单价:选择区域为基准价的 1.15–1.75 倍,非抢占式执行是 3 倍。
📦三档套餐:Starter / Team / Enterprise
Starter 是 0 美元月费加算力,含每月 30 美元免费算力、3 个席位、100 个容器与 10 个 GPU 并发、受限的定时与 Web 函数、实时指标与日志、区域选择,部署应用上限 200 个、日志保留 1 天。Team 是 250 美元月费加算力,含每月 100 美元免费算力、无限席位、5000 个容器与 50 个 GPU 并发、无限定时任务、自定义域名、静态 IP 代理、部署回滚(3 个版本)与环境级预算。Enterprise 为定制,含批量折扣、更高 GPU 并发、嵌入式 ML 工程服务、私有 Slack 支持、审计日志、SAML SSO 与 HIPAA 兼容。
🧪Sandbox 与 Notebooks 独立计价
沙箱是 Modal 的差异化能力之一:官方把它描述为「以编程方式扩展安全、短暂的环境来运行不受信代码」,可用于 Agent 的代码执行层、RL 的并行 rollout 环境等场景。Sandbox 与 Notebooks 走一套独立的资源价格:CPU 每物理核每秒 0.00003942 美元、内存每 GiB 每秒 0.00000667 美元,GPU 沿用标准价;官方强调这类环境可以「突发到所需规格」,不必提前超额分配 CPU 与内存。
🚀覆盖推理、训练与批处理
官方把适用负载列得很具体:前者是 LLM、音频、图像与视频生成的推理服务,可在请求之间缩到零、有需求时突发;中者是评测、嵌入、重排与数据集生成,官方称可以「数千张 GPU 全并行、不管理作业编排」;再往后是微调(SFT、LoRA、全量微调,支持 B200/H100/A100 与单卡或多卡)与超参数搜索。网络侧官方给出「全球分布式算力带来亚 10ms 开销延迟」,并支持 token 流式输出、WebRTC 与 WebSocket,适合实时交互类应用。
🏢合规、扶持与采购通道
企业侧列出 SOC 2 合规、HIPAA 兼容、审计日志、SAML SSO 与静态 IP 代理,并提供私有 Slack 支持与嵌入式 ML 工程服务。采购通道上,官方支持通过 AWS 与 GCP 云市场使用既有承诺消费额度结算,这对已经有云预算的企业比较实用。扶持方面,早期创业公司可申请免费算力额度,研究生、实验室与研究人员最多可申请 1 万美元免费算力;官方定价页还给出一个 serverless 与固定算力的成本对照示例,用以说明突发型负载更省钱。
产品特点
核心功能与独有价值
01从 0 到上千张 GPU 的即时弹性
官方首页把「Autoscale from 0 to 1000+ GPUs, instantly」当作主打能力,配合亚秒级冷启动与跨云跨区域实时路由。对波动型负载,这意味着无需容量规划与预留机器;对突发任务,则可以把并行度直接拉到硬件上限,用时间换成本。
02计费细到 CPU 核秒与内存 GiB 秒
GPU 按秒、CPU 按物理核每秒、内存按 GiB 每秒,Volumes 按月并含 1 TiB 免费额度,官方明确「空闲不计费」。区域选择与非抢占执行的价格倍率(1.15–1.75 倍、3 倍)也公开,成本模型可以事先算清而不靠猜。
03沙箱与训练推理同栈
官方称 Modal 是唯一把沙箱与训练基础设施原生放在同一套栈里的平台:Sandbox 能程序化地批量创建隔离环境跑不受信代码,同时旁边就是 GPU 推理与训练资源。对做 Agent 执行层或 RL 并行 rollout 的团队,这种组合省掉了两套基础设施拼接与网络打通的成本。
04价格与套餐差异写得很细
定价页把三档套餐的容器数、GPU 并发、部署应用数、日志保留天数、回滚版本数、定时任务数量逐项对比,并单列区域与非抢占倍率、AWS/GCP 市场结算、创业与学术额度。这类细则决定了实际能不能用,而不是只有月费数字。
最近动态
重要更新
Runtime 大会定档 10 月 1 日旧金山
官网公告条显示,Modal 将于 10 月 1 日在旧金山举办 Runtime 大会,定位是「为把 AI 跑进生产环境的工程师」准备的会议。对想了解该平台近期工程实践与路线的人,这类活动通常会同步发布产品能力与客户案例,可作为后续跟踪的入口。
按秒价目已覆盖 B300 与 B200
截至 2026 年 9 月,官方定价页的 GPU 按秒价目最上一档是 B300(每秒 0.001972 美元)与 B200(每秒 0.001736 美元),其下依次为 H200 SXM、H100 SXM5、RTX PRO 6000、A100 80GB/40GB、L40S、A10、L4 与 T4。机型上新速度与价格档位变化较快,采购前应以定价页当期数字为准。
Starter 含每月 30 美元免费算力
官方当前的套餐结构是:Starter 零月费并含每月 30 美元免费算力(3 席位、100 容器、10 GPU 并发);Team 250 美元月费并含每月 100 美元免费算力(无限席位、5000 容器、50 GPU 并发、回滚与自定义域名);Enterprise 定制,含批量折扣、审计日志、SAML SSO 与 HIPAA 兼容。
学术用户最高可申请 1 万美元算力额度
官方设有创业公司与学术两类算力扶持:早期创业公司可申请免费额度,研究生、实验室与研究人员最多可获 1 万美元免费算力。同时支持通过 AWS 与 GCP 云市场用既有承诺消费额度结算,便于已有云合同的组织直接采购而不必新增供应商流程。
产品总结
Modal 官方定位是「高性能 AI 基础设施」,把 CPU、GPU 与数据密集型计算做成 serverless 形态:用户在 Python 里用 SDK 把逻辑与硬件规格写在一处,官方称具备亚秒级冷启动、可从 0 即时弹性到 1000+ GPU,并会跨云与跨区域实时路由负载,让使用者在几秒内拿到所需算力而不必预留容量。适用负载包括 LLM、音频、图像与视频生成的推理服务,评测、嵌入、重排与数据集生成类批处理,以及 SFT、LoRA 与全量微调;官方还给出了沙箱这条独立产品线。 计费颗粒很细:GPU 按秒计价(B300 每秒 0.001972 美元、B200 每秒 0.001736 美元、H200 SXM 每秒 0.001261 美元、H100 SXM5 每秒 0.001097 美元、A100 80GB 每秒 0.000694 美元、L40S 每秒 0.000542 美元、T4 每秒 0.000164 美元等),CPU 按物理核每秒 0.0000131 美元(每容器最少 0.125 核),内存按每 GiB 每秒 0.00000222 美元,Volumes 存储 0.09 美元/GiB/月并含每月 1 TiB 免费额度;官方明确空闲资源不计费,选择特定区域是基准价的 1.15–1.75 倍,非抢占式执行是 3 倍。 套餐分三档:Starter 零月费含每月 30 美元免费算力、3 个席位、100 个容器与 10 个 GPU 并发;Team 每月 250 美元含 100 美元免费算力、无限席位、5000 个容器与 50 个 GPU 并发、自定义域名、静态 IP 代理与部署回滚;Enterprise 定制,含批量折扣、更高 GPU 并发、审计日志、SAML SSO 与 HIPAA 兼容。Sandbox 与 Notebooks 走独立的资源价格(CPU 每核每秒 0.00003942 美元、内存每 GiB 每秒 0.00000667 美元),面向运行不受信代码、Agent 执行层与 RL 并行 rollout 等场景。 需要注意的是:区域选择与非抢占执行会显著抬高单价,估算成本时应按目标档位计算;免费算力额度按月发放,超出后按量结算,Spike 型负载的实际账单取决于并发峰值与占用时长;少数高级能力(如更高的 GPU 并发、审计日志、SSO)只在企业档提供;官方价格与机型上新较快,且文档里的功能细节会随版本调整,部署前应以定价页与文档当期内容为准。整体而言,它适合不想做容量规划、又需要 GPU 弹性与细颗粒计费成本的 AI 工程团队。
- 产品类型
- Serverless GPU 计算平台
- 支持平台
- Python SDK / CLI(serve / deploy) / Web 端点 / 定时任务 / Sandbox 沙箱 / Notebooks / Volumes 存储 / 多区域部署
- 资费模式
- 按秒计费:H100 SXM5 每秒 0.001097 美元、B200 每秒 0.001736 美元,Starter 每月含 30 美元免费算力。
核验信息
参考文章与数据来源
本页事实来自 Modal 官方渠道:官网首页(「高性能 AI 基础设施」定位、亚秒级冷启动、0→1000+ GPU 弹性、跨云跨区域路由、沙箱执行层与推理/训练/批处理场景描述)、定价页(各 GPU 机型每秒价格、CPU 每核每秒与内存每 GiB 每秒价格、Volumes 与免费额度、区域与非抢占倍率、Starter / Team / Enterprise 三档对比、创业与学术额度、AWS/GCP 市场结算、Runtime 大会时间地点)与官方文档入口(资源、区域选择、预算等指南)。核验时间为 2026 年 9 月 22 日。价格、套餐额度与机型上新变化较快,请以官方定价页与文档当期内容为准。
- 官网Modal 官网
- 官网定价与套餐对比
- 官方文档官方文档(Guide)
- 官方文档资源与计费说明
- 官方文档区域选择说明
- 官网学术算力额度
- 更新日志官方博客
用户体验调查
Modal介绍页面对您是否有帮助?