
云服务
Modal
按秒计费的 Serverless GPU、批处理和模型推理基础设施。
资源介绍
Modal 面向需要 GPU、批处理和模型推理的开发者,把容器、硬件规格、函数和部署写进代码中。它适合运行开源模型、语音和图像处理、批量数据任务、训练实验以及需要临时隔离环境的 AI 应用。按秒计费和按需扩展可以减少团队自行维护 Kubernetes 或多云 GPU 调度的工作,但并不意味着所有任务都应该迁移到 GPU。
评估时要用真实模型和请求模式比较冷启动、显存占用、并发、队列等待、网络传输和每次调用成本。固定镜像、模型缓存和数据位置会显著影响体验。生产环境还要规划密钥、模型权重、日志、GPU 配额和区域故障,避免将实验脚本直接暴露为无限制的公共接口。对训练和推理分别建立预算,按任务价值决定是否使用更贵的硬件。
适合什么人
需要运行模型推理、训练、批处理、Notebook 或隔离沙箱的 AI 工程团队。
真实使用场景
价格说明
官网按 CPU、GPU、存储和运行时长计费,并提供不同团队方案;硬件价格、区域系数和免费额度以当前官方定价为准。
核心特点
限制与注意事项
常见问题
Modal 适合所有 AI 项目吗?
更适合需要自定义模型、GPU 或批处理的工程任务;简单调用第三方模型 API 时,直接使用供应商接口可能更省事。
如何估算 GPU 成本?
记录模型加载时间、每次请求运行时长、并发、显存和数据传输,再用真实任务量计算月度成本。
上线模型前要做哪些安全检查?
限制输入和并发,隔离密钥与模型文件,设置超时和额度,并确认日志不会记录敏感提示词或用户数据。
来源与核验
本页关于 Modal 的公开产品信息参考以下来源,未实测或未确认的事项另有说明,可以打开原页面核对。最近一次核验时间是 2026-08-13。官网改版后信息可能变化,以官网当前内容为准。
- modal.com官网Modal AI 基础设施官方指南











