Mistral 在 8 月 11 日宣布区域化推理端点正式可用。端点分三组:默认的全球端点、欧盟的 api.eu.mistral.ai 和美国的 api.us.mistral.ai,Python SDK 从 2.70 版起通过一个 server 参数切换。价格上区域端点按全球价的 1.1 倍计费,全球端点不加价。同批上线的还有 Priority Tier 公开预览,提供自定义速率限制和带 SLA 的可用性承诺,暂未公布单独定价。
限制写得比较明确,动手前要先看清:区域化目前只覆盖标准的 chat completions 和函数调用,Agents、Batch、Files API 这些有状态能力不走区域端点;欧盟与美国可用的模型清单并不一致;计费和访问管理这类控制面数据也不随区域固定。另一条同期消息是 Mistral 开始在自家平台上托管第三方开源模型,首个是智谱(Z.ai)的 GLM-5.2。基础设施侧,Mistral 推出「欧洲算力单元」,把企业的多年期采购承诺换成对未来自建算力的使用权,目标是 2030 年前形成最高 1 GW 规模,锚定客户包括 ASML、达飞海运和 Amadeus。
如果你的业务受数据驻留条款约束,这类可以把推理位置写进合同的端点是有实际价值的,一成溢价通常也比自建合规链路便宜。但要按限制清单反推能不能落地——如果你的应用重度依赖 Agents 或 Batch,现在切过去等于要拆掉一半功能;模型清单区域不一致也意味着欧美两地行为可能对不齐,需要分别回归测试。Priority Tier 还处于公开预览且没有价格,不适合现在写进采购方案。