$ python -m mlx_lm.server --port 8080
model loaded: quantized/model-4bit
listening on 0.0.0.0:8080
POST /v1/chat/completions 200
把 Apple Silicon 留在云端
让 AI 推理、iOS 与 macOS 构建和自动化任务持续运行。每个订单对应一台独享物理 Mac mini,非虚拟机,入口价为 $19.2/天。
算力留在节点,团队随时接入
固定的 Apple Silicon、内存和工具链持续在线,模型验证与构建记录不会因为个人电脑休眠或团队成员离线而中断。
环境保持一致,协作不靠转交电脑
开发者通过 SSH 或 VNC 接入同一台持续在线的物理 Mac,查看构建日志、模型进程和工程文件。
独享、持续、可控
先确认机器性质、运行方式和访问边界,再决定是否适合团队现有工作流。
独享物理 Mac mini
每个订单对应独立物理节点。芯片、内存和基础存储不与其他租户共享同一运行实例,便于固定实验条件和构建环境。
非虚拟机配置
三档规格直接对应 Mac mini 硬件。选择时可以按真实内存、存储和芯片能力规划 Xcode 构建、runner 并发或 MLX 模型规模。
远程全天运行
所有节点全年 365 天正常运行,不设置计划停机时段。团队可通过 SSH 或 VNC 接入,长任务在成员离线后继续执行。
从量化模型到 MLX API
先在固定配置上验证模型,再把推理进程封装为远程接口。模型路径、内存边界、监听地址和请求日志均保留可检查记录。
同步模型文件,固定 Python、MLX 和项目依赖版本,记录启动参数与工作目录。
使用同一组提示词观察峰值内存、首字延迟、持续吞吐和输出一致性。
确认监听地址、端口访问、进程守护和异常日志,避免只验证本机命令行结果。
从本机请求扩展到远程业务调用,并为超时、重试和模型切换保留调用记录。
- 模型格式
- 4-bit MLX
- 内存记录
- 42.8 / 64GB
- 监听地址
- 0.0.0.0:8080
- 请求状态
- HTTP 200
- 调用接口
- /v1/chat/completions
示意数据用于说明应记录的指标,不代表特定模型或配置的固定性能。实际表现取决于模型、量化方式、上下文长度和并发设置。
先看硬件,再选择租期
入口价为 $19.2/天。三档方案均可按天、周、月、季租用,所有订单一律以美元(USD)结算。
VMKeep M4 Core
M4
16GB RAM
256GB SSD
$51.7 / 周 · $95.8 / 月 · $260.6 / 季
适合轻量 Xcode 构建、自动化脚本、小型 runner 和 MLX 环境验证。需要更大依赖缓存或持续任务时,应优先比较中档配置。
VMKeep M4 Plus
M4
24GB RAM
512GB SSD
$106.3 / 周 · $196.9 / 月 · $535.6 / 季
适合持续 CI、较大的依赖缓存、React Native 构建和中型 MLX 模型验证,在容量与长期运行成本之间取得平衡。
VMKeep M4 Pro
M4 Pro
64GB RAM
2TB SSD
$164.1 / 周 · $303.8 / 月 · $826.3 / 季
适合高内存 MLX 推理、较大模型评测、多任务构建和需要本地保存大量模型或构建制品的工作流。
在 5 个节点中选择接近团队或调用端的位置
三档机型均在新加坡、日本(东京)、韩国(首尔)、香港和美国东部销售。目录内组合常态可订,实际可用状态以控制台实时返回为准。
延迟区间用于辅助初步选区,实际链路会受访问位置、网络运营商和当时路由影响。正式接入前应从团队所在网络完成测试。
控制台集中显示机器、租期、订单和管理操作。连接方法与首次接入检查项可在使用支持页查看。
查看连接与迁移说明按输入、运行方式与产出判断是否适合
云端 Mac 解决的是持续在线的 Apple Silicon 环境与远程接入问题。实际任务表现仍取决于代码规模、模型参数、依赖结构和所选配置。
iOS / macOS 构建
将代码、依赖、Xcode 工具链与签名材料组织在固定目录,执行测试、归档和发布前检查。
- 输入
- 代码、依赖与签名配置
- 运行
- xcodebuild 与自动化脚本
- 产出
- 测试报告、日志与归档包
Self-hosted runner
把仓库任务分配到独享物理节点,规划工作目录、依赖缓存、并发边界和失败任务重试顺序。
- 输入
- 仓库事件与流水线任务
- 运行
- 常驻 runner 与缓存目录
- 产出
- 执行日志、测试结果与制品
MLX 推理实验
固定芯片和内存条件,对比模型量化版本、峰值内存、首字延迟与持续吞吐,再封装远程 API。
- 输入
- 模型、提示词与推理参数
- 运行
- MLX server 与评测脚本
- 产出
- API、指标记录与模型结论
远程图形工作站
通过 SSH 处理命令行任务,通过 VNC 使用 macOS 图形界面,适合短期项目、跨地区协作和临时扩容。
- 输入
- 工程文件、工具链与素材
- 运行
- SSH 或 VNC 远程接入
- 产出
- 工程文件、构建结果与记录
周期明确,统一用美元结算
下单时依次确认机型、节点、租期和附加选项。支付网关的实际可用状态以控制台返回为准。
按天、周、月或季租用
短期验证可以从按天或按周开始;持续 CI、长期推理服务和固定远程工作环境可比较月付与季付。续用前应核对当前配置、节点、周期和数据迁移安排。
仅支持两类支付方式
所有订单一律以美元(USD)结算,不进行其他币种换算。
根据模型内存、构建缓存和并发任务选择配置;根据团队与调用端位置选择节点;确认租期结束前的数据导出、令牌撤销和密钥移除计划。
先核对机器性质、区域和支付范围
以下回答覆盖最常见的决策问题。更完整的配置、连接与计费说明可在常见答疑页查看。
VMKeep 提供的是虚拟机吗?
不是。每个订单对应一台独享物理 Mac mini,页面配置对应具体 Apple Silicon、内存和存储规格,不与其他租户共享同一运行实例。
可以运行 MLX inference server 吗?
可以。可以从命令行验证模型,再启动监听服务并通过 API 接入应用。模型兼容性、内存需求、首字延迟和吞吐表现取决于具体模型、量化参数与所选配置。
有哪些在售区域?
在售区域仅为新加坡、日本(东京)、韩国(首尔)、香港和美国东部,共 5 个节点或机房。三档机型均覆盖这 5 个节点。
支持哪些支付方式?
仅支持 USDT-TRC20 与 Visa / Mastercard / Amex(经 Stripe),所有款项一律以美元(USD)结算。实际可用网关以控制台返回为准。
选择一台持续在线的云端 Mac
从三档 Apple Silicon 独享物理机中选择配置,再确认新加坡、东京、首尔、香港或美国东部节点与租用周期。