📉 云基座 · 算力调整
甲骨文无预警将免费 ARM 算力砍半,个人开发者 Ollama 与边缘 AI 部署承压
甲骨文(Oracle)在未发布官方公告或电邮通知的情况下,悄然更新其云平台 OCI 官方文档,将 Always Free 免费层的 Ampere A1 计算节点资源上限由 4 OCPU / 24 GB 内存下调至 2 OCPU / 12 GB 内存。这一静默缩容直接冲击了大量将其作为云端 Ollama 轻量级 AI 推理、Agent 自动化及测试环境的开发者生态。
来源:公开报道与官方文档•
2026-06-22•
全文约 3 分钟读完
#甲骨文云
#Ollama
#AI算力基座
#ARM计算
#开发者生态
50%
核心算力与内存额度直接腰斩
1500 OCPUh
每月免费时长(原 3000 OCPUh)
0 次预告
未发博客或邮件,修改文档即生效
⚡ 30 秒速览
- 规则变化:变更自 2026 年 6 月 15 日起生效,免费层 Ampere A1 算力额度由 4核/24G 缩减为 2核/12G,算力时长减半至每月 1500 OCPU 小时与 9000 GB 小时。
- AI 开发者受创:原 24GB 内存可保障流畅运行 7B/8B 量化模型及多 Agent 编排,降至 12GB 后运行 Ollama 大模型推理及上下文拓展时极其容易触发内存溢出(OOM)。
- 规则模糊:人工客服邮件称新限额仅针对纯免费账户,付费按需账户(PAYG)“或许”不受影响,但官方文本明确写道“适用于所有租户”。
- 隐藏陷阱:即便旧 4/24 实例暂未关停,文档细则明确提示:一旦发生维护、故障或人工重启,将永久无法恢复旧配额。
01算力额度对比 轻量级 AI 推理基座受挤压
此前,OCI 的 Always Free Ampere A1 节点因免费提供高达 24 GB 的大内存,被开源社区视为最具性价比的轻量级云端 AI 推理试验场。开发者广泛用于运行 Ollama 本地模型(如 Llama 3 8B、Qwen 2.5 7B)、向量数据库以及基于反向代理的自动化 Agent。”
调整前配额(2026 年 6 月 15 日前)
4 OCPU / 24 GB 内存
- 每月 3000 OCPUh / 18000 GBh
- 可常驻运行 Ollama 8B 模型推理
- 同时部署向量库与轻量 Agent 编排
调整后新规(2026 年 6 月 15 日起)
2 OCPU / 12 GB 内存
- 每月 1500 OCPUh / 9000 GBh
- 模型推理与系统服务共用 12G 容易 OOM
- 长上下文推理与多任务并发性能受限
对于 AI 开发者而言,内存容限的剧减意味着无法再安全地在云端加载更高精度的模型权重,轻量 AI 部署被迫转向精简量化或回归本地设备。
02“静默修改”轨迹 缺乏告知引发社区混乱
此次配额调整并非通过官方博客发布,也未向受影响用户发送电邮说明,而是社区开发者在实例突然停机或对比页面数值后才被迫察觉:
06-15
悄然更新文档:新规则正式生效,算力上限减半,官方未作公开声明。
社区发酵
实例异常中断:用户发现旧 4 OCPU 实例被停机,PAYG(按需付费)升级账户担忧产生超出免费额度的静默账单。
06-22
支持团队口径矛盾:人工客服澄清称 PAYG 账户仍可保留旧配额,但这一政策未写入任何公开文档。
官方文档的通篇表述与客服邮件形成了直接冲突:
“所有租户每月可免费获得首次的 1500 OCPU 小时与 9000 GB 小时。”
—— OCI 官方文档条文
此外,文档中关于资源重建的细则更暴露了旧实例用户的潜在风险:
“如果现有资源被终止,可能无法重新创建超过更新后 Always Free 限额的资源。”
—— OCI 官方文档细则
🔍 编辑视角
本次变更为企业单方修改文档并由开源社区追踪揭露,甲骨文官方至今未发布任何正式博客或电邮通告。作为云厂商,随市场环境调整免费产品线属于常规商业决策,但通过静默修改文本、缺乏过渡期的做法,对高度依赖云基础设施稳定性的开发者生态构成了破坏。
云厂商对免费层算力生态的“静默缩容”,正在加速开发者向算力透明度更高、政策更稳定的边缘计算与去中心化 AI 部署阵地转移。
04开发者核查与应对指南
🛠️ 立即可采取的审计动作
- 实例配额审计:登录 OCI 控制台,检查 Ampere A1 实例总配额,确保租户内所有运行实例的总和不超过 2 OCPU 与 12 GB 内存,防止非预期停机。
- PAYG 账户凭证留存:若已升级为按需付费账户,建议直接提交工单联系人工支持确认旧配额适用性,并妥善保存客服回复邮件截图作为计费争议凭证。
- AI 内存阈值调整:在 Ollama 或 Docker 容器中设置内存资源上限,防止推理过程中内存溢出(OOM)触发系统强制杀死进程。