Ollama 在 2026-09-02(Asia/Shanghai)发布 v0.33.3-rc0 预览版,核心是两项实质更新:其一尊重 GGUF 模型自带的默认参数,其二同步升级 MLX、MLX-C 与 llama.cpp。该版本由 Ollama 组织在 GitHub 官方仓库发布,采用 MIT 许可,已提供多平台安装包,适合需要本地运行 Qwen、GLM、DeepSeek、Gemma 等开源大模型的用户早期验证。
关键变化
- 1)GGUF 默认参数:修复此前可能忽略模型文件内 default parameters 的行为,现优先使用模型作者在 GGUF 元数据中定义的采样、上下文等默认值,减少手动调参误差。 2)MLX 与 llama.cpp 升级:集成上游 MLX/MLX-C 与 llama.cpp 最新变更,改善 Apple Silicon(MLX 加速)、Linux AMD64 及 ROCm 环境下的加载与推理稳定性。 3)预发布产物完整:通过 GitHub Release 发布 darwin、linux-amd64、linux-amd64-mlx、linux-amd64-rocm 等归档及 install.sh / install.ps1 脚本,发布页面与 API 均可核验。
适用对象与访问条件
面向在中国使用 Ollama 进行本地大模型推理、微调验证、离线部署的开发者与团队。仓库地址为 https://github.com/ollama/ollama ,发布页面为 https://github.com/ollama/ollama/releases/tag/v0.33.3-rc0 。已安装 Ollama 的用户可通过官方脚本或直接下载对应平台归档升级;新用户可按仓库 README 的安装指引执行 install.sh(Linux/macOS)或 install.ps1(Windows)。需具备对应操作系统权限与网络访问 GitHub Release 的条件。
兼容性与迁移
该版本为预发布(prerelease),在 GitHub 标记为 v0.33.3-rc0,发布时间 2026-09-02T00:11:33Z。对比 v0.33.2,未引入破坏性 API 变更,主要为参数尊重与依赖升级。依赖 GGUF 自定义参数的模型将自动获得更准确的默认行为;若此前手动覆盖过 repeat_penalty 等参数,建议核对模型文档,避免重复设置。MLX 相关模型建议在 Apple Silicon 上验证 Metal 加速是否正常,Linux ROCm 用户需确认驱动与容器环境匹配。
已知限制与安全状态
作为 rc0 预览,尚未标记为 stable,官方页面明确为 Pre-release,不建议直接用于生产关键路径。当前发布说明未涉及许可证变更(仍为 MIT)与安全公告,未发现需立即处理的安全修复。已知限制包括:预编译产物需等待社区反馈后进入正式版;部分旧模型若依赖被覆盖的默认值,行为可能与此前不同,需回归测试。
下一步建议
建议在测试环境先升级验证 GGUF 模型默认参数是否符合预期,并对比 MLX/ROCm 平台的 TTFT 与稳定性。关注 https://github.com/ollama/ollama/releases 的后续正式版标注,生产环境等待 stable 标记后再全量升级。如遇参数或加载问题,可通过仓库 Issues 提交复现信息与模型信息。