Ollama v0.33.1 已于 GitHub 正式发布,GitHub API 显示 published_at 为 2026-08-26T18:09:57Z,对应北京时间 2026 年 8 月 27 日 02:09,落在上海当日 00:00-23:59 窗口内。该版本为增量 patch 更新,聚焦 Apple Silicon MLX 栈与构建稳定性,未引入破坏性 API 变更。

关键变化

  • MLX 新增 Qwen3.8 Flash Next 支持(Apple Silicon 优化);MLX 与 llama.cpp 同步升级;mlxrunner 新增结构化输出;修复慢速存储 Metal 超时;cmake 补丁幂等化;新贡献者 @pd95 #17948

适用对象与价值

适合在 macOS Apple Silicon、Linux 与 Windows 上本地运行大模型的开发者与团队,特别是使用 Qwen、DeepSeek、GLM、Gemma 等开源模型的场景。MLX 结构化输出对构建 Agent 与工具调用的中国用户尤为实用,可实现可控、可审计的本地生成,降低延迟与数据出境风险。

兼容性与安装条件

仓库由 Ollama 组织维护,采用 MIT 许可,允许商业使用与分发,需保留版权声明。支持 Linux、macOS、Windows 与 Docker,Go 语言实现,需配置相应 GPU 驱动方可加速。

  • macOS/Linux: curl -fsSL https://ollama.com/install.sh | sh;Windows: 下载 OllamaSetup;Docker: docker pull ollama/ollama;已安装用户重启服务即可生效

限制与下一步

本版本未包含重大安全修复公告,未变更许可证与维护状态,仍由 Ollama 团队持续维护。建议先在测试环境验证自定义模型后再全量升级,并关注官方 Releases 后续说明。