开源项目
核验开源项目、版本、许可证与维护状态。
- 阅读
llama.cpp 发布 b10919 预发布:更新 WebGPU Dawn 依赖并重构 server 子进程处理
ggml-org 维护的 llama.cpp 于上海时间 2026-09-12 10:18 发布预发布 b10919,更新 WebGPU Dawn 依赖并重构 server 子进程与下载逻辑,MIT 许可,提供 Windows/macOS/Linux/Android 预编译包,本地推理与 server 用户需先验证再升级。
- 阅读
llama.cpp 发布 b10830 预发布:新增 --fuse-qkv 融合转换与全平台二进制同步
ggml-org 维护的 llama.cpp 于上海时间 2026-09-07 07:29 发布预发布 b10830,新增 --fuse-qkv 将 Q/K/V 融合为单一 QKV 张量,MIT 许可,提供 Windows/macOS/Linux/Android/iOS 多平台预编译包,面向本地量化与转换的中国用户提升转换效率与加载局部性。
- 阅读
llama.cpp 发布 b10829 预发布:修正 GDN 归一化实现并同步全平台二进制
ggml-org 维护的本地 LLM 推理引擎 llama.cpp 于上海时间 2026-09-07 07:04 发布预发布版本 b10829,修正 GDN 归一化为 rsqrt 对齐 flash-linear-attention,MIT 许可,提供 Windows/macOS/Linux/Android/iOS 多平台预编译包,面向本地部署 Qwen3-Next 等 GDN 模型的中国用户修复精度偏差。
- 阅读
llama.cpp 发布 b10828 预发布:新增 Spark 2.5 支持与全平台二进制更新
ggml-org 维护的本地 LLM 推理引擎 llama.cpp 于上海时间 2026-09-07 06:08 发布预发布版本 b10828,新增 Spark2_5ForCausalLM 架构及 GGUF 转换支持,提供 Windows/macOS/Linux/Android 多平台预编译包,MIT 许可,面向需本地部署大模型的中国开发者。
- 阅读
llama.cpp 发布 b10827 预览版:修复 OpenCL 量化权重打包与全量预编译同步更新
ggml-org 于上海时间 2026-09-07 04:50 发布 llama.cpp b10827 预览版,MIT 许可,基于 b10826 增量 1 笔提交修复 OpenCL 上 q4_K/q5_K 权重打包与形状校验,提供 Windows CUDA/macOS/Linux/Android 全量预编译,无破坏性变更,可平滑升级。
- 阅读
OpenAI Node.js SDK v7.10.0 发布:新增 GPT-6 Astra 支持与安全模型文档
OpenAI 于上海时间 2026-09-04 发布 Node.js SDK v7.10.0,Apache-2.0 许可,新增 GPT-6 Astra 及关联特性支持并完善安全模型文档,面向 Node.js 22+ 用户,npm 可一键升级验证。
- 阅读
OpenAI Python SDK v3.8.0 发布:新增 GPT-6 Astra 支持与安全模型文档
OpenAI 于上海时间 2026-09-04 发布 Python SDK v3.8.0,Apache-2.0 许可,新增 GPT-6 Astra 及关联特性支持并完善 SDK 安全模型文档,面向 Python 3.10+ 用户,PyPI 可一键升级验证。
- 阅读
LangChain 1.4.0 正式发布:新增 langchain.mcp 命名空间与 MCPAdapter 支持
LangChain 1.4.0 由 langchain-ai 于上海时间 2026-09-04 正式发布,MIT 许可,正式引入 langchain.mcp 命名空间与 MCPAdapter,支持将任意 MCP 服务转为 Agent 工具并提供文档示例,中国开发者可通过 pip/uv 一键升级验证。
- 阅读
vLLM v0.29.0rc2 发布:修复多模态 SHM 缓存前缀覆盖问题
vLLM v0.29.0rc2 由 vllm-project 于 2026-09-03 发布,修复多模态 SHM Worker 缓存对 prefix-covered 项的处理,Apache-2.0 许可,面向已启用多模态前缀缓存的用户提升稳定性。
- 阅读
ONNX Runtime v1.28.2 发布:修复 Compile API 序列化重复节点问题
ONNX Runtime 由 Microsoft 于上海时间 2026-09-03 发布 v1.28.2 补丁,修复 Compile API 回调序列化导致优化模型重复图节点、输入输出的问题,MIT 许可,多平台预编译包同步更新,中国开发者可直接升级验证。
- 阅读
PyTorch 2.14.0 发布:Inductor 引入 NVGEMM 与分布式容错升级
PyTorch 2.14.0 由 PyTorch 团队发布,带来 NVGEMM 新后端、torch.switch 多分支、声明式动态形状及 nccl2 分布式容错,Apple Silicon 原生线性代数与多平台扩展,采用 BSD 3-Clause 许可,直接影响编译与分布式训练。
- 阅读
PyTorch 2.14.0 发布:NVGEMM、torch.switch 与分布式容错等多项核心更新
PyTorch 于上海时间 2026-09-03 发布 2.14.0,引入 Inductor NVGEMM、torch.switch 多分支、声明式动态形状、复数张量编译及全新 nccl2 与 c10d 容错等,BSD-3-Clause 许可,含多项破坏性变更,国内开发者需评估兼容性与升级路径。
- 阅读
LiteLLM 发布 v1.99.1 Docker 专用版:修复 OpenTelemetry 缓存计数遗漏
LiteLLM 1.99.1 由 BerriAI 于 2026-09-02 发布,MIT 许可的 Docker 专用补丁版,修复 OpenTelemetry v2 缓存创建与读取 Token 统计遗漏,完善 prompt caching 成本核算,需更新容器镜像,无 PyPI 包。
- 阅读
Ultralytics 发布 v8.4.138:修复旧版检查点与 YOLO-World 加载并优化推理与训练稳定性
Ultralytics 于 2026-09-02 发布 v8.4.138,由 Ultralytics 维护、AGPL-3.0 许可,修复 8.4.95 前旧检查点与 YOLO-World 加载,优化 SAM 推理显存与分布式训练,显著提升 YOLO 模型在本地与云端部署的稳定性。
- 阅读
LangChain 发布 1.4.0a3:新增 langchain.mcp 一键将 MCP 服务转为 Agent 工具
LangChain 1.4.0a3 于 2026-09-02 发布,由 LangChain AI 维护、MIT 许可,新增 langchain.mcp 命名空间与 MCPAdapter,支持将任意 MCP 服务转为可直接交给 create_agent 的工具,并提供缓存与人机协同能力。
- 阅读
Ollama 发布 v0.33.3-rc0 预览版:修复 GGUF 默认参数并升级 MLX 与 llama.cpp
Ollama 于 2026-09-02 发布 v0.33.3-rc0 预览版,由 Ollama 团队维护、采用 MIT 许可,修复 GGUF 默认参数继承并升级 MLX、MLX-C 与 llama.cpp,面向中国本地大模型部署用户提升兼容性与稳定性。
- 阅读
测试占位清理:非发布内容
该条目为内部测试占位,已标记为非当日发布,不作为正式开源项目资讯。
- 阅读
Ollama v0.33.2 发布:恢复深色模式并修复 macOS 与代理稳定性
Ollama 本地推理平台由 Ollama 团队于上海时间 2026-08-29 发布 v0.33.2 稳定版,MIT 许可。恢复系统深色模式支持,修复 macOS 重复启动与 Claude Desktop 代理中断问题,多平台可直接升级。
- 阅读
DeepSpeed v0.19.6 发布:新增 Apple Silicon 支持与 ZeRO 稳定性修复
DeepSpeed v0.19.6 由 deepspeedai 于上海时间 2026-08-28 03:08 发布,Apache-2.0 许可。补丁版新增 Apple Silicon MPS 的 ZeRO 1-3 支持,修复零尺寸参数与 checkpoint 稳定性,并加入 HybridEngine CUDA 图与性能优化,中国用户可通过 PyPI 升级验证。
- 阅读
LangGraph SDK 0.4.4 发布:新增线程流 LangSmith 追踪路由
LangGraph SDK 0.4.4 由 langchain-ai 于上海时间 2026-08-28 发布,MIT 许可。新增线程流场景下 LangSmith 追踪路由能力,提升长运行有状态智能体的可观测性,中国开发者可通过 PyPI 直接升级,无破坏性变更,建议先在预发环境验证追踪链路。
- 阅读
Ollama v0.33.1 发布:新增 Qwen3.8 Flash Next 与 MLX 结构化输出支持
Ollama v0.33.1 于上海时间 2026 年 8 月 27 日发布,由 Ollama 团队维护,采用 MIT 许可。新增 MLX 对 Qwen3.8 Flash Next 支持、结构化输出能力,并修复慢速存储下 Metal 超时与构建兼容问题。
- 阅读
vLLM v0.26.0 发布:Inkling、安全加固与模型支持变更
vLLM 项目(vllm-project)于 2026 年 7 月 27 日发布 v0.26.0,采用 Apache-2.0;新增 Inkling、KV 分层卸载和多模态前端,并列出安全加固,同时移除 TeleChat、Persimmon、Fuyu,升级前需核对 Linux 硬件与迁移影响。