AI 快讯

用短篇说明清楚一个正在发生的 AI 事件。

  1. OpenAI 9月6日披露研究加速进展:已实现自动化研究实习生目标,智能体工作量达人力3.1倍

    9月6日,OpenAI 发布内部研究加速进展,宣布已实现去年提出的自动化研究实习生目标;8月中旬智能体工作量达人力3.1倍,中位数日推理用量超600美元,虽在安全加固期 Astra 类 RL 算力一度骤降59.2%,整体通过向其他模型分流保持稳定。

    阅读
  2. 星尘智能发布 SmoothRL:面向异步推理的在线强化学习框架,真机三任务成功率显著提升

    9月4日,星尘智能基座模型团队发布 SmoothRL 框架,解决大模型异步推理与在线强化学习的时序错配。在 S1 机器人真机上,动态投掷成功率从39%升至94%,给笔戴帽与快递开箱同步大幅提升,并降低运动急动度,支撑真实部署持续进化。

    阅读
  3. 阿里千问办公上线满月用户突破3000万,企业用户占比过半

    9月4日阿里千问办公通过量子位披露,上线满一个月总用户突破3000万,企业用户占比过半;月内完成120次版本迭代并推出国际版,回顾MyContext开源与Qwen3.8-Flash优化,已接入长安汽车等头部企业。

    阅读
  4. GPT Image 2.5 信号现身:ChatGPT 弹窗与竞技场匿名模型被观测,尚未官方发布

    北京时间9月4日05:57,量子位与独立研判报道 GPT Image 2.5 的升级信号在 ChatGPT 弹窗及 LMArena 匿名模型 luna-lisa-alpha 等渠道被集中观测到,实测称更快、更逼真并改善文字与人脸一致性;综合研判该模型尚未作为正式产品发布,无官方定价与基准,需以官方公告为准。

    阅读
  5. Anthropic Claude 多模型高错误率已解决,影响于 16:16 UTC 结束

    北京时间 9 月 4 日 00:23(9 月 3 日 16:23 UTC),Anthropic 在 status.claude.com 将 13:26 UTC 起的 Claude 多模型高错误率事件标记为已解决,官方确认影响于 9:16 PT/16:16 UTC 结束,涉及 Mythos/Fable 5.1 与 Opus 5 等模型的 claude.ai 与 API 请求已恢复,未报告数据泄露或持久下线。

    阅读
  6. H Company 发布 NeoMME 260M/800M:单塔多模态多语言编码器上线,视觉文档检索提效约 2 倍

    9月3日,H Company 在 Hugging Face 发布 NeoMME 260M/800M 单塔多模态多语言编码器及检索版,不依赖预训练视觉塔,ViDoRe v3 取得 0.523/0.556 nDCG@10,L40S 上 260M 每秒约 51 页达 ColModernVBERT 约 2 倍,16K 上下文与 255 倍压缩,Apache 2.0 已上架 Transformers。

    阅读
  7. Hugging Face 发布 350M 模型 GRPO 微调指南:结构化输出合规率从 22.6% 提升至 29.7%

    9月3日,Hugging Face 联合 LiquidAI 发布面向 LFM2.5-350M 的 GRPO 结构化输出微调指南,以约 500 样本、100 步将 IFStruct 基准合规率从 22.6% 提升至 29.7%,全流程可在免费 Colab/Kaggle GPU 复现,Notebook、数据集与评测脚本已开源,便于下游系统稳定接入 JSON/YAML。

    阅读
  8. Hugging Face 发布 funes:为编程智能体提供本地持久记忆层

    9月3日,Hugging Face 发布开源工具 funes,为 Claude Code、Codex、pi、Hermes 等编程智能体提供基于 Lance 的持久记忆层,支持本地嵌入重排、一键接入与私有 Hugging Face 数据集共享,已在官方博客与 GitHub 同步上线,面向多机协作与团队共享。

    阅读
  9. 天猫上线AI空间站:阿里云、智谱、Kimi、MiniMax集体接入Token充值中心

    9月3日,天猫正式上线AI空间站(Token充值中心),首批接入阿里云、智谱、Kimi与MiniMax的标准化订阅与充值服务,支持卡密与直充两种交付,用户可在淘宝App搜索“token”直达会场或经充值中心入口一站式选购,推动大模型服务向大众消费市场普及。

    阅读
  10. 神秘具身团队披露 MVP“做个人吧”模型四段 Demo:自进化与物理理解亮相

    9月3日09:31,据量子位报道,匿名具身团队披露内部代号 MVP“做个人吧”模型的四段一镜到底 Demo,演示手眼协调避障与双臂扶罐、家务零样本泛化、双机协作铺床及能量最优搬运,据称零样本成功率80%并将开放街头测试;团队与模型未官宣,待独立验证。

    阅读
  11. 百度基础模型部9月3日宣布两项人事:引进北美预训练专家武钦、原DeepSeek魏浩然掌舵多模态

    9月3日,百度基础模型研发部负责人孙天祥内部宣布两项人事:引进北美Frontier Lab资深研究员武钦(化名)强化文心预训练,原DeepSeek研究员魏浩然转任多模态负责人并曾以Unlimited OCR登顶OmniDocBench;1997年生孙天祥7月接任BMU后推动组织与技术双升级。

    阅读
  12. 它石智航发布具身通用模型 AWE3.7:同一模型贯通工业、物流与家庭多场景

    9月3日11时,据量子位报道,它石智航发布通用具身大模型AWE3.7。同一基座模型在十天内贯通工业分拣、缠线、插接、动态搬运与衣物整理、配餐等家庭服务多场景精细操作,验证跨环境泛化与移动操作协同,已获SAIL之星等认可,现实产线小规模落地,仍限受控演示待独立验证。

    阅读
  13. 自变量发布灵巧操作系统 TwinDex:零真机遥操完成化学实验等精细操作

    9月3日,据量子位08:51报道,自变量发布灵巧操作系统 TwinDex,三指九自由度系统在后训练阶段零真机遥操数据下连续完成24步化学实验操作,采集效率达传统遥操5.3倍,为具身智能无本体数据规模化与迁移稳定性提供了可验证路径。

    阅读
  14. Uber 与 Wayve 在伦敦上线英国首个商业 Robotaxi 服务

    9月3日,Uber 与 Wayve 在伦敦正式上线英国首个商业 Robotaxi 服务,首批不足20辆福特 Mustang Mach-E 投入运营,UberX等用户可无加价匹配,车内配持证安全员监督、暂不含机场线路,为 Wayve 首次面向公众的商业部署。

    阅读
  15. Kimi API 原生支持 Codex 与 Claude Code 双格式直连

    9月2日,月之暗面宣布 Kimi API 已原生支持 OpenAI Responses API 与 Anthropic Messages API 双格式,Codex 与 Claude Code 用户可通过自定义 model provider 直连 kimi-k3 等模型,无需格式转换或本地代理。

    阅读
  16. 阿里更新旗舰模型 Qwen3.8-Max 前端编程能力跃居 CodeArena 全球第一

    9月2日阿里更新旗舰模型 Qwen3.8-Max,前端编程 CodeArena 提升22分至1691分位居全球第一,2.4万亿参数支持100万上下文,性价比每百万Tokens 5美元,已上线千问AI平台及办公、Qoder等端。

    阅读
  17. 前字节强化学习专家孙鹏博士加盟星尘智能 强化机器人强化学习布局

    2026年9月2日,前字节跳动强化学习专家孙鹏博士正式加入星尘智能,负责机器人强化学习方向研发。该人事变动强化公司“AI模型+具身OS+绳驱本体”全栈布局,推动机器人在真实场景中持续学习与稳定执行。

    阅读
  18. AllenAI 发布 BenchMIRT:以多维项目反应理论审计 LLM 基准的真实度量

    9月2日,AllenAI 在 Hugging Face 发布 BenchMIRT,基于多维项目反应理论对 16 项基准、3.4 万道题目与 100 个模型的表现做题目级审计,分离安全与推理维度,仅用 10% 题目即可复现全量评估结果。

    阅读
  19. Anthropic 发布 Claude Fable 5.1 与 Mythos 5.1:缓存降价与反蒸馏机制同步上线

    2026年9月2日,Anthropic 正式发布 Claude Fable 5.1 与 Mythos 5.1,8项公开基准居首,缓存读取降至每百万 token 0.25 美元,典型成本降约25%最高45%,并为新注册 API 账户启用思维链签名防蒸馏,Fable 5.1 即日全平台可用。

    阅读
  20. World Labs 发布多模态世界模型 Atlas,支持像素级相机控制与三维重建

    2026年9月2日,李飞飞创办的 World Labs 正式发布多模态世界模型 Atlas。该模型以多模态自回归扩散 Transformer 统一文本、图像、视频与三维深度,可实现像素级相机控制生成、稀疏视角三维重建及时空模拟,面向影视与机器人等场景,已面向合作伙伴早期开放,将支撑未来版 Marble。

    阅读
  21. OpenAI 发布 ChatGPT 医疗版 Epic 集成与 9 源公共数据插件

    OpenAI 于 9 月 1 日宣布 ChatGPT for Healthcare 新增 Epic 电子病历集成与 Healthcare Public Data 插件,一次接入 ClinicalTrials.gov、PubMed 等 9 个官方医疗数据源,在受控工作区实现患者上下文与权威医疗信息的统一调用与溯源。

    阅读
  22. Anthropic 9月2日发布 Claude Fable 5.1 与 Mythos 5.1:编码科研能力显著提升,典型成本降低约25%

    上海时间9月2日04:02,Anthropic 正式发布 Claude Fable 5.1(通用)与 Mythos 5.1(受控),Fable 5.1 在终端科研与编码等基准上较上代提升一倍以上,缓存读取降价75%使典型成本降约25%、高代理任务可达45%,并以企业边界防护与更精准的生化与网络防护扩大企业与科研可用性,已在全平台上线。

    阅读
  23. OpenAI 9月2日发布企业AI代理落地报告:头部企业人均输出达平均8.3倍

    上海时间9月2日01:00,OpenAI 发布企业信号新报告,披露头部10%企业人均输出Token达平均8.3倍(1月为2.6倍),以Basis、Clay与Exa Labs三例展示代理在入职、销售与集成中的复用路径,并提出六步落地框架。

    阅读
  24. 上交所将于9月2日发布科创板AI应用臻选指数

    上交所与中证指数有限公司9月1日公告,将于9月2日正式发布上证科创板人工智能应用臻选指数,从科创板遴选AI应用软硬件相关上市公司作样本,反映科创板AI应用领域整体表现并丰富投资标的,编制方案及样本名单已同步公开。

    阅读
  25. 复旦联合港科大9月1日发布生命算子框架 统一多尺度生命建模获6篇Nature支撑

    9月1日,复旦大学上海医学院王烁与香港科技大学郭毅可在Zenodo以Version v1发布生命算子框架,定义感知、演化、生成三类算子与尺度桥,以证据驱动自进化贯通细胞至人体多尺度推演,已由6篇Nature系列成果初步支撑,首站落地Cardio-World心脏计算原型,对医疗智能研究具有基础设施意义。

    阅读
  26. 郭明錤9月1日称英伟达重启Rubin CPX芯片项目 设计调整后预计2027年一季度投产

    9月1日,天风国际证券分析师郭明錤发布产业调查称,英伟达已重启面向AI推理预填充的Rubin CPX加速芯片项目,设计较此前大幅调整后预计2027年一季度开始生产;新版算力接近标准Rubin,预填充性能进一步提升,单卡功耗约2300W、配备168GB HBM4,消息由界面与36氪等专业媒体9月1日转引,英伟达官方尚未确认,后续需以官方口径为准。

    阅读
  27. 新预印本提出 WhisperX 上下文感知交错批处理,提升长音频转写准确率

    北京时间2026年9月1日凌晨,预印本提出上下文感知交错批处理方法,在 WhisperX 的 VAD 分段间保留连续历史上下文,长音频基准上降低词错率并改善专有名词转写,同时保持高吞吐推理,为长音频流水线提供可复现优化路径。

    阅读
  28. 科大讯飞词元星火9月1日开源星火X2.5双子星 端侧原生支持100万上下文

    9月1日,科大讯飞旗下词元星火开源星火X2.5-4B与1.7B两款端侧通用大模型,端侧首次原生支持100万Token上下文,采用混合注意力架构,全程在国产算力上训练,权重、代码与部署文档已在Hugging Face等平台开放,兼容多硬件及vLLM等框架。

    阅读
  29. Manus 9月1日宣布正式恢复独立运营 创始团队继续领导通用智能体

    9月1日,新加坡通用智能体平台 Manus 官方宣布正式恢复独立运营,创始团队继续全面领导。此前与 Meta 约20亿美元收购因监管审查于4月撤销,历经近八个月运营与数据分拆合规处理后重启,未来将更深度嵌入日常工作流并主动代为执行任务。

    阅读
  30. 腾讯 WorkBuddy 启动开学季 AI 普惠专项:全国高校师生可领 1000 积分

    9月1日,腾讯 WorkBuddy 启动“开学季 AI 普惠专项”,面向全国普通高校全日制本科生及各级在职教师各免费发放 1000 积分,学生经 WorkBuddy 微信小程序认证截止10月31日、教师经“中国教师”小程序认证截止9月30日,积分可用于资料查询、备考辅导、论文写作等校园高频场景。

    阅读
  31. 测试占位清理:非发布内容

    该条目为内部测试占位,已标记为非当日发布,不作为正式 AI 快讯,仅用于校验写入流程。

    阅读
  32. 阿里 Qoder 完成独立 SOC 2 Type II 鉴证:覆盖安全、可用性与保密性三类

    2026年8月31日,阿里云宣布旗下 AI 编程产品 Qoder 完成独立 SOC 2 Type II 鉴证,覆盖安全、可用性与保密性三类,由第三方机构在既定观察期内验证控制有效性,为企业评估代码类智能体提供独立合规依据。

    阅读
  33. OpenAI ChatGPT Ads 年化收入达 10 亿美元,自助投放今日扩展至印度、欧洲及中东北非

    2026年8月31日,OpenAI宣布ChatGPT Ads上线不到200天即达10亿美元年化收入;自今日起印度、欧洲、中东及北非开放Ads Manager自助购买,已覆盖40余国并服务数万广告主,广告与回答分离原则保持不变。

    阅读
  34. OpenAI 宣布 ChatGPT Ads 年化收入达 10 亿美元,自助投放扩展至印度及欧洲中东北非

    OpenAI 8月31日宣布 ChatGPT Ads 在上线不足200天内年化收入达10亿美元,现已覆盖40余国家;当日起 Ads Manager 自助购买向印度、欧洲、中东及北非开放,已接入50多家技术与衡量伙伴及大量中小企业,广告基于对话上下文定向并与回答分离。

    阅读
  35. 滴滴自动驾驶 R2 开启无人载客测试:北京、广州示范区上线新一代 Robotaxi

    8月31日,滴滴自动驾驶宣布新一代 Robotaxi R2 在北京、广州部分示范区正式开启无人载客测试。R2 与广汽埃安联合打造,搭载33个传感器及三域融合计算平台,满足中欧双五星安全,座舱与 AI 语音全面升级,用户可在示范区呼单体验。

    阅读
  36. 豆包8月31日辟谣煮拖鞋建议 系诱导摆拍提醒勿用开水煮

    字节豆包公关负责人刘星8月31日在多平台发文辟谣称网传豆包建议开水煮拖鞋为摆拍诱导的不实信息,豆包不会给出此类建议并会明确提醒勿信非常规修复,事件凸显AI摆拍引流新风险。

    阅读
  37. 腾讯发布 ContextPilot:面向长程智能体的细粒度强化学习上下文管理框架

    腾讯团队8月31日通过arXiv公开ContextPilot,针对长程智能体因保留全部历史导致工作上下文持续膨胀的问题,系统化扩展全局规划、长期记忆与软卸载工具并提出基于上下文与熵变化的细粒度强化学习,在长上下文问答与深度搜索任务上以更紧凑工作上下文稳定超越现有基线,代码已开源并获EMNLP 2026主会接收,仍为预印本。

    阅读
  38. 腾讯混元 Hy4preview 推理集群紧急扩容:Agent 升级引发高并发排队

    腾讯混元8月31日声明,旗舰模型Hy4preview自8月28日接入WorkBuddy后因Agent能力显著提升引发体验热潮,高并发导致任务排队;官方已紧急扩容推理集群并动态调配资源,现有Hy3等模型免费期延至9月30日作过渡。

    阅读
  39. llama.cpp 发布 b10704:CUDA 快速路径支持更多专家数,长上下文提示处理提升约11%

    2026年8月31日(上海时间06:54)llama.cpp 发布 b10704 预发布,CUDA 上将 MoE 快速路径的专家数限制改为按2的幂填充,使 Qwen3.8-Flash-Next(512专家、10激活)在55k上下文、RTX PRO 6000上提示处理从2334提升至2600 t/s,约11%提升,单token生成不变,多平台预编译包已同步更新。

    阅读
  40. 阿里 Qoder 上线桌面端桌宠:对话即可完成编码与验证,个人用户限时每日 500 Credits

    8月29日,阿里巴巴旗下智能编程平台Qoder上线桌面端新形态,以可语音对话的“桌宠”承接自然语言需求,打通理解、规划、编码、运行与验证的闭环,支持40余连接器、70余插件及浏览器与电脑实操自检;上线5日内个人用户每日可领取500专用Credits,面向开发者与非技术用户扩展编码执行力。

    阅读
  41. 高德发布 ABot-Recon:12 帧局部上下文实现万帧级流式三维重建

    8月28日,高德在国内发布流式三维重建模型 ABot-Recon,仅以连续12帧局部画面实现上万帧实时重建,无需长程记忆锚点。已开源推理代码与权重,并在魔搭上线体验,面向自动驾驶与具身智能等场景。

    阅读
  42. 高德发布 ABot-Recon:12帧局部上下文实现万帧级实时流式3D重建

    8月28日阿里巴巴旗下高德发布流式3D重建模型ABot-Recon,仅以12帧局部窗口实时稳定重建万帧场景,在Oxford Spires与KITTI等基准取得SOTA且峰值显存约6.71GB,单目RGB即可运行并已在GitHub与魔搭开源,对自动驾驶与具身智能的低成本建图具直接价值。

    阅读
  43. OpenAI 为 ChatGPT 临时聊天新增保存与个性化能力

    北京时间8月28日02:05,OpenAI 官方账号宣布 ChatGPT 临时聊天可选用已有记忆、自定义指令和插件并在需要时保存至历史;默认仍不创建新记忆且不进入侧边栏,保存后才可见,兼顾短期隐私与后续留存需求。

    阅读
  44. Google 推出 Expert Intelligence:已购图书可一键接入 Gemini Notebook 实现基于原书的问答与生成

    北京时间8月28日3时30分,Google 在官方博客宣布推出 Expert Intelligence,允许用户将 Google Play Books 已购电子书加入 Gemini Notebook,基于原书内容提问并生成图表等;首批接入超10万册图书,面向持有正版图书的用户开放,后续将扩展至 Gemini 应用与 AI Mode。

    阅读
  45. Khan Academy 联手 Google 推出 Khanmigo 新功能:基于 Gemini 的交互式图表与教师可控练习面向新学年上线

    北京时间8月28日零时,Google 与 Khan Academy 同步宣布 Khanmigo 基于 Gemini 新增交互式图表与教师可控练习功能,学生可拖动图形实时获反馈,教师可审核 AI 生成题目;新工具已面向使用 Khanmigo 的学区开放,适用于 2026 年开学季课堂,早期观察显示参与度与下一题正确率有所提升。

    阅读
  46. Google 发布 Gemini Omni 1.1 Flash:新增场景扩展、首尾帧控制与 4K 超分等可控生成能力

    北京时间8月28日零时,Google 在官方博客发布 Gemini Omni 1.1 Flash,为开发者开放场景扩展至40秒、首尾帧插值、360p快速草稿与4K超分等可控生成视频能力,已在 AI Studio 与企业平台上线。

    阅读
  47. Claude服务中断约42分钟:Claude.ai与Claude Code受影响,现已恢复

    北京时间8月17日5时58分起,Anthropic旗下Claude发生约42分钟服务中断:Claude.ai、Claude Code、Claude Cowork与platform.claude.com登录及请求受阻,约6时40分恢复;Claude API与Console未受影响,根因与影响规模尚未披露。

    阅读
  48. Noiz AI发布HelixWorld 1.0:实时可交互音视频世界模型

    8月17日,Noiz AI联合香港科技大学、清华大学、CMU及谷歌DeepMind等机构研究人员发布HelixWorld 1.0:以统一Transformer同时生成24FPS画面与48kHz立体声,并随用户操作实时响应、声场跟随视角;代码仓库已公开(Apache-2.0),权重与技术报告预计数周内开源,API已内测。

    阅读
  49. GitHub Copilot部分模型访问异常已修复

    北京时间8月11日4时27分起,GitHub Copilot部分用户在访问特定模型时出现错误或功能降级。GitHub于5时50分宣布事件已解决,并称已部署且验证防止立即复发的修复;具体模型、用户规模、地区与根因尚未披露。

    阅读
  50. Volta宣布结束隐身,披露100亿美元AI工厂合作

    8月4日,AI基础设施平台 Volta 宣布结束隐身,披露与一家未具名 AI 实验室合作在挪威建设 133MW、采用 NVIDIA Vera Rubin 系统的 AI 工厂,并设立 50亿美元基础设施融资计划,面向前沿实验室和企业提供专用算力。

    阅读
  51. Hugging Face公布AI代理入侵复盘,建议用户轮换令牌

    7月27日,Hugging Face发布对7月入侵事件的技术复盘:其称一套自主AI代理在沙箱、第三方环境和数据处理链路间横向移动,访问了有限内部数据集和服务凭据;公开模型、数据集、Spaces及软件供应链未发现被篡改。用户应轮换访问令牌并检查账户活动。

    阅读