2026-08 AI 月报
覆盖周期:2026-08-01 至 2026-08-31;月度归档日期:2026-08-31。
- DeepSeek、GLM、Qwen 与腾讯 Hy4 集中扩展编程、多模态和长程任务能力。
- MiniMax Music 3.0 与 Wan 3.0 分别推进音乐权重开放和视频服务公开访问。
- 支付宝 AHA、文心助手与豆包工作将 AI 接入服务履约和办公流程。
- MHS 硬件控制预览、评估事件复盘与实时监测,让执行边界更加具体。
- 月初的 GPT-Live 技术复盘、教育插件与 ChatGPT 更新,展示交互和使用门槛的变化。
月度观察
月初从实时交互与教育场景扩展使用方式
8 月 3 日,OpenAI 公开 GPT-Live 的实时系统工程复盘,介绍持续听说与异步调用推理模型如何配合。4 日推出的三类教育插件则面向中小学教师、高校教师和大学生,将课程材料、工具与常见工作流程组合起来,提供于 ChatGPT Edu 和学区部署的 ChatGPT for Teachers。
6 日的更新聚焦 ChatGPT 对话体验:调整 GPT-5.6 Sol 的回答,并分阶段扩大免费用户对 Luna 的访问。这次 Sol 调整不涉及 Work 与 Codex 所用版本。三项进展共同体现出,产品可用性既取决于模型能力,也取决于交互方式、场景配置与访问范围。
OpenAI GPT-Live 工程复盘 · OpenAI 教育插件 · ChatGPT Sol 与 Luna 更新
国内模型更新覆盖旗舰、轻量与视觉路线
8 月 13 日,DeepSeek-V4-Pro 正式版更新,随后生效新的计价方式,并在 21 日增加视觉实验型号。智谱 GLM-5.3 则分模型介绍、API 开放和权重开放推进发布。两家的更新都强调长程任务,但接入阶段和可处理输入并不相同。
Qwen3.8-27B 给出了稠密多模态模型的开放选择;月末的 Flash-Next 预览着重架构效率,托管型号与下载权重需要分别辨认。腾讯 Hy4 preview 则把模型能力与办公、编程产品共同分发。
由这些发布可见,评估单位需要从单个回答扩展到完整任务:模型是否能使用工具、验证中间结果,并在上下文增长后保持目标一致。参数规模与单项榜单无法独立回答这些问题。
DeepSeek 更新日志 · Qwen Flash-Next · 腾讯 Hy4
开放的对象不同,部署条件也不同
MiniMax 在 8 月发布 Music 3.0 开放权重音乐模型介绍;Wan 3.0 则在 24 日结束邀请阶段。GLM-5.3 的权重开放发生在 28 日,晚于模型介绍与 API 开放。把这些事件统一写成“模型上线”,会丢失对开发者最有用的差别。
对自行部署的团队,许可、量化与推理引擎适配决定可行性;对购买托管服务的团队,可用地域、计费和任务限制更直接。开放权重既不保证可在普通电脑运行,也不意味着不同模型采用相同的许可条款。
MiniMax Music 3.0 · QwenCloud 发布记录 · GLM-5.3 模型卡
支付宝、百度与字节从入口走向任务执行
支付宝 AHA 协议连接商家和终端;百度文心助手任务引擎 2.0 提供规划、触发与持续交付;豆包工作面向办公生产力并连接飞书上下文。三类更新分别从服务、搜索助手和企业协作切入。
本月的产品变化表明,用户开始把“完成一件事”交给助手。但服务接入数量、功能演示与真实成功率仍是不同指标。进入业务系统后,成果可复核、授权可追踪和失败可恢复,才决定任务能否可靠交付。
经济日报 — 支付宝 AHA · 科技日报 — 文心助手 · 北京商报 — 豆包工作
执行能力扩大,评测和隔离需要同步跟进
MHS 在月底向首批实验室与制造伙伴开放研究预览,将 Agent 操作范围延伸到物理设备。与此同时,OpenAI 与 Anthropic 分别披露评估事件的后续调查及整改;这些披露体现出隔离、实时监测和第三方评估规范的重要性。
语音领域的 ASR 基准研究也提示,公开榜单可能受到测试集特征影响。综合这些信息,本月一个值得保留的判断是:能力评测之外,还应验证模型在陌生任务、错误状态和权限边界下的行为。MHS 仍是预览,安全整改也不能等同于风险归零。
Anthropic MHS · OpenAI 事件后续 · Anthropic 整改说明 · ASR 基准研究
月度时间线
| 事件日期 | 进展 | 对应日报 |
|---|---|---|
| 08-03 | OpenAI 公开 GPT-Live 实时系统工程复盘 | 08-03 |
| 08-04 | ChatGPT Work 与 Codex 推出三类教育插件 | 08-04 |
| 08-06 | ChatGPT 更新 Sol 对话体验,扩大 Luna 访问 | 08-06 |
| 08-13 | DeepSeek-V4-Pro 正式版更新 | 08-13 |
| 08-13 | MiniMax 发布 Music 3.0 开放权重说明 | 08-15 |
| 08-14 | GLM-5.3 公布;Qwen3.8-27B 开源 | 08-15、08-16 |
| 08-17 | DeepSeek 新计价生效;支付宝发布 AHA 协议体系 | 08-17、08-18 |
| 08-19 | 智谱宣布 GLM-5.3 API 开放 | 08-19 |
| 08-20 | 文心助手任务引擎 2.0 上线;LFM2.5 发布 DSpark | 08-20 |
| 08-21 | DeepSeek 视觉实验模型上线;ASR 基准研究发布 | 08-21、08-22 |
| 08-24 | Wan 3.0 视频服务公开可用 | 08-24 |
| 08-25 | 豆包工作发布;IBM 公布 Granite 4.2 技术说明 | 08-25 |
| 08-26 | GLM-5.3-Flash、Qwen Flash-Next 更新;OpenAI 披露调查进展 | 08-26 |
| 08-27 | Anthropic 开放 MHS 研究预览 | 08-27 |
| 08-28 | GLM-5.3 权重开放;腾讯发布 Hy4 preview | 08-28、08-29 |
| 08-30 | QwenCloud 新增角色互动模型 | 08-30 |
| 08-31 | Anthropic 更新安全整改;ChatGPT 桌面浏览器增加网站工具 | 08-31 |
Sources
- OpenAI — GPT-Live 实时系统工程复盘 — 8 月 3 日公开的实时音频与推理系统设计。
- OpenAI — 教育插件 — 8 月 4 日推出的三类插件及机构部署范围。
- OpenAI — Sol 与 Luna 更新 — 8 月 6 日对话体验调整及分阶段访问安排。
- DeepSeek 官方更新日志 — 正式版更新、计价生效和视觉实验版日期。
- 智谱官方 API 开放公告 — GLM-5.3 的 API 阶段与定价关系。
- Z.ai GLM-5.3 模型卡 — 权重、许可标识和部署路径。
- Qwen3.8-27B 官方模型卡 — 稠密架构及原生和扩展上下文的区别。
- Qwen Flash-Next 技术公告 — 架构预览与托管型号关系。
- 腾讯 Hy4 preview 发布公告 — 8 月 28 日发布及产品分发入口。
- MiniMax Music 3.0 发布说明 — 8 月开放权重音乐模型说明。
- QwenCloud 发布记录 — Wan 3.0 公开访问及角色模型更新。
- 经济日报客户端 — 支付宝智能体商业底座 — 8 月 17 日大会与 AHA 协议体系。
- 科技日报 — 百度 AI Day — 文心助手任务引擎 2.0 与搜索功能升级。
- 北京商报 — 「豆包工作」上场 — 8 月 25 日生产力 Agent 发布。
- Anthropic — MHS 研究预览 — 物理设备接口与预览范围。
- OpenAI — Hugging Face 事件后续 — 8 月 26 日调查披露。
- Anthropic — 对齐与安全整改 — 8 月 31 日隔离和监测措施。
- Hume AI 等 — ASR 基准研究 — 语音识别基准优化的测试证据。
- 08-17 周报、08-24 周报 — 下半月逐日索引与工程观察。
本 AI 月报由公开信息整理,数据截至 2026-08-31。所有信息均来自公开来源,不构成投资建议。