2026-06-22 AI 周报
覆盖周期:2026-06-22 至 2026-06-28。
- Gemini Interactions API 把模型、Agent、工具调用和后台状态统一到主接口,平台层开始为长程任务提供原生运行时。
- GPT-5.6 Sol 的受限预览、Meta 模型评审协调和 Five Eyes 风险提示显示,前沿模型发布正在和安全评估、政府协调绑定。
- OpenAI-Broadcom Jalapeno、NVIDIA 欧洲超算与 NeMo AutoModel 指向同一趋势:推理效率、训练吞吐和区域算力主权成为基础设施竞争焦点。
- Codex 工作研究与 HP Frontier 案例说明,企业 Agent 的重点正从单点试用转向权限、上下文、评估和组织部署。
本周主线
Agent API 成为模型平台的新默认入口
Google 将 Gemini Interactions API 推向 GA,并设为 Gemini 模型与 Agent 的主要接口。Managed Agents、远程 Linux 沙箱、后台执行、服务端状态、工具组合和多模态生成被统一到一个端点。相比单轮 generateContent,平台正在围绕长程、有状态和可恢复的 Agent 工作流重构开发接口。
前沿模型发布进入受信任伙伴阶段
OpenAI 预览 GPT-5.6 系列,其中 Sol 定位为旗舰推理模型,Terra 强调性价比,Luna 面向快速低成本调用。该系列先提供给受信任伙伴、美国政府及部分 API/Codex 用户,再逐步进入 ChatGPT、Codex 和 API。同期,外部报道显示前沿模型发布节奏开始受到政府安全评估、网络风险和模型访问范围的影响。
算力栈从 GPU 集群延伸到专用推理芯片
OpenAI 与 Broadcom 公布 LLM 优化推理芯片 Jalapeno,定位为多代计算平台中的首款 Intelligence Processor,目标是在 2026 年底前进入初始部署。Hugging Face 与 NVIDIA 的 NeMo AutoModel 则把 MoE 微调的专家并行、DeepEP 通信和 TransformerEngine 集成进训练栈,在 Qwen3-30B-A3B、Nemotron 3 Nano 30B A3B 等模型上显著提高吞吐并降低显存。算力竞争不再只是采购 GPU,也包括推理芯片、训练框架和区域基础设施协同。
视频生成从效果展示转向生产控制
阿里 HappyHorse 1.1 支持 9 张角色参考图,强化动作、主体一致性、指令遵循、真实质感和音频表达。Google DeepMind 与 A24 建立长期研发合作,让电影制作人进入工具测试和技术迭代环节。视频模型进入专业制作后,角色连续性、镜头可控性和编辑复现会比单次样片更重要。
企业 Agent 从试点转向治理层
OpenAI 的 Codex 使用研究显示,较大比例的 Codex 请求已经对应半小时、一小时甚至更长的人类工作量;HP Frontier 案例则把这种能力放进企业权限、上下文、部署和评估框架中。企业真正需要交付的不只是“能跑的 Agent”,而是可审计的访问边界、稳定上下文、可复用评估和跨团队推广机制。
网络安全模型从“找漏洞”走向“交付修复”
OpenAI 扩展 Daybreak,发布 GPT-5.5-Cyber 完整版本并更新 Codex Security。GPT-5.5-Cyber 在 CyberGym 达到 85.6%;Codex Security 已扫描 3 万多个代码库和 3000 万次提交。Patch the Planet 则联合 Trail of Bits、HackerOne、开源维护者和研究人员,把验证、补丁、测试与协调披露纳入完整闭环。
临时推理服务降低评测和原型成本
Hugging Face 推出 vLLM Jobs,让开发者用一条命令启动私有 OpenAI 兼容 LLM 端点,按硬件使用时间计费,适合短期测试、评测和批量生成。它不取代长期生产部署,但会降低“为了几小时实验而搭一套服务”的摩擦。
时间线
| 日期 | 事件 | 分类 | 影响 |
|---|---|---|---|
| 06-22 | Gemini Interactions API GA | Agent 平台 | 模型、Agent、状态和工具调用统一到主接口 |
| 06-22 | HappyHorse 1.1 发布 | 视频模型 | 9 张角色参考图与音视频一致性面向生产场景 |
| 06-22 | Codex-maxxing 指南 | 长程 Agent | 强调持久工作区、验证步骤和人工监督 |
| 06-22 | Google DeepMind + A24 | 创意 AI | 创作者进入生成技术研发反馈环 |
| 06-23 | GPT-5.5-Cyber 完整版本 | 网络安全模型 | CyberGym 85.6%,面向受信任防御者 |
| 06-23 | Patch the Planet | 开源安全 | 从漏洞发现延伸到人工复核、补丁和披露 |
| 06-23 | Five Eyes 联合警告 | AI 安全治理 | 网络攻防能力跃迁时间被判断为数月 |
| 06-23 | 欧洲 35 套 NVIDIA AI 超算 | AI 基础设施 | 23 国、300 万+ 研究人员、800 AI exaflops |
| 06-24 | OpenAI-Broadcom Jalapeno | 推理芯片 | OpenAI 自研 LLM 推理芯片进入工程样片和部署规划 |
| 06-24 | NVIDIA NeMo AutoModel | 训练框架 | MoE 微调吞吐提升并降低显存需求 |
| 06-24 | FFASR Leaderboard | 语音识别评测 | 面向端到端语音识别的公开评测进一步细化 |
| 06-25 | OpenAI 发布 Codex 工作研究 | 企业 Agent | 长程代码 Agent 的组织使用数据被系统化披露 |
| 06-25 | Google Finance AI 升级 | 金融产品 | 搜索、图表和 Android 入口增强面向个人投资研究 |
| 06-25 | 白宫推动 Meta 提交模型评审 | 模型治理 | 前沿模型能力与漏洞评估扩展到更多实验室 |
| 06-26 | GPT-5.6 Sol / Terra / Luna 预览 | 前沿模型 | 旗舰推理、性价比和低成本模型形成分层组合 |
| 06-26 | Hugging Face vLLM Jobs | 推理服务 | 临时私有 OpenAI 兼容端点降低评测和原型成本 |
| 06-28 | HP 扩展 OpenAI Frontier | 企业部署 | 从试点进入工程、安全和伙伴生态的组织级落地 |
Sources
- blog/2026-06-22-ai-news - Gemini Interactions API、HappyHorse 1.1、Codex-maxxing 和 DeepMind-A24 合作。
- blog/2026-06-23-ai-news - GPT-5.5-Cyber、Codex Security、Patch the Planet、Five Eyes 警告和欧洲 AI 超算。
- blog/2026-06-24-ai-news - Jalapeno、NeMo AutoModel 和 FFASR Leaderboard。
- blog/2026-06-25-ai-news - Codex 工作研究、Google Finance AI 升级和 Meta 模型评审协调。
- blog/2026-06-26-ai-news - GPT-5.6 Sol / Terra / Luna、受限发布治理和 vLLM Jobs。
- blog/2026-06-27-ai-news - GPT-5.6 治理、临时推理服务与金融 AI 产品化复盘。
- blog/2026-06-28-ai-news - HP 与 OpenAI Frontier 的企业部署案例。
本周报基于 2026 年 6 月 22 日至 6 月 28 日自然周内已收录 AI 日报整理;所有信息均来自公开来源,不构成投资建议。