跳到主要内容

2026-06-22 AI 周报

· 阅读需 6 分钟

覆盖周期:2026-06-22 至 2026-06-28。

本周判断
  1. Gemini Interactions API 把模型、Agent、工具调用和后台状态统一到主接口,平台层开始为长程任务提供原生运行时。
  2. GPT-5.6 Sol 的受限预览、Meta 模型评审协调和 Five Eyes 风险提示显示,前沿模型发布正在和安全评估、政府协调绑定。
  3. OpenAI-Broadcom Jalapeno、NVIDIA 欧洲超算与 NeMo AutoModel 指向同一趋势:推理效率、训练吞吐和区域算力主权成为基础设施竞争焦点。
  4. Codex 工作研究与 HP Frontier 案例说明,企业 Agent 的重点正从单点试用转向权限、上下文、评估和组织部署。

本周主线

Agent API 成为模型平台的新默认入口

Google 将 Gemini Interactions API 推向 GA,并设为 Gemini 模型与 Agent 的主要接口。Managed Agents、远程 Linux 沙箱、后台执行、服务端状态、工具组合和多模态生成被统一到一个端点。相比单轮 generateContent,平台正在围绕长程、有状态和可恢复的 Agent 工作流重构开发接口。

前沿模型发布进入受信任伙伴阶段

OpenAI 预览 GPT-5.6 系列,其中 Sol 定位为旗舰推理模型,Terra 强调性价比,Luna 面向快速低成本调用。该系列先提供给受信任伙伴、美国政府及部分 API/Codex 用户,再逐步进入 ChatGPT、Codex 和 API。同期,外部报道显示前沿模型发布节奏开始受到政府安全评估、网络风险和模型访问范围的影响。

算力栈从 GPU 集群延伸到专用推理芯片

OpenAI 与 Broadcom 公布 LLM 优化推理芯片 Jalapeno,定位为多代计算平台中的首款 Intelligence Processor,目标是在 2026 年底前进入初始部署。Hugging Face 与 NVIDIA 的 NeMo AutoModel 则把 MoE 微调的专家并行、DeepEP 通信和 TransformerEngine 集成进训练栈,在 Qwen3-30B-A3B、Nemotron 3 Nano 30B A3B 等模型上显著提高吞吐并降低显存。算力竞争不再只是采购 GPU,也包括推理芯片、训练框架和区域基础设施协同。

视频生成从效果展示转向生产控制

阿里 HappyHorse 1.1 支持 9 张角色参考图,强化动作、主体一致性、指令遵循、真实质感和音频表达。Google DeepMind 与 A24 建立长期研发合作,让电影制作人进入工具测试和技术迭代环节。视频模型进入专业制作后,角色连续性、镜头可控性和编辑复现会比单次样片更重要。

企业 Agent 从试点转向治理层

OpenAI 的 Codex 使用研究显示,较大比例的 Codex 请求已经对应半小时、一小时甚至更长的人类工作量;HP Frontier 案例则把这种能力放进企业权限、上下文、部署和评估框架中。企业真正需要交付的不只是“能跑的 Agent”,而是可审计的访问边界、稳定上下文、可复用评估和跨团队推广机制。

网络安全模型从“找漏洞”走向“交付修复”

OpenAI 扩展 Daybreak,发布 GPT-5.5-Cyber 完整版本并更新 Codex Security。GPT-5.5-Cyber 在 CyberGym 达到 85.6%;Codex Security 已扫描 3 万多个代码库和 3000 万次提交。Patch the Planet 则联合 Trail of Bits、HackerOne、开源维护者和研究人员,把验证、补丁、测试与协调披露纳入完整闭环。

临时推理服务降低评测和原型成本

Hugging Face 推出 vLLM Jobs,让开发者用一条命令启动私有 OpenAI 兼容 LLM 端点,按硬件使用时间计费,适合短期测试、评测和批量生成。它不取代长期生产部署,但会降低“为了几小时实验而搭一套服务”的摩擦。


时间线

日期事件分类影响
06-22Gemini Interactions API GAAgent 平台模型、Agent、状态和工具调用统一到主接口
06-22HappyHorse 1.1 发布视频模型9 张角色参考图与音视频一致性面向生产场景
06-22Codex-maxxing 指南长程 Agent强调持久工作区、验证步骤和人工监督
06-22Google DeepMind + A24创意 AI创作者进入生成技术研发反馈环
06-23GPT-5.5-Cyber 完整版本网络安全模型CyberGym 85.6%,面向受信任防御者
06-23Patch the Planet开源安全从漏洞发现延伸到人工复核、补丁和披露
06-23Five Eyes 联合警告AI 安全治理网络攻防能力跃迁时间被判断为数月
06-23欧洲 35 套 NVIDIA AI 超算AI 基础设施23 国、300 万+ 研究人员、800 AI exaflops
06-24OpenAI-Broadcom Jalapeno推理芯片OpenAI 自研 LLM 推理芯片进入工程样片和部署规划
06-24NVIDIA NeMo AutoModel训练框架MoE 微调吞吐提升并降低显存需求
06-24FFASR Leaderboard语音识别评测面向端到端语音识别的公开评测进一步细化
06-25OpenAI 发布 Codex 工作研究企业 Agent长程代码 Agent 的组织使用数据被系统化披露
06-25Google Finance AI 升级金融产品搜索、图表和 Android 入口增强面向个人投资研究
06-25白宫推动 Meta 提交模型评审模型治理前沿模型能力与漏洞评估扩展到更多实验室
06-26GPT-5.6 Sol / Terra / Luna 预览前沿模型旗舰推理、性价比和低成本模型形成分层组合
06-26Hugging Face vLLM Jobs推理服务临时私有 OpenAI 兼容端点降低评测和原型成本
06-28HP 扩展 OpenAI Frontier企业部署从试点进入工程、安全和伙伴生态的组织级落地

Sources


本周报基于 2026 年 6 月 22 日至 6 月 28 日自然周内已收录 AI 日报整理;所有信息均来自公开来源,不构成投资建议。