- OpenAI 预览 GPT-5.6 系列:Sol、Terra、Luna。
- GPT-5.6 Sol 支持
max 推理努力和 ultra 多子 Agent 模式。
- 受美国政府要求影响,GPT-5.6 先向少量受信任伙伴开放。
- Hugging Face Jobs 支持一条命令启动私有 vLLM 服务。
- OpenAI 研究显示 Codex 使用从短交互转向长程委派任务。
- 2026 年 5 月,80.6% 抽样个人用户至少发起过一次 30 分钟以上人类工作量任务。
- Google Finance 结束 beta 并推出新版 Android App,把 AI 摘要和搜索能力嵌入金融信息入口。
- 美国白宫继续推动 Meta 将前沿模型纳入政府评估框架。
- OpenAI 与 Broadcom 发布 Jalapeno 推理芯片,指向多代自研推理平台。
- Jalapeno 从设计到 tape-out 用 9 个月,计划按吉瓦级数据中心部署。
- NVIDIA NeMo AutoModel 在 MoE 微调上比 Transformers v5 提升 3.4-3.7 倍吞吐。
- Hugging Face 推出 FFASR Leaderboard,强调真实语音识别场景评测。
- GPT-5.5-Cyber 在 CyberGym 达到 85.6%,进入受信任防御者的完整版本。
- Codex Security 已扫描 3 万多个代码库和 3000 万次提交。
- Patch the Planet 联合维护者与安全研究人员,把漏洞发现推进到补丁合并。
- Five Eyes 警告前沿模型改变网络攻防的时间尺度是“数月而非数年”。
- 欧洲 23 国建设 35 套 NVIDIA AI HPC 超算,服务 300 万以上研究人员。
- Gemini Interactions API 正式可用,成为 Google 模型与 Agent 的主接口。
- Managed Agents、后台执行和多工具组合进入稳定 API。
- 阿里 HappyHorse 1.1 支持 9 张角色参考图和 3 至 15 秒视频生成。
- OpenAI 发布 Codex-maxxing 指南,强调长程任务的上下文连续性与验证。
- Google DeepMind 与 A24 建立长期创作技术研究合作。
- 三星向韩国全体员工及全球 DX 部门开放 ChatGPT Enterprise 与 Codex。
- Codex 全球周活跃用户超过 500 万,韩国周活较 2 月初增长近 800%。
- gemma4-code-review-instruct 发布 197081 条代码审查训练样本。
- 国内具身智能上半年融资约 438 亿元,超过一半流向“机器人大脑”。
- MaineCoon 用 22B 参数实现单卡 47.5 FPS 流式音视频生成。
- ENPIRE 让 8 个 Coding Agent 并行控制双臂机器人做自主研究。
- Pin Insertion 实验中,ENPIRE 在 3 小时内把成功率从 0 提升到 99%。
- ERP-DocIQ 证明小型开放模型也能处理单据、数据问答和浏览器自动化。
- Google DeepMind 发布 AI Control Roadmap,把自主 Agent 风险管理借鉴到网络安全防御思路。
- Anthropic 与白宫讨论 Fable / Mythos 后续安全规则,模型发布争议转向标准化评估框架。
- Claude 出现空白回复和服务异常,AI 助手可靠性继续成为生产采用前提。
- 中文模型侧,GLM-5.2 的 1M 无损上下文延续国内长程 Coding 与 Agent 主线。
- OpenAI 称 GPT-5.5 Instant 在健康评估上接近前沿 Thinking 模型,并已覆盖免费用户。
- OpenAI 与 Boston Children’s Hospital 在 NEJM AI 展示罕见病基因重分析流程。
- ChatGPT Enterprise 新增 credit usage analytics 和 spend controls,企业 AI 进入成本治理阶段。
- AI 医疗的关键词从“给答案”转向医生主导评测、证据链和临床确认。
- Codex 出现 elevated errors 后恢复,编码 Agent 的服务可靠性成为生产采用前提。
- Fable / Mythos 管制后,美欧讨论 advanced AI model trusted partner 访问方案。
- Anthropic 订阅限制诉讼和模型访问争议说明高价 AI 服务需要更透明。
- Hugging Face 社区讨论 ColBERT 正则化,RAG 检索效率仍是基础问题。