- Gemini Interactions API 正式可用,成为 Google 模型与 Agent 的主接口。
- Managed Agents、后台执行和多工具组合进入稳定 API。
- 阿里 HappyHorse 1.1 支持 9 张角色参考图和 3 至 15 秒视频生成。
- OpenAI 发布 Codex-maxxing 指南,强调长程任务的上下文连续性与验证。
- Google DeepMind 与 A24 建立长期创作技术研究合作。
- 三星向韩国全体员工及全球 DX 部门开放 ChatGPT Enterprise 与 Codex。
- Codex 全球周活跃用户超过 500 万,韩国周活较 2 月初增长近 800%。
- gemma4-code-review-instruct 发布 197081 条代码审查训练样本。
- 国内具身智能上半年融资约 438 亿元,超过一半流向“机器人大脑”。
- MaineCoon 用 22B 参数实现单卡 47.5 FPS 流式音视频生成。
- ENPIRE 让 8 个 Coding Agent 并行控制双臂机器人做自主研究。
- Pin Insertion 实验中,ENPIRE 在 3 小时内把成功率从 0 提升到 99%。
- ERP-DocIQ 证明小型开放模型也能处理单据、数据问答和浏览器自动化。
- Google DeepMind 发布 AI Control Roadmap,把自主 Agent 风险管理借鉴到网络安全防御思路。
- Anthropic 与白宫讨论 Fable / Mythos 后续安全规则,模型发布争议转向标准化评估框架。
- Claude 出现空白回复和服务异常,AI 助手可靠性继续成为生产采用前提。
- 中文模型侧,GLM-5.2 的 1M 无损上下文延续国内长程 Coding 与 Agent 主线。
- OpenAI 称 GPT-5.5 Instant 在健康评估上接近前沿 Thinking 模型,并已覆盖免费用户。
- OpenAI 与 Boston Children’s Hospital 在 NEJM AI 展示罕见病基因重分析流程。
- ChatGPT Enterprise 新增 credit usage analytics 和 spend controls,企业 AI 进入成本治理阶段。
- AI 医疗的关键词从“给答案”转向医生主导评测、证据链和临床确认。
- Codex 出现 elevated errors 后恢复,编码 Agent 的服务可靠性成为生产采用前提。
- Fable / Mythos 管制后,美欧讨论 advanced AI model trusted partner 访问方案。
- Anthropic 订阅限制诉讼和模型访问争议说明高价 AI 服务需要更透明。
- Hugging Face 社区讨论 ColBERT 正则化,RAG 检索效率仍是基础问题。
- OpenAI 发布 Deployment Simulation,用真实对话上下文模拟模型部署前行为。
- Deployment Simulation 已覆盖 GPT-5 系列 Thinking 部署和 12 万条内部编码 Agent 轨迹。
- 智谱 GLM-5.2 上线,支持 1M 无损上下文,强调 Coding 与长程任务开源 SOTA。
- 前沿模型竞争从发布分数转向发布前风险预测和长程执行稳定性。
- Google 在 AWE 2026 展示 Android XR 生态,XREAL AURA 开放预约。
- Android XR 正把 Gemini、可穿戴设备和空间计算连到同一平台。
- Hugging Face 社区发布 FINAL-Bench Quantum,量子计算方法需要开放中立评测。
- PhysicsIntern 等项目显示,AI 科学工具正在从 benchmark runner 走向研究助手。
- OpenAI 发布 Partner Network,投入 1.5 亿美元支持企业 AI 交付生态。
- OpenAI 计划到 2026 年底培训 30 万名认证顾问。
- 企业 AI 采用瓶颈从模型能力转向工作流重设计、系统集成和变革管理。
- OpenAI 与 Anthropic 同时加码伙伴网络,前沿模型进入服务生态竞争。
- TCS 与 Anthropic 合作,先在 56 个国家的 5 万员工中部署 Claude。
- DXC 将 Claude 集成到银行、航空等受监管行业系统中。
- Hugging Face 社区更新 MTEB v3 Leaderboard,嵌入模型评测更接近可用产品。
- 企业 AI 的关键从模型采购转向行业流程、审计和交付能力。