- 前沿模型恢复访问背后,安全审查和政府协调正在成为发布流程的一部分。
- Meta Watermelon 被曝在内部评测中追赶 OpenAI 旗舰模型。
- 欧洲围绕美国前沿模型访问和本土 AI 能力的讨论继续升温。
- Google Android Enterprise 案例显示,企业 AI 采用正在和移动设备治理绑定。
- OpenAI 发布 GeneBench-Pro,用 129 个问题评估计算生物学研究判断能力。
- GPT-5.6 Sol 在 GeneBench-Pro 最高推理档达到 28.7%,Pro 模式 31.5%。
- OpenAI Signals 显示 ChatGPT 使用在非英语和低 HDI 国家快速增长。
- Hugging Face 与 EvalEval 打通 EEE,汇聚约 22.9 万条评测结果。
- IBM 发布 ScarfBench,评估企业 Java 框架迁移 Agent。
- GPT-5.6 Sol 的限量预览让模型发布流程成为产业议题。
- 前沿模型访问正在从产品发布问题转向安全、国家和伙伴资格问题。
- HF Jobs + vLLM 展示临时推理端点的开发者工作流。
- Google Finance 和模型评估新闻显示,AI 正同时进入消费入口和监管流程。
- OpenAI 预览 GPT-5.6 系列:Sol、Terra、Luna。
- GPT-5.6 Sol 支持
max 推理努力和 ultra 多子 Agent 模式。
- 受美国政府要求影响,GPT-5.6 先向少量受信任伙伴开放。
- Hugging Face Jobs 支持一条命令启动私有 vLLM 服务。