1. Google 推出 Gemini Omni 1.1 Flash,主要升级了视频创作的可控性。在场景延展时,该模型可参考最多 10 秒的前序内容,同时新增首尾帧控制、最长 3 秒的视频参考以及更具性价比的 360p 草稿模式,成片支持输出 1080p 或 4K 分辨率。
2. Codex 负责人 Tibo 宣布,所有 ChatGPT Work 和 Codex 用户的用量已全面重置。OpenAI 同时为这两类产品推出了 Luna Reserve 备用机制,在常规额度耗尽后提供仅限 GPT-5.6 Luna 的独立备用额度。该机制当前仅向部分 Plus 和 Pro 账户开放,暂不适用于 Business 与 Enterprise 订阅。
3. ChatGPT 推出临时聊天新控制功能,开启个性化后可调用现有记忆、自定义指令和插件,但不会产生新记忆。用户还可以选择保存临时聊天,保存后该对话将转为常规聊天并进入历史记录。
4. OpenAI 联合 Anthropic 等公司共同呼吁加强网络防御,指出应对 AI 驱动网络攻击的窗口期十分有限。该倡议提出了“赋能防御者”等原则及各方的行动方向。
5. Anthropic 推出 Model Hardware Standard(MHS)研究预览,旨在为 AI Agent 提供统一接口以操作实验室和设备。该标准已在药物实验、显微成像和量子设备等场景进行测试,目前尚未开源,后续将重点完善物理安全评测。
6. 蚂蚁百灵发布面向金融场景的模型 Ling-3.0-flash-Fin。该模型总参数量为 124B,激活参数为 5.1B,目前已在 OpenRouter 等平台上线并提供限时免费服务。
7. fal 发布了基于 MiniMax H3 后训练的视频生成模型 H3 Max。官方称其生成 5 秒视频仅需约 3 秒,并在提示词理解和美感等多个质量评估维度中排名第一。
8. Midjourney 开放 V8.2 首个图像编辑模型供用户测试。该模型支持指令编辑、最多 4 张参考图生图,以及局部重绘与外绘功能。
9. BreezeBlue 开源 Breeze TTS 2 模型权重及代码,官方称其开源排名居首。目前该模型的权重及输出仅限研究与非商业用途。
10. Cohere 发布文档解析模型 Cohere Parse 5。官方表示,该模型在 ParseBench 基准测试中已超越 Mistral OCR 4 等竞品。
11. Qoder 宣布正式发布全新 Qoder 智能体工作台及桌面应用端。该产品以 Coding 能力为核心底座,面向所有人提供编程与通用两种模式。即日起至 9 月 1 日 10 时,平台将提供专属 Credits 与模型折扣等限时福利。
12. 阿里云百炼宣布下调 Qwen3.8-Flash 模型单价,输入与输出价格分别降至 0.8 元和 2.7 元,新价格已于 8 月 27 日 12 时正式生效。
13. AISI 发布开源工具 optstop,可在模型精度足够时停止 LLM 评估运行。官方测试显示,该工具能节省 57% 至 97% 的计划测试量,且完全不影响最终评分。
14. Hugging Face 发布开源双足机器人 Microduck 并开放预购,售价 399 美元。该机器人自带行走和轮滑等 7 种预训练行为,其 SDK 与完整强化学习训练栈在 GitHub 以 Apache 2.0 开源,支持仿真训练后部署真机。
15. Google 搜索 AI Mode 升级旅游规划功能,航班价格追踪与积分里程查看已全球上线,酒店预订功能正于美国推出。此外,Google 在 Gemini Notebook 推出 Expert Intelligence 功能,目前支持将符合条件的已购 Google Play Books 电子书添加为来源。
16. 谷歌 DeepMind 正试运行前沿 AI 模型双盲评估机制。该机制确保评估者不可见模型权重,且谷歌不接触测试题,官方称此举可有效防止基准污染。
17. Anthropic 推出面向科学家的 Claude team plan,初期向全球开放一万个为期一年的免费及折扣席位。
18. 据知情人士向 The Information 透露,英伟达已同意以 129 亿美元收购 AI 模型权重托管平台 Hugging Face。报道称,英伟达此前已暂停向 AI 云服务商提供信用支持以换取营收分成的部分交易,有员工担忧相关计划可能引发反垄断审查,但英伟达发言人回应称该模式仍在正常运作。
19. 针对 Gemini 团队此前发布暗示与 Ox Alpha 有关联的推文,Logan Kilpatrick 回应称这主要是时机不当。他表示,团队当时实际上是在对 Gemini 3.7 Flash 的增长和进展作出反应。