1. 7月22日,Google发布三款新Gemini模型:Gemini 3.6 Flash主打更高效率与更低价格,Gemini 3.5 Flash-Lite极致低价,Gemini 3.5 Flash Cyber专注软件安全漏洞查找修复。Gemini 3.6 Flash任务步骤减少、输出成本降低,编码和知识工作性能提升。三模型已在Gemini API、Google AI Studio及Gemini应用上线。DeepMind员工透露已启动Gemini 4预训练,Gemini 3.5 Pro正与合作伙伴测试,即将发布。
2. Codex负责人Tibo宣布,为庆祝活跃用户突破1000万,Codex与ChatGPT Work付费用户的用量限制已重置,即刻生效。
3. 千问团队发布Qwen-Image-3.0图像生成模型,支持4.5k token输入、10像素小字及12国语言渲染,具备复杂版面生成与界面仿真能力。API已在阿里云百炼和千问AI平台开放邀测;Qwen Studio和千问APP将上线免费体验。同日千问上线Qwen3.8-Max-Preview版本,性能与前端表现提升,官方计划未来将正式版Qwen3.8-Max开源。
4. Poolside发布开源模型Laguna S 2.1,总参数1180亿但仅激活80亿,支持1M上下文窗口。在Terminal-Bench 2.1等Agent编程测试中媲美数倍参数模型。权重已开源,并在Nous Portal等平台限时免费。
5. Nanbeige团队发布Nanbeige4.2-3B,官方称在部分Agent评测中超越Qwen3.5-9B。
6. MindLab Research发布Macaron-V1系列开源模型,旗舰版Macaron-V1-Venti基于智谱GLM-5.2后训练,在个人智能、终端使用等基准测试中超越或匹配前沿模型。
7. 韩国Motif Technologies发布MoE模型Motif-3-Beta,据称基准测试得分居中美之外模型之首,当前仅限非商用,最终版8月初发布。
8. Sakana AI发布专为网络防御的Fugu-Cyber编排模型,作为新API端点可用,在CyberGym与CTI-REALM安全基准中达前沿水平。用户需订阅Token Plan并提交用例申请,经审核后访问。
9. Antigravity平台上线Gemini 3.6 Flash模型,并重置所有用户每周使用配额。
10. Claude Code桌面版现已支持iOS模拟器,构建运行应用时模拟器在对话旁面板打开,当前公测中。
11. GitHub为GitHub Copilot推出canvases扩展,支持开发者与Agent在共享交互界面实时协作。
12. OpenAI为Codex Code Review上线自定义仓库规则功能,开发者可在AGENTS.md文件中添加规则,让Codex在审查时引用这些约定。
13. Cognition推出Devin Outposts,支持在企业自有服务器、虚拟机、Kubernetes集群或Mac设备上运行。推理和规划仍在云端,命令执行、代码访问和文件修改留在客户环境,满足内网访问与安全管控需求。
14. Claude Cowork推出“Record a