1. **MiniMax 新一代多模态视频模型预计今日开源权重**
MiniMax 计划于今日发布新一代多模态视频模型 MiniMax-H3 的模型权重。截至本期内容发布前,相关官方页面显示该模型仍处于“即将开源”的状态,社区可在发布后下载使用。
2. **FFmpeg 感谢 Cursor 为开发者提供免费额度**
FFmpeg 官方账号发文,向 AI 编程工具 Cursor 表示感谢,称其为多名 FFmpeg 开发者提供了免费使用额度。这些额度将被用于支持项目的持续开发以及代码审查工作,有助于提升开源项目的维护效率。
3. **Codex 负责人透露谷歌曾开发类 ChatGPT 产品但未发布**
Codex 负责人 Tibo 在回复网友时透露,谷歌在 ChatGPT 发布约一年前已拥有类似产品 LMChat,Tibo 本人曾在该团队工作。然而,该产品因担心冲击谷歌核心的搜索业务而最终未被推出。
4. **Karpathy 改用 3D 世界生成测试,弃用“鹈鹕骑自行车”评测法**
Andrej Karpathy 近日发帖表示,不应再用“鹈鹕骑自行车”这类传统提示词测试 LLM。他使用 Opus 5 进行了一项 3D 世界生成能力测试:输入《指环王》第一段文本,并要求模型用 three.js 渲染出对应故事场景。Karpathy 形容结果“有些粗糙但很有趣”,展示了 LLM 在具象化生成方向的新潜力。
5. **Qwen 与 XLang Lab 联合发布计算机操控 Agent Qwen-CUA**
Qwen 团队与 XLang Lab 联合推出了原生 Computer Use agent——Qwen-CUA。该 Agent 仅通过界面截图即可感知屏幕内容,并使用键盘和鼠标直接操作计算机,目前已开放技术报告与参考 demo,供开发者和研究者体验。