AI 新闻摘要 2026-09-22

发布于 2026年09月22日

模型与能力

小米发布 MiMo-V2.6 系列:首个开源原生多模态模型

小米推出 MiMo-V2.6-Pro(最强能力)、MiMo-V2.6-Flash(平衡效率与成本)和 UltraSpeed 版(同质量下快 20 倍)。1.02T 总参数、42B 激活参数,MIT 开源,Intelligence Index 得分 46,暂居开源模型榜首。
> 相关链接:官方发布技术报告

Qwen-Image-2.1 开源:7B 参数、支持透明图+多区域局部编辑

通义发布 7B 图像生成/编辑模型,支持 RGBA 透明输出、最多 10 张参考图、单步三区域同步编辑(如删手表+染发+换衣),RTX 5060 Ti 16GB 可本地运行,但 LICENSE 文件仍含非商用条款争议。
> 相关链接:GitHub许可证澄清说明

Grok 4.7 发布:编码能力提升但综合排名反降

SpaceXAI 推出 Grok 4.7,称在相同价格和速度下优于 4.6;Coding Agent Index 得分 56(DeepSWE/Terminal-Bench 提升明显),但 Vals Index 排名跌至第 24(较前版降 5 名)。
> 相关链接:发布消息评测对比


Agent 与工具链

Jev 决策模型走红:零延迟路由/分类专用小模型

Jev 被广泛用于低延迟决策场景——比如 Chrome 插件自动选 WebMCP 工具、LangSmith 中当 judge、秒级重标 2300 篇论文(83 秒,$0.14)。本质是高精度单 token 分类器,不干‘思考’只做‘判断’。
> 相关链接:技术讨论应用案例

Cognition 推出 Devin Cloud CLI:终端直连 AI VM

Devin Cloud 新增 devin ssh 命令,用户可直接通过终端登录并操作其后台虚拟机,实现人机无缝协作——比如手动改代码后交还给 Devin 继续执行。
> 相关链接:官方公告


基础设施与硬件

Hugging Face Tokenizers v1 RC:最高提速 30 倍

新版 tokenizer 库宣称比旧版快 30 倍,多线程扩展更好、内存占用更低、安装包更小,被评价为当前 SOTA 分词方案。
> 相关链接:发布公告

vLLM 优化 Qwen3.8-2.4T 在 GB300 上的部署:5K tok/s/GPU 到 180 tok/s/user 可调

vLLM 发布针对 Qwen3.8-2.4T 的 GB300 NVL72 配置,吞吐和延迟可按需调节:高吞吐模式达 5000 token/s/GPU,低延迟模式支持 180 output token/s/用户。
> 相关链接:配置文档

vLLM 集成 NVDEC:视频推理去 CPU 解码瓶颈,吞吐翻倍

vLLM 新增 PyNvVideoCodec/NVDEC 支持,绕过 CPU 视频解码,8×H100 上视频工作负载吞吐提升超 2 倍。
> 相关链接:技术更新


研究与方法

小米开源 RL 训练栈:7K+ 环境、异步大批次、多任务强化学习

小米公开 MiMo-V2.6 的完整 RL 架构:1568 样本/步、百万上下文长度、跨编程/视觉/网络/音乐等多任务训练;环境代码和训练配方全开源,7K+ 任务数据集暂未发布。
> 相关链接:技术报告环境仓库

OpenAI 内部用 AI 自动写 GPU kernel 和优化训练代码

据内部员工透露,OpenAI 已将实验性模型训练流程高度自动化——包括自动生成 CUDA kernel、自动代码优化等,部分实验周期从数年压缩到约一周。
> 相关链接:技术总结


产品与应用落地

GitHub Copilot 桌面版将支持可编辑 diff

Copilot 桌面客户端即将上线「可编辑 diff」功能,用户能直接修改 AI 生成的代码变更再提交,不再只能全盘接受或拒绝。
> 相关链接:功能预告

Sentry 推出 AI 修复画布:从崩溃报告一键生成补丁

Sentry 新增集成画布,开发者点击 crash 报告即可触发 AI 自动复现、定位、生成修复代码并预览 diff,大幅缩短 debug 到 fix 的路径。
> 相关链接:演示说明


行业与公司动态

小米转型 AI 前沿实验室:首次跻身中国一线大模型阵营

小米被称作‘中国苹果’,此次以 MiMo-V2.6 系列打破传统认知,成为继阿里、百度、腾讯、字节、讯飞、月之暗面后,第七家被主流认可的中国前沿 AI 实验室。
> 相关链接:行业分析

Eidon AI 关停后开源 1274 小时机器人第一视角数据

机器人初创 Eidon AI 关闭后,无偿开源全部 13451 条 egocentric 机器人操作记录(1274 小时),含动作、传感器、语音多模态标注,极为罕见。
> 相关链接:数据集发布


政策、治理与安全

Muse 助手曝本地提权漏洞:OS 级权限成高危攻击面

安全研究员 Patrick Wardle 发现 Muse 存在严重本地劫持漏洞,因模型可直接调用系统命令,一旦被 prompt 注入即可获取完整设备控制权。
> 相关链接:漏洞报告

Meta 提出 Muse 类代理安全设计四原则

Meta 建议:默认假设 prompt 注入必发生;敏感凭证绝不交给模型;工具必须容器隔离;所有外呼请求经独立网关审核。
> 相关链接:设计指南




评论