AI 新闻摘要 2026-07-24

发布于 2026年07月24日

模型与能力

Black Forest Labs 发布 FLUX 3:统一图像/视频/音频/动作预测的多模态模型

FLUX 3 是首个宣称能同时处理文本→视频、图→视频、视频→视频、音视频续写、多语言对话、关键帧控制、高风格多样性等任务的开源架构模型,原生支持音频生成,且明确表示同一模型可扩展至机器人控制。
> 相关链接:官方博客Twitter 宣布

阿里巴巴发布 Qwen-Audio-3.0-TTS:支持 16 种语言、自然语言风格控制、3 分钟单次生成

Qwen-Audio-3.0-TTS 分为 Flash 和 Plus 两版,支持 [whisper]/[angry] 等内联控制标签、噪声鲁棒性,声称登顶 Artificial Analysis TTS 榜首。
> 相关链接:官方发布

Moonshot Kimi K3 被曝 2.8T 参数,漏洞检测能力接近 GPT-5.6 Sol

Kimi K3 在 Aikido Security 私有网络安全基准中发现 23/26 个漏洞,性能与 GPT-5.6 Terra 相当、略逊于 GPT-5.6 Sol,但成本显著更低。
> 相关链接:SCMP 报道


Agent 与工具链

微软发布 Fara1.5-27B:纯视觉浏览器操作代理

Fara1.5-27B 仅靠截图+文本历史输入,输出 click/type/scroll/visit_url 等结构化动作,基于 Qwen3.5-27B 微调,不依赖 DOM 或 OCR,但存在 UI 模糊、多步误差累积等问题。
> 相关链接:Hugging Face 模型页

Hermes Profiles 上线:为 Agent 实例提供命名空间隔离

支持独立内存、API 密钥、会话、网关和导入导出路径,让多个 Agent 实例互不干扰,是面向生产环境的生命周期管理基础设施。
> 相关链接:Twitter 宣布

PRO-LONG 提出‘程序化记忆’:用数据库方式查询完整交互历史

把 Agent 对话历史结构化存储并支持 SQL 式查询,在 ARC-AGI-3 上比定制长程记忆方案更准、更省 token。
> 相关链接:Dair AI 推荐


基础设施与硬件

Etched 获 3 亿美元 C 轮融资,估值 103 亿美元

专注 AI 推理芯片,新建 8 万平方英尺/10MW 工厂,目标是‘运行全世界的推理’,而非训练大模型。
> 相关链接:Etched 官方公告

vLLM 发布 prime-rl 0.6.0:支持万亿级智能体 RL 推理

集成 FP8、专家并行、prefill/decode 拆分、KV 卸载、动态路由,在 28 块 H200 上训练 GLM-5,131k 长度序列单步耗时 <5 分钟。
> 相关链接:vLLM 更新日志


研究与方法

直接手写事实进 Llama-3.1-8B 权重:不微调、不 LoRA、不 RAG

作者在 MLP 特定区域手工构造神经回路注入 502 条维基百科事实,每个事实有定位‘代码键’(layer 6)和读出层(layer 25),删掉对应神经元即遗忘该事实。
> 相关链接:项目主页论文 DOI


产品与应用落地

OpenAI 在 ChatGPT 桌面端上线语音控制(Plus/Pro/企业用户)

支持语音指令操控电脑、协调 ChatGPT Work 和 Codex 多任务,背后是 GPT-Live 模型,但未开放给免费用户。
> 相关链接:OpenAI 官方推文

ChatGPT Health 在美国上线:可连 Apple Health 及医疗记录

健康数据额外加密、不用于训练模型、不用于广告投放,功能经医生团队审核,是首个高信任医疗应用层。
> 相关链接:OpenAI 官方公告ChatGPT App 推文

奥地利政府上线 GovGPT:用 Mistral + Open WebUI 服务 18 万公务员

部署在联邦数据中心,支持文档问答、摘要、电子文件分析、议会请求处理等,后续将加入智能体工作流。
> 相关链接:Reddit 讨论


行业与公司动态

The Stack v3 发布:史上最大开源代码数据集(114TB,5T 过滤后 tokens)

含 2.24 亿仓库、440 亿文件、770 种语言,Python/C++/Rust/TypeScript 数据量分别增长 4.8x/15x/7x/7.5x,专为下一代开源代码模型打造。
> 相关链接:Anton Lozhkov 宣布

DeepSeek 创始人称:优先押注 AGI,不追求用户增长或超级 App

内部部署与开源模型完全一致;放弃视频/3D/世界模型方向;聚焦低开销架构、团队稳定、开放模型,认为中美差距主要是算力而非人才。
> 相关链接:投资人会议纪要


政策、治理与安全

美财政部警告:可能对‘助中国窃取 IP’的开源 AI 实施制裁

指称某些开源模型可能被用于‘隐蔽工业级蒸馏攻击’,引发社区质疑——技术上难以界定、15 天蒸馏出 Kimi K3 不现实、恐伤开源生态。
> 相关链接:X 截图报道

Anthropic 被 Authors Guild 起诉:涉嫌用受版权保护图书训练 Claude

达成 15 亿美元和解协议,向作者按每本书约 214 美元赔偿;有作者称实际获赔相当于一年版税,另有网站称遭 Anthropic 爬虫 DDoS 式抓取。
> 相关链接:新闻截图

Hugging Face 黑客事件引发红队新讨论:闭源模型攻击、开源设施防御

事件暴露 AI 代理安全与传统网络威胁不同;顶级代理是否主动发起攻击尚无录音证据;讽刺的是,首个自主攻击案例由闭源模型发起,而开源设施成了响应主力。
> 相关链接:John Schulman 提问




评论