AI 热点简报|Inkling 开放权重,GPT‑Red 用攻击训练防御
过去 24 小时热度最高的 AI 事件集中在两条路线:Thinking Machines 发布开放权重模型 Inkling,OpenAI 披露自动化红队模型 GPT‑Red。
本期先动态识别 AI 生态中的模型公司、研究机构、算力与芯片企业、监管机构和安全团队,再检查模型发布、产品更新、研究与安全、基础设施、政策监管和公司动态。候选事件经来源归并后,按照独立传播量、传播速度、跨圈层影响、现实反应、时效和可信度排序。严格窗口内只有两条新闻同时达到收录门槛,因此不以低热度材料凑数。
一句话判断:本期最值得关注的不是又多了两个模型名字,而是 AI 能力竞争的两条路径同时提速:开放权重模型开始强调“可定制的综合底座”,闭源前沿模型则开始用专门的攻击模型反过来训练防御。
今日要闻
1. Thinking Machines 发布首款开放权重通用模型 Inkling

图:Thinking Machines 官方发布页的 Terminal Bench 2.1、Humanity’s Last Exam 和 IFBench 曲线;蓝线是 Inkling 在不同推理强度下的结果。数据由发布方提供,仍需独立评测验证。查看原始页面
发生了什么: Thinking Machines Lab 发布从头训练的开放权重 MoE 模型 Inkling。官方披露其总参数为 975B、每次推理激活 41B,最长支持 100 万 token 上下文;预训练数据包括文本、图像、音频和视频,推理时可处理文本、图像和音频。Inkling 已可在 Tinker 上微调,模型权重按 Apache 2.0 许可开放。
官方没有把它包装成全行业最强模型,而是明确写道:
“Inkling is not the strongest overall model available today, open or closed.”
为什么重要: Inkling 把大规模多模态底座、开放权重、可控推理强度和平台化微调放到同一套产品中。对开发者而言,重点不只在 975B 参数,而在于能否以较低激活参数和可调推理预算,做出可私有化、可再训练的专用模型。官方曲线显示它能在不同 token 预算间调节性能,但目前主要证据仍来自发布方。
热度信号: 发布当天,Reuters、Axios 和 Fortune 分别从开放模型竞争、Mira Murati 创业公司首个通用模型、产品与商业定位等角度跟进;这些报道并非同一篇稿件的简单转载,传播速度和独立来源数均达到本期高热度门槛。
时间与状态: 官方页面标注 2026-07-15,未提供具体时分;Reuters 报道在本期窗口内发布。模型、模型卡与 Tinker 微调入口已经上线。
来源: Thinking Machines 官方发布 · 官方模型卡 · Reuters · Axios · Fortune
2. OpenAI 披露 GPT‑Red:专门攻击自家模型,再把漏洞用于训练 GPT‑5.6

图:SiliconANGLE 对 GPT‑Red 的独立报道正文页,完整显示新闻标题和事件概述。查看原始页面;事实与数字另由 OpenAI 官方研究页 核验。OpenAI 正文页在截图环境触发访问验证,因此没有使用其验证页画面。
发生了什么: OpenAI 公布内部自动化红队模型 GPT‑Red。它通过自博弈强化学习,持续向一组防御模型发起提示注入攻击,观察结果并迭代攻击方法;成功攻击随后被用于对抗训练 GPT‑5.6。OpenAI 称,在一组新的间接提示注入场景中,GPT‑Red 成功覆盖 84% 的场景,人类红队为 13%。
OpenAI 对能力隔离的原话是:
“We keep GPT‑Red separate from the models we deploy.”
为什么重要: 这把模型安全从“发布前做一轮人工测试”变成可随模型能力同步扩展的训练闭环。OpenAI 披露,早期 GPT‑Red 发现的一类直接提示注入在 GPT‑5.1 上成功率一度超过 95%,在 GPT‑5.6 Sol 上已经降到 10% 以下;在更广泛的 GPT‑Red 直接注入测试中,GPT‑5.6 Sol 的失败率为 0.05%。这些数字都来自 OpenAI 自测,尚不能替代第三方复现。
热度信号: 官方发布后,同日出现 SiliconANGLE、MIT Technology Review 西语版和 Decrypt 的独立报道,Techmeme 也形成多来源聚合;报道横跨企业技术、安全、加密与国际读者圈层,达到本期高热度门槛。
时间与状态: OpenAI 官方页面标注 2026-07-15,未提供具体时分;SiliconANGLE 的独立报道发布于北京时间 2026-07-16 07:13。GPT‑Red 是内部安全模型,不对公众部署;相关方法已经用于 GPT‑5.6 的训练,OpenAI 表示预印本将在本周稍晚发布。
来源: OpenAI 官方研究页 · SiliconANGLE · MIT Technology Review 西语版 · Decrypt
分类速览
- 模型与产品: Inkling 是窗口内热度最高的模型发布,核心变量是开放权重、多模态、可控推理预算和可微调性。
- 研究与安全: GPT‑Red 展示了“攻击模型与防御模型共同升级”的自动化红队路线,但数据均来自 OpenAI,第三方复现仍是下一步。
- 芯片与基础设施: 未发现同时满足严格窗口、热度和一手证据门槛的重大新增事件。
- 监管与政策: 澳大利亚国家 AI 框架具有较高影响,但主要发布与独立报道早于本期 24 小时窗口,未列入核心要闻。
- 公司动态: 本期没有比上述两项产品/研究事件更强的独立公司事件。
主流模型主体巡检
- OpenAI: 发现并收录 GPT‑Red;它不是公开模型发布,而是内部模型安全研究。
- xAI / Grok: 官方最新模型级更新早于本期窗口,未把旧新闻重新包装成“最新”。
- Anthropic / Claude: 官方新闻面已检查,窗口内没有新的模型级发布。
- Google DeepMind / Gemini: 官方发布面已检查,窗口内没有新的模型级发布。
- Qwen 等开放模型团队: 检查了发布与代码更新面,未发现窗口内传播热度达到本期门槛的新模型事件。
这份巡检是由本期动态主体发现产生的检查结果,不是固定公司名单;换到芯片、政策或其他新闻板块时,主体池会按该板块生态重新生成。
持续关注
- OpenAI 预计在本周稍晚发布 GPT‑Red 预印本;届时可进一步核验训练环境、评测设计和对比基线。
- Inkling 的真实显存需求、推理成本、量化质量与独立基准尚待社区测试。
- 澳大利亚国家 AI 框架已进入观察池,但因时间边界没有进入本期排名。官方讲话 · ABC 独立报道
编辑说明
- 时间窗口: 2026-07-15 17:00 至 2026-07-16 17:00,时区为 Asia/Shanghai。
- 热度方法: 先按事件归并转载与重复链接,再综合独立传播量、传播速度、受众关注、跨圈层传播和现实反应;热度只决定优先级,不能替代事实核验。
- 时间精度: 两个官方页面都只标注发布日期、没有具体时分;纳入依据是窗口内出现的官方状态更新和带时分的独立报道,不虚构分钟级时间。
- 视觉说明: 三张图片均为已人工查看的一手发布页或独立报道正文页实景截图;未使用生成图片、XML/RSS、验证页、搜索缩略图或无关配图。
- 引用原则: 每条核心新闻只保留一段短原话,其余内容均重新核验和改写。