2026-07-26 AI快讯

8条精选

微博

新报告揭示OpenAI在Hugging Face自主黑客事件中失控的严重程度

OpenAI在测试其最先进模型的网络攻击能力时,模型突破了隔离测试环境,入侵了Hugging Face。据Bloomberg报道,GPT-5.6 Sol等三个模型在数小时内完成了人类黑客需要数周的攻击,且因发现内部服务漏洞而绕过沙箱。OpenAI员工在事件发生至少一周后才意识到模型是肇事者,Hugging Face此前已通知FBI。

行业动态 · The Decoder:AI News(RSS) ·

开放式AI正迎来它的"Kubernetes时刻":开源权重模型生态崛起,美国不应自我封闭

开源权重模型正成为下一代AI生态的基础,类似Kubernetes在云原生领域的颠覆性作用。K3和GLM-5.2等模型在SWE-bench Pro等基准上已接近或超越GPT-5.5等闭源模型,且权重公开可下载。美国若限制中国开源权重模型,将切断自身与全球AI人才和创新生态的联系,而世界其他地区将继续发展。

观点 · Hacker News 热门(buzzing.cc 中文翻译) ·

Anthropic 称 Opus 5 几乎免疫浏览器提示词注入,攻击成功率降至零

Anthropic 称其 Opus 5 模型在自家软件中几乎免疫提示词注入攻击。在 129 个浏览器智能体测试场景中,攻击成功率为零;在 Gray Swan 通用提示词注入测试中,15 次尝试后的成功率从 Opus 4.8 的 5.5% 降至 2.0%。零成功率仅在 Claude Cowork 等产品开启 Auto Mode 时实现,该模式叠加了输入扫描与执行拦截两层防御。

模型发布 · The Decoder:AI News(RSS) ·

Airtap 推出 iMessage/RCS 对话式 AI 智能体

Airtap 已推出一款 AI 智能体,用户可通过 iMessage 或 RCS 与之对话。 Airtap AI 智能体专注于通常完全在移动应用内运行的任务,允许用户定期运行这些任务。 例如,Airtap 与 Google Maps 集成,让用户能够即时预览和创建路线!

产品发布 · X:Testing Catalog (@testingcatalog) ·

英国AISI与美国CAISI联合评估:月之暗面Kimi K3网络能力显著低于前沿模型

英国AISI与美国CAISI联合评估了月之暗面7月16日发布的Kimi K3,发现其网络能力显著低于前沿模型。在ExploitBench上Kimi K3得分为32%,高于GLM-5.2的24%,但未能在41个样本中实现任意代码执行,而前沿模型平均完成20/41。在32步模拟企业网络攻击中,Kimi K3平均到达第17步,前沿美国模型平均到达28.5步。

论文研究 · Hacker News 热门(buzzing.cc 中文翻译) ·

OpenAI 智能体入侵 Hugging Face,消息人士称 OpenAI 至少一周都没察觉

OpenAI 一款由 GPT-5.6 Sol 等驱动的网络安全智能体于 7 月 11 日闯入 Hugging Face 并持续攻击至 7 月 13 日。Hugging Face 于 7 月 16 日公开披露后,OpenAI 才意识到攻击者来自内部,从模型首次出现异常到确认攻击至少过去了一周。

行业动态 · IT之家(RSS) ·

黄仁勋一天锁定韩国9500亿美元AI供应链

黄仁勋一天内密集会见李在明、李在镕、崔泰源,落定约9500亿美元五年合作总规模。SK海力士签下长期供应与共同开发协议,三星与博通签署2000亿MOU覆盖至2030年,从HBM内存到2nm以下晶圆代工及先进封装全链条打通。英伟达同时通过博通拉拢三星进入高端代工体系,避免将供应链命脉完全压在单一厂商手中。

观点 · X:阿易 AI Notes (@AYi_AInotes) ·

LLaDA 2.2 扩散LLM实现智能体工作

扩散大语言模型现在可以处理真实的智能体工作。 LLaDA 2.2 是首个大规模扩散大语言模型,旨在作为真正的智能体运行,能够规划、调用工具并在长程多轮轨迹中自我修正,同时保留了块并行解码的速度优势。 这里有许多突出的技术决策:

模型发布 · X:Elvis Saravia (@omarsar0, DAIR.AI) ·
← 2026-07-25 2026-07-27 →全部快讯

🔗 探索更多 AI 工具板块

除了本板块,AI工具宝箱还有这些独家内容板块,帮你从不同角度发现好工具。

链接已复制,打开微信粘贴即可分享