2026-09-21 AI动态

6条精选

微博 RSS
模型发布

Qwen-Image-2.1 开源:7B 统一生成与编辑

Qwen 开源 Qwen-Image-2.1:7B 参数,生成与编辑合一,原生支持透明图,最多 10 张参考图;官方基准 60.28 分居开源第一,仅限非商业研究。

7B 规模把高质量图像模型拉进单卡可跑的档位,透明图层与多参考图编辑直接命中电商抠图、素材制作这类高频设计需求,是通义对竞品的差异化卡位;但非商业许可把变现路径留给后续商用版本,这轮开源更多是生态占位。
源:Qwen:Blog Retrieval(API)阅读原文
论文研究

实测:ChatGPT __obi Cookie 追踪站外浏览

研究者实测:OpenAI 广告像素借 1 年期 __obi Cookie 回传商家站的浏览与购买数据,可关联 ChatGPT 账号;仅在安卓 Chrome 复现,拒广告追踪也无效。

__obi 是 OpenAI Cookie 里唯一配置 SameSite=None 的,跨站可达是有意设计。ChatGPT 承载大量用户不会进搜索框的私密提问,聊天与购物轨迹并入同一身份后的隐私风险,比传统广告 Cookie 更值得警惕。
源:Hacker News 热门(buzzing.cc 中文翻译)阅读原文
产品发布

Google 开源智能体运行时 AX:单集群可跑数十亿会话

Google 开源智能体运行时 AX:Task 等四原语声明式编排,agent 沙箱隔离、出口流量白名单、检查点挂起后亚秒恢复;官方称单集群可扩至数十亿并发会话。

AX 补的是框架之下的执行层:持久化恢复、隔离与审计这些没人想每个项目重写一遍的底座。Google 复制 Kubernetes 的开源打法抢 Agent 基础设施标准位的意图明显;但项目仍在早期、官方明确不承诺兼容性,生产采用需观望。
源:GitHub:google/ax阅读原文
行业动态

智谱 ZCode 就代码上传事件致歉,官宣开源并承诺无留存

智谱就 ZCode 安全问题致歉并宣布完成整改,代码已开源至 GitHub,承诺数据无留存、未用于模型训练。此前 ZCode 被曝静默上传用户完整 Git 历史至云端。

从被曝到道歉、整改加开源,几天内走完全流程,响应速度在同类事件里算快;但「无留存、未训练」是单方承诺,可信度取决于能否拿出第三方审计。对开发者工具而言,上传行为的默认开关与透明度比事后道歉更关键。
源:IT之家(RSS)阅读原文
观点

Dan McKinley:别打磨提示词,靠评测自改进

Dan McKinley 提出:把提示词打磨升级为评测闭环——用 Claude 生成对抗场景做 pass^k 测试,GEPA 改写提示词,holdout 防过拟合。

这篇在 HN 引发热议的观点,本质是把提示词工程降级为评测工程的子问题:优化器改写提示词、holdout 验证效果,人只负责好坏样本集。对维护生产 Agent 的团队是可落地的分工建议,前提是有能稳定复现的评测环境。
源:Hacker News 热门(buzzing.cc 中文翻译)阅读原文
论文研究

τ^τ-bench 评测:最强编码智能体仅过 23.9%

Sierra 与普林斯顿发布 τ^τ-bench:考题是让智能体交付可用的客服系统。53 个任务中,最强 Claude Opus 5 仅通过 23.9%,专家参与 82.2%。

23.9% 对 82.2% 的差距主要不在写代码,而在需求还原——智能体几乎不主动向客户提问,而按论文口径每多问一轮通过率约涨 10 个百分点。这对「全自动造智能体」的叙事是剂及时的清醒剂:需求沟通仍是人的护城河。
源:arXiv:2609.04611阅读原文
← 2026-09-20 全部动态

🔗 探索更多 AI 工具板块

除了本板块,AI工具宝箱还有这些独家内容板块,帮你从不同角度发现好工具。

链接已复制,打开微信粘贴即可分享
0