2026-09-28 AI动态

7条精选

微博 RSS
行业动态

Authors Guild 诉 OpenAI 新文件:高管明知盗版书训练违法

原告简报称 OpenAI 与微软高管明知盗版书训练违法仍推进,微软 2019 年已知情,从 LibGen 下载约 460 万本书,2022 年以 Project Clear 删档。

评这批内部通信把诉讼焦点从「是否合理使用」转向「明知故犯」:早在 2019 年就把 LibGen 用法同步给微软、2022 年又启动删档,若法院采信,fair use 抗辩空间会被大幅压缩,训练数据授权可能加速成为出版行业的标准生意。
源:Authors Guild(官方)阅读原文
模型发布

Fireworks 发布 Ember-1,token 省 40% 质量持平

Fireworks 发布 Ember-1:基于 Kimi K3,token 省 40%,SWE-bench 92.2%(K3 为 93.2%),推理 token 省 71.3%。

评推理模型九成 token 花在内部思考,多轮任务还会把历史推理反复重放,省 token 直接等于省钱;Fireworks 以推理平台身份下场做专用模型,「托管方自有模型」可能成为推理价格战的下一战场。
源:Hacker News 热门(buzzing.cc 中文翻译)阅读原文
论文研究

上海 AI 实验室与复旦复盘 Atria Dawn 研发:人仍做 85.5% 决策

研究分析 56 人、769 份任务日志:每人类输入对应智能体操作中位数从 11 升至 28.5,约三分之一 AI 辅助任务无 AI 不会启动,但 85.5% 最终决策仍由人类做出。

评执行在加速、判断权在人,是当前智能体研发的真实分工;团队同时警告长链智能体会让人类监督退化成走过场审批——智能体操作 28 倍于人输入时,逐条审已不现实,监督机制要重新设计。
源:The Decoder:AI News(RSS)阅读原文
观点

Privatemode 用 GLM-5.3-Flash 单次前向输出类型化决策

Privatemode 展示无需微调的方法:选项编号、预填 choice_index 前缀并读取索引 log 概率,让 GLM-5.3-Flash 单次前向输出带概率的类型化决策。

评把生成问题变成分类问题,换来确定性输出与可校准置信度,对路由、风控这类高频结构化决策尤其划算;代价是丢掉自由文本理由,需要解释的场景仍要两段式。
源:Hacker News 热门(buzzing.cc 中文翻译)阅读原文
产品发布

开源科研 Agent OpenScience 结束 beta 正式发布

YC W26 团队宣布开源科研 Agent OpenScience 结束 beta:Apache 2.0 许可,配套 Ace 托管服务接入 30 多种模型。

评Synthetic Sciences 以「开源工具 + 付费托管」组合入场:模型无关、自带密钥免费,现金流来自不愿自己折腾的研究者;这套打法对各家 lab 的订阅定价是直接压力测试。
源:GitHub(synthetic-sciences/openscience)阅读原文
行业动态

努比亚 NaviX Ultra 玩王者荣耀被踢,豆包助手致歉

豆包手机助手 9 月 25 日说明:努比亚 NaviX Ultra 登录《王者荣耀》提示设备环境异常被强制下线,团队确认未对腾讯游戏系统做任何操作,被封账号可官方申诉。

评全球首款 AI 智能体手机上市十来天就撞上反外挂风控,端侧 Agent 跨应用操作与平台风控的边界还没人对齐;这类冲突会随智能体渗透更多 App 反复出现,要的是行业协议而非个案公关。
源:IT之家(RSS)阅读原文
论文研究

arXiv 论文:chat template 像开关切换 LLM 自指语气

研究测试 8 个 9B 以下开源模型:加 chat template 时免责语气达 53%、体验语气仅 1%,去掉模板后变为 36% 与 15%,模板如开关般控制自指风格。

评「语气」很可能不是模型性格而是格式伪影,评测与角色扮演应用都该把模板当变量控制;对想给产品去 AI 味的团队,调模板比换模型便宜得多。
源:Hacker News:AI 热帖阅读原文
← 2026-09-27 全部动态

🔗 探索更多 AI 工具板块

除了本板块,AI工具宝箱还有这些独家内容板块,帮你从不同角度发现好工具。

链接已复制,打开微信粘贴即可分享
☆ 0