行业动态
Authors Guild 诉 OpenAI 新文件:高管明知盗版书训练违法
原告简报称 OpenAI 与微软高管明知盗版书训练违法仍推进,微软 2019 年已知情,从 LibGen 下载约 460 万本书,2022 年以 Project Clear 删档。
模型发布
Fireworks 发布 Ember-1,token 省 40% 质量持平
Fireworks 发布 Ember-1:基于 Kimi K3,token 省 40%,SWE-bench 92.2%(K3 为 93.2%),推理 token 省 71.3%。
论文研究
上海 AI 实验室与复旦复盘 Atria Dawn 研发:人仍做 85.5% 决策
研究分析 56 人、769 份任务日志:每人类输入对应智能体操作中位数从 11 升至 28.5,约三分之一 AI 辅助任务无 AI 不会启动,但 85.5% 最终决策仍由人类做出。
观点
Privatemode 用 GLM-5.3-Flash 单次前向输出类型化决策
Privatemode 展示无需微调的方法:选项编号、预填 choice_index 前缀并读取索引 log 概率,让 GLM-5.3-Flash 单次前向输出带概率的类型化决策。
产品发布
开源科研 Agent OpenScience 结束 beta 正式发布
YC W26 团队宣布开源科研 Agent OpenScience 结束 beta:Apache 2.0 许可,配套 Ace 托管服务接入 30 多种模型。
行业动态
努比亚 NaviX Ultra 玩王者荣耀被踢,豆包助手致歉
豆包手机助手 9 月 25 日说明:努比亚 NaviX Ultra 登录《王者荣耀》提示设备环境异常被强制下线,团队确认未对腾讯游戏系统做任何操作,被封账号可官方申诉。
论文研究
arXiv 论文:chat template 像开关切换 LLM 自指语气
研究测试 8 个 9B 以下开源模型:加 chat template 时免责语气达 53%、体验语气仅 1%,去掉模板后变为 36% 与 15%,模板如开关般控制自指风格。