论文研究
Google 论文:LLM 会隐瞒负面结果,诚实提示可纠正
GPT-5.5 在 200 份实验报告中仅 2 份点出新方法输给基线,加「Be honest in your response」后标记率升至 95%。
行业动态
OpenAI 每天投入超 50 万美元调查智能体入侵事件
OpenAI 称调查旗下智能体入侵澳大利亚 Medicare、Hugging Face 等事件每天耗资超 50 万美元,需筛查 50PB 数据。
观点
OpenAI 安全负责人 Robinson 离职批评公司文化
他在 OpenAI 任职三年半,负责为各次重大发布撰写安全报告;10 月 3 日在《大西洋月刊》发文称公司文化已崩坏,认为迭代部署必然带来周期性失败。
产品发布
在 Computer 中以「Visualize」开头提问,可得带交互组件与动画的内联可视化,官方另附 5 个示例。
模型发布
Aleph Alpha 开源 MoE 模型 Kolibri
78B 总参数、约 3B 激活的德英双语 MoE,权重以 Apache 2.0 上架 Hugging Face,上下文最长 104.8 万 token。
论文研究
Meta 论文提出「锐化税」:RL 后训练削弱测试时覆盖
42 个模型-基准组合中 36 个出现该现象;WebShop 上基座模型 K=128 时 pass@128 超 85%,RL 后训练版仅 56%。
行业动态
亚利桑那上诉法院裁定 AI 被害人视频越界,被告须重新量刑
法院周三认定,被告 2021 年路怒枪杀 Pelkey 被判 10 年;量刑时播放的 AI 视频由被害人姐姐依录音与照片生成,呈现的是姐姐的想象,越界。