Agent 长任务上下文工程:四类机制对抗溢出与目标丢失
Agent harness 层对抗长任务上下文溢出的 4 类机制:预算与卸载、压缩、todo-state 复述、跨会话记忆,覆盖 token 超限与目标漂移。
评四类机制的价值是把上下文管理从提示词技巧变成系统工程:预算与卸载决定成本上限,压缩和 todo 复述决定长任务稳定性。做多步 Agent 的团队可对照自查 harness 缺了哪一环。
源:MarkTechPost(RSS)阅读原文
Agent harness 层对抗长任务上下文溢出的 4 类机制:预算与卸载、压缩、todo-state 复述、跨会话记忆,覆盖 token 超限与目标漂移。
Anthropic 9 月威胁报告称,评估关联胡塞组织的也门小组用 Claude Code 开发制导火箭、射程超 2000 公里弹道导弹与 R2000 滑翔载具软件。
微软 CEO 纳德拉发文支持 AI 审慎发展、赞同“独立审计”,将于 9 月 14 日公布自研 MAI 模型《行为准则》并公开征求意见。
ElevenLabs 发布 Music v2.5,应用与 API 同步开放并保留免费档;47885 组盲测中听众多数更偏好 v2.5,R&B、Soul 与 Rock 提升最明显。
Claude Fable 5.1 用 44 分钟、176k tokens 破解 Cyphral Distich——这串 64 个数字的密码自 1899 年起被列为未解问题。
AllSpark 开源 Iris-mini(35B)与 Iris-pro(397B)搜索智能体,基于 Qwen3.6 与 Qwen3.5 底座,训练配方公开。
FT 报道 Anthropic 将连续第二个季度调整后盈利,Q2 营收超 115 亿美元(同比增 14 倍),7 月底 ARR 达 650 亿美元,毛利率超 80%。
Business Insider 称,Anthropic 已选定纳斯达克上市,计划 10 月中旬启动路演,目标估值约 2 万亿美元,将超 SpaceX 1.77 万亿美元纪录。
除了本板块,AI工具宝箱还有这些独家内容板块,帮你从不同角度发现好工具。