2026-08-29 AI动态

6条精选

微博 RSS
行业动态

联邦法官裁定特朗普政府将 Anthropic 列入黑名单违法

美国加州北区联邦法官裁定并宣布,特朗普政府将 Anthropic 列为国安风险并封禁其 AI 技术的行为违法,构成违反第一修正案的非法报复。

这条裁决给「以国安之名行封禁之实」立了边界:企业因产品伦理限制(拒用于致命自主武器、大规模监控)遭政府报复,被认定违宪。对 AI 公司而言,坚持安全红线未必换来监管惩罚,反而可能受宪法保护。
源:Ars Technica:AI(RSS)阅读原文
论文研究

Anthropic 让 Claude 自主训练缓解对齐失败

Anthropic 让 Claude 自训练模型,缓解欺骗、谄媚等 10 类对齐失败;在 4.7 倍模型上有效,并超越 28 名人类研究员,欺骗方案优 20%。

让模型自己当研究员去修自己的对齐问题,本质是把「人类反馈」换成「自动红队」。亮点在方法可迁移到 4.7 倍更大的模型,说明不依赖同规模训练;对安全团队是降本信号——部分对齐审计可由 AI 自动完成。
源:Anthropic:Research(发表成果 · 网页)阅读原文
模型发布

腾讯混元发布 Hy4 preview 开源模型

腾讯混元发布旗舰模型 Hy4 preview,总参数 770B、激活 49B、上下文 1M,已开源并在腾讯云 TokenHub 和 OpenRouter 上线。

770B 总参 + 1M 上下文走开源路线,直接对标同档闭源旗舰。对中文开发者意义在可本地/私有部署且已上架 OpenRouter,推理选择更灵活;也显示大厂旗舰模型开源化趋势在加速。
源:公众号:腾讯混元阅读原文
观点

AI 工程师 Colab 笔记本覆盖 RAG/智能体/评估

Colab 笔记本用原始 API 而非框架构建 RAG、智能体、评估,免费 Groq API 运行、无需信用卡,含三个端到端案例,兼容 OpenAI API。

对想避开 LangChain 等框架抽象、直接理解底层调用的工程师是很好的上手材料。免费 Groq + Colab 零成本跑通 RAG/智能体,降低实验门槛;价值在「可运行的最小系统」而非又一层封装。
源:Hacker News 热门(buzzing.cc 中文翻译)阅读原文
论文研究

科研智能体基准 TBS 0.1 发布

斯坦福领衔发布 Terminal-Bench-Science 0.1,用生命、物理、地球、数学、工程科学的 70 个专家任务评估 AI 智能体的科研能力。

把 Terminal-Bench 从软件工程扩到真实科研流程,意味着智能体评测正从「写代码」走向「做研究」。70 个跨学专家任务能更真实反映 AI 在科研中的可用度,对衡量「AI 科学家」进展是更有意义的标尺。
源:Hacker News 热门(buzzing.cc 中文翻译)阅读原文
模型发布

GLM-5.3 开源权重,智能体编码与网防最强

智谱开放 GLM-5.3 权重(Hugging Face:zai-org/GLM-5.3),定位智能体编码与网络防御模型,可供下载定制,详见 z.ai 博客。

从 08-20 发布到今日开放权重,GLM-5.3 补齐了「可自部署」这最后一块。对国内企业尤其关键:无需调用云端 API 即可在私有环境跑最强编码/网防模型,数据不出域;开源权重也利于社区做安全审计与二次开发。
源:智谱 Z.ai:GLM-5.3 技术博客阅读原文
← 2026-08-28 全部动态

🔗 探索更多 AI 工具板块

除了本板块,AI工具宝箱还有这些独家内容板块,帮你从不同角度发现好工具。

链接已复制,打开微信粘贴即可分享
0