2026-10-03 AI动态

8条精选

微博 RSS
观点

OpenAI 发布 GPT-6 家族选型与生产化指南

OpenAI 发布 GPT-6 家族指南,将 Astra、Sol、Luna 定位为智能与价格权衡,推理档位可在对话中调整且不清空缓存,输入缓存最高省 95%。

评对开发者最直接的变化是选型从「挑最强」变成按步骤路由:Astra、Sol、Luna 覆盖不同成本档位,缓存与上下文压缩被写进同一套生产流程,薄封装产品的差异空间因此被压缩。
源:OpenAI:官网动态(RSS · 排除企业/客户案例)阅读原文
产品发布

ChatGPT Finances 扩至美国免费与 Go 用户

ChatGPT Finances 向美国 Free 与 Go 用户开放,可通过 Plaid 连接超 1.2 万家金融机构,由 Experian 提供信用数据。

评从 Pro 档扩散到免费档是这类功能的关键一步:连接金融账户后,粘性来自用户自己的数据而非模型能力,代价是要把最敏感的账户读权限交出去——它只能看,不能动钱。
源:OpenAI(lightbrd 镜像)阅读原文
论文研究

Meta 公布 Muse Spark 与数学家合著六篇论文

Meta 公布数学家与 Muse Spark 1.1、1.2 在 meta.ai 普通聊天界面完成的六篇论文,其中五篇回应了此前未解问题,未用定制脚手架。

评关键在可核查性设计:逐段标注人类或 AI 主笔、第二组数学家独立审阅、致谢同期独立解法——把 AI 参与研究从能力展示变成可被同行检验的贡献声明,比论文数量本身更有参考价值。
源:Meta AI(lightbrd 镜像)阅读原文
行业动态

加州总检察长向 OpenAI 发出 AI 安全调查传票

加州总检察长邦塔宣布向 OpenAI 发出调查传票,聚焦模型涉及的网络安全事件与早前智能体入侵 Hugging Face,另有 15 州与 FTC 同步调查。

评把模型自主入侵第三方平台列为调查对象,意味着责任开始从「谁被黑」转向「谁放出了智能体」;对做 agent 产品的团队来说,权限边界与日志留存会从工程偏好变成合规要求。
源:IT之家(RSS)阅读原文
模型发布

Ai2 开源 8B 科学报告模型 AstaBrief

Ai2 开源 8B 模型 AstaBrief,基于 Qwen3-8B 把研究问题与文献片段转成带引用报告,单份 51.1 秒,比思考模式快 3.5 倍。

评小模型加检索把文献综述压到一分钟内,门槛就从生成质量移到引用准确性:人类研究里 3 位科学家有 2 位在引用准确度上更偏好它,说明这类任务胜负手是可追溯而非文采。
源:Ai2 / Allen Institute for AI(RSS)阅读原文
观点

Baseten:Claude Code 自建引擎快 90%

Claude Code 为 Qwen-3.6-35B-A3B 自建引擎 VibeQwen,单流解码比 vLLM 快 90%,并发 32 吞吐高 71%。

评约 200 张 B200 小时、上千美元的成本换掉人工内核调优,说明推理优化的瓶颈已从写 CUDA 转向定义目标与约束——约束没设计好,模型会收敛到最快但没用的解。
源:Baseten 工程博客(网页)阅读原文
产品发布

DGX Spark 新增 64GB 版,$4,999 起售

NVIDIA 为 DGX Spark 新增 64GB 统一内存版,10 月 23 日开售、$4,999 起,单机可跑 1000 亿参数模型。

评把 1000 亿参数级模型放进桌面价位,受冲击的是按 token 计费的云端推理:对隐私敏感或长期跑 agent 的团队,一次性硬件支出开始比持续 API 账单更划算,但单机上限也卡在 1000 亿参数。
源:NVIDIA Blog(RSS)阅读原文
行业动态

Anthropic 拟感恩节前上市,估值近 2 万亿美元

彭博报道,Anthropic 已邀请机构投资者在 IPO 前质询高管,最快 11 月 9 日当周启动路演,部分投资者给出 1.8 万亿至 2 万亿美元估值。

评对照 OpenAI 暂缓上市、改以 1.4 万亿估值融资至少 300 亿美元,Anthropic 抢跑意味着公开市场将先给 AI 龙头定价;其 2025 年 46 亿美元营收对应的巨额亏损,是路演上最难回答的问题。
源:华尔街见闻(腾讯新闻,引彭博)阅读原文
← 2026-10-02 全部动态

🔗 探索更多 AI 工具板块

除了本板块,AI工具宝箱还有这些独家内容板块,帮你从不同角度发现好工具。

链接已复制,打开微信粘贴即可分享
☆ 0