2026-10-08 AI动态

6条精选

微博 RSS
产品发布

NVIDIA 与微软发布 RTX Spark 及桌面超算

RTX Spark 笔记本 10 月 16 日开售、最高 128GB 统一内存;同场预览桌面超算 DGX Station,748GB 内存可跑万亿参数模型。

评微软同场宣布 MXC 执行容器正式可用,把 Agent 的权限、观测与治理收进操作系统层,这正是本地 Agent 进企业的最大门槛。RTX Spark 走消费级预售、DGX Station 走企业桌面,两者共用同一套 CUDA 栈。
源:NVIDIA Blog(RSS)阅读原文
模型发布

Anthropic 发布 Claude Haiku 5.5

输入 $0.10/M、输出 $0.50/M,10 万 token 内较 Haiku 4.5 降价 90%;AA 智能指数 43 分,较上一代提升 26 分。

评Haiku 5.5 首次在 Haiku 档位加入可调 effort,把「省钱还是求准」交给调用方;同批 Sonnet 5.5 缓存读取价砍半,压低 Agent 长上下文重复调用的成本。做批量摘要与子 Agent 的团队拿到的是单价降本。
源:Anthropic 官方博客阅读原文
观点

a16z 解析德州为何让数据中心排队等电

德州电网并网队列从 2024 年底 63 GW 增至今年 6 月 474 GW,约 90% 是数据中心;投机性申请与社区沟通不足促使德州暂停审批。

评474 GW 是该州历史峰值负荷的五倍以上,意味着大量未落地的投机申请在挤占电网容量——先审后批反而保护了真实项目。对计划在德州建算力的公司,选址逻辑正从「电价便宜」转向「能否拿到并网许可」,审批周期成为新的选址变量。
源:a16z:News(RSS)阅读原文
论文研究

Nemotron 微调后达 IOI 与 IMO 金牌水平

NVIDIA 微调 Nemotron 3 超越 IOI 与 IMO 金牌线:IOI 2026 得 535.4/600,IMO 2026 得 30/42。

评两条结果含金量不同:IMO 由官方评分员判卷,IOI 是与人类选手同样时限与提交限制下的非官方跑分。金牌线分别为 361.12 与 29;方法上,SFT 补专业能力、RL 攻边界难题、GenCorrect 做多轮生成-评估-修正。
源:Hugging Face 社区博客(混合发现)阅读原文
模型发布

pplx-embed-v2-late 多模态检索模型开源

Perplexity 开源 0.6B 与 9B 两档模型,共享嵌入空间,免 OCR 检索文本、图片与 PDF,小模型可直接查大模型建的索引。

评索引端用 9B 保召回质量,查询端换 0.6B 压在线成本,且不必重建索引,这正是共享嵌入空间的价值。ViDoRe v3 图像 nDCG@10 上 9B 为 65.2%、0.6B 为 62.3%,代价是存储开销远高于单向量方案。
源:Hugging Face 模型页(Perplexity 官方)阅读原文
观点

Google 向全球开放 SynthID Detector

Google 向全球开放 SynthID Detector:上传图片、视频或音频即可查验是否含水印,累计水印 1800 亿张图片视频。

评检测只在「有水印」时有意义,所以 Google 把 OpenAI、NVIDIA、Kakao 拉进同一水印体系、Apple 即将加入,才是关键:跨厂商互认让水印从单家自证变成行业基础设施。但它识别不了未加水印或已被改写的内容,不能当最终判据。
源:Google 官方博客(The Keyword)阅读原文
← 2026-10-07 全部动态

🔗 探索更多 AI 工具板块

除了本板块,AI工具宝箱还有这些独家内容板块,帮你从不同角度发现好工具。

链接已复制,打开微信粘贴即可分享
☆ 0