产品发布

79条 · 每日更新

微博 RSS
产品发布

OpenAI 推 Daybreak 投10亿美元护一线

OpenAI 推出 Daybreak 计划,承诺投入 10 亿美元补贴访问、培训与技术支持,优先覆盖水处理、电网等一线网络防御者。

10 亿美元面向一线防御者的补贴,把前沿模型能力直接导入水处理、电网等平时买不起高级安全服务的领域,既是品牌叙事也是实打实的防护能力下沉,中小机构首次能以低成本获得顶级模型的威胁研判支持。
源:OpenAI:官网动态(RSS · 排除企业/客户案例)阅读原文2026-09-04
产品发布

Claude 支持后台操作电脑

Anthropic 为 Claude Cowork 与 Claude Code 加入后台电脑操作,Claude 可点击、输入、开应用自动完成任务,用户可同时做别的事。

后台电脑操作让 Agent 不再独占鼠标键盘,是桌面自动化 Agent 的可用性拐点;OpenAI 此前已在 Mac 落地同类能力,Anthropic 跟进意味自主桌面控制正成编码/生产力工具标配,下一步比拼可靠性与任务范围。
源:Anthropic 官方博客阅读原文2026-09-03
产品发布

Cursor 推出 Self-Hosted Machines

Cursor 发布 Self-Hosted Machines,让云智能体工具执行迁移到企业自有机器,推理规划留云端,Cursor 不主动连入企业网络。

把工具执行下沉到客户自有内网、推理规划留云端,解决企业把敏感数据或系统交给第三方云代理的合规顾虑;类 Cursor 的云编码 Agent 正把运行边界下沉到客户侧,是 toB Agent 落地的关键一步。
源:Cursor Blog阅读原文2026-09-03
产品发布

Gemini 推 agentic 视频理解

Google DeepMind 为 Gemini 三档 Flash 推 agentic 视频理解,动态扫描片段,token 降 88%/成本降 66%/准确率升 7%。

视频理解从抽固定帧转向按需看片段,直接砍掉无关帧 token 浪费,对长视频、监控、教程类应用降本明显。Gemini 把多模态 Agent 下放到 Flash 档,低成本视频分析更快进生产。
源:Google DeepMind:Blog(RSS)阅读原文2026-09-02
产品发布

Google Workspace 推图像工具 Pics

Google 发布 Workspace 图像工具 Google Pics,未来数周面向 AI Pro/Ultra 订阅者及多数商业客户推出。

把图像生成、编辑塞进 Workspace,是 Google 用 AI 功能锁订阅的典型打法——Pro/Ultra 才给。对中小团队,轻量素材不必再开独立工具,但重度创作仍受订阅档位限制。
源:Google Blog:AI(RSS)阅读原文2026-09-02
产品发布

MiniMax H3 Max 24 小时 AI 直播上线

MiniMax 将 H3 Max(768P、480P)接入开放平台,海外开发者已借此搭建 Twitch 直播与 24 小时 AI 电视台。

24 小时 AI 直播把视频生成从按条生产变成按流播放,对带货、虚拟主播、长剧内容是范式切换。H3 Max 开源接入降低了技术门槛,但 768P 分辨率与实时性仍是硬约束,离替代真人直播还有距离,早期更适合陪伴类低频场景。
源:公众号:MiniMax(稀宇科技)阅读原文2026-09-01
产品发布

Reactor 联手 HaoAI 推 FastH3 直播

Reactor 基于 FastH3 推无限直播流,画面持续生成,代码全部开源;FastH3 单 B200 上 15 秒视频耗时 47 秒,4 卡近实时。

对 AI 视频开发者:无限直播流把生成式视频从片段推向持续信号源,适合直播带货与虚拟主播。FastH3 已开源,本地复现门槛取决于能否上 B200。
源:网易号:像素与芯片阅读原文2026-08-31
产品发布

OpenAI 为 Codex 与 Work 重置用量

OpenAI 为 Codex 与 ChatGPT Work 用户重置用量,修复 8 类超额消耗,额度提升 10%-50%,部分用户周额度曾耗 70%。

OpenAI 承认 Codex 后台存在压缩、记忆、子代理等多处重复计费的工程 bug,修复后同等额度实际可用反升 10%-50%。这暴露 Agent 产品 token 计费极不透明,用户应善用 /usage 看清消耗来源,而非一味加购。
源:机器之心(新浪财经转载)阅读原文2026-08-30
产品发布

Claude in Chrome 正式全面上线

Anthropic 上线 Claude in Chrome,浏览器内自主操作免逐步审批;安全分类器每次验证合规,启用后自 Opus 4.8 起攻击成功率 0。

浏览器原生 Agent 让 Claude 从聊天框走进工作流,免逐步审批加安全分类器是双刃剑:效率提升但权限边界风险上升,企业部署需关注操作审计。
源:Claude:Blog(网页)阅读原文2026-08-27
产品发布

OpenWorker 新版内置网络安全智能体

Andrew Ng 开源智能体 OpenWorker 发布新版,内置代码漏洞扫描、供应链依赖注入检测、云安全配置检查三类安全智能体,可本地运行权重模型。

桌面 Agent 拿到文件与终端权限后,安全边界即攻击面。OpenWorker 把审批拆成读/写/执行/外部四档风险类,等于把"人确认"做成可审计的执行闸而非纯 UI。想接内部文档不想过别人云端的团队,可拿它当本地 Agent 的基线标尺。
源:GitHub:andrewyng/OpenWorker阅读原文2026-08-26
产品发布

Claude 记忆打通聊天与 Cowork 可逐条编辑

Claude 将聊天与 Cowork 记忆统一,任一场景可调用此前上下文,可在 Memory 设置按主题逐条查看、编辑或删除,健康信仰等敏感话题默认不存储。

记忆统一后,"AI 记得我"从单应用功能变成跨场景基础设施,体验提升明显。但逐条可编辑只是透明的一端,另一端是模型如何调用这些记忆、是否会悄悄拼出用户画像。敏感话题默认不存是底线,真正考验在"用户以为没存其实存了"的边界把控。
源:Claude:Blog(网页)阅读原文2026-08-26
产品发布

OCR It 发布本地文档提取扩展

OCR It 是 Chrome 扩展,本地 OCR 提取扫描书/PDF 文本供 LLM,用内置 Tesseract 无需密钥,支持自动翻页,上限 300 页。

本地 OCR 意味着扫描件全程不出设备,规避了云端 API 的隐私与按量计费问题。Tesseract 在中文识别精度上不及商业云端引擎,但对个人文档场景够用。300 页上限说明其定位是轻量工具,批量生产场景仍需云服务。
源:Hacker News 热门(buzzing.cc 中文翻译)阅读原文2026-08-25
产品发布

NVIDIA Vera NVL72 能效升 30 倍

NVIDIA 实测 Vera Rubin NVL72 每兆瓦吞吐较 GB300 NVL72 最高提升 30 倍,每百万 token 成本降为 1/35。

每百万 token 成本降到上一代的 1/35,直接决定推理定价的下降空间——这波硬件换代是下半年 API 降价潮的底层支撑。能效提升 30 倍还意味着同等电力下可承载的推理规模大幅扩张,自建算力的门槛同步下移。
源:NVIDIA Blog(RSS)阅读原文2026-08-25
产品发布

FreeToken 单卡跑 753B GLM-5.2

FreeToken 边缘推理引擎:8 GB 笔记本 GPU 跑 35B,单张工作站显卡可跑 753B 的 GLM-5.2。

源:MarkTechPost(RSS)阅读原文2026-08-24
产品发布

llm 0.33 发布

llm 0.33 发布,升级 OpenAI 库至 3.x,HTTP 客户端由 httpx 换为 httpx2,embed 新增 --key 参数支持多密钥。

源:Simon Willison 博客阅读原文2026-08-23
产品发布

SGLang 权重缓存守护实现亚秒级引擎重启

SGLang Weight Cache Daemon,零拷贝将权重加载从 495 秒降至 0.63 秒(785 倍),启动耗时减 93.9%,支持多实例共享。

源:LMSYS:Blog(Chatbot Arena 团队)阅读原文2026-08-22
产品发布

Claude Mythos 5 安全能力扩展至更多防御者

Anthropic 宣布 Claude Mythos 5 集成至 Claude Security,推出 3500 万美元安全基金资助开源漏洞修复。

源:Claude:Blog(网页)阅读原文2026-08-22
产品发布

Mistral 推出 Agentic Search 多步检索

Mistral 用 search、open、navigate、read、grep 五工具循环检索,让模型在长文档与多来源中查找、定位并验证信息。

源:Mistral AI:News(网页)阅读原文2026-08-21
产品发布

AlloyDB ScaNN 扩至 100 亿向量

AlloyDB ScaNN 支持超 100 亿向量,四层树架构查询复杂度从 O(N^1/2) 降至 O(N^1/4),p95 延迟 51 毫秒、召回率 95%。

源:Google Cloud:Databases(RSS)阅读原文2026-08-21
产品发布

Claude Computer Use 全面可用

Anthropic 宣布 Computer Use、Skills API、Files API 全面可用,新增浏览器操作工具,智能体可操作软件并调用团队技能。

源:Claude:Blog(网页)阅读原文2026-08-21
产品发布

Anthropic 发布 Claude Academy

Anthropic 发布 Claude Academy,面向全球数百万用户,课程含 4D AI Fluency Framework 与持续学习项目。

源:Claude:Blog(网页)阅读原文2026-08-21
产品发布

智谱 GLM-5.3 上线:AA 指数 60 分并列开源第一

GLM-5.3 API 即日开放,擅长复杂编码与防御性网络安全;单任务成本为旗舰最低,API 定价与 GLM-5.2 持平,权重下周五开源。

源:公众号:智谱(GLM)阅读原文2026-08-20
产品发布

FastMetal 让 Mac 本地 30 秒生成视频

FastMetal 让 Mac 本地 30 秒生成 5 秒 480P 视频,无需 CUDA 与云端,仅占 3.9 GiB 内存。

源:GitHub:hao-ai-lab/FastVideo阅读原文2026-08-20
产品发布

Sentence Transformers v6.0 发布

新增第四种模型类型 MultiVectorEncoder,可加载 PyLate、ColBERT 与 colpali-engine 检查点,支持晚期交互检索。

源:Hugging Face:Blog(RSS)阅读原文2026-08-19
产品发布

Mojo 语言正式开源

采用 Apache 2.0 许可证(含 LLVM 例外),编译器与工具链全部源码已上传 GitHub;上周刚发布 1.0,编译器贡献计划年底开放。

源:Hacker News 热门(buzzing.cc 中文翻译)阅读原文2026-08-19
产品发布

Claude 接入 Gmail 与 Google Drive

可在 Gmail 起草并发送邮件回复、管理 Google Drive 文件,默认发送前需用户批准;连接器菜单开启,全部付费套餐可用。

源:9to5Google(媒体报道)阅读原文2026-08-19
产品发布

Cursor 推出 Origin 代码托管服务

Cursor 向付费用户开放 Origin 代码托管,支持仓库、PR、GitHub 双向同步,Vercel、Depot、Buildkite 集成可用。

源:Hacker News 热门(buzzing.cc 中文翻译)阅读原文2026-08-18
产品发布

OpenRouter 上线 Activity 仪表盘 API

OpenRouter 发布 Activity 仪表盘与 Analytics API,可按智能体、模型、请求维度追踪支出、token 量与缓存命中率。

源:OpenRouter:Announcements(RSS)阅读原文2026-08-18
产品发布

Suno Studio 2.0 发布,新增 MIDI 与效果插件

MIDI 可直接生成音频并自动加混响、压缩、EQ 效果,向专业 DAW 工作流靠拢。

源:IT之家(RSS)阅读原文2026-08-16
产品发布

Qwen3.8-2.4T-A95B 开源,硅基流动即日上线

阿里开源 Qwen3.8-2.4T-A95B,硅基流动已提供 Day-0 支持。该模型拥有 2.4T 参数、95B 激活参数,主打自主编码、深度研究与端到端智能体执行。API 定价为输入 $2.00/百万 token,输出 $6.00/百万 token,缓存输入 $0.25/百万 token。

源:X:硅基流动 SiliconFlow (@SiliconFlowAI)阅读原文2026-08-14
产品发布

DeepSeek Harness v0.1 开发者预览版发布

DeepSeek Harness v0.1 现已推出开发者预览版,并以 MIT 许可证开源。该智能体框架基于 Cordis 元框架构建,核心设计为"一切皆插件",模型、工具、技能、会话、沙箱、文件系统、循环、编排及 UI 均可自由组合、替换和扩展。

源:X:DeepSeek (@deepseek_ai)阅读原文2026-08-14
产品发布

Meta 开源 Muse Glimmer 登陆 OpenRouter

Meta AI 超级智能实验室的首个开放权重模型 Muse Glimmer 已在 OpenRouter 上线! 这是一款 30B 密集文本+图像模型,采用 Apache 2.0 许可证,旨在成为可靠的本地智能体,MCP Atlas 得分 75.5,SWE-Bench Pro 得分 51.2。 https://openrouter.ai/meta/muse-glimmer-30b

源:X:OpenRouter (@OpenRouter)阅读原文2026-08-13
产品发布

OpenRouter 推出实时网页搜索基准测试:如何为智能体选择引擎、深度与模型

OpenRouter 发布实时排行榜,系统评测模型、搜索引擎、搜索方法与预算四类配置组合。数据显示,将搜索预算从 1 轮增至 25 轮可使 BrowseComp 得分近乎翻倍,成本仅增 2.5-7 倍;模型选择比引擎更重要,平均分差 15 分 vs 10 分。失败率高的任务应降低搜索深度以控制成本。

源:OpenRouter:Announcements(RSS)阅读原文2026-08-13
产品发布

Runway Seedance 2.5 上线,支持50角色参考

完整阵容,完整曲目,一次生成一个。 Seedance 2.5 已在 Runway 上线,支持 50 个独特角色参考,以及最长 30 秒、与音乐同步的片段。点击下方链接即可开始使用。

源:X:Runway (@runwayml)阅读原文2026-08-12
产品发布

Gemini 助力 Database Migration Service 加速 PostgreSQL 迁移

Google Cloud 在 Database Migration Service(DMS)中推出由 Gemini 驱动的 AI 辅助代码转换,可将 Oracle 或 SQL Server 的存储过程、触发器和自定义函数转换为 PostgreSQL PL/pgSQL 代码。

源:Google Cloud:Databases(RSS)阅读原文2026-08-12
产品发布

OpenRouter 推出由市场智慧驱动的新版 Auto 路由器

OpenRouter 基于每周超 55T token 的社区消费数据,推出新版 Auto 路由器(openrouter/auto),其模型选择在多数任务和成本档位上优于旧版。新路由器按约 30 种任务类型匹配近 7 天社区实际消费的模型,支持 cost_tier 参数(low 至 max)并遵循账户隐私设置。在 MMLU Pro 等基准上,新默认档位在多数领域以更低成本达到旧版同等性能。

源:OpenRouter:Announcements(RSS)阅读原文2026-08-11
产品发布

千问开放平台上线:租房、寄快递、查理财等十余领域服务可对话办理

千问开放平台今日上线,面向生态伙伴和开发者开放手机、PC 和 AI 眼镜三类终端的服务接入,首批覆盖物流运输、房产居住、本地生活、理财、汽车等十多个领域。用户可在对话中@相关服务或点击"圆点角标"进入智能体,完成从咨询、推荐到下单的完整流程。平台支持标准化协议接入、一键授权与端到端调测,并提供账号、AI 支付、订单接入等基础设施。

源:公众号:千问APP(阿里)阅读原文2026-08-11
产品发布

OpenAI 宣布取消 ChatGPT 免费版纯文本对话次数限制

OpenAI 自 8 月 10 日起取消免费版和 Go 版账户的纯文本对话次数限制,但图片生成、文件上传及语音模式仍保留独立额度。本周起,免费和 Go 用户默认模型将更换为产品线中规模最小的 GPT-5.6 Luna,并新增"Think(思考)"按钮以支持更深度的回复。付费用户方面,旗舰模型 GPT-5.6 Sol 将优化对话自然度,并新增"思考强度"调节选项。

源:IT之家(RSS)阅读原文2026-08-10
产品发布

Anthropic 将 Claude Code 的自动模式设为默认选项

Anthropic 宣布自 8 月 14 日起,将 Claude Code 的自动模式设为 Pro、Max 和 Team 账户的默认选项,该模式仅在操作被判定为"不可逆、具破坏性或超出环境范围"时才请求人工批准。测试显示,在 1,053 名付费测试者中,自动模式捕获了 89% 的有害操作,而人工审查仅捕获 13.6%。公司还新增了提示词注入筛查和可自定义的硬性拒绝规则等安全功能。

源:TechCrunch:AI(RSS)阅读原文2026-08-10
产品发布

苹果 Mac 简体中文支持文档更新,"Apple 智能"阿里千问扩展现身

苹果官网 Mac 简体中文使用手册新增《在 Mac 上配合 Apple 智能使用千问》支持文档,明确 Apple 智能可配合阿里巴巴千问模型工作。千问扩展适用于 macOS 26.6 或更高版本,需中国大陆 Apple 账户及机型,支持写作工具与 Siri,用户需登录千问账户使用。

源:IT之家(RSS)阅读原文2026-08-09
产品发布

Anthropic 将 Claude Code 默认设为 Auto Mode,以防开发者误批准危险操作

Anthropic 宣布自 8 月 14 日起,Claude Code 将对 Pro、Max 和 Team 套餐默认启用 Auto Mode,企业客户仍需手动开启。该模式通过分类器判断操作是否危险或不可逆,仅在必要时请求确认。测试中,Auto Mode 识别出 89% 的危险命令,而人工审查仅发现 13.6%。

源:The Decoder:AI News(RSS)阅读原文2026-08-09
产品发布

Seedance 2.5 API 上线,视频生成开启「电影级长叙事」

火山引擎正式上线 Seedance 2.5 API,将单次视频生成时长从15秒提升至30秒,并支持最高50个全模态素材参考。模型在指令遵循、长叙事、真人感及声画质感上大幅提升,能稳定保持多角色外形与场景关系,兼容十余种语言。

源:公众号:火山引擎阅读原文2026-08-08
产品发布

Kitesurf:一款在 V8 隔离环境中运行的"代理优先"浏览器

Cloudflare 推出 Kitesurf,一款专为 AI 智能体设计的浏览器,完全运行在 Workers 上,基于 V8 隔离环境,现已在 Browser Run 中免费开放测试。

源:Hacker News 热门(buzzing.cc 中文翻译)阅读原文2026-08-08
产品发布

Qwen-Image-3.0 发布:高分辨率低至 0.03 美元

Qwen-Image-3.0 已可投入生产。支持 4.5K token 提示词。100%+ 文本准确率(无破损 logo)。原生支持 12 种语言。定价灵活可扩展:高分辨率低至 $0.03。完整详情见图片。👉 探索:• Model Studio:https://click.alibabacloud.com/m/20000001606/ • Qwen Cloud:https://click.qwencloud.com/m/20000001648/ #Qwen #QwenImage3 #AlibabaCloud #GenerativeAI #AICreativity

源:X:阿里云 / Alibaba Cloud (@alibaba_cloud)阅读原文2026-08-07
产品发布

Agent Plugins 1.0.0 发布:谷歌、亚马逊、微软等支持的统一智能体插件规范

Agent Plugins 1.0.0 是一项由谷歌、亚马逊、微软等支持的中立目录规范,将 Agent Skills 和 MCP 服务器打包为单一可移植单元。通过标准化 plugin.json 清单和固定目录布局,开发者无需为不同 AI 编码智能体和 IDE 维护单独封装。谷歌已作为核心维护者加入,并在 Agents CLI 和 Data Agent Kit 中提供支持。

源:Google Developers Blog(RSS)阅读原文2026-08-07
产品发布

LLM 0.32 发布:新增推理轨迹、OpenAI Responses、服务端工具与更智能的日志

Simon Willison 发布 LLM 0.32,这是该项目自启动以来最重要的新版本。新版本支持显示推理轨迹、服务端工具、OpenAI Responses API,并默认使用 GPT-5.6 Luna 模型。

源:Simon Willison 博客阅读原文2026-08-06
产品发布

Cloudflare OS:面向智能体、应用与工作的开放平台

Cloudflare 开源新版 Cloudflare OS,任何组织均可部署并连接内部系统。该平台为每位员工提供基于公司上下文与技能的智能体工作区,包含隔离运行时、安全治理框架及可共享修改的个人应用。此前内部版本已供数千名员工日常使用,新版针对协作中的信息暴露风险重建了安全基础。

源:Cloudflare Blog阅读原文2026-08-06
产品发布

Swiftlet:在 Mac 上运行 80B 版 Qwen(内存 4.3 GB),在 iPhone 上运行 35B 版

Swiftlet 是一个 Swift + Metal 运行时,可在普通 Apple 设备上运行 Qwen3-Next 和 Qwen3.5/3.6 MoE 混合模型,仅将小型稠密核心驻留内存,按需从存储流式加载路由专家权重。

源:Hacker News 热门(buzzing.cc 中文翻译)阅读原文2026-08-05
产品发布

Reflex 开源 XY:基于 Rust 的超快 Python 绘图库,可保持 1 亿点图表交互流畅

Reflex AI 发布 Apache-2.0 许可的 Python 交互式 2D 绘图库 XY,通过 Rust 原生核心、二进制缓冲传输和 WebGL2 渲染,在 1 万至 1 亿点范围内保持约 0.08 秒的渲染时间。

源:MarkTechPost(RSS)阅读原文2026-08-05
产品发布

Cloudflare 推出 Billable Usage API:为自助账户提供按产品与计费周期的程序化成本可见性

Cloudflare 发布 Billable Usage API,为自助账户提供单一端点,一次调用即可返回按产品和计费周期拆分的用量与成本,覆盖 Workers、R2、D1、Workers AI、Vectorize、Images 和 Stream。

源:Cloudflare Blog阅读原文2026-08-04
产品发布

OpenRouter 推出 Ori Eval 简化评估流程

推出 Ori Eval:编写首个评估的最简单方式。 没有绝对最好的模型,只有最适合每项任务的模型。Ori Eval 利用 OpenRouter 的 API 处理代码库中的每项任务,然后评估结果。 curl -fsSL https://openrouter.ai/skills/spawn-ori-eval

源:X:OpenRouter (@OpenRouter)阅读原文2026-08-04
产品发布

Grok 支持分析任意视频

Grok 可以分析任何视频 https://grok.com/share/bGVnYWN5_8013f7a3-f604-4351-8cd7-acecf3ef165b

源:X:Elon Musk (@elonmusk, xAI)阅读原文2026-08-03
产品发布

Replit Design 一键提取品牌设计系统

找到了你喜欢的风格?将其提取为设计系统。 Replit Design 可将任意画面提炼为包含你的颜色、字体和样式的实时风格指南,让每个新界面、帖子和应用都保持品牌一致。无需交接,不会走样,也不会丢失你最初的设计初衷。 你的品牌,无处不在,一键搞定。 立即体验:http://replit.com/design

源:X:Replit (@Replit)阅读原文2026-08-03
产品发布

Replit 设计套件支持多款顶级模型

你的设计,你的模型。 使用你从世界领先模型中选择的任意一款进行创作,包括 Claude、GPT-5、GeminiKimi 和 GLM。跨模型家族比较输出结果,保留最符合需求的那一个。 一个套件,囊括所有顶级设计模型。 立即在 http://replit.com/design 体验。

源:X:Replit (@Replit)阅读原文2026-08-02
产品发布

Token Saver:用本地混合 RAG 将 Claude PDF token 消耗削减 92%-99% 的开源 MCP 扩展

Marktechpost AI 团队发布 Token Saver,一款面向 Claude Desktop 的开源 MCP 扩展,通过本地混合 RAG 在设备端检索 PDF,无需上传文件。该工具将 token 消耗削减 92%-99%,并保证数据隐私,设置无需 Python 环境或终端配置。

源:MarkTechPost(RSS)阅读原文2026-07-31
产品发布

Gemini Spark 集成 Chrome 自动浏览功能

Gemini Spark 🤝 @GoogleChrome Gemini Spark 现已与 Google Chrome 的自动浏览功能集成。经你许可,Spark 可直接在你的 Chrome 浏览器中处理网页任务,例如预约看房或自动填写航班信息。

源:X:Gemini (@GeminiApp)阅读原文2026-07-31
产品发布

在 M1 Max 上运行 2.8T 参数的 Kimi K3:Deltafin 项目实现 0.0687 token/s 推理

Deltafin 项目成功在 64 GB M1 Max 上运行了 2.8T 参数的 MoE 模型 Kimi K3,当前中位推理速度为 0.0687 token/s(14.6 秒/token)。完整安装需约 1.7 TB 本地磁盘,流式模式仅需 215 GB 但推理速度降至 3 分钟以上/token。项目提供 OpenAI 兼容 API 服务器,支持聊天和代码补全,但建议客户端超时设为小时级别。

源:Hacker News 热门(buzzing.cc 中文翻译)阅读原文2026-07-30
产品发布

Replit Design 发布:AI 赋能设计愿景

你不需要成为设计师。你只需要知道你想把什么变为现实。 你脑海中的想法与屏幕上的成果之间的差距刚刚消失了。 这就是 Replit Design 背后的愿景。 阅读我们构建它的原因以及我们认为 AI 驱动设计的未来方向:https://replit.com/blog/introducing-replit-design

源:X:Replit (@Replit)阅读原文2026-07-30
产品发布

OpenAI 发布 Codex 安全 CLI 与 SDK

更多开源福利。我们刚刚发布了一个 CLI 和 TypeScript SDK,用于查找、验证和修复代码中的安全漏洞。扫描仓库、审查变更、随时间追踪发现,并在 CI 中运行安全检查。 https://github.com/openai/codex-security

源:X:Tibo (@thsottiaux)阅读原文2026-07-29
产品发布

Gemini API Managed Agents 默认升级为 3.6 Flash,新增环境钩子与免费套餐

Google DeepMind 将 Gemini API Managed Agents 的默认模型升级为 Gemini 3.6 Flash,并支持显式选择 3.5 Flash 或 3.5 Flash-Lite。新增环境钩子允许在沙箱内工具调用前后执行自定义脚本,用于安全审查或代码格式化。此外,还推出了免费套餐、预算控制和基于 cron 的定时触发功能。

源:Google Blog:AI(RSS)阅读原文2026-07-29
产品发布

Kimi 发布视觉感知基准 PerceptionBench

Kimi.ai 发布 PerceptionBench,一个从当前前沿模型在 42 个基准上的失败模式中归纳出的视觉感知基准。该基准将视觉感知拆解为 10 种原子能力,并构建了 3000 道验证题,每道题只考察单一感知能力,无需推理或外部知识。

源:X:Kimi.ai (@Kimi_Moonshot)阅读原文2026-07-28
产品发布

SGLang 和 Miles 为月之暗面 2.8T 参数 Kimi K3 模型提供发布当日支持

SGLang 和 Miles 为月之暗面开源的 2.8T 参数模型 Kimi K3 提供发布当日支持,分别负责推理和 RL 训练。K3 采用 69 层 KDA 线性注意力与 24 层 MLA 交错的混合架构,在 SGLang 上单卡 batch-1 解码速度达约 113 tok/s,结合 DSpark 推测解码可达约 423 tok/s。

源:LMSYS:Blog(Chatbot Arena 团队)阅读原文2026-07-28
产品发布

xAI 发布 Grok CLI 并支持 /tutorial 命令

下载 Grok Build 并输入 /tutorial http://X.ai/cli

源:X:Elon Musk (@elonmusk, xAI)阅读原文2026-07-27
产品发布

Suno 推出多项新功能,含 MIDI 导出等

我们一直在以比以往更快的速度构建!🚀 以下是网页端和移动端的新功能一览: • 高级音轨分离 • 将音轨导出为 MIDI • 歌词合写与自动保存 • 截图生成歌曲 • Apple CarPlay 与 Android Auto 你最期待 Suno 的哪些新功能?

源:X:Suno (@suno)阅读原文2026-07-27
产品发布

Airtap 推出 iMessage/RCS 对话式 AI 智能体

Airtap 已推出一款 AI 智能体,用户可通过 iMessage 或 RCS 与之对话。 Airtap AI 智能体专注于通常完全在移动应用内运行的任务,允许用户定期运行这些任务。 例如,Airtap 与 Google Maps 集成,让用户能够即时预览和创建路线!

源:X:Testing Catalog (@testingcatalog)阅读原文2026-07-26
产品发布

Runway Agent 推出自然语言工作流功能

Runway Agent 中引入工作流。现在你可以通过自然语言构建、运行或编辑基于节点的工作流。工作流可大规模解锁高质量输出。 立即尝试,点击下方链接调用 / Workflow 技能。

源:X:Runway (@runwayml)阅读原文2026-07-25
产品发布

ChatGPT 桌面版上线语音控制多智能体

ChatGPT 语音功能现已登陆桌面应用。 只需使用语音,即可控制你的电脑,并指挥在 ChatGPT Work 或 Codex 中运行的多个智能体。 该功能由 GPT-Live 驱动,因此它能够同时在该应用中说话、聆听并协调工作。 今日起,面向 macOS 和 Windows 平台的 Plus、Pro、Business、Edu 及 Enterprise 计划用户全球推送。

源:X:OpenAI (@OpenAI)阅读原文2026-07-24
产品发布

Claude 语音模式现已支持 Opus、Sonnet 及连接工具与多语言

即日起,Claude 语音模式在 Opus、Sonnet 和 Haiku 上运行,并支持连接 Gmail、Slack 等工具及更多语言。用户可在对话中切换模型,语音模式默认沿用上次文本聊天使用的模型。该功能面向所有用户开放 beta 测试,免费版可使用 Haiku 及一个连接工具,付费版可访问更多模型和全部连接工具。

源:Claude:Blog(网页)阅读原文2026-07-24
产品发布

腾讯设计 Agent 平台 Miora 全面开放

腾讯设计 Agent 平台 Miora 今日全面开放,无需邀请码即可使用。该平台由 WorkBuddy 团队打造,提供品牌设计、影视创意等五大场景模式,支持自定义多模态模型和 Agent 推理深度,并内置 Skill 市场与记忆系统。

源:公众号:数字生命卡兹克阅读原文2026-07-23
产品发布

GigaToken 发布:语言模型分词速度最高提升约 1000 倍,可无缝替代 HuggingFace Tokenizers

GigaToken 是一款新的语言模型分词器,在 AMD EPYC 9565 双路 144 核 CPU 上对 GPT-2 分词速度达 24.53 GB/s,比 HuggingFace Tokenizers 快 989 倍、比 tiktoken 快 681 倍。

源:Hacker News 热门(buzzing.cc 中文翻译)阅读原文2026-07-23
产品发布

OpenAI 在 ChatGPT 中正式推出广告服务

OpenAI 在 ChatGPT 中推出原生广告服务,允许广告主在用户探索选项、比较选择和做出决策时投放相关广告。广告在体验中明确标注并与回答区分,首批广告主包括 Best Buy、Lowe's 和 VistaPrint。广告主可通过 Ads Manager 创建广告系列、设置预算并优化效果。

源:Hacker News 热门(buzzing.cc 中文翻译)阅读原文2026-07-22
产品发布

OpenRouter 上线 Gemini 3.6 Flash 与 3.5 Flash-Lite

今日在 OpenRouter 上线:Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite! 两者均为其模型系列的重大更新,具备高吞吐量(150+ tok/s),适用于智能体场景,从高效 token 的编码与知识工作,到低延迟、高并发的子智能体。 详情如下 🧵

源:X:OpenRouter (@OpenRouter)阅读原文2026-07-22
产品发布

LoRA Speedrun 公开排行榜:6分05秒微调 Qwen2.5-1.5B 达 GSM8K 61.1%准确率

LoRA Speedrun 项目推出公开排行榜,在固定硬件(单张 L40S)上比拼 Qwen2.5-1.5B 的微调运行时间。当前纪录由@Saivineeth147以6分05秒保持,采用序列打包与仅完成损失掩码技术,相比基线11分57秒提速约2倍且准确率更高(61.1%)。项目提供免费 Modal 沙箱验证,任何提交需经3次独立复现确认。

源:Hacker News 热门(buzzing.cc 中文翻译)阅读原文2026-07-21
产品发布

Grok for Excel 发布:在 Microsoft Excel 中用自然语言提问、写公式和运行场景

xAI 将 Grok 引入 Microsoft Excel,推出免费 Microsoft 365 加载项。用户可在工作表中用自然语言提问、根据描述编写公式或运行场景,答案会引用具体单元格,图表可直接插入工作表。该加载项还支持连接 SharePoint 或 Google Drive 获取上下文,并已同步支持 Word 和 PowerPoint。

源:xAI:News(网页)阅读原文2026-07-21
产品发布

字节跳动发布 Seed Audio 1.0 音频创作模型,统一建模人声与音效实现端到端影视级音频生成

字节跳动 Seed 团队发布音频创作模型 Seed Audio 1.0,在统一框架下联合建模人声、音效和环境声,支持 100ms 间隔精度的时间控制、单次约 2 分钟音频的延展生成及 20+ 语种自然生成。该模型已在火山方舟体验中心上线,多数场景音频可用率达 90% 以上,多语言音频自然度 MOS 超 4 分。

源:字节 Seed:Research Feed(网页内嵌数据)阅读原文2026-07-20
产品发布

LoRA Speedrun 公开排行榜:6分05秒微调 Qwen2.5-1.5B 达 GSM8K 61.1%准确率

LoRA Speedrun 项目推出公开排行榜,在固定硬件(单张 L40S)上比拼 Qwen2.5-1.5B 的微调运行时间。当前纪录由@Saivineeth147以6分05秒保持,采用序列打包与仅完成损失掩码技术,相比基线11分57秒提速约2倍且准确率更高(61.1%)。项目提供免费 Modal 沙箱验证,任何提交需经3次独立复现确认。

源:Hacker News 热门(buzzing.cc 中文翻译)阅读原文2026-07-20
产品发布

小红书与北大开源 UltraEP:面向大规模 MoE 训推的实时负载均衡方案

小红书与北大提出 UltraEP,首次将基于精确路由信息的实时负载均衡引入生产系统,在每个 microbatch 和每一层动态复制热点专家。在 Qwen3-235B 等模型上,训练吞吐平均达到理想性能的 94.6%,相比 Megatron-LM 提升 42%;推理 prefill 吞吐相比 SGLang 提升 1.56 倍。

源:公众号:小红书技术(dots.llm)阅读原文2026-07-20
产品发布

Claude Code v2.1.214 发布:修复权限绕过 + 新增 EndConversation 工具

Anthropic 发布 Claude Code 最新版本 v2.1.214,修复多项权限绕过漏洞,新增 EndConversation 工具及多项 Bash 权限检查改进,提升 CLI 开发体验。

源:Claude Code阅读原文2026-07-19

全部动态

🔗 探索更多 AI 工具板块

除了本板块,AI工具宝箱还有这些独家内容板块,帮你从不同角度发现好工具。

链接已复制,打开微信粘贴即可分享
0