2026-09-16 AI动态

7条精选

微博 RSS
观点

Gergely Orosz 探访 OpenAI:Codex 已成多数工作底座

Gergely Orosz 探访 OpenAI 总部并访谈 7 位工程师:近一个月来 Codex 与 ChatGPT Work 已成公司多数工作的底座。

可参考的是分工形态:工程师管架构设计、代码评审与发布授权,智能体负责跨会话的持续检查、备好修复与迁移执行。落地快慢取决于流程能否被智能体持续验证,而不是模型单项能力——这也是两个月就能跑通内部全量替代的原因。
源:Pragmatic Engineer(RSS)阅读原文
行业动态

Perplexity 自研 CobbleDB 替代 DynamoDB,延迟降 82%

Perplexity 自研键值库 CobbleDB 替代 DynamoDB:2 名工程师带数百智能体两个月建成,读取延迟 31.4ms→5.60ms,成本至少省 20%。

延迟数字是表层。真正的取舍是把按字节计费的托管库,换成按自身读写模式调优的自建存储:一次检索要取 100-120 个键、单条约 50KB,这种负载下费用随索引规模线性上涨。代价是失去强一致与复杂事务支持,读密集且负载可预测的团队才划算。
源:Perplexity 官方博客阅读原文
产品发布

Google 发布 TranslateGemma,55 种语言可离线翻译

Google 称其语言技术已覆盖 300 多种语言、占全球人口 86%;TranslateGemma 为轻量开源翻译模型,跨 55 种语言训练,可离线运行。

端侧加开源,等于取消了「有没有稳定网络」这个前提:全球仍有 30 亿人网络不稳,云端翻译在弱网地区等于不可用。对企业和内容站,私有部署多语翻译的门槛下降,同时跨语种检索与引用的竞争面会变宽。
源:Google Blog:AI(RSS)阅读原文
模型发布

Google 发布 Gemini 3.8 Live 双语音模型,支持 97 种语言

Google 发布 Gemini 3.8 Live 与扩展思考版:支持 97 种语言自动切换,扩展思考版在语音质量榜以 82.6 分居首、智能体任务完成率 68.6%。

两版定位分野清楚:Live 走规模化与低延迟,Extended Thinking 走多步推理与工具调用并行。做语音智能体的团队按「是否需要边说边调后台函数」来选更靠谱——68.6% 的完成率说明复杂流程仍是短板。
源:Google DeepMind:Blog(RSS)阅读原文
产品发布

Claude for Small Business 新增 43 工作流与 27 集成

Anthropic 为 Claude for Small Business 新增 43 个工作流与 27 个集成,覆盖 Shopify 等,安装量已超 90 万次。

更新里更该看的是默认权限:43 个工作流默认走审批模式,发送、发布与付款仍需人工确认。对小企业来说,自动化边界正从「模型能不能做」转向「公司敢不敢让它直接做」;集成数量反映的是渠道覆盖,不是可放手程度。
源:Claude:Blog(网页)阅读原文
模型发布

生数科技发布 Vidu S2:实时交互与实时编辑双模型

生数科技发布 Vidu S2 双模型,距 S1 仅 69 天:Avatar 输出由 540P 升至 720P、25-42 FPS,Editing 可实时换风格、试穿与换背景。

国内厂商把实时编辑塞进视频流,最先落地的是电商与直播:试穿、换背景、换风格都在拍摄中完成,省掉后期重做。注意实时空间视频仍是固定视角的探索阶段,头显下的清晰度与延迟没解决,短期更适合当卖点而非生产依赖。
源:公众号:生数科技(Vidu·视频)阅读原文
观点

404 Media 曝光 OpenAI 莉莉计划:人工审核聊天记录

404 Media 披露 OpenAI 内部项目「莉莉计划」:数百名外部审核员时薪超 50 美元,按 1-7 分制给真实对话回复打分,会看到用户记忆摘要与大致位置。

真正会影响用户的是默认值:免费、Plus 与 Pro 的「为所有人改进模型」默认开启,企业版与 API 默认关闭,手动关掉也只对新对话生效。把聊天当私人倾诉的场景要留意——审核员看得到上下文与记忆摘要,而不只是单条提问。
源:IT之家(RSS)阅读原文
← 2026-09-15 全部动态

🔗 探索更多 AI 工具板块

除了本板块,AI工具宝箱还有这些独家内容板块,帮你从不同角度发现好工具。

链接已复制,打开微信粘贴即可分享
0