观点
DeepSeek V4.1-Flash 缓存输入降价 7 倍
实测显示 V4.1-Flash 缓存命中输入价格降至约 1/7、输出降约 2/3;9 月 14 日 12 时起,发往 v4-pro 的请求将强制路由至该模型并按新价计费。
None
第三方架构还原显示,V4.1-Flash 采用 20 层因果编码器加 20 层解码器的 CED 双塔:总参数量 552B,读长文本仅激活约 8B,生成阶段激活 16B。
行业动态
月之暗面瞄准年底 20 亿美元年化营收
据 Bloomberg 报道,月之暗面目标年底年化营收达 20 亿美元,为 8 月运行率的两倍,主要受益于今夏发布的 K3 模型。
论文研究
多伦多大学演示可自主扩散的 LLM 蠕虫
多伦多大学预印本演示 LLM 蠕虫:借用被感染主机的 GPU 跑本地模型,自主发现漏洞并跨主机扩散,无需外部 C&C,在混合测试网中自主运行 7 天。
模型发布
蚂蚁开源 Ling-3.0-flash-VL 多模态模型
蚂蚁百灵开源首个原生多模态模型 Ling-3.0-flash-VL:总参 124B、单次推理激活 5.5B、上下文 256K,原生支持图像/文本/视频输入,采用 MIT 许可。
产品发布
OpenAI 开放 Agents API 公测
OpenAI 开放 Agents API 公测:以 Codex harness 托管云端 Agent,编排与上下文由 OpenAI 承担,沙箱可自带或接 E2B 等 9 家。
观点
GPT Image 2.5 双版本包揽图像榜前二
GPT Image 2.5 双版本包揽图像榜前二:Flare 生成中位耗时由 142.9 秒降至 52.7 秒,价格维持每百万输出 token 30 美元。
None
GPT-Rosalind 结束研究预览向机构开放
OpenAI 宣布 GPT-Rosalind 结束研究预览,通过 API 与 Codex 向审核通过的全球机构开放,可跨论文与实验数据推理、权衡靶点证据并规划实验。