模型发布

45条 · 每日更新

微博 RSS
模型发布

我国发布大豆垂直大模型丰菽 2.0

安徽农业大学发布大豆垂直大模型"丰菽"2.0,集成 6 大模块,整合超 1000 万字文本、1 万篇文献,构建含 2 万实体、10 万关系的知识图谱。

来源:IT之家(RSS)阅读原文2026-08-17
模型发布

dots3-note Preview 开源:280B 参数轻量模型,主打长程智能体与多模态推理

小红书技术开源 dots3-note Preview,这是 dots3 系列最轻量模型,总参数 280B、激活参数 16B,支持 512K 上下文及文本、视觉、语音多模态理解,并针对复杂推理和长程 Agent 任务优化。

来源:公众号:小红书技术(dots.llm)阅读原文2026-08-15
模型发布

GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力

智谱发布 GLM-5.3,基于与 GLM-5.2相同的基座,通过极致的后训练 Scaling 提升智能上界,编程能力较前代提升50%,在 Terminal Bench 3.0等公开基准中取得开源第一,并接近 Claude Fable 5。模型在白盒代码审查等安全任务中表现持平 Mythos 5,在 CyberGym 测试中得分84.5%。模型权重将在两周后开源,即日起上线 ZCode、AutoClaw 等工具。

来源:公众号:智谱(GLM)阅读原文2026-08-15
模型发布

通义千问开源 Qwen3.8 系列模型

通义千问兑现承诺,开源 Qwen3.8 系列模型。其中 Qwen3.8-27B 为原生多模态稠密模型,仅 27B 参数即全面超越 Qwen3.7-Plus,原生支持 262K 上下文,可通过 YaRN 扩展至 1M tokens,采用 Apache 2.0 许可。Max 级 Qwen3.8-2.4T-A95B 的开放权重也已同步发布。

来源:X:通义千问 / Qwen (@Alibaba_Qwen)阅读原文2026-08-15
模型发布

DeepSeek-V4-Pro 正式版上线,Agent 能力大幅增强

DeepSeek-V4-Pro 正式版已在 APP、网页端和 API 同步上线,模型名设为 deepseek-v4-pro 即可使用。其 Agent 能力显著提升,HLE (wo/w tools) 达 42.7/60.0,Terminal Bench 2.1 为 87.9。

来源:DeepSeek:API 更新日志阅读原文2026-08-14
模型发布

小红书开源连续自回归语音合成模型 dots.tts:打造可持续扩展的 TTS 基座

小红书 dots 团队开源 20 亿参数全连续端到端自回归语音合成模型 dots.tts,在 Seed-TTS-Eval 三个子集上取得最佳平均内容准确度和平均说话人相似度。

来源:公众号:小红书技术(dots.llm)阅读原文2026-08-14
模型发布

Google DeepMind 推出 Gemini 3.7 Flash:面向编程与智能体的最强工作模型

Google DeepMind 发布 Gemini 3.7 Flash,距 3.6 Flash 仅三周,主打编程与智能体任务,输入/输出价格分别为每百万 token $0.75 和 $3.75,为原 3.6 Flash 的一半。

来源:Google DeepMind:Blog(RSS)阅读原文2026-08-14
模型发布

xAI 发布 Grok 4.6,强化长时运行智能体能力

xAI 今日发布 Grok 4.6,在 Grok 4.5 基础上重点强化长时运行智能体及更复杂的交互式与视觉工作能力。该模型在多项智能体编码与知识工作基准上达到前沿水平,在 Artificial Analysis Intelligence Index(九项基准综合分)上追平 GPT-5.6 Sol

来源:xAI:News(网页)阅读原文2026-08-13
模型发布

阿里开放 Qwen3.8-2.4T-A95B 模型权重:2.4T MoE、激活 95B、原生 256K 上下文

阿里 Qwen 团队正式开放 Qwen3.8-2.4T-A95B 模型权重,这是 Qwen-Max 级别模型首次开源。模型总参数 2.4T,每个 Token 激活 95B,原生支持 262,144 Token 上下文并可扩展至 1,010,000 Token。

来源:IT之家(RSS)阅读原文2026-08-13
模型发布

NVIDIA 推出 Nemotron 3.5 Lightning,加速本地智能体任务

NVIDIA 发布 Nemotron 3.5 Lightning,一款可定制的开源 30B 混合专家(MoE)模型,专为常驻智能体设计。相比同类开源模型,其 token 生成速度最高提升 4 倍,任务完成时间缩短 30%。该模型采用开放权重,支持用户微调以匹配特定任务,并可在 RTX PC、DGX Spark 及 Jetson 等设备上运行。

来源:NVIDIA Blog(RSS)阅读原文2026-08-12
模型发布

Scale AI 开源 Muse 系列模型

1/ 今天有个重大消息:我们很快将发布 Muse Spark 1.2 的开源权重版本。 同时,我们还将发布 Muse Glimmer--一个 30B 参数的智能体模型,采用 Apache 2.0 协议开源权重。Muse Glimmer 可在 24GB 显存上运行,且不损失智能体可靠性。🧵

来源:X:Alexandr Wang(Scale AI 创始人/Meta 首席 AI 官) (@alexandr_wang)阅读原文2026-08-11
模型发布

NVIDIA 发布 NemotronLabs VoiceChat 11B:开源全双工语音模型,支持约 450 毫秒轮换与实时工具调用

NVIDIA 发布开源端到端全双工语音对话模型 NemotronLabs VoiceChat 11B,在统一网络中完成流式语音理解与生成,实测轮换延迟 448 毫秒。该模型为首个支持对话中工具调用的开源全双工模型,通过独立输出通道及预置"保持"话术避免 API 执行期间冷场。权重与容器已公开,但仅限研究用途,需单张 80 GB 显存 GPU,目前无托管 API。

来源:MarkTechPost(RSS)阅读原文2026-08-11
模型发布

Google DeepMind 发布 DiffusionGemma:无需从头训练即可构建文本扩散模型

Google DeepMind 发布 DiffusionGemma,将现有 Gemma-4-26B-A4B 改造为文本扩散模型,训练 token 预算不到原来的 10%。

来源:The Decoder:AI News(RSS)阅读原文2026-08-10
模型发布

Pokee AI 发布 Pokee-Isaac 28B:可在客户边界内运行的千万级 token 上下文智能体模型

Pokee AI 发布 Pokee-Isaac 28B,一款 280 亿参数、支持 1000 万 token 上下文的纯文本模型,专为数据不得离开客户边界的受监管行业设计。该模型在 RULER 基准 10M token 长度下得分 93.3%,单张 B200 级 GPU 即可推理,通过 OpenAI 兼容 API 提供并授权 VPC、本地或设备端部署。

来源:MarkTechPost(RSS)阅读原文2026-08-09
模型发布

蚂蚁百灵开源 Ling-3.0-flash:124B 总参数 MoE 模型,支持 API、单机与高性能三种部署

蚂蚁百灵正式开源新一代原生混合推理模型 Ling-3.0-flash,采用 124B 总参数、5.1B 激活参数的 MoE 架构,并提供 FP8、FP4、INT4 等多个版本。

来源:公众号:蚂蚁百灵(Ling)阅读原文2026-08-08
模型发布

NVIDIA Cosmos 3:开放世界模型如何推动物理 AI 前沿

NVIDIA 发布 Cosmos 3,一个基于混合 Transformer 架构的开放物理 AI 基础全模态模型,整合视觉推理、世界生成与动作预测。

来源:NVIDIA Blog(RSS)阅读原文2026-08-07
模型发布

NVIDIA 发布 Alpamayo 2 Super:面向 Robotaxi 与自动驾驶的 34B 开源视觉-语言-动作模型

NVIDIA 发布 Alpamayo 2 Super,一款 34B 参数的视觉-语言-动作(VLA)模型,专为自动驾驶长尾事件设计,权重采用 Linux 基金会 OpenMDW-1.1 许可,代码为 Apache 2.0,发布首日即可商用。

来源:MarkTechPost(RSS)阅读原文2026-08-06
模型发布

NVIDIA Alpamayo 2 Super 开放商用,面向 Robotaxi 与自动驾驶的前沿开源模型

NVIDIA Alpamayo 2 Super 现已开放商用,基于 Cosmos 3 Super Reasoner 构建,采用强化学习后训练,支持轨迹预测、因果链推理、元动作、自动标注及视觉问答等多任务输出。

来源:NVIDIA Blog(RSS)阅读原文2026-08-05
模型发布

商汤 SenseNova U1 开源:统一推理与图像生成

商汤发布开源模型 SenseNova U1,可在统一流程中同时进行推理与图像生成。其信息图模式可将单条提示词转为结构化幻灯片,交错模式则逐步生成图文内容,如演示六步画龙教程。模型已上线 SenseNova Studio、HuggingFace 及 GitHub。

来源:X:商汤 SenseTime (@SenseTime_AI)阅读原文2026-08-05
模型发布

Qwen3.8-Max 发布:开源最强编码与协作模型,2.4T 参数

Qwen 正式发布 Qwen3.8-Max,这是 Qwen 家族迄今最强的模型,拥有 2.4T 参数(95B 激活),并首次开源 Qwen-Max 级权重,开放权重将于下周发布。

来源:Qwen:Blog Retrieval(API)阅读原文2026-08-04
模型发布

MiniMax H3 正式开源:通用全模态生成系统支持 2K 视频与原生立体声

MiniMax 正式开源新一代通用视频模型 H3,可统一理解文本、图像、视频和音频,生成最高 2K 分辨率、最长 15 秒、带 32 kHz 原生立体声音频的视频。

来源:公众号:MiniMax(稀宇科技)阅读原文2026-08-04
模型发布

Thinking Machines Lab 发布 Inkling-Small:276B 总参数、12B 激活的开源权重多模态 MoE 模型

Thinking Machines Lab 发布开源权重 MoE 模型 Inkling-Small,总参数 276B、激活参数 12B,约为 975B 总参数 Inkling 的四分之一,原生支持文本、图像和音频推理,上下文窗口达 1M tokens,权重以 Apache 2.0 协议在 Hugging Face 上提供。

来源:MarkTechPost(RSS)阅读原文2026-08-03
模型发布

GPT-6 破解 10 个 Costco Guys 难题

重磅消息:GPT-6 刚刚找到了 10 个 Costco Guys 难题的解决方案,其中 #24(自 2011 年起悬而未决)也在其中。另有 4 个难题取得重大进展。 DJ Khaled 今早对这一结果表示认可:"为这个感到骄傲。#24 对我个人意义重大。"

来源:X:Gabriel (@gabriel1)阅读原文2026-08-02
模型发布

DeepSeek V4 Flash 0731 开源,登顶开源模型前三

DeepSeek 发布开源模型 DeepSeek V4 Flash 0731,在 Artificial Analysis 智能指数上得分 50,位列开源模型前三。该模型采用 MIT 许可,总参数 284B(激活 13B),FP4/FP8 混合精度约 167GB,与 V4 Flash 架构和定价一致,并已上线官方 API。

来源:X:Artificial Analysis (@ArtificialAnlys)阅读原文2026-08-01
模型发布

MiniMax H3 发布:开源全能多模态生成模型,支持 2K 原生立体声视频

MiniMax 正式推出全能多模态生成模型 H3,可联合理解文本、图像、视频和音频,生成最高 2K 分辨率、15 秒时长且带原生立体声的视频。H3 在指令跟随、文字与品牌呈现、V2V 动作迁移上表现突出,2K 下每秒价格低于主流模型三分之一,768p 下低于主流 720p 价格一半。官方计划近日开源模型权重,以支持开源社区并加速硬件兼容。

来源:MiniMax:Blog(网页)阅读原文2026-08-01
模型发布

Google DeepMind 发布 Gemini Robotics 2 物理 AI

One brain. For any robot. 🤖 我们正在推出 Gemini Robotics 2:我们的下一代物理 AI,为仿人机器人带来全身智能、高级灵巧性、多机器人团队协作等能力。

来源:X:Google DeepMind (@GoogleDeepMind)阅读原文2026-07-31
模型发布

GPT-5.6 如何推进性价比前沿

OpenAI 为 GPT-5.6 的 Luna 和 Terra 版本推出更低定价,以更高效的模型帮助企业大规模部署 AI 工作流。

来源:OpenAI:官网动态(RSS · 排除企业/客户案例)阅读原文2026-07-31
模型发布

OpenAI 发布 GPT-5.6 模型家族:Sol、Terra 与 Luna

OpenAI 发布 GPT-5.6 模型家族,旗舰款 Sol 开启最大推理时在 Artificial Analysis Coding Agent Index 上超越 Claude Fable 5,成本不到后者一半。Terra 智能持平 GPT-5.5 但价格减半,Luna 定价比 Sol 低 80%。该系列通过负载均衡、推测解码等全栈优化实现更高 token 效率。

来源:OpenAI:官网动态(RSS · 排除企业/客户案例)阅读原文2026-07-30
模型发布

Google DeepMind 在 Flow Music 中推出 Lyria 3.5,提升音乐性、歌词、人声与创作控制

Google DeepMind 今日在 Google Flow Music 中发布新一代音乐生成模型 Lyria 3.5,带来音乐性、歌词质量、人声表现力与创作控制的多项提升。新模型能生成更自然复杂的旋律结构,歌词对提示词的遵循度和结构意识更强,人声更逼真且富有情感,同时支持更便捷地控制输出节奏与时长。

来源:Google DeepMind:Blog(RSS)阅读原文2026-07-30
模型发布

Microsoft 发布 MAI-Cyber-1-Flash:5B 活跃参数的网络安全模型,驱动 MDASH 在 CyberGym 上达到 95.95%

Microsoft 发布 MAI-Cyber-1-Flash,一款 137B 总参数(5B 活跃参数)、256k 上下文窗口的稀疏 MoE 网络安全模型,是 MAI-Code-1-Flash 的微调版本。

来源:MarkTechPost(RSS)阅读原文2026-07-29
模型发布

Kimi K3 开源:2.8T MoE 模型与技术报告

Kimi 发布其最强模型 Kimi K3,这是一个 2.8T 参数的 MoE 模型,具备原生视觉理解和 1M token 上下文窗口。新架构实现了每单位计算 2.5 倍的智能提升。除模型权重外,Kimi 还开源了高性能注意力内核、MoE 通信库及大规模智能体运行环境基础设施。

来源:X:Kimi.ai (@Kimi_Moonshot)阅读原文2026-07-28
模型发布

Kimi K3 上线 Modal,支持无损加速推理

很高兴 @modal 成为 Kimi K3 的 Day 0 发布合作伙伴! 他们为 K3 的架构训练了自定义 DFlash 投机器,实现更快推理且无质量损失。

来源:X:Kimi.ai (@Kimi_Moonshot)阅读原文2026-07-28
模型发布

Black Forest Labs 发布 FLUX 3:统一图像、视频、音频与机器人动作预测的多模态基础模型

Black Forest Labs 发布 FLUX 3,这是首个在单一架构中联合学习图像、视频和音频,并从同一组权重输出视频、音频和动作预测的多模态基础模型。FLUX 3 Video 可单次生成长达 20 秒、带原生音频的视频,在 10 秒 720p 文本生成视频的人类偏好测试中,以 93% 的偏好率击败 Luma Ray 3.2。

来源:MarkTechPost(RSS)阅读原文2026-07-27
模型发布

Anthropic 称 Opus 5 几乎免疫浏览器提示词注入,攻击成功率降至零

Anthropic 称其 Opus 5 模型在自家软件中几乎免疫提示词注入攻击。在 129 个浏览器智能体测试场景中,攻击成功率为零;在 Gray Swan 通用提示词注入测试中,15 次尝试后的成功率从 Opus 4.8 的 5.5% 降至 2.0%。零成功率仅在 Claude Cowork 等产品开启 Auto Mode 时实现,该模式叠加了输入扫描与执行拦截两层防御。

来源:The Decoder:AI News(RSS)阅读原文2026-07-26
模型发布

LLaDA 2.2 扩散 LLM 实现智能体工作

扩散大语言模型现在可以处理真实的智能体工作。 LLaDA 2.2 是首个大规模扩散大语言模型,旨在作为真正的智能体运行,能够规划、调用工具并在长程多轮轨迹中自我修正,同时保留了块并行解码的速度优势。 这里有许多突出的技术决策:

来源:X:Elvis Saravia (@omarsar0, DAIR.AI)阅读原文2026-07-26
模型发布

Anthropic 发布 Claude Opus 5

Anthropic 发布 Claude Opus 5,其智能水平接近 Claude Fable 5,但价格减半。该模型在 Frontier-Bench v0.1 上性能超过 Opus 4.8 两倍以上,在 ARC-AGI 3 上得分是次优模型的三倍。Opus 5 即日起成为 Claude Max 的默认模型和 Claude Pro 的最强模型。

来源:Anthropic:Newsroom(网页)阅读原文2026-07-25
模型发布

蚂蚁百灵发布 Ling-3.0-flash 原生混合推理模型

蚂蚁百灵发布新一代原生混合推理模型 Ling-3.0-flash,总参数量124B,激活参数量仅5.1B,在传统推理、指令遵循与长文本等指标上对标甚至超越上一代旗舰 Ring-2.6-1T。模型采用原生混合线性注意力架构与1/64稀疏 MoE,并扩展至10,000+可交互训练环境,长输入下 TTFT 降低60%至80%以上。

来源:公众号:蚂蚁百灵(Ling)阅读原文2026-07-25
模型发布

通义千问发布 Qwen-Audio-3.0-TTS,登顶 TTS 排行榜

阿里通义千问推出最新文本转语音模型 Qwen-Audio-3.0-TTS,提供 Flash(实时交互)和 Plus(高质量生成)两个版本。新功能包括细粒度内联标签控制(如【whisper】、【angry】)、自然语言风格控制、支持16种语言,以及一次生成长达3分钟的长文本。该模型目前在 Artificial Analysis TTS 排行榜上排名第一。

来源:X:通义千问 / Qwen (@Alibaba_Qwen)阅读原文2026-07-24
模型发布

小红书 dots 模型获 IMO 2026 满分金牌

小红书 dots 团队携内部版本 dots-note 3.0 参加第 67 届 IMO 2026,六道题均获满分,以 42/42 分取得满分金牌,全球仅 7 位人类选手获此成绩。模型不依赖形式化语言,直接读取原始 LaTeX 题目,通过递归自我批判能力端到端完成解题。dots-note 3.0 是 dots3 系列最轻量级模型,预期将开源。

来源:公众号:小红书技术(dots.llm)阅读原文2026-07-22
模型发布

面壁智能发布首个具身智能成果 MiniCPM-Robot 系列模型,含 1.5B VLA 与 0.9B 跟踪模型

面壁智能联合 OpenBMB 发布并开源 MiniCPM-Robot 系列,包括通用 VLA 模型 MiniCPM-RobotManip(1.5B 参数)与移动跟踪模型 MiniCPM-RobotTrack(0.9B 参数)。

来源:公众号:面壁智能(MiniCPM)阅读原文2026-07-21
模型发布

面壁智能发布首个具身智能成果 MiniCPM-Robot 系列模型,含 1.5B VLA 与 0.9B 跟踪模型

面壁智能联合 OpenBMB 发布并开源 MiniCPM-Robot 系列,包括通用 VLA 模型 MiniCPM-RobotManip(1.5B 参数)与移动跟踪模型 MiniCPM-RobotTrack(0.9B 参数)。

来源:公众号:面壁智能(MiniCPM)阅读原文2026-07-20
模型发布

通义实验室发布 Qwen-Audio-3.0-TTS 实时语音合成模型

通义实验室发布 Qwen-Audio-3.0-TTS,含 Flash(首包延迟约300ms)和 Plus 两个版本。Plus 版本在 Artificial Analysis 榜单夺冠,支持16种语言和20种中文方言,平均 WER/CER 低至3.87(Flash),说话人相似度最高达82.75(Plus)。

来源:公众号:通义实验室(千问)阅读原文2026-07-20
模型发布

OpenAI GPT-Live-1/mini 登场:边听边说让 AI 对话更接近真人聊天

OpenAI 发布最新语音模型 GPT-Live-1 和 mini 版,实现「边听边说」实时对话能力,打破传统串行模式,大幅降低延迟,语音 AI 体验拐点已至。

来源:IT之家阅读原文2026-07-19
模型发布

Kimi K3:Moonshot 发布全球最大开源模型,逼近美国一流水平

北京月之暗面(Moonshot)发布 Kimi K3 开源大模型,参数规模全球最大,性能逼近 ClaudeChatGPT 等美国一流闭源模型,中国开源力量加速追赶。

来源:Economic Times阅读原文2026-07-19
模型发布

OpenAI GPT-5.6 Sol/Terra/Luna 三款新模型集中发布

OpenAI 集中发布三款新模型:旗舰 Sol(推理+多模态突破)、Terra 和 Luna 分别面向特定部署场景,标志着 AI 模型竞争进入白热化阶段。

来源:量子位阅读原文2026-07-19

全部快讯

🔗 探索更多 AI 工具板块

除了本板块,AI工具宝箱还有这些独家内容板块,帮你从不同角度发现好工具。

链接已复制,打开微信粘贴即可分享
0