通义实验室发布 Qwen-Audio-3.0-TTS 实时语音合成模型
通义实验室发布 Qwen-Audio-3.0-TTS,含 Flash(首包延迟约300ms)和 Plus 两个版本。Plus 版本在 Artificial Analysis 榜单夺冠,支持16种语言和20种中文方言,平均 WER/CER 低至3.87(Flash),说话人相似度最高达82.75(Plus)。
OpenAI GPT-Live-1/mini 登场:边听边说让 AI 对话更接近真人聊天
OpenAI 发布最新语音模型 GPT-Live-1 和 mini 版,实现「边听边说」实时对话能力,打破传统串行模式,大幅降低延迟,语音 AI 体验拐点已至。
OpenAI GPT-5.6 Sol/Terra/Luna 三款新模型集中发布
OpenAI 集中发布三款新模型:旗舰 Sol(推理+多模态突破)、Terra 和 Luna 分别面向特定部署场景,标志着 AI 模型竞争进入白热化阶段。
全部快讯
🔗 探索更多 AI 工具板块
除了本板块,AI工具宝箱还有这些独家内容板块,帮你从不同角度发现好工具。