阿里发布 Qwen-Audio-3.0-ASR-Flash 语音识别大模型,让 AI 更好听懂专业词汇
最新 7 月 31 日消息,阿里巴巴今日发布语音识别大模型 Qwen-Audio-3.0-ASR-Flash。简单来说,就是让 AI 更好地听懂专业词汇。
Qwen-Audio-3.0-ASR-Flash 主要在上下文一致性、行业词识别和热词定制化三个维度做了系统性的优化,同时让模型具备语音润色能力,可直接输出结构化文本。
研究团队持续从医疗、IT 编程、股票、社会名人等领域里挖掘专业词汇,建成了覆盖多行业的高质量词库,加强模型对专业术语和冷门词的识别。在最新的行业词汇内部评测中,新模型对各行业专业词的“听中率”都有明显提升,其中医疗场景更是突破了 95.36%。

目前,Qwen-Audio-ASR-Flash 系列已经在会议纪要整理、实时字幕、教育录播、智能客服等场景里得到验证,曾在 AI 评测平台 Artificial Analysis 上,以 1.7% 的错字率拿下全球第一。
Qwen-Audio-3.0-ASR—— 现已通过阿里云百炼平台开放调用,提供三个版本:
Qwen-Audio-3.0-ASR-Flash:语音识别,最长 5 分钟
Qwen-Audio-3.0-ASR-Filetrans:离线文件转写
Qwen-Audio-3.0-ASR-Streaming:实时语音识别
最新附 Qwen-Audio-3.0-ASR-Flash 体验地址如下:
Qwen-Audio-3.0-ASR-Flash:
https://help.aliyun.com/zh/model-studio/non-real-time-speech-recognition-for-fun-asr-flash
Qwen-Audio-3.0-ASR-Flash-Filetrans:
https://help.aliyun.com/zh/model-studio/fun-asr-recorded-speech-recognition-http-api
Qwen-Audio-3.0-ASR-Flash-Streaming:
https://help.aliyun.com/zh/model-studio/fun-asr-realtime-websocket-api
《阿里发布 Qwen-Audio-3.0-ASR-Flash 语音识别大模型,让 AI 更好听懂专业词汇》转载自互联网,如有侵权,联系我们删除,QQ:369-8522。
相关图文
-
打击低质量 AI 内容,领英现允许用户举报 AI 垃圾帖文
领英推出举报选项,用户可一键举报 AI 生成的低质量垃圾帖文,同时调整平台内置 AI 工具,不再支持生成完整帖文,仅保留基础校对功能。#领英AI垃圾帖文治理#... -
Meta 借助 AI 大幅缩短应用开发周期,更多新应用已在路上
近期推出的产品包括面向 Marketplace 卖家的应用、Facebook 群组应用、通过“氛围编程”打造的游戏应用、Instagram 照片应用,以及 AI 睡前故事实验。... -
消息称 DeepSeek 计划在内蒙古建设大型 AI 数据中心,增加 1GW 算力
据彭博社报道,DeepSeek 正扩大算力布局,计划在内蒙古建设大型 AI 数据中心,增加 1GW 算力。部分算力预计 2027 年底或 2028 年初投用,目前暂不清楚项目所用芯片。#DeepSeekAI数据中心#... -
新研究:AI 对就业市场的真正威胁不是失业,而是让加薪更困难
最新研究显示,AI 暂未对整体就业产生可检测影响,但会显著压低工资增速,低收入劳动者受冲击最明显,未来或将进一步加剧收入不平等。... -
智谱 GLM Coding Plan 订阅回归:透明积分制,每月 118 元起
智谱今日官宣 GLM Coding Plan 订阅回归,套餐价格和套餐规则有所调整。即日起至 2026 年 8 月 15 日,订阅新版包年 / 包季套餐分别享限时 7 折/ 8 折优惠。...












