Mistral 推出 Voxtral 系列语音理解模型：以开源形式提供一流正确率表现

AI中国

AI技术专栏作家 | 发布了 246 篇文章

IT之家 7 月 16 日消息，Mistral AI 当地时间昨日公布了其 Voxtral 语音理解模型。该系列模型以开源形式推出，可以更低价格提供一流的低错误率表现，支持真实世界的语音智能生产应用。

Voxtral 系列模型由 Mistral Small 3.1 派生而来，包括面向生产应用的 24B 版本 Voxtral Small 和适用于本地 / 边缘部署的 3B 版本 Voxtral Mini，此外还有仅具备语音转文字功能的 Voxtral Mini Transcribe。

该模型支持 32K Token 的上下文长度，可处理 30 分钟音频转录或 40 分钟音频理解，内置生成相关问题、结构化摘要的能力，支持英语、西班牙语、法语、葡萄牙语、印地语、德语、荷兰语、意大利语等印欧诸语言。

Mistral AI 宣称 Voxtral Mini Transcribe 在成本敏感用例中性能优于 OpenAI Whisper，而价格不到后者的一半；而在高级用例方面，Voxtral Small 的性能与本领域顶尖模型 ElevenLabs Scribe 接近，价格也不到一半。

广告声明：文内含有的对外跳转链接（包括不限于超链接、二维码、口令等形式），用于传递更多信息，节省甄选时间，结果仅供参考，IT之家所有文章均包含本声明。

登录账号

Mistral 推出 Voxtral 系列语音理解模型：以开源形式提供一流正确率表现

AI前线

评论 (128)

AI爱好者

开发者小明

AI前线作者

科技观察家

文章章节

推荐文章

何必DiT！字节首次拿着自回归，单GPU一分钟生成5秒720p视频

用户破8亿！GPT-5.1来了，表情包含量可自定义

发布即开放：百度猎户座葫芦里卖的什么药？

李飞飞的世界模型来了！一句话生成3D世界，AI 真的开始理解现实了

科技巨头「偷偷借钱」搞AI，次贷危机魅影重现？

腾讯总裁剧透微信搭载智能体！阿里和谷歌也都开始互相伤害了

AIGC大模型能力提升10倍！安谋科技Arm China掏出最强NPU IP大招

速抢（2核2G）77元/年香港免备案服务器

热门标签

热门作者

AI前沿

机器学习实验室

AI创业圈

登录账号

Mistral 推出 Voxtral 系列语音理解模型：以开源形式提供一流正确率表现

AI前线

评论 (128)

AI爱好者

开发者小明

AI前线 作者

科技观察家

文章章节

推荐文章

何必DiT！字节首次拿着自回归，单GPU一分钟生成5秒720p视频

用户破8亿！GPT-5.1来了，表情包含量可自定义

发布即开放：百度猎户座葫芦里卖的什么药？

李飞飞的世界模型来了！一句话生成3D世界，AI 真的开始理解现实了

科技巨头「偷偷借钱」搞AI，次贷危机魅影重现？

腾讯总裁剧透微信搭载智能体！阿里和谷歌也都开始互相伤害了

AIGC大模型能力提升10倍！安谋科技Arm China掏出最强NPU IP大招

速抢（2核2G）77元/年香港免备案服务器

热门标签

热门作者

AI前沿

机器学习实验室

AI创业圈

AI前线作者