速递|IPO在即?Cohere发布首个语音模型Transcribe,ARR已达2.4亿美元
图片来源:Cohere
企业人工智能公司 Cohere 于周四发布了其首个语音模型:Transcribe 是一款开源自动语音识别模型,可用于笔记记录和语音分析等任务。
该模型仅包含 20 亿参数,相对轻量,专为希望自行部署的用户设计,可在消费级 GPU 上运行。目前支持 14 种语言:英语、法语、德语、意大利语、西班牙语、葡萄牙语、希腊语、荷兰语、波兰语、中文、日语、韩语、越南语和阿拉伯语。
Cohere 表示,Transcribe在 Hugging Face Open ASR 排行榜上超越了Zoom Scribe v1、IBM Granite 4.0 1B、ElevenLabs Scribe v2 和 Qwen3-ASR-1.7B Speech等模型,平均词错误率(WER)达到 5.42,低于该基准测试中的所有其他模型。
该公司宣称,在人工评估转录准确性、连贯性和可用性时,Transcribe 对其他模型的平均胜率达到 61%。然而,该模型在转录葡萄牙语、德语和西班牙语时表现落后于竞争对手。
Cohere 表示,Transcribe每分钟可处理 525 分钟音频,这在其同类模型中处于较高水平。
该公司计划将 Transcribe 集成至其企业级智能体编排平台 North,并通过 API 免费提供该模型。该模型也将在 Cohere 的托管推理平台 Model Vault 上线。
随着 Granola 和 Wispr Flow 等笔记记录与听写应用需求增长,语音识别模型正日益普及。
今年早些时候,有报道称 Cohere 告知投资者,其 2025 年年度经常性收入已达 2.4 亿美元,其首席执行官 Aidan Gomez 被引述表示这家初创公司可能“很快”进行首次公开募股 。
参考资料:
https://techcrunch.com/2026/03/26/cohere-launches-an-open-source-voice-model-specifically-for-transcription/