OpenAI 升级 Whisper 语音转录 AI 模型，不牺牲质量速度快 8 倍

心灵探险家今天 12

默认

摘要： 金融界年月日消息国家知识产权局信息显示深圳市腾讯天游科技有限公司申请一项名为游戏处理方法装置计算机设备及存储介质的专利公开号申请日期为年月专利摘要显示本...

金融界 2024 年 9 月 25 日消息，国家知识产权局信息显示，深圳市腾讯天游科技有限公司申请一项名为“游戏处理方法、装置、计算机设备及存储介质”的专利，公开号 CN 118681222 A，申请日期为 2023 年 3 月。专利摘要显示，本发明实施例公开了一种游戏处理方法、装置、计算机设备及存储介质，其中方法包括：获取游戏中第一...

IT之家 10 月 3 日消息，OpenAI 在 10 月 1 日举办的 DevDay 活动日中，宣布推出了 Whisper large-v3-t bo 语音转录模型，共有 8.09 亿参数，在质量几乎没有下降的情况下，速度比 large-v3 快 8 倍。

Whisper large-v3-t bo 语音转录模型是 large-v3 的优化版本，并且只有 4 层解码器层（Decoder Layers），作为对比 large-v3 共有 32 层。

Whisper large-v3-t bo 语音转录模型共有 8.09 亿参数，比 7.69 亿参数的 medium 模型稍大，不过比 15.5 亿参数的 large 模型小很多。