- N +

OpenAI 升级 Whisper 语音转录 AI 模型,不牺牲质量速度快 8 倍

OpenAI 升级 Whisper 语音转录 AI 模型,不牺牲质量速度快 8 倍原标题:OpenAI 升级 Whisper 语音转录 AI 模型,不牺牲质量速度快 8 倍

导读:

科创板日报月日讯记者徐赐豪内地新茶咖品牌正密集出海香港市场科创板日报记者获悉霸王茶姬香港首店已于月日在购物艺术馆店开业正式营业两天霸王茶姬香港首店累计销售杯量近万杯据悉霸王茶姬...

《科创板日报》9月30日讯(记者 徐赐豪) 内地新茶咖品牌正密集出海香港市场。《科创板日报》记者获悉,霸王茶姬香港首店已于9月28日在K11购物艺术馆店开业,正式营业两天,霸王茶姬香港首店累计销售杯量近1万杯。据悉,霸王茶姬已收到香港多家商场开店邀约。位于旺角的茶百道首店则于9月30日正式试营业。事实上,早有一大...

IT之家 10 月 3 日消息,OpenAI 在 10 月 1 日举办的 DevDay 活动日中,宣布推出了 Whisper large-v3-t bo 语音转录模型,共有 8.09 亿参数,在质量几乎没有下降的情况下,速度比 large-v3 快 8 倍

Whisper large-v3-t bo 语音转录模型是 large-v3 的优化版本,并且只有 4 层解码器层(Decoder Layers),作为对比 large-v3 共有 32 层。

Whisper large-v3-t bo 语音转录模型共有 8.09 亿参数,比 7.69 亿参数的 medium 模型稍大,不过比 15.5 亿参数的 large 模型小很多。

OpenAI 表示 Whisper large-v3-t bo 的速度比 large 模型快 8 倍,并且所需的 VRAM 为 6GB,而 large 模型需要 10GB。

OpenAI 升级 Whisper 语音转录 AI 模型,不牺牲质量速度快 8 倍

Whisper large-v3-t bo 语音转录模型大小为 1.6GB,OpenAI 继续根据 MIT 许可证提供 Whisper(包括代码和模型权重)。

IT之家援引 Awni Hannun 结果,在 M2 Ultra 上,将 12 分钟的内容转录为 14 秒。

返回列表
上一篇:
下一篇:

发表评论中国互联网举报中心

快捷回复:

验证码

    评论列表 (暂无评论,共56人参与)参与讨论

    还没有评论,来说两句吧...