OpenAI 升级 Whisper 语音转录 AI 模型，不牺牲质量速度快 8 倍

创意奇才昨天 10

默认

摘要： 之家月日消息苹果今日向用户推送了正式版系统更新带来了全新主屏幕自定义功能深色模式改进等诸多新特性然而更新发布后还我妈生相册丑等话题登上微博热搜不少网友吐槽新的相册布局妈生是一种幽默...

IT之家 9 月 17 日消息，苹果今日向 iPhone 用户推送了 iOS 18 正式版系统更新，带来了全新主屏幕自定义功能、深色模式改进等诸多新特性。然而更新发布后，“iOS 18 还我妈生相册”“iOS 18 丑”等话题登上微博热搜，不少网友吐槽新的相册布局（“妈生”是一种幽默夸张的表述，指原始 / 原来的相册布局）。IT之家查询苹果官...

IT之家 10 月 3 日消息，OpenAI 在 10 月 1 日举办的 DevDay 活动日中，宣布推出了 Whisper large-v3-t bo 语音转录模型，共有 8.09 亿参数，在质量几乎没有下降的情况下，速度比 large-v3 快 8 倍。

Whisper large-v3-t bo 语音转录模型是 large-v3 的优化版本，并且只有 4 层解码器层（Decoder Layers），作为对比 large-v3 共有 32 层。

Whisper large-v3-t bo 语音转录模型共有 8.09 亿参数，比 7.69 亿参数的 medium 模型稍大，不过比 15.5 亿参数的 large 模型小很多。

OpenAI 表示 Whisper large-v3-t bo 的速度比 large 模型快 8 倍，并且所需的 VRAM 为 6GB，而 large 模型需要 10GB。