当前位置:首页 > 元宇宙 > AI

英伟达 Parakeet TDT 0.6B 成开源 ASR 模型新王:1 秒 AI 转录 60 分钟音频,字错率低至 6.05%

来源: 责编: 时间:2025-05-08 17:51:06 107观看
导读 5 月 7 日消息,科技媒体 marktechpost 昨日(5 月 6 日)发布博文,报道称英伟达最新推出 Parakeet TDT 0.6B,是一款先进的自动语音识别(ASR)模型,已在 Hugging Face 平台上完全开源。Parakeet TDT 0.6B 的核心优势在于

5 月 7 日消息,科技媒体 marktechpost 昨日(5 月 6 日)发布博文,报道称英伟达最新推出 Parakeet TDT 0.6B,是一款先进的自动语音识别(ASR)模型,已在 Hugging Face 平台上完全开源。53m28资讯网——每日最新资讯28at.com

Parakeet TDT 0.6B 的核心优势在于其无与伦比的速度和转录质量。该模型仅需 1 秒即可处理 60 分钟音频,是现有主流开源 ASR 典型模型速度的 50 倍。53m28资讯网——每日最新资讯28at.com

在 Hugging Face 的 Open ASR Leaderboard 上,其字错率(WER)低至 6.05%,成为开源模型中的佼佼者。这一性能为实时转录、语音分析、呼叫中心智能和音频内容索引等企业级应用提供了强大支持。53m28资讯网——每日最新资讯28at.com

53m28资讯网——每日最新资讯28at.com

该模型基于 Transformer 架构,结合高质量转录数据进行微调,并针对英伟达硬件优化推理。53m28资讯网——每日最新资讯28at.com

援引博文介绍,该模型关键特性包括:6 亿参数的编码-解码结构、量化和融合内核以提升推理效率、支持 TDT(Transducer Decoder Transformer)架构,以及精确的时间戳、数字格式化和标点恢复功能。53m28资讯网——每日最新资讯28at.com

此外,该模型还开创性地支持歌曲转歌词转录,这一罕见功能拓展了音乐索引和媒体平台的用例,依托英伟达的 TensorRT 和 FP8 量化技术,其实时率(Real Time Factor,RTF,模型处理时间和音频长度的比值)达到 3386。53m28资讯网——每日最新资讯28at.com

Parakeet TDT 0.6B 不仅关注速度和精度,还内置了多项独特功能。该模型能将歌曲内容转为歌词,适用于音乐和媒体领域;支持数字和时间戳格式化,提升会议记录、法律转录和医疗记录的可读性;标点恢复功能则增强了下游自然语言处理(NLP)应用的表现。这些特性大幅提升转录质量,减轻后期处理或人工编辑的负担,尤其适合企业级部署。53m28资讯网——每日最新资讯28at.com

本文链接:http://www.28at.com/showinfo-45-12737-0.html英伟达 Parakeet TDT 0.6B 成开源 ASR 模型新王:1 秒 AI 转录 60 分钟音频,字错率低至 6.05%

声明:本网页内容旨在传播知识,若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。邮件:2376512515@qq.com

上一篇: 谷歌推 I O 版 Gemini 2.5 Pro 模型,AI 助力前端开发与复杂编程

下一篇: “活化”敦煌 IP:商汤科技与敦煌当代美术馆达成战略合作

标签:
  • 热门焦点
  • B端难做:留给魔珐科技的时间不多了

    来源:零态LT元宇宙泡沫正在碎裂,进入2023年后这一赛道热度一直在递减。今年2月,微软解散了成立仅四个月的工业元宇宙部门;今年3月,该公司2017年收购的虚拟现实社交平台AltspaceVR
  • 2022年6款最佳的NFT稀有度查询工具

    NFT正在风靡全球,但拥有一个你自认为看起来很酷的 NFT 是不够的,因为它还应该是稀有的,稀有度会影响每个 NFT 的价值。因此,如果您打算投资 NFT,则需要使用 NFT 稀
  • 2022年最具关注的9个头像NFT项目

    什么是 PFP NFT 项目?PFP NFT (个人资料图片NFT)是一组独特的数字收藏品,人们用来在互联网平台上代表自己。这些数字艺术作品通常是一系列可作为头像的角色,在 Twit
  • 从虚拟餐厅到虚拟时装秀,行业巨头掀起元宇宙商标注册潮

    自从 Facebook 更名为 Meta 后,关于元宇宙的讨论愈发激烈,这一词汇也越来越多的出现在我们的视野里。这是一个非常有趣的话题。伴随着争论,有些人认为是马克·扎
  • 虚拟数字人:元宇宙的主角破圈而来

    虚拟数字人市场逐步进入成熟期,商业化进程加速。1982年世界第一位虚拟歌姬林明美诞生,虚拟数字人行业经历了萌芽、探索、初级和成长四个阶段。随技术逐年突破,制
  • Meta 在衰落吗?

    扎克伯格已经很久没有出现在公众视野里了,近日,他罕见的接受播客采访,在两个小时的时间里畅谈了Meta、Facebook、Instagram、元宇宙的未来。正方观点:是的阿伦·达
  • 融资千万美元的元宇宙平台UGC到底是什么?

    据获悉,全球化元宇宙社交平台BUD Technologies, Inc.(以下简称“BUD”)宣布完成1500万美元A+轮融资,本轮融资由启明创投领投,老股东源码资本、GGV纪源资本、云九资
  • 利用元宇宙平台10天收入160万,风口还是虎口?

    美国Meta平台有限公司,也就是原来的脸书公司,9日宣布,公司旗下的虚拟现实应用《地平线世界》正式向美国和加拿大的18岁以上人群开放。这也是目前Meta推出的最具象
  • 赵长鹏预测SoicalFi为今年主要驱动力,新的机会在哪里?

    作者:五火球教主前不久,赵长鹏在《财富》杂志印度版块刊登评论。他表示:“DeFi 在 2021 年出现了快速创新,我们可能会在 2022 年看到蓬勃发展的兴趣和创新,其中 Soc
Top