0
  • 聊天消息
  • 系统消息
  • 评论与回复
登录后你可以
  • 下载海量资料
  • 学习在线课程
  • 观看技术视频
  • 写文章/发帖/加入社区
会员中心
创作中心

完善资料让更多小伙伴认识你,还能领取20积分哦,立即完善>

3天内不再提示

NVIDIA Triton开源推理服务软件三大功能推动效率提升

NVIDIA英伟达企业解决方案 来源:NVIDIA英伟达企业解决方案 作者:NVIDIA英伟达企业解 2022-01-04 14:20 次阅读

MicrosoftTeams借助AI生成的实时字幕和转录功能,帮助全球学生和职场人士顺利进行在线会议。用于训练的NVIDIA AI计算技术和用于推理语音识别模型的NVIDIA Triton推理服务器进一步提升了这两个功能。

Microsoft Teams 是全球沟通和协作的重要工具,每月有近2.5亿活跃用户。Microsoft Azure 认知服务为Teams提供28种语言的字幕和转录,并将很快能够在NVIDIAGPU上运行关键的计算密集型神经网络推理。

实时字幕功能帮助与会者实时跟踪对话,转录功能方便与会者在日后回顾当时的创意或回看未能参与的会议。

实时字幕对聋哑人、听力障碍者,或者异国与会者特别有用。

NVIDIA Triton开源推理服务软件能够帮助Teams使用认知服务优化语音识别模型。

使用Triton,认知服务能够支持高度先进的语言模型,以极低的延迟实时提供高度准确、个性化的语音转文本结果。同时,可以保证运行这些语音转文本模型的NVIDIA GPU充分发挥其潜力,在消耗更少计算资源的同时,为客户提供更高的吞吐量,进而降低成本。

底层语音识别技术作为认知服务中的一个API,开发人员可以使用它定制和运行自己的应用程序——客服电话转录、智能家居控制或为急救人员提供AI助手。

字字达意的AI

认知服务会生成Teams的转录和字幕,将语音转换为文本,并识别说话人。同时也能够识别专业术语 、姓名和其他会议背景,提高字幕的准确性。

Microsoft Teams的通话、会议及设备首席项目经理Shalendra Chhabra表示:“这样的AI模型非常复杂,需要数千万个神经网络参数才能识别几十种不同的语言。但模型越大,就越难以经济高效地实时运行。”

NVIDIA GPU和Triton软件能够帮助微软在不牺牲低延迟的情况下,通过强大的神经网络,实现高准确性,确保语音-文本的实时转换。

当启用转录功能时,与会者可以在会议结束后轻松补上错过的内容。

Triton三大功能推动效率提升

NVIDIA Triton有助于简化AI模型部署,并解锁高性能推理。用户甚至可以为自己的应用开发自定义后端。软件的一些关键功能可将Microsoft Teams的字幕和转录功能扩展到更多会议和用户,包括:

流推理:新型流推理功能——通过跟踪语音上下语境,提高延迟、敏感性字幕的准确度,它助力NVIDIA和Azure认知服务合作定制语音转文本的应用程序。

动态合批:批大小指神经网络同时处理的输入样本数量。通过Triton的动态合批,单项推理请求被自动组合成一个批次,因此能够在不影响模型延迟的情况下更好地利用GPU资源。

并发模型执行:实时字幕和转录需要同时运行多个深度学习模型。Triton使开发人员能够在单个GPU上同时完成这些工作,包括使用不同深度学习框架的模型。

即刻启程,借助Azure 认知服务,在您的应用中使用语音转文本的功能,并进一步了解NVIDIA Triton 推理服务软件如何帮助团队大规模部署AI模型。

NVIDIA 将参加 CES 2022, 并将在 1 月 5 日凌晨 0 点(北京时间)发表 NVIDIA 特别演讲。

NVIDIA GeForce 高级副总裁 Jeff Fisher 和 NVIDIA 汽车部门副总裁兼总经理 Ali Kani 将展示加速计算在设计、仿真、游戏和自动驾驶汽车方面的新突破。扫描下方海报,即刻将该日程添加到日历!

原文标题:Microsoft Azure 认知服务和NVIDIA AI提升Microsoft Teams实时字幕和转录功能

文章出处:【微信公众号:NVIDIA英伟达企业解决方案】欢迎添加关注!文章转载请注明出处。
审核编辑:汤梓红

声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表德赢Vwin官网 网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉
  • NVIDIA
    +关注

    关注

    14

    文章

    4756

    浏览量

    102344
  • 功能
    +关注

    关注

    3

    文章

    587

    浏览量

    29093
  • 开源
    +关注

    关注

    3

    文章

    3108

    浏览量

    42008

原文标题:Microsoft Azure 认知服务和NVIDIA AI提升Microsoft Teams实时字幕和转录功能

文章出处:【微信号:NVIDIA-Enterprise,微信公众号:NVIDIA英伟达企业解决方案】欢迎添加关注!文章转载请注明出处。

收藏 人收藏

    评论

    相关推荐

    魔搭社区借助NVIDIATensorRT-LLM提升LLM推理效率

    “魔搭社区是中国最具影响力的模型 开源社区,致力给开发者提供模型即 服务的体验。魔搭社区利用 NVIDIATensorRT-LLM,大大提高了大语言模型的 推理性能,方便了模型应用部署,提高
    的头像 发表于08-23 15:48 168次阅读

    全新NVIDIANeMo Retriever微服务大幅提升LLM的准确性和吞吐量

    企业能够通过提供检索增强生成 功能的生产就绪型 NVIDIANIM 推理服务,充分挖掘业务数据的价值。这些微 服务现已集成到 Cohesit
    的头像 发表于07-26 11:13 622次阅读
    全新 <b class='flag-5'>NVIDIA</b> NeMo Retriever微<b class='flag-5'>服务</b>大幅<b class='flag-5'>提升</b>LLM的准确性和吞吐量

    NVIDIA携手Meta推出AI服务,为企业提供生成式AI服务

    NVIDIA近日宣布了一项重大举措,正式推出 NVIDIAAI Foundry 服务NVIDIANIM( NVIDIAInference
    的头像 发表于07-25 16:57 363次阅读

    英伟达推出全新NVIDIAAI Foundry服务NVIDIANIM推理服务

    NVIDIA宣布推出全新 NVIDIAAI Foundry 服务NVIDIANIM 推理服务
    的头像 发表于07-25 09:48 528次阅读

    英伟达推出AI模型推理服务NVIDIANIM

    英伟达近日宣布推出一项革命性的AI模型 推理 服务—— NVIDIANIM。这项 服务将极大地简化AI模型部署过程,为全球的2800万英伟达开发者提供前所未有的便利。
    的头像 发表于06-04 09:15 503次阅读

    NVIDIA与Google DeepMind合作推动大语言模型创新

    支持 NVIDIANIM 推理服务的谷歌最新 开源模型 PaliGemma 首次亮相。
    的头像 发表于05-16 09:44 349次阅读

    NVIDIA加速微软最新的Phi-3 Mini开源语言模型

    NVIDIA宣布使用 NVIDIATensorRT-LLM 加速微软最新的 Phi-3 Mini 开源语言模型。TensorRT-LLM 是一个 开源库,用于优化从 PC 到云端的
    的头像 发表于04-28 10:36 362次阅读

    利用NVIDIA组件提升GPU推理的吞吐

    本实践中,唯品会 AI 平台与 NVIDIA团队合作,结合 NVIDIATensorRT 和 NVIDIAMerlin HierarchicalKV(HKV)将 推理的稠密网络和热
    的头像 发表于04-20 09:39 459次阅读

    使用NVIDIATriton推理服务器来加速AI预测

    这家云计算巨头的计算机视觉和数据科学 服务使用 NVIDIA Triton 推理 服务器来加速 AI 预测。
    的头像 发表于02-29 14:04 431次阅读

    利用NVIDIA产品技术组合提升用户体验

    UTalk-Doc 将用户指令识别 服务吞吐量 提升了 5 倍,单个请求响应时间缩减了 分之一,大幅 提升 服务运行
    的头像 发表于01-17 09:30 540次阅读

    华为云 CodeArts开源治理服务,解锁软件安全新标准

    的传统束缚,更是开启了一场 软件安全的“革命”。本文将深入剖析业界痛点、产品优势以及选择华为云 开源治理 服务华为云 开源治理 服务CodeArts
    的头像 发表于12-10 21:00 826次阅读
    华为云 CodeArts <b class='flag-5'>开源</b>治理<b class='flag-5'>服务</b>,解锁<b class='flag-5'>软件</b>安全新标准

    周四研讨会预告 | 注册报名NVIDIAAI Inference Day - 大模型推理线上研讨会

    由 CSDN 举办的 NVIDIAAI Inference Day - 大模型 推理线上研讨会,将帮助您了解 NVIDIA 开源大型语言模型(LLM)
    的头像 发表于10-26 09:05 271次阅读

    Nvidia通过开源提升LLM推理性能

    加利福尼亚州圣克拉拉—— Nvidia通过一个名为TensorRT LLM的新 开源 软件库,将其H100、A100和L4 GPU的大型语言模型(LLM) 推理性能提高了一倍。 正如对相同硬件
    的头像 发表于10-23 16:10 485次阅读

    NVIDIAGrace Hopper超级芯片横扫MLPerf推理基准测试

    平台无论是在云端还是网络边缘均展现出卓越的性能和通用性。 此外, NVIDIA宣布推出全新 推理 软件,该 软件将为用户带来性能、能效和总体拥有成本的大幅
    发表于09-13 09:45 624次阅读
    <b class='flag-5'>NVIDIA</b> Grace Hopper超级芯片横扫MLPerf<b class='flag-5'>推理</b>基准测试

    NVIDIAGrace Hopper 超级芯片横扫 MLPerf推理基准测试

    平台无论是在云端还是网络边缘均展现出卓越的性能和通用性。 此外, NVIDIA宣布推出全新 推理 软件,该 软件将为用户带来性能、能效和总体拥有成本的大幅
    的头像 发表于09-12 20:40 360次阅读