英伟达发布1亿参数免费模型Nemotron3,支持8人实时语音分割识别
9月27日,英伟达正式发布了拥有约1亿参数的免费人工智能模型 Nemotron3Diarization 。该模型专注于语音分割聚类(Diarization)任务,开放了权重数据,能够精准识别对话中任意时刻的说话者,支持最多8人同时发声的实时及录音音频处理。 在技术突破与性能表现上, Nemotron3Diarization 在严苛的VoiceArena语音分割基准测试(v1版本)中以14.72%的
本文
9月27日,英伟达正式发布了拥有约1亿参数的免费人工智能模型
在技术突破与性能表现上,
在功能应用层面,新模型可与
此次英伟达推出轻量级且免费的高精度语音分割模型,大幅降低了复杂语音分析的技术门槛。这一动作不仅为实时会议记录、智能客服与多角色语音交互等应用提供了极具性价比的底层支撑,也预示着多说话人识别技术在端侧与实时商业场景下的落地将进一步提速。
出典:公開されているAIニュース集約ディレクトリ。著作権は原著作者・媒体に帰属します。当サイトは索引と要約のみを掲載しています。