据南方+理解到,通义听悟接入了通义千问大模型的理解与择要能力,可成为用户事情学习中的得力AI助手,帮助随时随地高效完成对音视频内容的转写、检索、择要和整理,比如用大模型自动做条记、整理访谈、提取PPT等。
公测期间,用户可领取100小时以上听悟免费转写时长。

“换一种办法,让音视频可以被轻松阅读、整理和分享。
阿里云CTO周靖人先容,听悟是一款事情学习AI助手,它瞄准具有高知识附加值的音视频内容场景,比如开会、上课、访谈、培训、口试、直播、看视频、听播客等,能通过大模型等最新AI技能快速提炼和沉淀知识。

根据现场演示,听悟领悟了十多项AI功能,可以全面提升知识从音视频向图文形态转化的效率。
除了“听力好”,能高准确度天生会议记录、区分不同发言人,这个AI助手“悟性也极高”,大模型可以一秒给音视频划分章节并形成择要、总结全文及每个发言人不雅观点、整理关注重点和待办事项。
大模型一键提取PPT、针对多个音视频内容向AI提问、概括特定段落等功能近期也将上线。

阿里云php录音识别可以听灌音做笔记的AI来了阿里云通义听悟开放公测 AJAX

据南方+体验创造,针对一些细分场景,听悟还设置了不少“宝藏功能”:打开Chrome插件,外语学习者和听障人士可以借助双语悬浮字幕条随时随地看无字幕视频,日程冲突时,听悟还可成为职场人士的“开会替人”,在静音情形下入会AI可代为记录会议、整理要点;转写结果可下载为字幕文件,方便新媒体从业者视频后期制作;听悟梳理的问答回顾可以让、剖析师、状师、HR等群体整理访谈更高效。

另一显著上风是,听悟与阿里云盘打通,一键就能转写云盘上的音视频内容,公测期间注册的听悟用户后续还将得到更大的阿里云盘存储空间,在云盘内在线播放视频时也可自动出字幕。

周靖人先容,听悟集成了阿里最前辈的语音和措辞技能。
其内置阿里新一代工业级语音识别模型,识别准确率在多个威信中文数据集上名列第一;领悟自研语音语义多模态说话人算法,能对10人以上说话场景进行角色区分;接入通义千问大模型后,能够对上万字的音视频内容进行择要总结,事实准确与要点完备性海内领先,支持跨多音视频内容的精准问答理解。

值得留神的是,阿里云再次送出大家都能用上的AI“大礼包”。
此前海内语音厂商AI转写定价达19.8元每小时,而听悟用户可通过逐日上岸等多种任务领取免费转写时长。
公测期间,阿里云官方微博、微信及各大平台社区还会发放大量20小时转写口令码,用户得到的福利权柄可累加,一年内有效,免费时长可高达100小时以上,市场代价上千元。

据理解,听悟除个人版本外,还有企业运用。
此前,听悟企业版已在阿里集团内部被广泛利用,帮助减少了大量会议记录和整理的事情,受到好评。
同时,听悟的能力也可嵌进各种音视频平台,形成实时字幕、智能择要等,范例运用如钉钉的“钉闪记”背后便集成了听悟。
未来听悟还将在夸克APP、阿里云盘等端供词给做事。

【南方+】叶丹

【作者】 叶丹

【来源】 南方报业传媒集团南方+客户端