IT商业网-解读信息时代的商业变革
当前位置: 首页 > 电商 > 正文

阿里云通义听悟上线三大新功能:包括国内音视频AI领域首创的视频自动提取PPT等

2023-08-02 20:52:57  来源:电商报    

  8月2日讯:阿里云通义听悟上线三大新功能,包括国内音视频AI领域首创的视频自动提取PPT,以及浏览器插件、钉钉和微信小程序。

  今年6月,阿里云首次宣布通义听悟开放公测。此次升级,在原有实时记录、音视频文件转写、全文概要、章节速览等功能之上,新增“提取PPT”功能。该功能通过引入视觉AI算法,自动将PPT讲解视频分割为演示文稿,并对每页PPT进行要点总结,形成一份图文并茂的大纲,解决培训、网课学习等场景“求PPT难”的问题。

  通义听悟还增加了浏览器插件和移动端的支持。用户开会、上网课、看直播、看视频时,Chrome和Edge浏览器插件功能可全程录制,并实时生成双语字幕,帮助用户更轻松地浏览视频内容。

  在移动端,通义听悟钉钉和微信小程序不仅支持PC端的基础功能,还可以一键转写手机和聊天记录的音视频文件。

  本次新功能上线期间,阿里云继续联合各大平台和社区推出定制口令码,用户根据口令码可随机抽取20h、30h、66h、88h、100h的免费转写时长。通义听悟集成了阿里云的语音、语言和视觉AI技术,未来还将陆续上线适用于更多场景的新功能。

  据悉,阿里云自2019年启动大模型研发以来,通义大模型逐步从单一模态真正升级为多模态大模型。今年4月,阿里云正式推出大语言模型“通义千问”,它能够响应人类以自然语言提出的指令,完成回答问题、创作文字、编写代码、角色扮演对话等各项任务。

  在7月举行的2023世界人工智能大会期间,阿里云宣布推出通义大模型家族新成员通义万相,用户可以在通义万相中输入提示词,以输出相应图像。除文生图以外,通义万相也推出了包括风格迁移、相似图生成等功能。

  阿里云智能集团首席技术官周靖人在2023世界人工智能大会透露,通义千问已有累计超30的申请用户,超过100家深度共创企业,而通义听悟发布首月已有36万用户。

 

原标题:阿里云通义听悟新增自动提取PPT等三大功能

免责声明: IT商业新闻网遵守行业规则,本站所转载的稿件都标注作者和来源。 IT商业新闻网原创文章,请转载时务必注明文章作者和来源“IT商业新闻网”, 不尊重本站原创的行为将受到IT商业新闻网的追责,转载稿件或作者投稿可能会经编辑修改或者补充, 如有异议可投诉至:post@itxinwen.com
微信公众号:您想你获取IT商业新闻网最新原创内容, 请在微信公众号中搜索“IT商业网”或者搜索微信号:itxinwen,或用扫描左侧微信二维码。 即可添加关注。
标签:

品牌、内容合作请点这里: 寻求合作 ››

相关阅读RELEVANT