0
  • 聊天消息
  • 系统消息
  • 评论与回复
登录后你可以
  • 下载海量资料
  • 学习在线课程
  • 观看技术视频
  • 写文章/发帖/加入社区
会员中心
创作中心

完善资料让更多小伙伴认识你,还能领取20积分哦,立即完善>

3天内不再提示

阿里通义大模型发布新进展 “通义听悟”开放公测

电子麦克风 ? 来源:电子发烧友网 ? 作者:张迎辉 ? 2023-06-03 01:19 ? 次阅读
加入交流群
微信小助手二维码

扫码添加小助手

加入工程师交流群

6月1日,“2023阿里云峰会·粤港澳大湾区”在广州举行,峰会上阿里云CTO周靖人登台向业界宣布了阿里的AI新品的新产品“通义听悟”正式上线开放公测。通义听悟接入了通义千问大模型的理解与摘要能力,可成为用户工作学习中的得力AI助手,帮助随时随地高效完成对音视频内容的转写、检索、摘要和整理,比如用大模型自动做笔记、整理访谈、提取PPT等。公测期间,用户可领取100小时以上听悟免费转写时长。

过去几个月内国内非常多的大模型产品发布,阿里云也在4月7日向业界 宣布自研大模型“通义千问”,邀请用户公测体验。仅过去不到两个月阿里云就再次发布大模型的迭代产品,产品进一步落地到更加专业的场景和应用。

wKgaomR5womAR4YMABD959Mfrcs722.png
(图1:2023阿里云峰会CTO周靖人发布大模型通义听悟 摄影:电子发烧友网)


阿里云CTO周靖人表示:“咱们换一种方式,让音视频可以被轻松阅读、整理和分享。”他介绍,通义听悟是一款工作学习AI助手,它瞄准具有高知识附加值的音视频内容场景,比如开会、上课、访谈、培训、面试、直播、看视频、听播客等,能通过大模型等最新AI技术快速提炼和沉淀知识。

wKgZomR5wpOAX-ZAAAOg4H6uunQ571.jpg?
图2:阿里云通义听悟的应用场非常丰富,帮助提升办公效率 (摄影:电子发烧友网)


根据现场演示,听悟融合了十多项AI功能,可以全面提升知识从音视频向图文形态转化的效率。除了“听力好”,能高准确度生成会议记录、区分不同发言人,这个AI助手“悟性也极高”。大模型可以一秒给音视频划分章节并形成摘要、总结全文及每个发言人观点、整理关注重点和待办事项。

大模型一键提取PPT、针对多个音视频内容向AI提问、概括特定段落等功能近期也将上线。

wKgaomR5wqCAe5mqABIBiMwpU8s271.png
通义听悟可自动为音视频生成全文摘要、章节概括、发言总结


除此以外,通义听悟据说还有一些非常细分场景的功能,例如用户打开Chrome插件,外语学习者和听障人士可以借助双语悬浮字幕条随时随地看无字幕视频。在日程冲突时,听悟还可成为职场人士的“开会替身”,在静音情况下入会AI可代为记录会议、整理要点;转写结果可下载为字幕文件,方便新媒体从业者视频后期制作;听悟梳理的问答回顾可以让记者、分析师、律师、HR等群体整理访谈更高效。

wKgZomR5wquAZXp9AAchqQbZu14367.png
通义听悟Chrome插件将在近期对所有用户开放下载


另一显著优势是,听悟与阿里云云盘打通,一键就能转写云盘上的音视频内容,公测期间注册的听悟用户后续还将获得更大的阿里云盘存储空间,在云盘内在线播放视频时也可自动出字幕。这些都是大模型新用户的福利。小编在此推荐朋友们去使用,在文章下面发表您使用的体验反馈。

wKgaomR5wraAE0ZOAAxEcG9L9hI496.png
通义听悟支持一键导入阿里云盘音视频文件


当然,语音识别生成文字的大模型国内也还有其他的企业在做。我们看看阿里云通义听悟与这类产品的主要区别。

wKgZomR5wr-AXGV_AAECpuoloic370.jpg
图:阿里云CTO周靖人


阿里云CTO周靖人介绍,听悟集成了阿里非常先进的语音和语言技术。其内置阿里新一代工业级语音识别模型,识别准确率在多个权威中文数据集上名列第一;融合自研语音语义多模态说话人算法,能对10人以上说话场景进行角色区分;接入“通义千问”大模型后,能够对上万字的音视频内容进行摘要总结,事实准确与要点完备性国内领先,支持跨多音视频内容的精准问答理解。

继史无前例的大降价后,阿里云再次送出人人都能用上的AI“大礼包”。此前国内语音厂商AI转写定价达19.8元每小时,而听悟用户可通过每日登陆等多种任务领取免费转写时长。公测期间,阿里云官方微博、微信及各大平台社区还会发放大量20小时转写口令码,用户获得的福利权益可累加,一年内有效,免费时长可高达100小时以上,市场价值上千元。

据了解,听悟除个人版本外,还有企业应用。此前,听悟企业版已在阿里集团内部被广泛使用,帮助减少了大量会议记录和整理的工作,受到好评。同时,听悟的能力也可嵌进各类音视频平台,形成实时字幕、智能摘要等,典型应用如钉钉的“钉闪记”背后便集成了听悟。未来听悟还将在夸克APP、阿里云盘端口提供服务。

wKgZomR5wsuAclmFAAyEWJNPHmU781.png
“钉闪记”背后集成通义听悟


虽然我们普通用户没有办法去体会海外的相关版本,但是阿里云的AI大模型能够在非常具体的办公场景中使用人工智能来提升办公的生产效率,相信未来不久国内的互联网又会诞生新的超级应用APP产品出来。电子发烧友网在人工智能方面有专业的分析师跟进,紧跟行业带来一手的资讯报道与分析。


声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉
  • AI
    AI
    +关注

    关注

    88

    文章

    35758

    浏览量

    282446
收藏 人收藏
加入交流群
微信小助手二维码

扫码添加小助手

加入工程师交流群

    评论

    相关推荐
    热点推荐

    AI大模型加速上车,联手高通,阿里有哪些策略?

    (电子发烧友网报道 文/章鹰)2025年6月26日至27日,“2025高通汽车技术与合作峰会”在苏州举行,阿里云副总裁徐栋带来通义模型在发展方向的最新思考,以及汽车领域的端云侧落地的方案。
    的头像 发表于 07-03 01:10 ?8156次阅读
    AI大<b class='flag-5'>模型</b>加速上车,联手高通,<b class='flag-5'>阿里</b>有哪些策略?

    比亚迪座舱接入通义模型,未来将联合打造更多AI智能座舱场景

    比亚迪与阿里云一直保持着深度合作,已在多个业务场景广泛应用通义模型。 在智能座舱领域,与比亚迪座舱团队联合开发,基于通义万相,比亚迪腾势上线了“AI壁纸”功能,该功能可根据用户语音指
    的头像 发表于 06-12 08:52 ?307次阅读

    阿里最新消息:国家超算互联网平台、广州算力中心、多所高校接入通义千问大模型

    QwQ-32B是阿里通义团队最新开源的推理模型。千问QwQ-32B发布后稳居全球最大AI开源社区HuggingFace趋势榜榜首,成为当下最受欢迎的开源大
    的头像 发表于 03-14 11:54 ?860次阅读

    Manus与阿里通义达成合作

    据媒体报道,火爆异常的AI Agent新秀Manus和阿里云旗下大语言模型通义千问达成合作。双方将基于通义千问系列开源模型,在国产
    的头像 发表于 03-12 15:47 ?947次阅读

    摩尔线程支持阿里通义千问QwQ-32B开源模型

    近日,阿里云团队正式开源全新推理模型——通义千问QwQ-32B。摩尔线程在该模型发布后2小时内,迅速且高效完成了对千问QwQ-32B的支持。
    的头像 发表于 03-07 17:48 ?831次阅读
    摩尔线程支持<b class='flag-5'>阿里</b>云<b class='flag-5'>通义</b>千问QwQ-32B开源<b class='flag-5'>模型</b>

    广和通基于阿里通义模型推出随身智能解决方案,赋能消费电子终端行业

    2月,广和通与全球领先的云解决方案提供商阿里云达成合作:广和通AI模组及解决方案,基于阿里通义千问大模型,推出“随身智能解决方案”,赋能消费电子行业。
    的头像 发表于 03-03 17:55 ?781次阅读
    广和通基于<b class='flag-5'>阿里</b>云<b class='flag-5'>通义</b>大<b class='flag-5'>模型</b>推出随身智能解决方案,赋能消费电子终端行业

    阿里通义Qwen2.5-Max模型全新升级

    近期,阿里通义团队为用户带来了一个振奋人心的好消息:其旗舰版模型Qwen2.5-Max迎来了全新升级发布。 Qwen2.5-Max模型
    的头像 发表于 02-05 14:07 ?866次阅读

    阿里通义开源长文本新模型Qwen2.5-1M

    近日,阿里通义宣布了一项重大开源举措,推出了支持100万Tokens上下文的Qwen2.5-1M模型。这一新模型在处理长文本任务中展现出了卓越的性能,稳定超越了GPT-4o-mini
    的头像 发表于 02-05 14:01 ?588次阅读

    阿里通义万相2.1视频生成模型震撼发布

    近日,阿里云旗下的通义万相迎来了重要升级,正式推出了全新的万相2.1视频生成模型。这一创新成果标志着阿里云在视频生成技术领域的又一次重大突破。 据悉,万相2.1视频生成
    的头像 发表于 01-13 10:00 ?885次阅读

    AI眼镜新品炸场!雷鸟V3接入阿里通义模型,未来双方合作更进一步

    电子发烧友网报道(文/黄晶晶)1月2日,消费级AR领先品牌雷鸟创新RayNeo与阿里云举行战略签约仪式,双方宣布在AI眼镜领域达成独家战略合作,通义系列大模型将为雷鸟创新的AI眼镜提供独家定制
    的头像 发表于 01-07 16:29 ?2589次阅读
    AI眼镜新品炸场!雷鸟V3接入<b class='flag-5'>阿里</b>云<b class='flag-5'>通义</b>大<b class='flag-5'>模型</b>,未来双方合作更进一步

    通义”应用团队从阿里云分拆并入智能信息事业群

    近日,据多个独立消息源透露,阿里巴巴旗下的AI应用“通义”已经正式从阿里云体系中分拆出来,并并入阿里智能信息事业群。这一调整意味着“通义”将
    的头像 发表于 12-20 14:10 ?766次阅读

    阿里通义千问代码模型全系列开源

    近日,阿里通义模型团队宣布了一项重大决策:将通义千问代码模型全系列正式开源。此次开源的模型
    的头像 发表于 11-14 15:26 ?1145次阅读

    通义千问三款主力模型再降价

    阿里云百炼平台再次掀起降价风暴,三款通义千问主力模型——Qwen-Turbo、Qwen-Plus及Qwen-Max,继5月首次大幅度降价后,再次迎来价格调整。此次降价力度空前,Qwen-Turbo价格直降85%,百万tokens
    的头像 发表于 09-20 16:46 ?1648次阅读

    阿里通义发布视频生成大模型

    在即将召开的云栖大会上,阿里通义将震撼发布其自主研发的视频生成大模型。目前,用户已可通过通义App频道及
    的头像 发表于 09-19 17:01 ?658次阅读

    通义千问发布第二代视觉语言模型Qwen2-VL

    阿里巴巴旗下的通义千问近日宣布,其第二代视觉语言模型Qwen2-VL正式问世,并宣布旗舰模型Qwen2-VL-72B的API已顺利接入阿里
    的头像 发表于 09-03 16:31 ?934次阅读