AI实时互动方案:10分钟打造一个企业专属云上智能体

原创 阿里云视频云 2024-09-05 19:41

我们打造了一款满足想象与应用的智能体——AI 实时互动。



谈谈 AI 智能体



当 AI 变得足够聪明时,用户与 AI 的交互将变得真实自然。于是,构建高拟真 AI 与用户的实时交互,已经成为企业提升数智化生产力的新思路。

在这个交互过程中,存在一个极具活力的对象,就是智能体(AIAgent)

顾名思义,“智能体”利用人工智能,能够基于内部状态、感知到的信息或外部输入,来做出决策并执行动作。它具有一定程度的自治性和智能性,等同于一个自主性的网络实体可发挥的想象空间不言而喻。

AI 智能体的衍生,可以突破更高的效率、营造更好的链接深入场景里,它能为企业塑造 7*24 小时、不限并发的“真实在线”的高质量服务,能为孩子匹配专属的智慧互动教育陪伴者;能为每个人在日常生活中配备专业领域的网络私人教练;能在买家和卖家之间构建高效的沟通链路;能在无人商超打造 7*24 小时的专属售卖员......它为任何需要数字交互的领域,赋予全新的体验,意义非凡。

回归产品,回归商业,阿里云视频云为此推出全新的「AI 实时互动」方案。

该方案已正式上线阿里云官网,并在 7 月 31 日发布了语音通话智能体(VoiceAgent)、8 月 31 日发布了数字人通话智能体(AvatarAgent)



10 分钟,构建企业专属云上智能体



阿里云全新推出的 AI 实时互动方案,其深度整合了阿里云在 AI、实时音视频 ARTC 的能力积累,助力企业打造高拟人化、超低延时、高可靠的人机交互体验。

产品架构图

正如 AI 智能体的应用空间更多是创新领域,于是,开发上线的效率对企业的快速商业探索,是至关重要的。阿里云 AI 实时互动方案正满足这一核心,能够帮助企业 10 分钟构建专属云上智能体

「AI 实时互动」提供白屏化、可插拔的 AI 组件编排工作流,通过控制台可以将 STT(语音转文本)、TTS(文本转语音)、LLM(大语言模型)、数字人等 AI 组件进行灵活编排无需企业组建专属团队从零开发真正实现 10 分钟快速构建专属智能体的目标,让企业更专注在业务内核以及智能体上线所驱动的价值。

具体来看,通过如下的控制台实时编排图例,用户可以感受如何用 10 分钟快速构建企业的专属 AI 智能体。

AI实时互动控制台实时编排图例

再者,作为端到端的 AI 通话解决方案,「AI 实时互动」提供完善的 AI 智能体客户端集成方案,以低代码、场景化 API 快速接入让使用更具低门槛、高灵活的属性。对此,企业仅需调用 OpenAPI,即可启动云端 AI 智能体任务,同时在客户端配套实时字幕、AI 状态回调、AI 智能体生命周期管理等场景化接口,所有集成仅需 1 天内即可实现



低门槛之上,真正的 AI 超拟人体验



AI 智能体的智能与否,一定取决于交互人性化的程度,考验的是超低时延下 AI 对人的理解和输出能力所以,拥有一个超拟人质感的专属智能体,是交互在商业应用上的一大跨越。

阿里云的 AI 实时互动,超拟人化是首要特点。

然而,实现超拟人化并非易事,需要突破几个关键点:互动延时、智能降噪、高拟人音色、智能意图识别。在这四个维度的打磨上,「AI 实时互动」有卓越的能力呈现:


  • 自然延时:在 AI 实时互动中,用户与 AI 的通话延时低至 1.5 秒(即从用户说话结束至收到 AI 反馈的响应时间),以最自然的延时,实现用户与 AI 的人机沟通。

  • 智能降噪:基于算法加持,智能降噪可以过滤用户通话时的周侧嘈杂音,更精准清晰地识别真正的用户声音,从而产生更有效的拟人互动。

  • 高拟人音色:同时支持 100+高拟人音色可灵活切换。

  • 智能意图识别:在人机对话过程中,AI 智能体能够有效识别用户的对话打断意图,同时能识别用户当前说话是否结束,从而有效规避 AI 抢话的情况。


所以,做一个能够与用户进行自然流畅沟通的 AI 智能体,是超拟人化的关键能力,也是阿里云 AI 实时互动的独到之处。

AI 实时互动的超拟人化,在客户端可以为人机交互带来真实沟通感,从而优化各类场景下的高质量体验。同时对企业端,其开放 AI 生态的重要能力,让企业的智能互动更具延展性。

正是依托阿里云强大的云+AI 底座,「AI 实时互动」可以提供一个开放的 AI 生态给到企业。通过默认预置阿里云 AI 能力,并与阿里云百炼平台深度联动,企业可以在编排工作流中引入百炼已有的模型;同时,企业也可以通过标准的 API 规范引入其自研的大模型;此外,还可以提供即插即用的三方 AI 组件插件,来拓展业务需要的其他 AI 能力。




四大类场景,全球化服务



基于阿里云「AI 实时互动」的全新推出,目前已经迅速在四大场景商业落地,并真切攻克行业普遍存在的痛点。

场景 1:智能客服

绝大多数行业都需要的客户服务环节,但传统的客户服务存在高人力成本、服务话术标准落地不足的问题。得益于 AI 技术,智能客服行业随之而升。

助力智能服务的质量升级和成本优化,AI 实时互动公有云方案,整合所在行业的模型和知识库,构建高拟真的客服服务从而极大降低行业的用人成本、提升服务效能,尤其承载超拟人的智能互动能力,打破以往人工智能理解能力的限制,营造了高质量的智能客服,对零售、电商等众多行业,起到服务加持的真实价值。

场景 2:AI 撮合助手/AI 虚拟助手

撮合助手通常是指在特定场景下,帮助促进双方或多方达成交易与合作的工具或服务。这类助手可以是人工智能程序、软件平台或实际的人工服务,其通过匹配需求、提供信息、协商沟通等方式,使得参与方能够更高效地完成撮合过程。

所以,该行业的核心是提高信息透明度、加速决策过程,而同时存在的痛点在于,双方往往受限于时间、通话并发等问题,难以建立有效连通。为了提升撮合平台的连通效率,AI 实时互动公有云方案,结合所在行业的模型与知识库,通过 AI 构建 7*24 小时的在线撮合服务。于是,在物流货运、金融交易、房产中介、在线招聘、二手平台等众多行业都能逐步建立更有效的双方资源配置,撮合精准度和效能直线提升。

场景 3:AI 心理咨询师

当下对社会心理健康的关注,加速心理咨询行业发展,而专业心理咨询师的数量呈现需求缺口。AI 咨询师也同样应运而生,不仅解决咨询师数量问题,还对个人隐私保护更有裨益。

于是,解决资源缺失,提升咨询效率,AI 实时互动公有云方案,基于 AI 大模型训练,打造满足平台数量的“超拟人心理咨询师”,提供 7*24 小时全天候咨询、满足定制化服务,输出辅助诊断和有效监测。

场景 4:AI 虚拟教师

在线教育行业之上,衍生了全新的 AI 直播小班课场景,也是教育领域的技术融合创新。它结合了人工智能与在线直播教学的优势,为学生提供更加个性化、灵活和高效的学习体验。同样解决了教师资源有限、服务用户有限的弊端。

在此之上,AI 实时互动公有云方案,整合教育行业模型、预置课程视频片段,结合 AI 实时响应能力,打造无时间和数量限制、高品质的小班课助力新型的教育模式发展。

这款 AI 音视频通话端到端解决方案,不仅在上述四类场景中陆续落地,也在更多行业中探索创新。然而,其不仅在场景维度上的适用性很强,在物理空间上的服务质量更有全球性保障。

「AI 实时互动」依托实时音视频 ARTC 产品体系,全球 3200+节点覆盖和 QOS 优化,用户可以与 AI 智能体进行全球范围的高可靠、低延时通话,网络延时低至 200ms这意味着,它可以提供高质量的全球化服务,满足众多场景下的全球性用户覆盖。



体验定制 专属 AI 智能体




阿里云「AI 实时互动」方案

已在 7 月 31 日正式上线

陆续发布

语音通话智能体(VoiceAgent)

数字人通话智能体(AvatarAgent)

探索数智化生产力的新思路

打造企业专属云上 AI 智能体

仅需 10 分钟


加入「钉钉咨询群」联系专人,体验Demo



阿里云视频云 「视频云技术」你最值得关注的音视频技术公众号,每周推送来自阿里云一线的实践技术文章,在这里与音视频领
评论
  • 根据环洋市场咨询(Global Info Research)项目团队最新调研,预计2030年全球中空长航时无人机产值达到9009百万美元,2024-2030年期间年复合增长率CAGR为8.0%。 环洋市场咨询机构出版了的【全球中空长航时无人机行业总体规模、主要厂商及IPO上市调研报告,2025-2031】研究全球中空长航时无人机总体规模,包括产量、产值、消费量、主要生产地区、主要生产商及市场份额,同时分析中空长航时无人机市场主要驱动因素、阻碍因素、市场机遇、挑战、新产品发布等。报告从中空长航时
    GIRtina 2025-01-09 10:35 135浏览
  • 光伏逆变器是一种高效的能量转换设备,它能够将光伏太阳能板(PV)产生的不稳定的直流电压转换成与市电频率同步的交流电。这种转换后的电能不仅可以回馈至商用输电网络,还能供独立电网系统使用。光伏逆变器在商业光伏储能电站和家庭独立储能系统等应用领域中得到了广泛的应用。光耦合器,以其高速信号传输、出色的共模抑制比以及单向信号传输和光电隔离的特性,在光伏逆变器中扮演着至关重要的角色。它确保了系统的安全隔离、干扰的有效隔离以及通信信号的精准传输。光耦合器的使用不仅提高了系统的稳定性和安全性,而且由于其低功耗的
    晶台光耦 2025-01-09 09:58 105浏览
  • 在过去十年中,自动驾驶和高级驾驶辅助系统(AD/ADAS)软件与硬件的快速发展对多传感器数据采集的设计需求提出了更高的要求。然而,目前仍缺乏能够高质量集成多传感器数据采集的解决方案。康谋ADTF正是应运而生,它提供了一个广受认可和广泛引用的软件框架,包含模块化的标准化应用程序和工具,旨在为ADAS功能的开发提供一站式体验。一、ADTF的关键之处!无论是奥迪、大众、宝马还是梅赛德斯-奔驰:他们都依赖我们不断发展的ADTF来开发智能驾驶辅助解决方案,直至实现自动驾驶的目标。从新功能的最初构思到批量生
    康谋 2025-01-09 10:04 123浏览
  • 故障现象一辆2017款东风风神AX7车,搭载DFMA14T发动机,累计行驶里程约为13.7万km。该车冷起动后怠速运转正常,热机后怠速运转不稳,组合仪表上的发动机转速表指针上下轻微抖动。 故障诊断 用故障检测仪检测,发动机控制单元中无故障代码存储;读取发动机数据流,发现进气歧管绝对压力波动明显,有时能达到69 kPa,明显偏高,推断可能的原因有:进气系统漏气;进气歧管绝对压力传感器信号失真;发动机机械故障。首先从节气门处打烟雾,没有发现进气管周围有漏气的地方;接着拔下进气管上的两个真空
    虹科Pico汽车示波器 2025-01-08 16:51 132浏览
  • 在智能网联汽车中,各种通信技术如2G/3G/4G/5G、GNSS(全球导航卫星系统)、V2X(车联网通信)等在行业内被广泛使用。这些技术让汽车能够实现紧急呼叫、在线娱乐、导航等多种功能。EMC测试就是为了确保在复杂电磁环境下,汽车的通信系统仍然可以正常工作,保护驾乘者的安全。参考《QCT-基于LTE-V2X直连通信的车载信息交互系统技术要求及试验方法-1》标准10.5电磁兼容试验方法,下面将会从整车功能层面为大家解读V2X整车电磁兼容试验的过程。测试过程揭秘1. 设备准备为了进行电磁兼容试验,技
    北汇信息 2025-01-09 11:24 121浏览
  • 1月9日,在2025国际消费电子展览会(CES)期间,广和通发布集智能语音交互及翻译、4G/5G全球漫游、随身热点、智能娱乐、充电续航等功能于一体的AI Buddy(AI陪伴)产品及解决方案,创新AI智能终端新品类。AI Buddy是一款信用卡尺寸的掌中轻薄智能设备,为用户带来实时翻译、个性化AI语音交互助手、AI影像识别、多模型账户服务、漫游资费服务、快速入网注册等高品质体验。为丰富用户视觉、听觉的智能化体验,AI Buddy通过蓝牙、Wi-Fi可配套OWS耳机、智能眼镜、智能音箱、智能手环遥
    物吾悟小通 2025-01-09 18:21 120浏览
  • 一个真正的质量工程师(QE)必须将一件产品设计的“意图”与系统的可制造性、可服务性以及资源在现实中实现设计和产品的能力结合起来。所以,可以说,这确实是一种工程学科。我们常开玩笑说,质量工程师是工程领域里的「侦探」、「警察」或「律师」,守护神是"墨菲”,信奉的哲学就是「墨菲定律」。(注:墨菲定律是一种启发性原则,常被表述为:任何可能出错的事情最终都会出错。)做质量工程师的,有时会不受欢迎,也会被忽视,甚至可能遭遇主动或被动的阻碍,而一旦出了问题,责任往往就落在质量工程师的头上。虽然质量工程师并不负
    优思学院 2025-01-09 11:48 142浏览
  • Snyk 是一家为开发人员提供安全平台的公司,致力于协助他们构建安全的应用程序,并为安全团队提供应对数字世界挑战的工具。以下为 Snyk 如何通过 CircleCI 实现其“交付”使命的案例分析。一、Snyk 的挑战随着客户对安全工具需求的不断增长,Snyk 的开发团队面临多重挑战:加速交付的需求:Snyk 的核心目标是为开发者提供更快、更可靠的安全解决方案,但他们的现有 CI/CD 工具(TravisCI)运行缓慢,无法满足快速开发和部署的要求。扩展能力不足:随着团队规模和代码库的不断扩大,S
    艾体宝IT 2025-01-10 15:52 102浏览
  • 1月7日-10日,2025年国际消费电子产品展览会(CES 2025)盛大举行,广和通发布Fibocom AI Stack,赋智千行百业端侧应用。Fibocom AI Stack提供集高性能模组、AI工具链、高性能推理引擎、海量模型、支持与服务一体化的端侧AI解决方案,帮助智能设备快速实现AI能力商用。为适应不同端侧场景的应用,AI Stack具备海量端侧AI模型及行业端侧模型,基于不同等级算力的芯片平台或模组,Fibocom AI Stack可将TensorFlow、PyTorch、ONNX、
    物吾悟小通 2025-01-08 18:17 91浏览
  • HDMI 2.2 规格将至,开启视听新境界2025年1月6日,HDMI Forum, Inc. 宣布即将发布HDMI规范2.2版本。新HDMI规范为规模庞大的 HDMI 生态系统带来更多选择,为创建、分发和体验理想的终端用户效果提供更先进的解决方案。新技术为电视、电影和游戏工作室等内容制作商在当前和未来提供更高质量的选择,同时实现多种分发平台。96Gbps的更高带宽和新一代 HDMI 固定比率速率传输(Fixed Rate Link)技术为各种设备应用提供更优质的音频和视频。终端用户显示器能以最
    百佳泰测试实验室 2025-01-09 17:33 162浏览
  • 车机导航有看没有懂?智能汽车语系在地化不可轻忽!随着智能汽车市场全球化的蓬勃发展,近年来不同国家地区的「Automotive Localization」(汽车在地化)布局成为兵家必争之地,同时也是车厂在各国当地市场非常关键的营销利器。汽车在地化过程中举足轻重的「汽车语系在地化」,则是透过智能汽车产品文字与服务内容的设计订制,以对应不同国家地区用户的使用习惯偏好,除了让当地车主更能清楚理解车辆功能,也能进一步提高品牌满意度。客户问题与难处某车厂客户预计在台湾市场推出新一代车款,却由于车机导航开发人
    百佳泰测试实验室 2025-01-09 17:47 80浏览
  • 职场是人生的重要战场,既是谋生之地,也是实现个人价值的平台。然而,有些思维方式却会悄无声息地拖住你的后腿,让你原地踏步甚至退步。今天,我们就来聊聊职场中最忌讳的五种思维方式,看看自己有没有中招。1. 固步自封的思维在职场中,最可怕的事情莫过于自满于现状,拒绝学习和改变。世界在不断变化,行业的趋势、技术的革新都在要求我们与时俱进。如果你总觉得自己的方法最优,或者害怕尝试新事物,那就很容易被淘汰。与其等待机会找上门,不如主动出击,保持学习和探索的心态。加入优思学院,可以帮助你快速提升自己,与行业前沿
    优思学院 2025-01-09 15:48 122浏览
  • 在当前人工智能(AI)与物联网(IoT)的快速发展趋势下,各行各业的数字转型与自动化进程正以惊人的速度持续进行。如今企业在设计与营运技术系统时所面临的挑战不仅是技术本身,更包含硬件设施、第三方软件及配件等复杂的外部因素。然而这些系统往往讲究更精密的设计与高稳定性,哪怕是任何一个小小的问题,都可能对整体业务运作造成严重影响。 POS应用环境与客户需求以本次分享的客户个案为例,该客户是一家全球领先的信息技术服务与数字解决方案提供商,遭遇到一个由他们所开发的POS机(Point of Sal
    百佳泰测试实验室 2025-01-09 17:35 140浏览
我要评论
0
点击右上角,分享到朋友圈 我知道啦
请使用浏览器分享功能 我知道啦