首页必读视频专题飞象趣谈光通信人工智能低空机器人智能汽车终端会展特约记者

对话AI Agent,直达视频名场面:当虹科技重塑车载智能座舱新体验

2026年7月23日 17:28CCTIME飞象网

“我想看哪吒、敖丙共渡天劫的片段。”体验者话音刚落,眼前的屏幕画面,便开始乌云翻涌,毁灭性的雷霆如巨龙咆哮,直击陈塘关。

这一幕,发生在7月17日开幕的2026世界人工智能大会(WAIC)现场。当虹科技的视频AI Agent交互展项前,不少观众排队体验这一全新的视频交互方式。

与传统的视频搜索不同,体验者无需输入片名或关键词,也不用反复拖动进度条。哪怕只记得一个演员、一句台词,或某个经典画面,只要观众用自然语言描述出来,视频AI Agent便能迅速理解用户意图,准确定位到对应视频片段及具体时间点。

例如,“我想看《狂飙》最后一集”“帮我找张艺谋的最新电影”等指令,都能快速响应。观看过程中,用户还可以围绕画面内容随时提问,真正实现“边看边聊”。

“与以文本为主的语言模型相比,这项技术的难点在于,视频包含的信息更加复杂。”当虹科技工作人员介绍,除了画面本身,视频还包含人物、场景、动作、音乐、字幕等丰富的多模态信息。如何让AI真正理解这些内容,并准确定位用户想要的片段,是视频AI交互最核心的挑战。

为此,当虹科技展示的视频AI Agent融合了多维内容理解与多轮语义交互能力,能够深度解析人物、场景、事件及其上下文关系,将传统的“用文本搜索视频”升级为“直接和视频对话”。同时,依托当虹科技在视听传媒领域的多年沉淀,与内容生产平台建立了丰富的生态合作,模型能够持续优化理解与检索能力,为更加精准、自然的视频交互提供支撑。

“我们的视频AI Agent看似是改变了视频搜索的方式,实际上改变的是人与视频之间的交互逻辑。”当虹科技工作人员表示。

长期以来,视频更多是一种被动播放的内容载体,用户只能依赖关键词搜索、菜单选择或手动定位来获取想要的内容。而随着多模态大模型的发展,视频正从扁平的内容载体演变为可理解、可检索、可调用的信息空间。

借助视频AI Agent,视频中的人物、场景、事件等内容都成为了可理解、可检索的信息单元,用户面对的不再只是播放器,而是一个能够理解内容、持续对话的智能交互入口,从而实现与视频内容更深度的互动。

不少观众体验后表示:“太方便了,非常适合我这种总记不住片名、却记得剧情的人。”“以后不知道看什么的时候,直接让Agent根据我的心情推荐就行了。”相比过去依赖关键词搜索、反复拖动进度条寻找片段,如今一句话就能找到想看的内容,这种交互方式更加自然,也更符合日常使用习惯。

据了解,目前当虹科技已将该视频AI Agent引入智能座舱,让车主在车内通过语音即可获取想要的视频片段,充分利用停车、驻车等碎片化时间享受娱乐体验。

编 辑:T01
飞象网版权及免责声明:
1.本网刊载内容,凡注明来源为“飞象网”和“飞象原创”皆属飞象网版权所有,未经允许禁止转载、摘编及镜像,违者必究。对于经过授权可以转载,请必须保持转载文章、图像、音视频的完整性,并完整标注作者信息和飞象网来源。
2.凡注明“来源:XXXX”的作品,均转载自其它媒体,在于传播更多行业信息,并不代表本网赞同其观点和对其真实性负责。
3.如因作品内容、版权和其它问题,请在相关作品刊发之日起30日内与本网联系,我们将第一时间予以处理。
本站联系电话为86-010-87765777,邮件后缀为cctime.com,冒充本站员工以任何其他联系方式,进行的“内容核实”、“商务联系”等行为,均不能代表本站。本站拥有对此声明的最终解释权。
推荐阅读

精彩视频

精彩专题

关于我们广告报价联系我们隐私声明本站地图

CCTIME飞象网 CopyRight © 2007-2026 By CCTIME.COM

京ICP备08004280号-1 电信与信息服务业务经营许可证080234号 京公网安备110105000771号

公司名称: 北京飞象互动文化传媒有限公司

未经书面许可,禁止转载、摘编、复制、镜像