


在2026年7月17日开幕的世界人工智能大会(WAIC)上,当虹科技展示了其视频AIAgent交互系统。该系统允许用户通过自然语言描述视频内容,如角色、台词或场景,即可快速定位到对应视频片段及具体时间点,无需输入片名、关键词或手动拖动进度条。例如,用户说出“我想看哪吒、敖丙共渡天劫的片段”或“帮我找张艺谋的最新电影”,系统能即时响应并播放相关画面。观看过程中,用户还可围绕画面内容实时提问,实现“边看边聊”。该技术基于多模态大模型,融合人物、场景、动作、音乐、字幕等多维信息的理解能力,并结合多轮语义交互,将传统“用文本搜索视频”升级为“与视频对话”。依托当虹科技在视听传媒领域的积累及其与内容生产平台的生态合作,系统持续优化视频内容的理解与检索精度。目前,该视频AIAgent已应用于智能座舱场景,支持车主通过语音在停车或驻车时获取所需视频内容。
“特别声明:以上作品内容(包括在内的视频、图片或音频)为凤凰网旗下自媒体平台“大风号”用户上传并发布,本平台仅提供信息存储空间服务。
Notice: The content above (including the videos, pictures and audios if any) is uploaded and posted by the user of Dafeng Hao, which is a social media platform and merely provides information storage space services.”