深耕大模型与多模态方向近三年,专注视频智能体工程落地与时序感知记忆管理机制研究。参与了 OPPO 一键问屏与实景问答两款多模态 Agent 产品的研发,历史迭代产品分别在 2024、2025 年 OPPO 开发者大会正式亮相。拥有 7 年一线算法工程经验,长期负责从模型到系统的全链路交付。

深耕大模型与多模态方向近三年,专注视频智能体工程落地与时序感知记忆管理机制研究。参与了 OPPO 一键问屏与实景问答两款多模态 Agent 产品的研发,历史迭代产品分别在 2024、2025 年 OPPO 开发者大会正式亮相。拥有 7 年一线算法工程经验,长期负责从模型到系统的全链路交付。
智能手机每天承载着用户大量的内容消费与操作行为,但传统 AI 助手仅能被动响应单次唤醒,无法真正"陪伴"用户的手机使用旅程。本次分享介绍的系统,以手机屏幕时序视频流为输入,构建了一个具备持续感知、个性化记忆与主动执行能力的多模态伴随 Agent。
我们将重点分享三个算法核心:一是屏幕多模态意图理解,在用户无需明确表达完整需求的伴随场景中,结合屏幕内容与对话上下文,推断用户真实意图并主动规划最优响应路径;二是时序记忆管理,基于时间窗口与指数衰减的伴随记忆机制,让 Agent 始终"活在当下"并持续积累用户个性化偏好;三是工具执行与结果融合,面向本地生活、知识检索、系统操作等多类任务,多工具并发调用与结果排序的工程实践。
该系统已在 OPPO 手机端规模化落地,历史迭代产品分别在 2024、2025 年开发者大会正式亮相。我们将结合真实踩坑案例,分享陪伴类 Agent 从 0 到 1 落地的完整经验。
演讲提纲:
听众收益:



微信咨询

电话咨询
微信联系我们

