关于我

你好!我是 邹元昊(Yuanhao Zou),现为 University of Central Florida 计算机科学博士生,在 Center for Research in Computer Vision (CRCV) 师从 Prof. Chen Chen

此前,我在 University of Michigan, Ann Arbor 获得电子与计算机工程硕士学位,并与 Zhaozheng Yin 教授合作研究医学视觉语言模型;本科毕业于中南大学,期间在 Xiangjian He 教授指导下开展医学图像分割研究。

中文简历 English CV Google Scholar GitHub 邮箱

研究方向

我的研究目标是构建高效、可扩展、能够理解真实世界时序信息的多模态模型,目前重点关注:

  • 视频理解与长视频推理 — 时序定位、多事件条件推理、长视频问答与自适应帧选择。
  • 高效视觉语言模型 — 在有限算力下保持视觉感知和推理能力的紧凑型、端侧 VLM。
  • 多模态智能体与强化学习 — 面向 RGB、热成像、深度与多视角视频的联合建模和复杂推理。
  • 视频异常检测 — 真实监控与边缘场景中的异常事件检测和定位。

我此前也长期研究医学视觉语言模型(视觉问答、图文检索)和医学图像分割

代表性进展

  • [2026.06] 发布长视频条件多事件时序定位工作 CoMET Agent / CoMET-Bench
  • [2026.06] 医学世界模型 CLARITYECCV 2026 接收。
  • [2026.02] 高效视频时序定位工作被 CVPR 2026 Workshop 接收。
  • [2026.01] 自适应视频帧选择工作 A.I.R.ICLR 2026 接收。
  • [2025.08] 加入 UCF CRCV,开始计算机科学博士研究。

联系方式

如需交流研究合作或 2027 年上海暑期算法研究实习机会,欢迎发送邮件至 yuanhaoz@ucf.edu