关于我
我目前是南京大学 Vision Lab 信号与信息处理方向硕士生,研究和工程兴趣集中在 AI Agent 系统与多模态应用。我关注如何让 Agent 从可运行的 Demo 进入可观测、可评测、可持续演进的工程系统,同时保留在点云压缩与三维视觉方向的研究积累。
我的实践覆盖 Agentic Search 执行链路治理、电商视觉 Agent 的分层 Skill 自进化、端到端 AI 摄影辅助,以及具备持久记忆的多智能体投资系统。面对复杂系统,我习惯先定义可验证的目标,再让数据、工具和评测共同驱动迭代。
实习与项目经历
大模型与智能体应用,蚂蚁集团
项目负责人,华为校企合作项目
算法实习生,OPPO 研究院
研究兴趣
- Agent 系统:工具调用、Skill、Multi-Agent 与 LangGraph 工作流
- Agent 工程:Agentic Search、执行链路可观测、评测与质量治理
- Agent 自进化:细粒度 Skill 演化、验证集 Gate 与精确回滚
- 多模态与三维视觉:VLM、图像编辑、点云压缩与 3DGS 编码
技能
- 编程与工程
- Python · Java 后端生产项目经验 · C/C++ · LangGraph
- 平台与效率
- Git · Docker · PyTorch · Claude Code 与 Codex 深度工作流
- Agent
- 工具调用 · Skill · Multi-Agent · Agentic Search · 可观测 · 自进化
- 多模态
- VLM · 图像编辑 · 深度学习点云与 3DGS 编码 · MPEG AI-PCC
- 语言
- 英语 CET-6 601、TOEFL 106 · 日语 JLPT-N2 154 · 英文交流与文献检索/阅读
教育背景
信号与信息处理硕士(推免)· 南京大学 Vision Lab · GPA 4.45/52024.9 – 2027.6
通信工程学士 · 南京大学2020.9 – 2024.7
E-SkillChain
面向电商视觉 Agent 的分层 Skill 自进化框架
个人开源项目,2026.5 - present
- 8 个公开视觉数据集与 1,500 条图文交互轨迹
- 三阶段细粒度 Skill 自进化
- GCS 较 No Skill / Static Skill 提升 12.5 / 6.5pp
- 路由 Macro-F1 较 Static Skill 提升 8.7pp
系统将 Skill 演化拆分为能力知识、路由描述与执行指令三个可归因阶段,并以确定性评分器和 LLM Rubric 联合衡量端到端成功率。验证集 Gate 只接受有增益的改进,否则精确回滚;六类电商助手能力均未出现退化。
AI-assisted Photography Composition
基于视觉 Agent 的端到端 AI 摄影辅助 App
华为校企合作项目,项目负责人,2025.10 - 2026.6
- React Native 前端与 LangGraph 后端
- VLM 与图像编辑模型协作
- StateGraph 人机协同与动作循环验证
- 测试场景中审美评分较 Google Camera Coach 提升 25%-40%
我主导整体架构与开发,将 App 部署到 Android 设备,并构建场景感知理解、交互式预览、动作循环验证的系统闭环。系统根据实时取景帧动态拆解移动与缩放指令,持续校验动作达成状态。
StockAgent
基于持久记忆的自主股票投资 Agent 系统
个人开源项目,2026.3 - 2026.6
- 12-Agent 四层协作架构
- 长期记忆 + FTS5 研报语料库 + 交易日志
- 情境记忆与反思引擎
- BaseBroker 支持模拟盘与实盘无缝切换
StockAgent 采用分析师并行、研究辩论、执行、风控辩论四层协作架构,并通过三层持久记忆与反思引擎支持跨会话学习和策略复盘。多厂商 LLM 客户端、CI/CD、多渠道通知与 Docker Compose 支持 24 小时运行。
动态
2026.6:加入蚂蚁集团大模型与智能体应用团队,参与 Deep Research 与 Agentic Search 保险产品研究工具。
2026.5:启动 E-SkillChain,探索电商视觉 Agent 的分层 Skill 自进化。
2026.3:构建 StockAgent,一个具备持久记忆和 12-Agent 协作架构的自主股票投资 Agent 系统。
2025.10:负责华为校企合作中基于视觉 Agent 的端到端 AI 摄影辅助项目。
2024.9:开始在南京大学 Vision Lab 攻读信号与信息处理硕士。
2024.2:在 OPPO 研究院实习,参与深度学习点云压缩与 MPEG AI-PCC 标准化工作。
代表论文
点云压缩与视觉信号处理方向的代表性研究成果。
Content-aware rate control for geometry-based point cloud compression SCI 一区 · CCF-B
IEEE Transactions on Circuits and Systems for Video Technology
面向基于几何的点云压缩提出内容感知码率控制方法。
荣誉
一等学业奖学金
人民奖学金
人民奖学金