关于我
我目前是华南农业大学电子科学与技术专业的本科生,最近在做具身智能相关研究,关注 VLA 和 world models(WM)。我已经完全掌握了如何平衡科研与生活。 这句话先划掉,等以后真能做到再放回来。现在先把电脑合上五分钟,算作阶段性胜利。
过去一年,我先在华南农业大学兰玉彬教授实验室参与农业大模型研究,围绕真实荔枝果园完成田间图像采集、多模态问答数据构建,参与 Lychee-Bench / Lychee-Mind 的设计,并进行基于 Qwen2.5-VL-7B 的 SFT 与 GRPO 训练。之后在香港城市大学开展科研实习,参与 SemBid,研究语言表征如何进入自动出价决策;参与 PhysicsMind,构建真实—仿真统一的物理推理评测;参与 Latent Reward Steering,探索推理过程中的隐状态引导。随后,我在中山大学 HCP 实验室开展触觉感知与世界模型研究(本来想继续深造,结果推免被学院拒了——好气,先记一笔)。接下来,我将进入复旦大学,在姜若曦老师指导下继续学习与研究。
我目前关注具身智能中的 VLA 与 world models(WM)。
闲暇时会继续追《罗小黑战记》更新日记:目前最新进度是“希望它快点更新”,发布日期暂未公布。
最新动态
-
🎉 Latent Reward Steering 被 EMNLP 2026 接收!

-
🎤 两篇 CIKM 2026 论文入选 Oral Presentation!
-
🎉 两篇论文被 CIKM 2026 接收!

On the Role of Language Representations in Auto-Bidding: Findings and Implications 和 ClinSDT: LLM-Encoded Clinical Semantic Guidance for Sepsis Treatment via Decision Transformer。
-
On the Role of Language Representations in Auto-Bidding: Findings and Implications 已发布于 arXiv。
-
PhysicsMind 已发布于 arXiv。
论文成果
(* equal contribution · † corresponding author)
Latent Reward Steering: An Adaptive Inference-Time Framework that Implicitly Promotes Cognitive Behaviors in Reasoning LLMs
PhysicsMind: Sim and Real Mechanics Benchmarking for Physical Reasoning and Prediction in Foundational VLMs and World Models
Beyond Uniform Alignment: LLM-based Recommendation
Lychee-Bench: A Process-Level Vision Language Benchmark for Trustworthy Lychee Orchard Diagnosis
ClinSDT: LLM-Encoded Clinical Semantic Guidance for Sepsis Treatment via Decision Transformer
科研经历
实习经历
-
2026.08 - 至今
北京莫刻机器人技术有限公司
科研实习生 · 具身智能 / VLA
-
2026.05 - 2026.08
中山大学 HCP 实验室
科研实习生 · 触觉感知与世界模型
奖励荣誉
- 国家奖学金(2025)· Top 1%
- 全国大学生集成电路创新创业大赛 · 全国二等奖
- 全国大学生数学建模竞赛(省二等奖)
- 优秀学生干部(2025)
- 学风建设先进个人(2024、2025)

