韩文娟
博士 、副教授 、副教授
博士 、副教授 、副教授
| 办公电话: | 电子邮件: wjhan@bjtu.edu.cn |
| 通讯地址:北京交通大学计算机与信息技术学院 | 邮编:100044 |
北京交通大学副教授。加州大学洛杉矶分校访问学者,NUS研究员。EMNLP 2022研讨会(UM-IoS Workshop)Chair,ACM SIGAI CHINA 新星奖,铁科院审稿顾问。博士生导师。在国内外公认的本学科权威学术刊物上发表60余篇。研究方向为多模态大模型、具身操作大模型。
当前的研究重点在于赋予机器基于多模态大模型的认知智能:以多模态联合信息表达机制和跨模态计算建模为切入点和突破口,将高阶常识和认知以符号等形式与低维感知结合,以此增强智能体对人、物体、场景的统一语义表征和抽象推理,构建认知智能增强的交互式智能体。
关于保研、统招和博士:
完整论文列表:https://scholar.google.com/citations?user=rfVLLfAAAAAJ&hl=en
实验室 GitHub:https://github.com/cocacola-lab
部分项目展示 Selected Project:
Demo: http://124.221.16.143:5000/
GitHub:https://github.com/cocacola-lab/ChatIE
Paper:https://arxiv.org/pdf/2302.10205.pdf
Demo: http://124.221.16.143:8080/
GitHub:https://github.com/cocacola-lab/GPT4IE
全部项目展示: https://winniehan.github.io/
2014.09-2020.01,中国,中国科学院大学UCAS,信息科学与技术学院,自然语言处理方向,博士,
2019.05-2019.11,美国,加利福尼亚大学洛杉矶分校(University of California, Los Angeles),人工智能方向,访问学者
2021/04-2022/10,北京智源人工智能研究院,研究员;
2020/01-2021/04,National University of Singapore,计算机系,Research Fellow;
2019/05-2019/11,加利福尼亚大学洛杉矶分校(University of California, Los Angeles),统计系,Visiting Scholar 访问学者
代表性论著、论文情况(完整列表请关注Google Scholar: https://scholar.google.com/citations?user=rfVLLfAAAAAJ&hl=en)
(AAAI 2026) STOLA: Self-Adaptive Touch-Language Framework for Tactile Commonsense Reasoning in Open-Ended Scenarios (CCF-A 会议) Ning Cheng, Jinan Xu, Jialing Chen, Bin Fang, Wenjuan Han*
(AAAI 2026) EMAformer: Enhancing Transformer Through Embedding Armor for Time Series Forecasting (CCF-A 会议) Zhiwei Zhang, Xinyi Du, Xuanchi Guo, Weihao Wang, Wenjuan Han*
ICDE 2026 VisiFold: Long-Term Traffic Forecasting via Temporal Folding Graph and Node Visibility (CCF-A 会议) Zhiwei Zhang, Xinyi Du, Weihao Wang, Xuanchi Guo, Wenjuan Han*
(Inf. P. 2026) GLINT: Global-local Fusion with Attention Intervention for MLLM Hallucination Mitigation Caused by Insufficient Visual Resolution (一区期刊) Pengyu Zhao, Jinan Xu, Songming Zhang, Chengkai Wang, Wenjuan Han*
(Nature H. 2026) Combined Evidence from Artificial Neural Networks and Human BrainLesion Models Reveals that Language Modulates Vision in Human Perception (Nature 子刊) Haoyang Chen, Bo Liu, Shuyue Wang, Xiaosha Wang, Wenjuan Han, Xiaochun Wang, Yixin Zhu, Yanchao Bi
(TPAMI 2026) Intentqa: Intent Question Answering in Videos by Cognitive Context Reasoning (CCF-A 期刊) Jiapeng Li, Ping Wei, Wenjuan Han, Songchun Zhu, Lifeng Fan
(ACL 2025) A Law Reasoning Benchmark for LLM with Tree-Organized Structures including Factum Probandum, Evidence and Experiences (CCF-A 会议) Jiaxin Shen, Jinan Xu, Huiqi Hu, Luyi Lin, Guoyang Ma, Fei Zheng, Fandong Meng, Jie Zhou, Wenjuan Han*
(Exp. S. 2025) Bridging the Reality Gap: A Benchmark for Physical Reasoning in General World Models with Various Physical Phenomena Beyond Mechanics (一区 期刊) Pengyu Zhao, Jinan Xu, Ning Cheng, Huiqi Hu, Xue Zhang, Xiuwen Xu, Zijian Jin, Fandong Meng, Jie Zhou, Wenjuan Han*
(Inf. Fusion 2025) Touch100k: A Large-scale Touch-Language-Vision Dataset for TouchCentric Multimodal Representation (一区期刊) Ning Cheng, Jinan Xu, Changhao Guan, Jing Gao, Weihao Wang, You Li, Fandong Meng, Jie Zhou, Bin Fang, Wenjuan Han*
(Inf. Sci. 2024) LegalAsst: Human-centered and AI-empowered Machine to Enhance Court Productivity and Legal Assistance (一区期刊) Wenjuan Han, Jiaxin Shen, Yanyao Liu, Zhan Shi, Jinan Xu, Fangxu Hu, Hao Chen, Yan Gong, Xueli Yu, Huaqing Wang, Zhijing Liu, Yajie Yang, Tianshui Shi, Mengyao Ge
(ICLR 2024) MMICL: Empowering Vision-language Model with Multi-Modal InContext Learning (CCF-A 会议) Haozhe Zhao, Zefan Cai, Shuzheng Si, Xiaojian Ma, Kaikai An, Liang Chen, Zixuan Liu, Sheng Wang, Wenjuan Han*, Baobao Chang
(ACL 2023) PersLEARN: Research Training through the Lens of Perspective Cultivation (CCF-A 会议) Yu-Zhe Shi, Shiqian Li, Xinyi Niu, Qiao Xu, Jiawen Liu, Yifan Xu, Shiyu Gu, Bingru He, Xinyang Li, Xinyu Zhao, Zijian Zhao, Yidong Lyu, Zhen Li, Sijia Liu, Lin Qiu, Jinhao Ji, Lecheng Ruan, Yuxi Ma, Wenjuan Han*, Yixin Zhu
(CVPR 2022) Unsupervised Vision-Language Parsing: Seamlessly Bridging Visual Scene Graphs with Language Structures via Dependency Relationships (CCF-A 会议) Chao Lou, Wenjuan Han*, Yuhuan Lin, Zilong Zheng
(ICLR 2022) Unsupervised Vision-Language Grammar Induction with Shared Structure Modeling (CCF-A 会议) Bo Wan, Wenjuan Han*, Zilong Zheng, Tinne Tuytelaars
(ACL 2022) On the Robustness of Question Rewriting Systems to Questions of Varying Hardness (CCF-A 会议) Hai Ye, Hwee Tou Ng, Wenjuan Han
(ACL 2023) A Holistic Approach to Reference-Free Evaluation of Machine Translation (CCF-A 会议) Hanming Wu, Wenjuan Han (First Co-author), Hui Di, Yufeng Chen, Jinan Xu
《Synthesis Lectures on Human Language Technologies》一部 (In Process)
举办国际学术会议:
2022-12-7至2022-12-7
举办Proceedings of the Workshop on Unimodal and Multimodal Induction of Linguistic Structures (UM-IoS) (EMNLP 2022 Workshop)
地点:Abu Dhabi and Virtual
发起人、组织者:韩文娟
特邀报告
受邀分别在南加州大学、欧洲顶级自然语言处理会议EACL作专题讲座
国内外学术组织、学术会议重要职务:
审稿人: ACL | TKDE | WWW(TheWebConf) | AAAI | IJCAI | EMNLP | NAACL
长期审稿人: Computational Linguistics
分会主席: COLING2020 (Session Chair)