完整论文列表请访问 Google Scholar

前往 Google Scholar →

实验室在 CVPR、ICCV、ECCV、AAAI、NeurIPS、ACM MM、Nature Communications、IEEE TPAMI 等顶级会议和期刊上发表论文百余篇

会议论文

CVPR 2026 H. Liu, B. Zou, Q. Liu, H. Yu, Q. Mei, J. Jiang, C. Liu, C. Bi, Z. Wang, X. Zhang, Y. Zhan, J. Chen, H. Ma, "Unposed-to-3D: Learning Simulation-Ready Vehicles from Real-World Images"
CVPR 2026 S. Liu, X. Li, B. Zou, J. Zhuo, H. Ma, J. Chen, "Video-Only ToM: Enhancing Theory of Mind in Multimodal Large Language Models"
ICML 2026 H. Yu, D. Zha, X. Ding, J. Li, J. Zhuo, Q. Liu, H. Ma, J. Chen, "MEDUSA: Motion Elimination in Diffusion Using Spectral Attack"
ACL FINDINGS 2026 L. Wang, J. Xing, T. Hu, J. Jiang, J. Zhao, H. Ma, "Bridging the Temporal Gap in Multimodal LLMs: Deeply Stacking Temporal Tokens for Audio-Visual Speech Recognition"
ICASSP 2026 J. Lyu, H. Yu, H. Liu, Q. Mei, H. Ma, T. Hu, "SPAR-GS: Single-View Pose-Free Automobile Reconstruction with 3D Gaussian Splatting"
ICASSP 2026 K. Li, X. Zhang, J. Liu, T. Hu, H. Ma, "KAN-LLM: Kolmogorov-Arnold Networks-Enhanced Large Language Models for Time Series Forecasting"
CVPR 2025 J. Zhao, J. Zhuo*, J. Chen, H. Ma*, "SAM2Object: Consolidating View Consistency via SAM2 for Zero-Shot 3D Instance Segmentation"
ICCV 2025 J. Jiang, Q. Liu*, H. Yu, H. Liu, L. Wang, J. Chen, H. Ma*, "MonoMVSNet: Monocular Priors Guided Multi-View Stereo Network"
ICCV 2025 X. Ding, H. Yu, J. Li, B. Zou, H. Ma, J. Chen*, "Kaleidoscopic Background Attack: Disrupting Pose Estimation with Multi-Fold Radial Symmetry Textures"
ICCV 2025 H. Yu, X. Ding, J. Li, J. Wang, Y. Zhang, R. Wang, H. Ma, J. Chen*, "DADet: Safeguarding Image Conditional Diffusion Models against Adversarial and Backdoor Attacks"
ICML 2025 X. Li, S. Liu, B. Zou*, J. Chen, H. Ma*, "From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models"
NeurIPS 2025 J. Jiang, Q. Liu*, H. Liu, H. Yu, L. Wang, J. Chen, H. Ma*, "MVSMamba: Multi-View Stereo with State Space Model"
NeurIPS 2025 Y. Hou, B. Zou*, M. Zhang, R. Chen, S. Yang, Y. Zhang, J. Zhuo, S. Chen, J. Chen, H. Ma*, "AGC-Drive: A Large-Scale Dataset for Real-World Aerial-Ground Collaboration in Driving Scenarios"
AAAI 2025 J. Jiang, L. Wang, H. Yu, T. Hu, J. Chen, H. Ma*, "RRT-MVS: Recurrent Regularization Transformer for Multi-View Stereo"
AAAI 2025 J. Li, H. Yu, J. Chen*, X. Ding, J. Wang, J. Liu, B. Zou, H. Ma, "A²RNet: Adversarial Attack Resilient Network for Robust Infrared and Visible Image Fusion"
AAAI 2025 B. Zou, Z. Guo, X. Hu, H. Ma*, "RhythmMamba: Fast, Lightweight, and Accurate Remote Physiological Measurement"
AAAI 2025 H. Liu, H. Yu, B. Zou*, J. Lyu, M. Qi, J. Chen, H. Ma*, "ProtoCar: Learning 3D Vehicle Prototypes from Single-View and Unconstrained Driving Scene Images"
AAAI 2025 J. Zhuo, S. Wang*, Z. Chen, L. Shen, Q. Huang, H. Ma*, "Image-to-video Adaptation with Outlier Modeling and Robust Self-learning"
ACM MM 2025 Z. Guo, B. Zou, Y. Jia, X. Li, H. Ma, "Boosting Micro-Expression Analysis via Prior-Guided Video-Level Regression"
ICME 2025 X. Li, B. Zou, R. Wang, H. Ma*, "Puzzle-MAE: A Puzzle-Inspired Mask Autoencoder for Multi-Modal Fusion"
ICME 2025 X. Zhang, K. Wang, T. Hu*, H. Ma*, "Efficient Knowledge Transfer in Multi-Task Learning through Task-Adaptive Low-Rank Representation"
ICME 2025 K. Wang, X. Zhang, J. Lyu, T. Hu*, H. Ma, "CSCE: Boosting LLM Reasoning by Simultaneous Enhancing of Causal Significance and Consistency"
ICASSP 2025 R. Wang, X. Xu, H. Yang, L. Wei, H. Ma*, "A novel multimodal personality prediction method based on pretrained models and graph relational transformer network"
ICASSP 2025 B. Zou, Z. Guo, W. Qin, X. Li, K. Wang, H. Ma*, "Synergistic Spotting and Recognition of Micro-Expression via Temporal State Transition"
ICASSP 2025 X. Zhang, K. Wang, T. Hu*, H. Ma*, "Enhancing Autonomous Driving through Dual-Process Learning with Behavior and Reflection Integration"
ICML 2024 K. Song, Z. Tan, B. Zou, H. Ma, W. Huang, "Unveiling the Dynamics of Information Interplay in Supervised Learning"
NeurIPS 2024 J. Zhu, S. Li, A. Liu, P. Huang, J. Shan, H. Ma*, J. Yuan, "ODGEN: Domain-specific Object Detection Data Generation with Diffusion Models"
ACM MM 2024 S. Chen, J. Zhuo*, X. Li, H. Liu, R. Wang, J. Chen, H. Ma*, "CMT: Co-training Mean-Teacher for Unsupervised Domain Adaptation on 3D Object Detection"
ACM MM 2024 H. Liu, J. Zhuo*, C. Liang, J. Chen, H. Ma*, "Affinity3D: Propagating Instance-Level Semantic Affinity for Zero-Shot Point Cloud Semantic Segmentation"
ICASSP 2024 S. Chen et al., "PLS: Unsupervised Domain Adaptation for 3D Object Detection Via Pseudo-Label Sizes"
ICME 2024 X. Li, "EMo Transformer: Transformer-Based Depression Detection via Eye Movements"
NeurIPS 2023 K. Song, H. Ma, B. Zou, H. Zhang, W. Huang, "FD-Align: Feature Discrimination Alignment for Fine-tuning Pre-Trained Models in Few-Shot Learning"
MM 2023 W. Qin, B. Zou, X. Li, W. Wang, H. Ma, "Micro-Expression Spotting with Face Alignment and Optical Flow"
ACM MM 2022 H. Liu, H. Ma, Y. Wang, B. Zou, T. Hu, R. Wang, J. Chen, "Eliminating Spatial Ambiguity for Weakly Supervised 3D Object Detection without Spatial Labels"
ACM MM 2022 Y. Xue, J. Chen, Y. Zhang, C. Yu, H. Ma, H. Ma, "3D Human Mesh Reconstruction by Learning to Sample Joint Adaptive Tokens for Transformers"
ACCV 2022 K. Song, Y. Wu, J. Chen, T. Hu, H. Ma, "Gestalt-Guided Image Understanding for Few-Shot Learning"
ICCV 2021 C. Yu, J. Chen, Y. Xue, Y. Liu, W. Wan, J. Bao, H. Ma, "Defending against Universal Adversarial Patches by Clipping Feature Norms"
NeurIPS 2021 J. Chen, Y. Zhang, Y. Xu, H. Ma, H. Yang, J. Song, Y. Wang, Y. Wu, "Variational Automatic Curriculum Learning for Sparse-Reward Cooperative Multi-Agent Problems"
ACM MM 2021 Y. Huang, H. Xue, J. Chen*, H. Ma, H. Ma, "Semantic Tag Augmented XlanV Model for Video Captioning"
PRCV 2021 P. Lin, X. Wang, J. Chen, H. Ma, H. Ma, "Face Anti-Spoofing Based on Cooperative Pose Analysis"
PRCV 2021 J. Bao, J. Chen, H. Ma, H. Ma, C. Yu, Y. Huang, "Improving Adversarial Robustness of Detector via Objectness Regularization"
CVPR 2018 X. Wang, S. You, X. Li, H. Ma, "Weakly-Supervised Semantic Segmentation by Iteratively Mining Common Object Features"
CVPR 2017 X. Chen, H. Ma, J. Wan, B. Li, T. Xia, "Multi-View 3D Object Detection Network for Autonomous Driving" (Spotlight)
ICCV 2017 Z. Zhao, H. Ma, S. You, "Single Image Action Recognition using Semantic Body Part Actions"
CVPR 2016 X. Chen, K. Kundu, Z. Zhang, H. Ma, S. Fidler, R. Urtasun, "Monocular 3D Object Detection for Autonomous Driving"
CVPR 2015 X. Chen, H. Ma, "Improving Object Proposals with Multi-Thresholding Straddling Expansion"
NIPS 2015 X. Chen, Y. Zhu, K. Kundu, H. Ma, S. Fidler, R. Urtasun, "3D Object Proposals for Accurate Object Class Detection"

期刊论文

Nature Comm. 2026 X. Zhang, T. Hu, J. Lyu, Q. Liu, Q. Zhao, M. Li, K. Li, S. Han, J. Chen, H. Ma, "Autonomous driving system based on dual process theory and deliberate practice theory"
PR 2026 C. Liu, H. Liu, J. Zhuo, B. Zou, J. Chen, Q. Zhao, H. Ma, "Implicit alignment and query refinement for RGB-T semantic segmentation"
TMM 2026 J. Li, J. Chen, J. Liu, H. Yu, X. Ding, H. Ma, "Multi-Scale Spatial Channel Joint Representation for General Multi-Modality Image Fusion With Self-Supervision"
TCSVT 2026 C. Liu, J. Zhuo, B. Zou, J. Chen, Q. Zhao, H. Ma, "Spatial-frequency Awareness for Low-light Instance Segmentation"
TCSVT 2026 Z. Guo, B. Zou, J. Zhuo, H. Ma, "ME-TST+: Micro-expression Analysis via Temporal State Transition with ROI Relationship Awareness"
CSEE JPES 2026 M. Li, H. Liu, K. Li, J. Liu, T. Hu, H. Ma, "Causality-enhanced large language forecaster for wind speed and wind power forecasting"
CSEE JPES 2026 H. Liu, T. Hu, H. Ma, "Short-term wind speed forecasting using graph attention and frequency domain attention"
TPAMI 2025 J. Zhu, H. Ma, J. Chen, J. Yuan, "Object Detection Data Synthesis via Box-to-Image Generation based on Diffusion Models"
TIP 2025 H. Yu, W. Gong, J. Chen, H. Ma, "HomuGAN: A 3D-Aware GAN With the Method of Cylindrical Spatial-Constrained Sampling"
TITS 2025 J. Ren, B. Zou, J. Lyu, H. Ma, "MLSTP: A Mamba-based Long-Short Term Fusion Network for Improved Trajectory Prediction in Autonomous Driving"
TITS 2025 S. Liu, X. Li, J. Chen, C. Guo, J. Wu, Q. Luo, H. Ma, "Individualized driving intention prediction with inverse reinforcement learning"
TSE 2025 H. Liu, J. Liu, T. Hu, H. Ma, "Spatio-Temporal Probabilistic Forecasting of Wind Speed Using Transformer-Based Diffusion Models"
PR 2025 J. Jiang, H. Ma, "Efficient Multi-View Stereo with Depth-Aware Iterations and Hybrid Loss Strategy"
PR 2025 B. Zou, Z. Guo, J. Chen, J. Zhuo, W. Huang, H. Ma*, "RhythmFormer: Extracting patterned rPPG signals based on periodic sparse attention"
IJCV 2025 J. Zhu, H. Ma, J. Chen et al., "DomainStudio: Fine-Tuning Diffusion Models for Domain-Driven Image Generation Using Limited Data"
TCE 2025 C. Fan, K. Song, B. Zou, X. Hu, H. Ma, "DA-Distill: Dual-Alignment Distillation for Multimodal Knowledge Transfer on Edge Devices"
TIP 2024 J. Zhu, H. Ma, J. Chen, J. Yuan, "High-Quality and Diverse Few-Shot Image Generation via Masked Discrimination"
IJCV 2024 H. Ma, S. Yi, S. Chen, J. Chen, Y. Wang, "Few annotated pixels and point cloud based weakly supervised semantic segmentation of driving scenes"
Neurocomputing 2024 H. Liu, F. Liang, T. Hu, J. Hong, H. Ma, "Multi-Scale Fusion Model Based on Gated Recurrent Unit for Enhancing Prediction Accuracy of State-of-Charge"
TITS 2023 C. Guo, H. Liu, J. Chen, H. Ma, "Temporal Information Fusion Network for Driving Behavior Prediction"
TMM 2023 J. Zhu, H. Ma, J. Chen, J. Yuan, "MotionVideoGAN: A Novel Video Generator Based on the Motion Space Learned From Image Pairs"
TMM 2023 Z. Xing, Y. Wu, S. Liu, S. Di, H. Ma, "Virtual Try-On With Garment Self-Occlusion Conditions"
TIE 2023 T. Hu, H. Ma, K. Liu, H. Sun, "Lithium-Ion Battery Calendar Health Prognostics Based on Knowledge-Data-Driven Attention"
TIP 2022 Y. Xue, J. Chen, Y. Zhang, C. Yu, H. Ma, H. Ma, "Boosting Monocular 3D Human Pose Estimation With Part Aware Attention"
PR 2022 S. Yi, H. Ma, X. Wang, T. Hu, X. Li, Y. Wang, "Weakly-supervised semantic segmentation with superpixel guided local and global consistency"
TCSVT 2022 X. Fu, F. Huang, Y. Zhou, H. Ma, X. Xu, L. Zhang*, "Cross-Modal Cross-Domain Dual Alignment Network for RGB-Infrared Person Re-Identification"
TII 2022 T. Hu, H. Ma, H. Liu, H. Sun, K. Liu, "Self-Attention-Based Machine Theory of Mind for Electric Vehicle Charging Demand Forecast"
TII 2022 K. Liu, Q. Peng, H. Sun, M. Fei, H. Ma*, T. Hu*, "A Transferred Recurrent Neural Network for Battery Calendar Health Prognostics"
TAC 2022 B. Zou, J. Han, Y. Wang, R. Liu, S. Zhao, L. Feng, X. Lyu, H. Ma*, "Semi-structural interview-based Chinese multimodal depression corpus towards automatic preliminary screening of depressive disorders"
KBS 2021 X. Ni, L. Zhang, X. Xu, T. Guo, H. Ma, "Label Disentangled Analysis for Unsupervised Visual Domain Adaptation"
TITS 2020 D. Zhou, H. Ma*, X. Wang, X. Zhang, Y. Dong, "Driving Behavior Prediction Considering Cognitive Prior and Driving Context"
IJCV 2020 X. Wang, S. Liu, H. Ma*, M.-H. Yang, "Weakly-Supervised Semantic Segmentation by Iterative Affinity Learning"
TIP 2019 X. Li, H. Ma*, "Weaklier Supervised Semantic Segmentation with Only One Image Level Annotation per Category"
TVC 2019 J. Wen, H. Ma*, X. Luo, "Deep Generative Smoke Simulator: Connecting Simulated and Real Data"
J. Autism 2019 P. Zhou, L. Zhan, H. Ma, "Understanding others' minds: Social inference in preschool children with autism spectrum disorder"
TPAMI 2017 X. Zhang, T. Hu, J. Lyu, Q. Liu, Q. Zhao, M. Li, K. Li, S. Han, J. Chen, H. Ma, "Autonomous driving system based on dual process theory and deliberate practice theory"
TPAMI 2017 X. Chen, K. Kundu, Y. Zhu, A. Berneshawi, H. Ma, S. Fidler, R. Urtasun, "3D Object Proposals Using Stereo Imagery for Accurate Object Class Detection"
TIP 2017 X. Wang, H. Ma, S. You, X. Chen, "Edge Preserving and Multi-Scale Contextual Neural Network for Salient Object Detection"
TITS 2017 X. Li, H. Ma, "Traffic Light Recognition for Complex Scene with Fusion Detection"
PR 2017 Z. Zhao, H. Ma, X. Chen, "Generalized Symmetric Pair Model for Image Recognition in still images"
PR 2011 S. You, H. Ma, "Manifold topological multi-resolution analysis method"
TVCG J. Zhu, H. Ma, J. Chen, J. Yuan, "Isolated Diffusion: Optimizing Multi-Concept Text-to-Image Generation Training-Freely with Isolated Diffusion Guidance"
TCSVT H. Yu, W. Gong, J. Chen, H. Ma, "GET3DGS: Generate 3D Gaussians Based on Points Deformation Fields"

更多论文请访问 Google Scholar 完整列表

73已授权专利

自动驾驶与3D感知

  • 一种基于开放目标检测的无人车周围目标识别方法及系统 — ZL 202511168152.7
  • 一种基于激光雷达的异构协同感知3D目标检测方法 — ZL 202510119210.0
  • 一种基于3DGS的单图车辆重建方法及系统 — ZL 202510243879.0
  • 一种基于多视角一致性的零样本点云实例分割方法和系统 — ZL 202510546772.3
  • 基于建议-优化框架的自动驾驶轨迹预测方法及系统 — ZL 202410731488.9
  • 一种基于长短时预测的自动驾驶轨迹预测方法及装置 — ZL 202410664898.6
  • 基于场景重建的三维点云标注方法与系统 — ZL 202410314925.7
  • 可见光相机,红外相机与激光雷达的联合标定方法及系统 — ZL 202410106754.9
  • 一种多模态弱监督三维目标检测方法,系统及设备 — ZL 202211435079.1
  • 障碍物检测方法,模型训练方法,装置及自动驾驶车辆 — ZL 202111154672.4
  • 一种适用于长距离城市道路的自动驾驶决策方法及系统 — ZL 202110463384.0
  • 用于智能驾驶的深度学习图像识别方法,系统及终端设备 — ZL 201610929312.X

情感计算与认知

  • 一种驾驶员个性化驾驶意图预测方法及系统 — ZL 202410909042.0
  • 一种基于上半身姿态的驾驶员情绪状态检测方法及系统 — ZL 202410597315.2
  • 一种非接触多生命体征监测方法及装置 — ZL 202410755157.9
  • 一种基于非接触生理信号的情绪识别方法及装置 — ZL 202310158469.7
  • 基于融合特征增强的非接触式生理信号检测方法及装置 — ZL 202410168344.7
  • 一种基于高效时空建模的非接触生理信号检测方法及系统 — ZL 202211451949.4
  • 一种基于周期稀疏注意的周期性信号检测方法及装置 — ZL 202410170587.4
  • 基于模拟场景与交互任务设计的社交焦虑干预方法及系统 — ZL 202210913181.1
  • 一种多模态抑郁情绪识别方法及装置 — ZL 202211671363.9
  • 基于眼动序列时空特征分析的抑郁状态鉴别方法及装置 — ZL 202211598004.5
  • 基于图像的显著性差异和情绪分析的抑郁人群眼动鉴别方法 — ZL 202011530259.9
  • 一种基于视频注视差异的心理测评系统 — ZL 202110865777.4
  • 一种心理测评数据管理系统及方法 — ZL 202210958034.6
  • 基于视觉认知注意的心理测评数据采集与干预方法及系统 — ZL 202210159451.4
  • 基于图像视觉认知的心理测评数据获取方法及VR系统 — ZL 202210154330.0
  • 基于眼动特征分析的图像认知心理分析系统 — ZL 201710027561.4
  • 一种图像认知心理分析系统 — ZL 201310221563.9
  • 基于MMPI心理量表的图像库及其构建方法 — ZL 201310222323.0

图像融合与视觉感知

  • 一种基于场景关系认知的鲁棒图像融合方法及装置 — ZL 202511774395.5
  • 基于时空分层注意力网络的多模态视频融合方法及装置 — ZL 202511559535.7
  • 基于可见光与红外图像决策级融合检测框标定方法及装置 — ZL 202511466816.8
  • 一种基于空频融合的低照度感知方法及系统 — ZL 202511347038.0
  • 基于决策级融合的低光照场景多模态行人检测跟踪方法 — ZL 202311537940.X
  • 基于注意力机制的鲁棒自监督多模态图像融合方法及装置 — ZL 202410611048
  • 一种基于辐射场和生成对抗网络的数据生成方法及装置 — ZL 202310111709.8
  • 一种虚拟场景数据标注生成方法及系统 — ZL 202310294094.7
  • 基于真实数据集的三维驾驶场景生成与构建方法及装置 — ZL 202310473105.8
  • 基于迭代挖掘物体共同特征的弱监督图像语义分割方法 — ZL 201810594322.1
  • 一种基于单一像素标注的图像语义分割方法及系统 — ZL 202010023166.0
  • 基于新型神经网络的多任务场景语义理解模型及其应用 — ZL 201710453745.7
  • 一种基于遮挡维度的图像库构建方法 — ZL 201610930997.X
  • 海面红外对抗仿真系统 — ZL 201510109242.9
  • 空中红外目标对抗仿真系统 — ZL 201510192315.5
  • 对抗仿真寻优方法及系统 — ZL 201510132160.6

人格预测与多模态分析

  • 多种关联特征和图关系注意的多模态人格感知方法及装置 — ZL 202411236190.7
  • 融合CLIP和自适应图变换网络的人格预测方法及装置 — ZL 202411145652.4
  • 基于预训练模型和金字塔图融合的多模态人格预测方法 — ZL 202411884879.0
  • 一种融合时空图注意力网络的多模态人格预测方法和系统 — ZL 202410393379.0
  • 基于多模态特征和层次特征融合的情绪识别方法及系统 — ZL 202411193418.9

对抗鲁棒性与安全

  • 一种思维链引导的多模态大模型对抗样本检测方法及装置 — ZL 202510891996.8
  • 针对对抗通用补丁攻击的鲁棒视觉Transformer视觉感知方法及装置 — ZL 202310190344.2

大语言模型与智能系统

  • 遥感生成图像的语义标注方法及电子设备 — ZL 202610063063.4
  • 一种基于提示的脑肿瘤交互式分割方法及系统 — ZL 202510498889.9
  • 一种基于大语言模型先验知识的推理状态控制方法及装置 — ZL 202410851175.7
  • 一种基于知识与数据联合的路径规划方法,应用及装置 — ZL 202311816500.8
  • 一种基于OD数据的多目标旅行商控制方法,系统及介质 — ZL 2023110864004
  • 一种基于特征调制的自适应小样本图像分类方法及装置 — ZL 202310104730.5
  • 一种适用于多图形接口的跨平台的仿真系统 — ZL 202310240069.0
  • 基于图卷积神经网络和Transformer的时空短期风速预测方法及系统 — ZL 202211341900.3
  • 一种社交网络中社区结构的检测方法 — ZL 202210996162.X
  • 基于有监督学习检测蛋白质复合物的方法及装置 — ZL 202111558297.X
  • 一种基于自注意力机制的个性化注视点检测方法及装置 — ZL 202210818407.X
  • 一种差分式二维注视点检测方法及装置 — ZL 202110822170.8
  • 基于伪标签大小的无监督领域自适应目标检测方法及系统 — ZL 2023105523368
  • 特征解耦的少量样本预训练模型鲁棒性微调方法及装置 — ZL 202311273553X
  • 基于特征分布对齐与聚类的零样本草图检索方法及系统 — ZL 2023113991961
  • 基于多尺度融合GRU网络的汽车电池SOC多步预测方法与系统 — ZL 202410106018.3
  • 基于注意力的锂离子电池日历老化预测模型和方法 — ZL 202310023441.2
  • 基于机器心智模型和自注意力的风力发电分位数预测方法 — ZL 202310014898.7
  • 一种集群机器人合作导航的多向课程学习训练方法及装置 — ZL 202311374713.X
  • 一种基于话题聚类和转移预测的图像段落释意方法 — ZL 2023107044955
  • 基于主成分分析的舰船干扰对抗决策优化与评估方法 — ZL 200910123941.3