|
Selected Publications
*: indicating equal contribution or alphabetic ordering.
For all publications, please see Google scholar.
Selecting or Solving? What Best-of- Verification Delivers in Video Reasoning
Martin Q. Ma, Yuxiao Qu, Ruslan Salakhutdinov, Louis-Philippe Morency, Paden Tomasello, Juan Pino.
Neural Information Processing Systems Workshop on Grounded and Faithful Vision-Language Models for Real-World Deployment (NeurIPS VLM4RWD) 2026.
[Paper], [Code]
Understanding Masked Autoencoders via Hierarchical Latent Variable Models
Lingjing Kong*, Martin Q. Ma*, Guangyi Chen, Eric Xing, Yuejie Chi, Louis-Philippe Morency, Kun Zhang.
Highlight, The IEEE / CVF Computer Vision and Pattern Recognition Conference (CVPR) 2023.
[Paper], [Video], [Slides], [Code]
Complex Transformer: A Framework for Modeling Complex-Valued Sequence
Muqiao Yang*, Martin Q. Ma*, Dongyu Li*, Yao-Hung Hubert Tsai, Ruslan Salakhutdinov
International Conference on Acoustics, Speech and Signal Processing, (ICASSP) 2020
Oral, Neural Information Processing Systems Science meets Engineering of Deep Learning Workshop (NeurIPS SEDL) 2019.
[Paper], [Video], [Slides], [Code]
|