@inproceedings{arxiv250619848,
  title     = {{ScaleCap: Scalable Image Captioning via Dual-Modality Debiasing}},
  author    = {Long Xing and Qidong Huang and Xiaoyi Dong and Pan Zhang and Yuhang Zang and Yuhang Cao and Jinsong Li and Shuangrui Ding and Weiming Zhang and Nenghai Yu and Jiaqi Wang and Feng Wu and Dahua Lin},
  booktitle = {International Conference on Learning Representations},
  year      = {2026},
  volume    = {2026},
  pages     = {32266--32285},
  url       = {https://proceedings.iclr.cc/paper_files/paper/2026/hash/37050ebbbd7096719ab96cec19a4c69f-Abstract-Conference.html}
}
