Ax Abu Tyeb Azad, Ishita Sur Apan, Fahim Ahmed, Sumaiya Karim Katha, Ezharuddin Jubaer, Armun Alam, Pranjal Kumar Nandi, Amin Ahsan Ali, Aman Chadha, Md Mofijul Islam, AKM Mahbubur Rahman 23d ago

BaFCo: A Document Understanding Benchmark for Complex Bangla Form Comprehension

BaFCo benchmark dataset for Bangla form comprehension using multimodal LLMs, addressing low-resource language document understanding gaps.

Ax Pan Li, Kai Chen, Shuai Chang, Shengzhi Zhang, Peizhuo Lv, Jinwen He 23d ago

Differentially Private Natural Gradient Descent

Natural gradient descent variant for differentially private training that accounts for loss curvature to improve optimization efficiency under privacy constraints.

Ax Ryota Tanaka, Taku Hasegawa, Kyosuke Nishida 23d ago

CMDR: Contextual Multimodal Document Retrieval

Contextual multimodal document retrieval benchmark and methods that preserve textual/visual content while resolving multi-page aggregation queries.

Ax Krittanon Kaewtawee, Petmongkon Pornpichitsuwan, Natchaya Temyingyong, Nutnicha Laplamoon, Wachiravit Modecrua, Krittin Pachtrachai, Touchapon Kraisingkorn 23d ago

InfluMatch: Frontier-Quality KOL Search at 4B-Model Cost

Cost-efficient influencer matching system using three-stage cascade of small open-weight models instead of frontier LLM prompting for semantic matching on Thai marketing criteria.

Ax Daryna Dementieva, Nikolay Babakov, Kathy H\"ammerl, Ilseyar Alimova, Jind\v{r}ich Libovick\'y, Shu Okabe, Miras Baisbay, Lukas Edman, Abrorkhon Inomkhujaev, Antonia Karamolegkou, Mateusz Lango, Volkan \"Ozer, Nikola Selic, Subhankar Swain, Tsedeniya Kinfe Temesgen, Galit Bary Weisberg, Alexander Fraser 23d ago

PluraMath: Extending Mathematical Reasoning Evaluation Beyond High-Resource Languages

PluraMath extends mathematical reasoning evaluation to 99 languages beyond English and Chinese, addressing dataset bias in LLM benchmarks.

Ax Yipeng Liu, Chang Liu, Si Shen, Jiaqi Zheng, Mingfan Li, Yuyang Yang, Guanhua Li, Yuquan Zhang, Yimeng Xu, Zhongzhe Hu, Zhiyuan Huang, Qihang Duan, Junsong Wang, Wenkai Ling, Baochuan Yang, Xianzhi Yu, Han Bao, Yijie Chen, Guihai Chen 23d ago

UBEP: Re-architecting Expert Parallelism Communication Library for Production Superpods

UBEP optimizes communication library for Mixture-of-Experts models on high-bandwidth superpods, addressing serialization and latency bottlenecks.