Pixels Don't Lie (But Your Detector Might): Bootstrapping MLLM-as-a-Judge for Trustworthy Deepfake Detection and Reasoning Supervision Paper • 2602.19715 • Published Feb 23 • 1
Evaluating and Designing Sparse Autoencoders by Approximating Quasi-Orthogonality Paper • 2503.24277 • Published Mar 31, 2025 • 8
AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations Paper • 2507.20579 • Published Jul 28, 2025
GeoChat: Grounded Large Vision-Language Model for Remote Sensing Paper • 2311.15826 • Published Nov 24, 2023 • 1
All Languages Matter: Evaluating LMMs on Culturally Diverse 100 Languages Paper • 2411.16508 • Published Nov 25, 2024 • 10
GEOBench-VLM: Benchmarking Vision-Language Models for Geospatial Tasks Paper • 2411.19325 • Published Nov 28, 2024
Sparse Logit Sampling: Accelerating Knowledge Distillation in LLMs Paper • 2503.16870 • Published Mar 21, 2025 • 7
MMTEB: Massive Multilingual Text Embedding Benchmark Paper • 2502.13595 • Published Feb 19, 2025 • 50
Data Contamination Report from the 2024 CONDA Shared Task Paper • 2407.21530 • Published Jul 31, 2024 • 10