📝 Variation-aware Vision Token Dropping for Faster Large Vision-Language Models - CVPR'26

March 23, 2026

📝 PRUNE REDUNDANCY, PRESERVE ESSENCE: VISION TOKEN COMPRESSION IN VLMS VIA SYNERGISTIC IMPORTANCE–DIVERSITY - ICLR'26

March 1, 2026

📝 MMTok: Multimodal Coverage Maximization for Efficient Inference of VLMs - ICLR'26

February 28, 2026

📝 Accelerating Streaming Video Large Language Models via Hierarchical Token Compression - CVPR'26

December 27, 2025

📝 Stop Looking for “Important Tokens” in Multimodal Language Models: Duplication Matters More - EMNLP'25

November 12, 2025

📝 Beyond Attention or Similarity: Maximizing Conditional Diversity for Token Pruning in MLLMs - *NeurIPS'25

October 24, 2025