MLLM-Token-Compression

Towards Efficient Multimodal Large Language Models: A Survey on Token Compression

Y

yaolinli

Dernière activité 21 sept. 2026
yaolinli/MLLM-Token-Compression

225

étoiles

11

forks

0

issues ouvertes

Le README de ce projet n'est pas disponible pour le moment.

Le lire sur GitHub

Projets similaires

[TMLR 2026] Survey: https://arxiv.org/pdf/2507.20198

awesome-listefficient-aiefficient-mllm
Ccokeshao
394 étoiles24

Awesome LLM compression research papers and tools.

HHuangOwen
1,9 k étoiles133

[EMNLP'23, ACL'24] To speed up LLMs' inference and enhance LLM's perceive of key information, compress the prompt and KV-Cache, which achieves up to 20x compression with minimal performance loss.

Python
Mmicrosoft
6,7 k étoiles432