Compressing visual tokens in vision-language models: 3x more requests per GPU on Qwen2-VL
โข 1
None defined yet.
Tokenize any file into a compact Polygen token
Compress visual tokens. Same answer, proven per image.
A visual corpus encoded once, queried many times