Victor

ViCToR: Improving Visual Comprehension via Token Reconstruction for Pretraining LMMs

// repository documentation