VAST
Renmin University of China / Baidu
Structures found in this family (1)
By model (2)
TRIANGLE (VAST backbone, fusion layers removed, retrained with triangle-area loss)
VAST (Vision-Audio-Subtitle-Text foundation model)
Observations (1)
Papers
A TRIANGLE Enables Multimodal Alignment Beyond Cosine Similarity (2025)