Figure 8.

Benchmark comparison across multimodal integration methods using fused-space and cross-latent metrics. Violin plots summarize cross-validation folds and random seeds (orange markers: mean). (A) Fused-latent k-NN label transfer accuracy (k = 15). (B) Fused-latent k-means ARI (k set to the number of evaluated label classes). (C) Fused-latent k-means NMI (k set to the number of evaluated label classes). (D) Fused-latent silhouette score by ground-truth labels. (E) Wall-clock fit time (seconds). (F) Cross-latent FOSCTTM between modality-specific embeddings. (G) Cross-latent Recall@10. (H) Cross-latent k-NN label transfer accuracy (k = 15). (I) Cross-latent k-NN label-transfer macro-F1 (k = 15). (J) Modality mixing on stacked modality-specific embeddings (k = 30).

2068f08