lora-based-cascaded-multimodal-fusion-for-action-recognition-in-medical-training-environments-0d45d980·1 events·first seen Aliases: LoRA-Based Cascaded Multimodal Fusion for Action Recognition in Medical Training Environments
A new arXiv preprint proposes a cascaded Low-Rank Adaptation (LoRA) framework for multimodal fusion applied to action and activity recognition in healthcare training settings. The architecture integrates modalities sequentially without retraining prior components, enabling scalable adaptation across datasets with different modality sets. Evaluation on two healthcare datasets (NurViD and Nurse Training) shows competitive performance against dataset-specific baselines. The work is a narrow application of parameter-efficient fine-tuning techniques to a specialized domain.