arxiv:2606.08572
๐ In a Training Loop
Han Wang
v21n
ยท
AI & ML interests
None yet
Recent Activity
upvoted a paper about 15 hours ago
AVSCap: Orchestrating Audio-Visual Synergy for Omni-modal Video Captioning published a model 3 months ago
v21n/your-model-name authored a paper 3 months ago
OmniCap-IF: Benchmarking and Improving Instruction Following Abilities for Omni-Video CaptioningOrganizations
None yet