EM^2Mem: Event-Centric Multimodal Memory for Large Language Models Paper • 2609.00551 • Published about 1 month ago • 13
Delineate Anything v2: A Global Foundation Model for Field Delineation Paper • 2607.19069 • Published Jul 21 • 6
ABot-N1: Toward a General Visual Language Navigation Foundation Model Paper • 2607.10383 • Published Jul 14 • 97
mlboydaisuke/Streaming-Sortformer-Diar-CoreAI Voice Activity Detection • Updated 17 days ago • 67 • 2
MuSViT: A Foundation Vision Model for Sheet Music Representation Paper • 2606.31811 • Published Jun 30 • 10
electricsheepasia/asia-owid-deaths-from-substance-use-disorders-who Viewer • Updated Jun 3 • 1.03k • 16 • 1