N_0-TWAM: Scaling Tactile-Native World-Action Model for Contact-Rich Manipulation Paper • 2607.23783 • Published 15 days ago • 47
InfiniSplat: Implicit Gaussian Decoding for Large-Baseline Monocular View Synthesis Paper • 2608.02437 • Published 7 days ago • 63
N_0-VTLA: Scaling Vision-Tactile-Language-Action Model with Latent Tactile Tokens Paper • 2607.23782 • Published 15 days ago • 76
World-to-Wrist: Task-Conditioned Future Wrist Modeling for Fine-Grained Robot Manipulation Paper • 2608.05369 • Published 5 days ago • 24
OpenMed Persian🇮🇷 Collection OpenMed Persian models and datasets for Persian/Iranian privacy, PII masking, and medical-adjacent language infrastructure. • 10 items • Updated May 31 • 2
Play2Perfect: What Matters in Dexterous Play Pretraining for Precise Assembly? Paper • 2606.26428 • Published Jun 24 • 17
Monte Carlo Energy Aggregation for Mobile 3D Gaussian Splatting Paper • 2606.30017 • Published Jun 29 • 21
MolmoMotion: Forecasting Point Trajectories in 3D with Language Instruction Paper • 2606.18558 • Published Jun 17 • 53
Revisiting Articulated Parts Perception in Robot Manipulation Paper • 2606.08103 • Published Jun 6 • 3
VideoMDM: Towards 3D Human Motion Generation From 2D Supervision Paper • 2606.13364 • Published Jun 11 • 20
view article Article How to Fine-Tune Nemotron 3.5 ASR for Your Language, Domain, or Accent nvidia • Jun 4 • 76
AudioMosaic Collection ICML2026 AudioMosaic: Contrastive Masked Audio Representation Learning • 15 items • Updated May 10 • 3
MOSS-Audio Collection An open-source audio understanding model supporting speech recognition, environmental sound analysis, music understanding, time-aware QA, and complex • 13 items • Updated 30 days ago • 67