MamaBench: Benchmarking LLM Robustness in Maternal and Child Health Diagnosis through Counterfactual Clinical Perturbation Paper • 2607.14385 • Published 8 days ago • 1
HOMIE: Human-object Centric Video Personalization via Multimodal Intelligent Enchancement Paper • 2607.18217 • Published 3 days ago • 52
S1-Omni: A Unified Multimodal Reasoning Model for Scientific Understanding, Prediction, and Generation Paper • 2607.15686 • Published 6 days ago • 15
Ring-Zero: Scaling Zero RL to a Trillion Parameters for Emergent Reasoning Paper • 2607.12395 • Published 9 days ago • 97
view article Article From Hugging Face to Amazon SageMaker Studio in one click amazon • 15 days ago • 15
view article Article Profiling in PyTorch (Part 3): Attention is all you profile +2 ariG23498, sergiopaniego, sayakpaul, ror • 13 days ago • 36
ABot-N1: Toward a General Visual Language Navigation Foundation Model Paper • 2607.10383 • Published 9 days ago • 102
Metacognition in LLMs: Foundations, Progress, and Opportunities Paper • 2607.11881 • Published 10 days ago • 28
LongE2V: Long-Horizon Event-based Video Reconstruction, Prediction, and Frame Interpolation with Video Diffusion Models Paper • 2607.08770 • Published 14 days ago • 37
view article Article Shipping huggingface_hub every week with AI, open tools, and a human in the loop Wauplin, celinah • about 1 month ago • 20
Perceive-to-Reason: Decoupling Perception and Reasoning for Fine-Grained Visual Reasoning Paper • 2607.01191 • Published 22 days ago • 19
ELDR: Expert-Locality-Aware Decode Routing for PD-Disaggregated MoE Serving Paper • 2607.00466 • Published 22 days ago • 32
PerceptionRubrics: Calibrating Multimodal Evaluation to Human Perception Paper • 2606.28322 • Published 27 days ago • 42
AI translation of literary texts is "fine", but readers still prefer human translations Paper • 2606.26040 • Published 29 days ago • 8
Rank-Aware Hyperbolic Alignment for Vision-Language Dataset Distillation Paper • 2606.29464 • Published 25 days ago • 7
Personalization as Inverse Planning: Learning Latent Design Intents for Agentic Slide Generation via Structural Denoising Paper • 2607.00407 • Published 22 days ago • 10
When LLMs Read Tables Carelessly: Measuring and Reducing Data Referencing Errors Paper • 2606.32029 • Published 23 days ago • 14
ABot-M0.5: Unified Mobility-and-Manipulation World Action Model Paper • 2607.00678 • Published 22 days ago • 20
Multimodal Continuous Reasoning via Asymmetric Mutual Variational Learning Paper • 2607.00461 • Published 22 days ago • 28