Certifiable Safe RLHF: Semantic Grounding and Fixed Penalty Constraint Optimization for S…
Explorar
Noticias de IA
29673 elementos — filtrados, clasificados y sin duplicados
When Researchers Say Mental Model/Theory of Mind of AI, What Are They Really Talking Abou…
Architecture-Aware Reinforcement Learning Makes Sliding-Window Attention Competitive in M…
Synthetic Homes: A Multimodal Generative AI Pipeline for Residential Building Data Genera…
Offline Diffusion Policy for Multi-User Delay-Constrained Scheduling
Improving Generalization and Data Efficiency with Diffusion in Offline Multi-agent RL
FACTR 2: Learning External Force Sensing for Commodity Robot Arms Improves Policy Learning
DIRECT: When and Where Should You Allocate Test-Time Compute in Embodied Planners?
Redesign Mixture-of-Experts Routers with Manifold Power Iteration
System Report for CCL25-Eval Task 5: New Dataset and LoRA-Fine-Tuned Qwen2.5
TAHOE: Text-to-SQL with Automated Hint Optimization from Experience
ATLAS: Active Theory Learning for Automated Science
Illumination-Robust Camera-Based Heart-Rate Estimation for Physiological Sensing in Robots
Ambient Diffusion Policy: Imitation Learning from Suboptimal Data in Robotics
Latent World Recovery for Multimodal Learning with Missing Modalities
CHORUS: Decentralized Multi-Embodiment Collaboration with One VLA Policy
CCKS: Consensus-based Communication and Knowledge Sharing
Mathematical perspective on genetic algorithms with optimization guided operators
Market Design for AI: Beyond the Copyright Binary
Using Explainability as a Training-Time Reliability Signal for Efficient ECG Classificati…
VIA-SD: Verification via Intra-Model Routing for Speculative Decoding
Anthropic’s Dario Amodei has just one direct report
[AINews] Open Models, Model Labs vs Agent Labs, and What's Untrainable — Sarah Guo
Interpretable Factor Decomposition for Decision Intelligence in Large-Scale Financial Mar…
Anthropic Walks Back Policy That Could Have ‘Sabotaged’ AI Researchers Using Claude
CLARITree: Cholesky and Lookahead Accelerations for Regression with Interpretable Piecewi…
Graph Reinforcement Learning for Calibration-Aware Quantum Circuit Routing
South Korea Fines Coupang Record $409 Million for Data Leak
SymQNet: Amortized Acquisition for Low-Latency Adaptive Hamiltonian Learning
How frontier teams are reinventing AI-native development