Diagnosing Failure Modes of Shared-State Collaboration in Resource-Constrained Visual Age…
Explorar
Noticias de IA
30288 elementos — filtrados, clasificados y sin duplicados
Industrializing Prediction-Powered Inference: The GLIDE Library for Reliable GenAI and Ag…
Distilling LLM Feedback for Lean Theorem Proving
GaMi: Geometry-Agnostic Material Identification via Cross-Modal Subtractive Disentangleme…
CobSeg: Coherence Boundary Modeling for Dialogue Topic Segmentation
COMPASS: Cognitive MCTS-Guided Process Alignment for Safe Search Agents
Human-Alignment and Calibration of Inference-Time Uncertainty in Large Language Models
SLAT: Segment-Level Adaptive Trimming for Efficient CoT Reasoning
Structure-Induced Information for Rerooting Levin Tree Search
Sophrosyne: Agentic Exploration of Relational Data Systems Needs Moderation
XOResNet: Exclusive-OR Meta-Residuals Facilitate Deep Spiking Neural Networks Learning
Safe Equilibrium Policy Optimization for Strategic Agent Policies
Uncertainty-Aware and Temporally Regulated Expert Advice in Reinforcement Learning for Au…
GraphARC: A Comprehensive Benchmark for Graph-Based Abstract Reasoning
Physically Viable World Models: A Case for Query-Conditioned Embodied AI
BilliardPhys-Bench: Benchmarking Physical Reasoning and Visual Dynamics of Multimodal LLMs
NGDBench: Towards Neural Graph Data Management
From Leaky Thoughts to Private Reasoning: Controlling What LRMs Say to Themselves
The Global Landscape of Environmental AI Regulation: From the Cost of Reasoning to a Righ…
Position: Evaluation of ECG Representations Must Be Fixed
DTBench: A Synthetic Benchmark for Document-to-Table Extraction
HiPER: Hierarchical Reinforcement Learning with Explicit Credit Assignment for Large Lang…
Not All Synthetic Data Is Yours to Learn From
A Behavioural and Representational Evaluation of Goal-Directedness in Language Model Agen…
NEMO: Execution-Aware Optimization Modeling via Autonomous Coding Agents
Effective Reasoning Chains Reduce Intrinsic Dimensionality
Breaking the Simplification Bottleneck in Amortized Neural Symbolic Regression
Fine-Tuning Improves Information Conveyance in Language Models
Stop the Flip-Flop: Context-Preserving Verification for Fast Revocable Diffusion Decoding
An Odd Estimator for Shapley Values