Explorar

Noticias de IA

30288 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Diagnosing Failure Modes of Shared-State Collaboration in Resource-Constrained Visual Age…
arXiv cs.AI Research & Papers
Industrializing Prediction-Powered Inference: The GLIDE Library for Reliable GenAI and Ag…
arXiv cs.AI Research & Papers
Distilling LLM Feedback for Lean Theorem Proving
arXiv cs.AI Research & Papers
GaMi: Geometry-Agnostic Material Identification via Cross-Modal Subtractive Disentangleme…
arXiv cs.AI Research & Papers
CobSeg: Coherence Boundary Modeling for Dialogue Topic Segmentation
arXiv cs.AI Research & Papers
COMPASS: Cognitive MCTS-Guided Process Alignment for Safe Search Agents
arXiv cs.AI Research & Papers
Human-Alignment and Calibration of Inference-Time Uncertainty in Large Language Models
arXiv cs.AI Research & Papers
SLAT: Segment-Level Adaptive Trimming for Efficient CoT Reasoning
arXiv cs.AI Research & Papers
Structure-Induced Information for Rerooting Levin Tree Search
arXiv cs.AI Research & Papers
Sophrosyne: Agentic Exploration of Relational Data Systems Needs Moderation
arXiv cs.AI Research & Papers
XOResNet: Exclusive-OR Meta-Residuals Facilitate Deep Spiking Neural Networks Learning
arXiv cs.AI Research & Papers
Safe Equilibrium Policy Optimization for Strategic Agent Policies
arXiv cs.AI Research & Papers
Uncertainty-Aware and Temporally Regulated Expert Advice in Reinforcement Learning for Au…
arXiv cs.AI Research & Papers
GraphARC: A Comprehensive Benchmark for Graph-Based Abstract Reasoning
arXiv cs.AI Research & Papers
Physically Viable World Models: A Case for Query-Conditioned Embodied AI
arXiv cs.AI Research & Papers
BilliardPhys-Bench: Benchmarking Physical Reasoning and Visual Dynamics of Multimodal LLMs
arXiv cs.AI Research & Papers
NGDBench: Towards Neural Graph Data Management
arXiv cs.AI Security & Safety
From Leaky Thoughts to Private Reasoning: Controlling What LRMs Say to Themselves
arXiv cs.AI Policy & Regulation
The Global Landscape of Environmental AI Regulation: From the Cost of Reasoning to a Righ…
arXiv cs.AI Research & Papers
Position: Evaluation of ECG Representations Must Be Fixed
arXiv cs.AI Research & Papers
DTBench: A Synthetic Benchmark for Document-to-Table Extraction
arXiv cs.AI Research & Papers
HiPER: Hierarchical Reinforcement Learning with Explicit Credit Assignment for Large Lang…
arXiv cs.AI Research & Papers
Not All Synthetic Data Is Yours to Learn From
arXiv cs.AI Research & Papers
A Behavioural and Representational Evaluation of Goal-Directedness in Language Model Agen…
arXiv cs.AI Research & Papers
NEMO: Execution-Aware Optimization Modeling via Autonomous Coding Agents
arXiv cs.AI Research & Papers
Effective Reasoning Chains Reduce Intrinsic Dimensionality
arXiv cs.AI Research & Papers
Breaking the Simplification Bottleneck in Amortized Neural Symbolic Regression
arXiv cs.AI Research & Papers
Fine-Tuning Improves Information Conveyance in Language Models
arXiv cs.AI Research & Papers
Stop the Flip-Flop: Context-Preserving Verification for Fast Revocable Diffusion Decoding
arXiv cs.AI Research & Papers
An Odd Estimator for Shapley Values