Explorar

Noticias de IA

21863 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
A Unified Geometric Space for Topological Alignment Between Transformer-Based Models and …
arXiv cs.AI Research & Papers
CoRe-MoE: Contrastive Reweighted Mixture of Experts for Multi-Terrain Humanoid Locomotion…
arXiv cs.AI Research & Papers
A Goal-Set Characterization of Task Composition in the Boolean Task Algebra
arXiv cs.AI Research & Papers
Beyond Pixel Histories: World Models with Persistent 3D State
arXiv cs.AI Research & Papers
A Geometric Characterization of the Stationary Plateau for Two-Layer Neural Networks
arXiv cs.AI Research & Papers
Uncertainty Estimation using Variance-Gated Distributions
arXiv cs.AI Research & Papers
Bilevel Autoresearch: Meta-Autoresearching Itself
arXiv cs.AI Research & Papers
Who Needs Labels? Adapting Vision Foundation Models With the Metadata You Already Have
arXiv cs.AI Research & Papers
UniCAD: A Unified Benchmark and Universal Model for Multi-Modal Multi-Task CAD
arXiv cs.AI Research & Papers
BioBlue: Systematic runaway-optimiser-like LLM failure modes on biologically and economic…
arXiv cs.AI Research & Papers
Tree-Based Formalization of Multi-Agent Complementarity in Human-AI Interactions
arXiv cs.AI Research & Papers
Multi-Granularity 3D Kidney Lesion Characterization from CT Volumes
arXiv cs.AI Research & Papers
MM-BizRAG: Rethinking Multimodal Retrieval-Augmented Generation for General Purpose Enter…
arXiv cs.AI Research & Papers
Self-Reflective APIs: Structure Beats Verbosity for AI Agent Recovery
arXiv cs.AI Research & Papers
SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimiza…
arXiv cs.AI Research & Papers
Semiparametric Preference Optimization: Your Language Model is Secretly a Single-Index Mo…
arXiv cs.AI Research & Papers
Incremental Sheaf Cohomology on Cellular Complexes: O(1)-in-n Lazy Edit Processing under …
arXiv cs.AI Research & Papers
Model-Preserving Adaptive Rounding
arXiv cs.AI Research & Papers
DAR: Deontic Reasoning with Agentic Harnesses
arXiv cs.AI Research & Papers
100-LongBench: Are de facto Long-Context Benchmarks Literally Evaluating Long-Context Abi…
arXiv cs.AI Research & Papers
Value Entanglement: Conflation Between Different Kinds of Good In (Some) Large Language M…
arXiv cs.AI Research & Papers
From Agent Traces to Trust: Evidence Tracing and Execution Provenance in LLM Agents
arXiv cs.AI Research & Papers
Plan, Watch, Recover: A Benchmark and Architectures for Proactive Procedural Assistance
arXiv cs.AI Research & Papers
SharedRequest: Privacy-Preserving Model-Agnostic Inference for Large Language Models
arXiv cs.AI Research & Papers
Characterizing initial human-AI proof formalization workflows
arXiv cs.AI Research & Papers
ChatSOP: An SOP-Guided MCTS Planning Framework for Controllable LLM Dialogue Agents
arXiv cs.AI Research & Papers
Not All Errors Are Equal: Consequence-Aware Reasoning Compute Allocation
arXiv cs.AI Research & Papers
Belief-Aware VLM Model for Human-like Reasoning
arXiv cs.AI Research & Papers
Bounded Hyperbolic Tangent: A Stable and Efficient Alternative to Pre-Layer Normalization…
arXiv cs.AI Research & Papers
Expectations vs. Realities: The Cost of MSE-Optimal Forecasting Under Conditional Uncerta…