Explorar

Noticias de IA

30294 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Post-Hoc Merging is Not Enough: Many-Shot Model Merging with Loss-Gap Balancing
arXiv cs.AI Research & Papers
Tensor-Coord: Algebraic Decomposition of Joint Plan Tensors for Conflict-Free Multi-Agent…
arXiv cs.AI Research & Papers
When Agent Automation Becomes Profitable: Quantifying and Insuring Autonomous AI Risk thr…
arXiv cs.AI Research & Papers
Posterior Twins: Distributional Behavioral Simulation for Enterprise Decisions
arXiv cs.AI Research & Papers
Whose hotel does the AI recommend? An algorithm audit of reputation signals in LLM-assist…
arXiv cs.AI Research & Papers
Limited Marginal Benefit of Reasoning-Heavy LLM Deployment in ESG Narrative Scoring: A 4-…
arXiv cs.AI Research & Papers
Exploiting Search in Symbolic Numeric Planning with Patterns
arXiv cs.AI Research & Papers
AdaSTORM: Scaling LLM Reasoning on Dynamic Graphs via Adaptive Spatio-Temporal Multi-Agen…
arXiv cs.AI Research & Papers
Architectural Wisdom: A Framework for Governing Optimization in AI Systems
arXiv cs.AI Research & Papers
SpecAlign: Efficient Specification-Grounded Alignment of Large Language Models via Synthe…
arXiv cs.AI Research & Papers
Latent Thought Flow: Efficient Latent Reasoning in Large Language Models
arXiv cs.AI Research & Papers
Sensor-Conditioned Representation Learning via Scene-Relevant Observation Quotients
arXiv cs.AI Research & Papers
Measuring Whether LLM Tutors Teach or Solve: A Diagnostic for Educational Impact
arXiv cs.AI Research & Papers
PAL-Bench: Evidence-Grounded Profile Reconstruction from Longitudinal Personal Albums
arXiv cs.AI Research & Papers
TimeVista: Exploring and Exploiting Vision-Language Models as Judges for Time Series Fore…
arXiv cs.AI Research & Papers
AI Pluralism and the Worlds It Misses
arXiv cs.AI Research & Papers
The Quality-Utility Paradox: Why High-Reward Data Impairs Small Model Mathematical Reason…
arXiv cs.AI Research & Papers
Symbolic Informalization: Fluent, Productive, Multilingual
arXiv cs.AI Research & Papers
GIST-CMTF: Goal-State Inference for Causal Minimal Tool Filtering in LLM Agents
arXiv cs.AI Research & Papers
LabOSBench: Benchmarking Computer Use Agents for Scientific Instrument Control
arXiv cs.AI Research & Papers
ACC: Compiling Agent Trajectories for Long-Context Training
arXiv cs.AI Research & Papers
OpenClaw-Skill: Collective Skill Tree Search for Agentic Large Language Models
arXiv cs.AI Research & Papers
A First-Principles Derivation of LLM Policy Optimization: From Expected Reward to GRPO an…
arXiv cs.AI Research & Papers
AgentFairBench: Do LLM Agents Discriminate When They Act?
arXiv cs.AI Research & Papers
From Affect Prediction to Affect Forecasting: Evidence for Distinct Information Sources i…
arXiv cs.AI Research & Papers
MR-GVNO: A Geometry-Aware Variational Physics-Informed Neural Operator for Mindlin-Reissn…
arXiv cs.AI Research & Papers
CoffeeBench: Benchmarking Long-Horizon LLM Agents in Heterogeneous Multi-Agent Economies
arXiv cs.AI Research & Papers
Fusion is not one-size-fits-all: Cross-Modal Representation Alignment for Time-to-Event M…
arXiv cs.AI Research & Papers
OSGuard: A Benchmark for Safety in Computer-Use Agents
arXiv cs.AI Research & Papers
Metric Match: A Subset Selection Approach to Evaluating LLM Judge Reliability