Explorar

Noticias de IA

21863 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Hedge-Bench: Benchmarking Agents on Hard, Realistic Tasks Pertaining to Financial Reasoni…
arXiv cs.AI Research & Papers
GRZO: Group-Relative Zeroth-Order Optimization for Large Language Model Fine-Tuning
arXiv cs.AI Research & Papers
Adaptive Latent Agentic Reasoning
arXiv cs.AI Research & Papers
Local Guidance, Global Impact: Gaussian-Reshaped Trust Region Unlocks Behavior Transitions
arXiv cs.AI Research & Papers
A Training-Free Mixture-of-Agents Framework for Multi-Document Summarization using LLMs a…
arXiv cs.AI Research & Papers
WRIT: Write-Read Intensive Trajectory Synthesis for Multi-Turn User-Facing Agents
arXiv cs.AI Research & Papers
SCOPE: Real-Time Natural Language Camera Agent at the Edge
arXiv cs.AI Research & Papers
Perceive Before Reasoning: A Pre-Reasoning Perception Framework for Efficient and Reliabl…
arXiv cs.AI Research & Papers
See Less, Specify More: Visual Evidence Budgets for Generalizable VLAs
arXiv cs.AI Research & Papers
MedCUA-Bench: A Screenshot-Only Benchmark for Clinical Computer-Use Agents
arXiv cs.AI Research & Papers
A Negative Result on Cross-Model Activation Transfer in a Pythia Multi-Hop Setting
arXiv cs.AI Research & Papers
Towards Non-Monotonic Entailment in Propositional Defeasible Standpoint Logic
arXiv cs.AI Research & Papers
OpenAgenet/OAN: Open Infrastructure for Trusted Agent Interconnection
arXiv cs.AI Research & Papers
TSQAgent: Rating Time Series Data Quality via Dedicated Agentic Reasoning
arXiv cs.AI Research & Papers
Code-on-Graph: Iterative Programmatic Reasoning via Large Language Models on Knowledge Gr…
arXiv cs.AI Research & Papers
Enhancing Operational Safety via Agentic Dialogue Hazard Identification Analysis
arXiv cs.AI Research & Papers
EntangleCodec: A Unified Discrete Audio Tokenizer via Semantic-Acoustic Entanglement
arXiv cs.AI Research & Papers
Oscillatory State-Space Models as Inductive Biases for Physics-Informed Neural PDE Solvers
arXiv cs.AI Research & Papers
Aletheia: What Makes RLVR For Code Verifiers Tick?
arXiv cs.AI Research & Papers
Geometry-Aware Tabular Diffusion
arXiv cs.AI Research & Papers
ConTraIRL: Factorized Contrastive Abstractions for Transferable IRL
arXiv cs.AI Research & Papers
Uncertainty-Aware Clarification in LLM Agents with Information Gain
arXiv cs.AI Research & Papers
Distribution-Calibrated Inference Time Compute for Thinking LLM-as-a-Judge
arXiv cs.AI Research & Papers
Leave it to the Specialist: Repair Sparse LLMs with Sparse Fine-Tuning via Sparsity Evolu…
arXiv cs.AI Research & Papers
A Close Look At World Model Recovery In Supervised Fine-Tuned LLM Planners
arXiv cs.AI Research & Papers
The Agent's First Day: Benchmarking Learning, Exploration, and Scheduling in the Workplac…
arXiv cs.AI Research & Papers
DTKG: Dual-Track Knowledge Graph-Verified Reasoning Framework for Multi-Hop QA
arXiv cs.AI Research & Papers
Brief Announcement: Generative Markov Model for Distributed Computing Systems
arXiv cs.AI Research & Papers
AdapShot: Adaptive Many-Shot In-Context Learning with Semantic-Aware KV Cache Reuse
arXiv cs.AI Research & Papers
EqGINO: Equivariant Geometry-Informed Fourier Neural Operators for 3D PDEs