Explorar

Noticias de IA

37834 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
The Geometry of Ignorance: LLMs Know When to Temper Bayesian Priors
arXiv cs.AI Research & Papers
StrixAE: An Intelligent Agent for Audio Enhancement under Complex Distortion Coupling in …
arXiv cs.AI Research & Papers
Judging LLM-as-a-Judge: Concerning Rubric Artifacts in LLM-based Automated Text Generatio…
arXiv cs.AI Research & Papers
Reflect-SQL: A Self-Reflection Based Framework for Text-to-SQL
arXiv cs.AI Research & Papers
X-Translator: A Real-Time Multilingual Speaker-Aware Speech-to-Speech Translation System
arXiv cs.AI Research & Papers
ExecRetrieval: Measuring the Functional-Correctness Gap in Code-Embedding Retrieval
arXiv cs.AI Research & Papers
Counterexamples as Feedback for Agent Self-Correction
arXiv cs.AI Research & Papers
A Computationally Feasible Framework for Causal Probabilistic Explanation
arXiv cs.AI Research & Papers
Clean Engineering, Unstable Measurement: A Preregistered Reliability Failure of Black-Box…
arXiv cs.AI Research & Papers
Representational alignment yields generalizable safety in language models
arXiv cs.AI Research & Papers
From Deceptive Outputs to Deceptive Mechanisms: A Causal Framework for Language-Model Dec…
arXiv cs.AI Research & Papers
Seeing Before Synthesizing: VLM-Guided Transition Event Discovery for Weakly-Supervised D…
arXiv cs.AI Research & Papers
Epistemic Warrant for LLM Recommendations: Characterizing the Basis for Reliance When Gro…
arXiv cs.AI Research & Papers
Why Gated DeltaNet Survives 4-Bit Quantization: NVFP4 W4A4 for the Recurrent Half of a Hy…
arXiv cs.AI Research & Papers
Instruction Duplication as an Inference-Time Control Primitive
arXiv cs.AI Research & Papers
Environment Evolution for Terminal Agents
arXiv cs.AI Research & Papers
Spurious Advantage Hidden in GRPO
arXiv cs.AI Research & Papers
ESPO: Error-Structured Prompt Optimization via Diagnose, Diversify, and Stabilize
arXiv cs.AI Research & Papers
The Dually Flat Geometry of Planning as Inference
arXiv cs.AI Research & Papers
Common-Witness Certificates and Sharp Feature Bounds for Counterfactual Image Auditing
arXiv cs.AI Research & Papers
InSituMeasure: Probing Situated Measurement Grounding in Industrial Scenes with Multimoda…
arXiv cs.AI Research & Papers
Interface-Induced Trajectory Censoring
arXiv cs.AI Research & Papers
FLY-EVAL++: An Evidence-Driven Evaluation Protocol for Safety-Constrained Flight Predicti…
arXiv cs.AI Research & Papers
Lose the Order, Keep the Hierarchy: Deordering HTN Plans
arXiv cs.AI Research & Papers
Bioinfoysis Technical Report
arXiv cs.AI Research & Papers
STAIR (STructure Aware Information Retriever): A novel dataset and LLM based retriever fo…
arXiv cs.AI Research & Papers
Adapting to Evolving Requirements: Agentic AI for Retail Supply Chain Operations
arXiv cs.AI Research & Papers
SVG-Score: Human-Aligned Evaluation of Text-to-SVG Generation
arXiv cs.AI Research & Papers
CauseCollab: Causal Unified and Modality-Agnostic Network for Heterogeneous Collaborative…
arXiv cs.AI Research & Papers
Speak for Me: Giving LLMs the Situational Awareness to Participate in a Meeting