Explorar

Noticias de IA

27413 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Topological Attribution Distance (TAD): Revealing Segment-Level RAG Influence on LLM Outp…
arXiv cs.AI Research & Papers
OGX: An Open-Source, Vendor-Neutral Generative AI Application Server
arXiv cs.AI Research & Papers
Toward Safe LLM Agents: A Survey of Specification, Verification, and Enforcement
arXiv cs.AI Research & Papers
Euclid-Omni : A Unified Neuro-Symbolic Framework for Plane Geometry
arXiv cs.AI Research & Papers
An Agentic Framework Using Rules and LLMs for Embedding and Annotating Descriptive Docume…
arXiv cs.AI Research & Papers
The Hallucination Snowball: Modeling Error Propagation as State Transitions in Multi-Agen…
arXiv cs.AI Research & Papers
When Do LLMs Apply the Wrong Law? Diagnosing LLM Failures in Temporal Legal Reasoning
arXiv cs.AI Research & Papers
Do LLM Agents Negotiate Rationally? A Mechanism-Design Framework for Verifiable Multi-Age…
arXiv cs.AI Research & Papers
Large Language Models and their Awareness of Mechanics and Spatial Geometry
arXiv cs.AI Research & Papers
A Human-Centred Approach to Benchmarking LLMs for Parenting Advice
arXiv cs.AI Research & Papers
Learning Agent Execution for KV-Cache Management in Agentic Serving
arXiv cs.AI Research & Papers
Task- and Session-Level Model Routing: A Common-Interface Hybrid Evaluation of Four Open-…
arXiv cs.AI Research & Papers
Accuracy and Reliability of Large Language Models in Cosmetic Chemistry and Skin Health: …
arXiv cs.AI Research & Papers
Evaluating Multimodal LLMs across Text and Audio Modalities for Accessible Disaster Assis…
arXiv cs.AI Research & Papers
When Uncertainty Isn't Enough: An Empirical Study of Self-Correction in Code Generation
arXiv cs.AI Research & Papers
Cross-Domain Industrial Fault Detection by Causal Mechanism Monitoring
arXiv cs.AI Research & Papers
Efficient Table QA via TableGrid Navigation and Progressive Inference Prompting
arXiv cs.AI Research & Papers
Path2ST: Hierarchical Cell-Tissue Grounded Cross-Modal Translation for Spatial Transcript…
arXiv cs.AI Research & Papers
Which Question Is Your Attention Metric Answering? Attention Rows as Compositional Data
arXiv cs.AI Research & Papers
DeCo-MIL: Debiased Counterfactual Reasoning for Long-Tailed Whole Slide Image Analysis
arXiv cs.AI Research & Papers
CoupVisor: Strategy Optimization by Round and Challenge Decision Support
arXiv cs.AI Research & Papers
Dear Algo: A Precision-First Agentic Intent Layer for Unified Search and Recommendation
arXiv cs.AI Research & Papers
Unified Pedestrian Path Prediction Using Inverse Reinforcement Learning
arXiv cs.AI Research & Papers
UI-Mate: Advancing Open-Weight Foundation GUI Agents with In-Context Demonstrations
arXiv cs.AI Research & Papers
Solvable Sokoban Without a Solver via Diffusion
arXiv cs.AI Research & Papers
ALPS: Measuring Valid Creativity in Large Language Models with Mathematical Construction
arXiv cs.AI Research & Papers
MUPA$^{2}$E: Multimodal Unified Perception with Asymmetric Attention for Emotion Assessme…
arXiv cs.AI Research & Papers
Prior Audit-Repair Context Shifts LLM Verifier Thresholds Toward Leniency
arXiv cs.AI Research & Papers
Governance at the Boundary: How Agent Decomposition Degrades Policy Compliance
arXiv cs.AI Research & Papers
Eigenanalysis framework for autoregressive neural emulators of multi-scale chaotic dynami…