Explorar

Noticias de IA

29673 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
ClimAgent: LLM as Agents for Autonomous Open-ended Climate Science Analysis
arXiv cs.AI Research & Papers
To Use AI as Dice of Possibilities with Timing Computation
arXiv cs.AI Research & Papers
Counterfactual Trace Auditing of LLM Agent Skills
arXiv cs.AI Research & Papers
Regret-Based Federated Causal Discovery with Unknown Interventions
arXiv cs.AI Research & Papers
Agentic Physical AI toward a Domain-Specific Foundation Model for Energy Systems: A Case …
arXiv cs.AI Research & Papers
SAC-Opt: Semantic Anchors for Iterative Correction in Optimization Modeling
arXiv cs.AI Research & Papers
Breaking Information Cocoons: A Hyperbolic Framework for Balancing Exploration and Exploi…
arXiv cs.AI Research & Papers
Auto-Discovery-Bench: Diagnosing Structured State Tracking in Oracle-Guided Discovery
arXiv cs.AI Research & Papers
ReTabAD: A Benchmark for Restoring Semantic Context in Tabular Anomaly Detection
arXiv cs.AI Research & Papers
Who Gets Credit or Blame? Attributing Accountability in Modern AI Systems
arXiv cs.AI Research & Papers
Neuro-Symbolic Predictive Process Monitoring
arXiv cs.AI Research & Papers
Symbolic Intermediaries as a Linguistic-Numerical Interface for LLM-Driven Geometric Reas…
arXiv cs.AI Research & Papers
SHIELD: Secure Hypernetworks for Incremental Expansion Learning Defense
arXiv cs.AI Research & Papers
PictSure: Pretraining Embeddings Matters for In-Context Learning Image Classifiers
arXiv cs.AI Research & Papers
Target-Agnostic Calibration under Distribution Shift with Frequency-Aware Gradient Rectif…
arXiv cs.AI Research & Papers
Human Psychometric Questionnaires Mischaracterize LLM Behavior
arXiv cs.AI Research & Papers
LLM Bias Evaluation: Gender, Racial, and Age Disparities in Occupational and Crime Scenar…
arXiv cs.AI Research & Papers
OBCache: Optimal Brain KV Cache Pruning for Efficient Long-Context LLM Inference
arXiv cs.AI Research & Papers
SPECTRA: Synthetic IR Test Collections with Relevance Oracles and Controlled Distractor D…
arXiv cs.AI Research & Papers
Mechanistic Interpretability as Statistical Estimation: A Variance Analysis
arXiv cs.AI Research & Papers
Conditional Coverage Diagnostics for Conformal Prediction
arXiv cs.AI Research & Papers
SpectralTrain: A Universal Framework for Hyperspectral Image Classification
arXiv cs.AI Research & Papers
If LLMs Have Human-Like Attributes, Then So Does Age of Empires II
arXiv cs.AI Research & Papers
Bottom-up Policy Optimization: Your Language Model Policy Secretly Contains Internal Poli…
arXiv cs.AI Research & Papers
Scaling Conversational Hungarian ASR: The BEA-Dialogue+ Corpus
arXiv cs.AI Research & Papers
The Refutability Gap: Challenges in Validating Reasoning by Large Language Models
arXiv cs.AI Research & Papers
Decouple Searching from Training: Scaling Data Mixing via Model Merging for Large Languag…
arXiv cs.AI Research & Papers
Gap-K%: Measuring Top-1 Prediction Gap for Detecting Pretraining Data
arXiv cs.AI Research & Papers
Pull Requests as a Training Signal for Repo-Level Code Editing
arXiv cs.AI Security & Safety
CVE-Factory: Scaling Expert-Level Agentic Tasks for Code Security Vulnerability