Explorar

Noticias de IA

27413 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Routing by Reasoning Need: Trajectory-Aware Decoding Control for Diffusion Vision-Languag…
arXiv cs.AI Research & Papers
Bio-inspired Learning and Decision-Making with Probabilistic In-Memory Computing Hardware…
arXiv cs.AI Research & Papers
Off-Target Effects of Response-Style Alignment in a Korean 27B Language Model
arXiv cs.AI Research & Papers
Predicting Train Delays in Finland Using Machine Learning and Weather Data
arXiv cs.AI Research & Papers
AI-Powered Flare Combustion Efficiency Estimation
arXiv cs.AI Research & Papers
Counterfactual Marginalisation: Framework for Evaluating Robustness to Nuisance Variables
arXiv cs.AI Research & Papers
The Oligarch Barely Steers Model Collapse in Multi-Model Ecosystems
arXiv cs.AI Research & Papers
Benchmark Radar: A Living Database and Search Engine for AI Benchmarks and Evaluation
arXiv cs.AI Research & Papers
Breaking Predictions Is Not Enough: Specified-Foil Counterfactuals for Temporal Graphs
arXiv cs.AI Research & Papers
Can LLMs Follow Medical Expert Logic? A Benchmark for Hierarchical Logical Consistency in…
arXiv cs.AI Research & Papers
From Parameters to Answers: How LLMs Retrieve and Use Their Internal Knowledge
arXiv cs.AI Research & Papers
Are We Really Doing Few-Shot Learning? A Critical Examination of Pre-Training Assumptions
arXiv cs.AI Research & Papers
A Voice-Interactive Multi-Agent System for Smart Operating Rooms: Architecture Design and…
arXiv cs.AI Research & Papers
Geospatial AI, Dataverse Metadata, and the Study of Place-Based Government
arXiv cs.AI Research & Papers
Distributed Optimization of Modular Production Systems using Model-based Reinforcement Le…
arXiv cs.AI Research & Papers
SIRF: A Spec-Internalized Risk Foundation Model for Industrial Content Risk Control
arXiv cs.AI Research & Papers
A Unified Per-Token Gating Family for On-Policy Distillation: FKL/RKL Mixing with Multi-C…
arXiv cs.AI Research & Papers
Defining AI Agents: A Compendium of Criteria, Metrics, and Benchmarks
arXiv cs.AI Research & Papers
The Agent Incident Registry: Toward Preventing Repeated AI Agent Failures
arXiv cs.AI Research & Papers
Studying Without a Syllabus: Task-Agnostic Environment Preprocessing
arXiv cs.AI Research & Papers
Finishing the Task Is Not Enough: Evaluating Agent Resilience and Considerate Participati…
arXiv cs.AI Research & Papers
When Validation Stops Learning: Auditing Update Admission for Continual Embodied Agents
arXiv cs.AI Research & Papers
Characterizing Job Power Elasticity for Power-Flexible AI Training
arXiv cs.AI Research & Papers
GitSkills: A Dataset of Agent Skills on GitHub
arXiv cs.AI Research & Papers
Continuous Diffusion Scales Competitively with Discrete Diffusion for Language
arXiv cs.AI Research & Papers
Automating Quadratic Unconstrained Binary Optimization (QUBO) Formulation Generation from…
arXiv cs.AI Research & Papers
Understanding LoRA Rank Trade-offs in Diffusion Model Fine-Tuning
arXiv cs.AI Research & Papers
On the Regularization Landscape for the Linear Recommendation Models
arXiv cs.AI Research & Papers
Monotone Neural Policy Iteration for High-Dimensional First-Order Hamilton--Jacobi--Bellm…
arXiv cs.AI Research & Papers
Analyzing LLM Reasoning to Uncover Mental Health Stigma