Explorar

Noticias de IA

37834 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
The Invisible Editorial Layer: Formalizing Undisclosed Inference-Time Steering, Probabili…
arXiv cs.AI Research & Papers
Parason: Revealing Subtask and Trial Parallelism in LLM Reasoning
arXiv cs.AI Research & Papers
Neurosymbolic Alignment for Physiologically-Safe Clinical Language Models
arXiv cs.AI Research & Papers
HMGCLIP: Heterogeneous Multi-Granularity Contrastive Learning for E-commerce Representati…
arXiv cs.AI Research & Papers
PeakBench: Benchmarking Resource-Aware Tool Invocation in LLM Agents
arXiv cs.AI Research & Papers
Pivot-and-Station Multi-Agent Path Finding: Solvability, Complexity, and Algorithms
arXiv cs.AI Research & Papers
Partial Identification under Causal Orders by Linear Programming
arXiv cs.AI Research & Papers
Do Recipes Have Personas? Characterizing and Generating Creator Style in Attributed Proce…
arXiv cs.AI Research & Papers
A Human-Factors Guided Cognitive Model of Visuospatial Complexity in Embodied Active Visi…
arXiv cs.AI Research & Papers
CoMMa: Contribution-Aware Medical Multi-Agents for Decentralized Oncology Decision Support
arXiv cs.AI Research & Papers
Ensemble of Convolutional Neural Networks for StrokePrediction: Towards Improved Diagnost…
arXiv cs.AI Research & Papers
FedV-KGQA: Multi-Hop Question Answering over Vertically Partitioned Knowledge Graphs
arXiv cs.AI Research & Papers
Fidelity Preference, Not Demographic Preference: A Pixel-Level Attribute-Sensitivity Audi…
arXiv cs.AI Research & Papers
From State to Action: OODA-Tool for Reliable Multi-Turn Tool Use
arXiv cs.AI Research & Papers
Benchmarking LLM Judges for Voice-Agent Evaluation: Reliability, Calibration, and Human O…
arXiv cs.AI Research & Papers
Feedback That Backfires: Why Small Language Model Agents Repeat the Call They Just Watche…
arXiv cs.AI Research & Papers
Method, Mind, and Morality: How People Make Sense of Artificial Intelligence
arXiv cs.AI Research & Papers
Reinforcement Learning-Guided Evolutionary Policy Optimization for Preference-Adjustable …
arXiv cs.AI Research & Papers
ExPhy: A Benchmark for Explicit Physical Property Learning in Multi-Object Trajectory For…
arXiv cs.AI Research & Papers
Confidently Wrong, Silently So: Auditing Undetectable Failures of a Deployed On-Device La…
arXiv cs.AI Research & Papers
Implicit Q-learning-bootstrapped ant colony optimization for maritime moving-target obser…
arXiv cs.AI Research & Papers
ToolRobustBench: Stage-Wise Perturbation Evaluation and Failure Diagnosis for Tool-Callin…
arXiv cs.AI Research & Papers
ChorusTIC: Training-Free Multivariate Time Series Classification via Chorus In-Context Le…
arXiv cs.AI Research & Papers
PARTAB: Partition-Aware Reasoning with Structured Evidence for Scalable Table Understandi…
arXiv cs.AI Research & Papers
Identifying Latent Declarative Representations of Code for Assisting Repository Migration
arXiv cs.AI Research & Papers
StepGuard: Learning Step-Level Guardrails with Scalable Supervision and Safety-Utility Ba…
arXiv cs.AI Research & Papers
Strictly Causal Streaming Video Anomaly Detection with a Theoretically-Grounded State-Spa…
arXiv cs.AI Research & Papers
Rebuild Dossier: Mechanically-Enforced Specs for Agentic App Rebuilds, and What Model-Tie…
arXiv cs.AI Research & Papers
SonarLLM: A Native Sonar--Optical Multimodal Large Language Model for Underwater Percepti…
arXiv cs.AI Research & Papers
Adaptive Influence Graphs for Failure Attribution in Multi-Agent Systems