Explorar

Noticias de IA

27413 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evid…
arXiv cs.AI Research & Papers
Diagnostic Foundation for Evaluating LLMs' Research Integrity as Co-Scientists
arXiv cs.AI Research & Papers
Agreement Is Not Alignment: Divergent Moral Grounds in Human and LLM Ethical Judgments
arXiv cs.AI Research & Papers
FluctlightDB: A Memory Model of Data for AI Agents
arXiv cs.AI Research & Papers
Rethinking Normalization Placement for LLMs: Post-Norm under Curriculum Depth Growing
arXiv cs.AI Research & Papers
SkillShapley: Boundary-Adaptive Shapley Valuation for Skill Step Attribution in LLM Agents
arXiv cs.AI Research & Papers
TsuGO: Probing Search Efficiency in LLM Reasoning via Go Life-and-Death Problems
arXiv cs.AI Research & Papers
NAS-Driven Hardware Accelerator Exploration for Edge AI and Quantization Effects on the P…
arXiv cs.AI Research & Papers
Jointly Predicting Courses and Grades Using a Transformer-Based Model
arXiv cs.AI Research & Papers
Enhancing Virtual Agents through SLMs and Edge-Computing: An Exploratory Evaluation of Th…
arXiv cs.AI Research & Papers
MARC v1: An Open-Source Multi-Agent Framework for Clinical AI Reasoning and Coordination
arXiv cs.AI Research & Papers
Critic-Free Pretraining for Efficient Online Reinforcement Learning Fine-Tuning
arXiv cs.AI Research & Papers
Commit Locally, Exit Globally: Coordinating Adaptive Sampling and Early Exit in Diffusion…
arXiv cs.AI Research & Papers
Vibe to Code: Elucidating Strategic Oscillation of Tacit Knowledge in Generative AI Desig…
arXiv cs.AI Research & Papers
Early Warning Signals for OpenVLA Failure under Visual Distribution Shift
arXiv cs.AI Research & Papers
INSHAPE: Instance-Level Shapelets for Interpretable Time-Series Classification
arXiv cs.AI Research & Papers
Learning Latency-Aware Orchestration for Multi-Agent Systems
arXiv cs.AI Research & Papers
RadarGen: Automotive Radar Point Cloud Generation from Cameras
arXiv cs.AI Research & Papers
CityRiSE: Reasoning Urban Socio-Economic Status in Large Vision-Language Models via Reinf…
arXiv cs.AI Research & Papers
StarEmbed: Benchmarking Time Series Foundation Models on Astronomical Observations of Var…
arXiv cs.AI Research & Papers
REHEARSE: Experiential Rehearsal for Verbal Confidence Calibration in Large Language Mode…
arXiv cs.AI Research & Papers
AlayaWorld: Interactive Long-Horizon World Modeling - Full Technical Report (v1.1)
arXiv cs.AI Research & Papers
LLMs Know the Constraint But Do Not Use It: Activation Bottlenecks in Pragmatic Constrain…
arXiv cs.AI Research & Papers
Why Do AI Agents Break Rules? How Framing, Context, and Social Signals Shape Compliance
arXiv cs.AI Research & Papers
CRAFT: LLM-Based Iterative Refinement for Temporal Reasoning over Clinical Narratives
arXiv cs.AI Research & Papers
Can Generalist Vision Language Models (VLMs) Rival Specialist Medical VLMs? Benchmarking …
arXiv cs.AI Research & Papers
Are you Talking Logic to Me? Assessing Language Models Syllogistic Reasoning Capabilities
arXiv cs.AI Research & Papers
Query Timing Produces Opposite Positional Biases Between LLMs and Humans
arXiv cs.AI Research & Papers
SynWeaver: Website-Prior Task and Trajectory Co-Synthesis for Web Agents
arXiv cs.AI Research & Papers
How Significant Are the Real Performance Gains? An Unbiased Evaluation Framework for Grap…