Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evid…
Explorar
Noticias de IA
27413 elementos — filtrados, clasificados y sin duplicados
Diagnostic Foundation for Evaluating LLMs' Research Integrity as Co-Scientists
Agreement Is Not Alignment: Divergent Moral Grounds in Human and LLM Ethical Judgments
FluctlightDB: A Memory Model of Data for AI Agents
Rethinking Normalization Placement for LLMs: Post-Norm under Curriculum Depth Growing
SkillShapley: Boundary-Adaptive Shapley Valuation for Skill Step Attribution in LLM Agents
TsuGO: Probing Search Efficiency in LLM Reasoning via Go Life-and-Death Problems
NAS-Driven Hardware Accelerator Exploration for Edge AI and Quantization Effects on the P…
Jointly Predicting Courses and Grades Using a Transformer-Based Model
Enhancing Virtual Agents through SLMs and Edge-Computing: An Exploratory Evaluation of Th…
MARC v1: An Open-Source Multi-Agent Framework for Clinical AI Reasoning and Coordination
Critic-Free Pretraining for Efficient Online Reinforcement Learning Fine-Tuning
Commit Locally, Exit Globally: Coordinating Adaptive Sampling and Early Exit in Diffusion…
Vibe to Code: Elucidating Strategic Oscillation of Tacit Knowledge in Generative AI Desig…
Early Warning Signals for OpenVLA Failure under Visual Distribution Shift
INSHAPE: Instance-Level Shapelets for Interpretable Time-Series Classification
Learning Latency-Aware Orchestration for Multi-Agent Systems
RadarGen: Automotive Radar Point Cloud Generation from Cameras
CityRiSE: Reasoning Urban Socio-Economic Status in Large Vision-Language Models via Reinf…
StarEmbed: Benchmarking Time Series Foundation Models on Astronomical Observations of Var…
REHEARSE: Experiential Rehearsal for Verbal Confidence Calibration in Large Language Mode…
AlayaWorld: Interactive Long-Horizon World Modeling - Full Technical Report (v1.1)
LLMs Know the Constraint But Do Not Use It: Activation Bottlenecks in Pragmatic Constrain…
Why Do AI Agents Break Rules? How Framing, Context, and Social Signals Shape Compliance
CRAFT: LLM-Based Iterative Refinement for Temporal Reasoning over Clinical Narratives
Can Generalist Vision Language Models (VLMs) Rival Specialist Medical VLMs? Benchmarking …
Are you Talking Logic to Me? Assessing Language Models Syllogistic Reasoning Capabilities
Query Timing Produces Opposite Positional Biases Between LLMs and Humans
SynWeaver: Website-Prior Task and Trajectory Co-Synthesis for Web Agents
How Significant Are the Real Performance Gains? An Unbiased Evaluation Framework for Grap…