AxQM: A Textbook-Scale Benchmark for Formal Proof Synthesis in a Library of Finite-Dimens…
Explorar
Noticias de IA
37834 elementos — filtrados, clasificados y sin duplicados
RoboSPA: Can VLA Models Go Beyond Simple Scenes and Short-Horizon Tasks?
A Human-in-the-Loop Framework for AI-Assisted Scoring in Large-Scale Writing Assessment
Beyond Co-purchase Relation: Evolution of Complementary Recommendations at Allegro
Beyond Stationarity in Time Series: Discovering Causal Structures and Latent Regimes via …
How a Chatbot's Response Style Shapes a Classroom: A Multi-Agent Simulation of Students C…
VICAL: Vicinal Consistency Alignment for Long-Tailed Visual Recognition
How do LLMs Evaluate Perceived Moral Agency? Investigating Moral Decision-Making in Human…
When LLM Decompilers Recompile More and Preserve Less
One Diffusion Model, Two Roles: Guided Trajectory Planning and Safety-Critical Scenario G…
Qlippy: A Retrieval-Augmented GenAI Assistant for Reproducible Quantum Workflows and Expe…
ARIA - An Agentic Framework for Autonomous Testing of Infotainment Systems
MCPO: Modality-Contrastive Preference Optimization for Multimodal Chain-of-Thought Compre…
Lightweight Vision Transformer Compression for On-Device Plant Disease Detection in Resou…
RefactorPlatform: An Open-Source Harness for Controlled Evaluation of Repository-Scale Re…
Adaptation Interfaces for In-Context Tabular Foundation Models in Time-to-Event Prediction
Sound-based Multi-Person 3D Pose Estimation
SimFuse3D: Source-Guided Target Simulation and Confidence-Guided Multi-Stage Localization…
Attention-guided super-resolution of 4D flow MRI in carotid arteries
TreeFI: Value-Aware Statistical Fault Injection for Deep Neural Networks
Reinforcement Learning for improving Large Language Models' Catalan text simplification c…
MABPD: Multi-Agent Bias Probing & Detection via Structured Argument Debate
Can Activation Steering Capture Multidimensional Authorship Style?
Cost-Aware Hierarchical Multi-Agent Ransomware Detection and Family Attribution
MMTClinic: Multimodal, Multilingual Time Series Question Answering and Reasoning Benchmar…
Persistent Teacher Anchoring for Tool-Using Agents
Building a research-software catalog with a coding agent: from hackathon prototype to pub…
Refuse without Refusal: A Structural Analysis of Safety-Tuning Responses for Reducing Fal…
Enhancing Multimodal Emotion Recognition via Multi-Feature Encoding and Attention-Based F…
Knowing What Not to Answer: Selective Non-Compliance in Vision-Language Models