AgentMisalignment: Measuring the Propensity for Misaligned Behaviour in LLM-Based Agents
Explorar
Noticias de IA
22318 elementos — filtrados, clasificados y sin duplicados
Autonomous and Self-Adapting System for Synthetic Media Detection and Attribution
FairSAM: Fair Classification on Corrupted Image Data Through Sharpness-Aware Minimization
ACTIVA: Amortized Causal Effect Estimation via Transformer-based Variational Autoencoder
GAPartManip: A Large-scale Part-centric Dataset for Material-Agnostic Articulated Object …
Measuring Human Contribution in AI-Assisted Content Generation
Enhancing Cognitive Workload Classification Using Integrated LSTM Layers and CNNs for fNI…
Transcribing Bengali Text with Regional Dialects to IPA using District Guided Tokens
Are LLMs Effective Negotiators? Systematic Evaluation of the Multifaceted Capabilities of…
Semantic Browsing: Controllable Diversity for Image Generation
AIR: Adaptive Interleaved Reasoning with Code in MLLMs
Open Problem: Is AdamW Effective Under Heavy-Tailed Noise?
Learning Process Rewards via Success Visitation Matching for Efficient RL
DiT-Reward: Generative Representations for Text-to-Image Reward Modeling
Data Selection Through Iterative Self-Filtering for Vision-Language Settings
LemmaBench: A Live, Research-Level Benchmark to Evaluate LLM Capabilities in Mathematics
Learning More from Less: Unlocking Internal Representations for Benchmark Compression
Scheduling Thoughts: Learning the Order of Thought in Diffusion Language Models
SQLConductor: Search-to-Policy Learning for Step-wise Text-to-SQL Orchestration
DVL-DeepONet: A Physics-Guided Operator Learning for Resilient Underwater Navigation
What Does a Chemical Language Model Know About Molecules?
Rethinking Object-Centric Representations for Video Dynamics Modeling
GRINQH: Graded Input-based Quantization Hierarchy for Efficient LLM Generation
Distribution-Aware Diffusion-LLM for Robust Ultra-Long-Term Time Series Forecasting
A Neural Operator-Based Approach to Symbolic Discovery of PDEs
Emergent Communication in Continuous Worlds: Self-Organisation of Conceptually Grounded V…
A criterion for Artificial General Intelligence: hypothetic-deductive reasoning, tested o…
The Correct Answer Trap: Pedagogically-Grounded Detection and Feedback for Hidden Misconc…
When Does Intrinsic Self-Correction Help? A Task-Sensitive Analysis
Interpretable Probabilistic Medical Image Segmentation via Gaussian Process with Explicit…