Auditory Illusion Benchmark for Large Audio Language Models
Explorar
Noticias de IA
27413 elementos — filtrados, clasificados y sin duplicados
SkillGLoW: Procedural-Family Skill Consolidation for Self-Improving Agents on Long-Horizo…
Dutch Books for Language Models
Examining the Vulnerability of Multi-Agent Medical Systems to Human Interventions for Cli…
READY or Not: Reliable Enterprise Agent Deployment
Beyond Context Windows: Persistent Discovery Context for Data-Centric Agents
Post-Training Language Models for Gold-Medal Performance in Coding Competitions
LoRA-GA$^2$: Low Rank Adaptation with Multi-step Gradient Adaptive Alignment
General Demographic Pre-trained Models for Enhancing Predictive Performance Across Diseas…
No Data Wasted: A Semi-supervised Generative Model for Incomplete Multi-view Data Integra…
FUSE: An Evaluating Framework for Dangerous Capabilities of LLMs
Automated Vulnerability Injection in Smart Contracts Using Large Language Models
ProbeMatchDTI: Probe-Driven Multi-Scale Biochemical Pattern Matching for Drug-Target Inte…
Fine-Grained Anomaly Perception in Wild UGC-Enhanced Images: A Comprehensive Dataset and …
Evidence for Shared Routing Geometry and Dynamics in Sparse Mixture-of-Experts
Competitive Market Behavior of LLMs
Learn from Whoever Is Right: Answer-Verified Multi-Teacher Distillation for Multi-Domain …
PaperCompiler: Faithful Paper-to-Code Generation via Repository-Level Specification Compi…
CrashDiffuser: VLM-Guided Collision Intent Reasoning for Fine-Grained Safety-Critical Tra…
DocHop: Benchmarking Out-of-domain Multi-hop Reasoning in Information-Dense Documents
PolERo: Studying Political Evasion in Romanian
MultiGhostBench: A Multilingual Benchmark for Long-Form LLM-Generated Text Attribution un…
DiffuSearch: How Hybrid Trajectory Planning Benefits from Aligned Objectives in Diffusion…
Do Large Language Models Capture the Diversity in their Training Data?
Retrosynthesis of Synthetic Media for Explainable AI Provenance Forensics
ToolGate: An Executable Acceptance Pipeline for Tool-Dependent Scientific Benchmark Const…
Before the Script, Set the Stage: How Worldview Simulation Amplifies Psychologically Grou…
Spectral Initialization and Scheduled Graph Smoothness for Uncertain Knowledge Graph Comp…
Percolation Dynamics in Optimization : Variance Cascades and Discrete Scale Invariance
NE-R1: Enhancing Named Entity Recognition Model via Reinforcement Learning