Deceptive Grounding: Entity Attribution Failure in Clinical Retrieval-Augmented Generation
Explorar
Noticias de IA
30934 elementos — filtrados, clasificados y sin duplicados
WILDTRACE: Benchmarking Natural Evidence Trails in Long-Context Reasoning
Letting the Data Speak: Extracting Keywords from Crowdsourced Collections with AI
Automatic Thematic Indexing of Large Literary Corpora: A Machine Learning Approach to Vol…
Creativity, honesty and designed forgetting emerge in small hyperbolic language models
Risk-Aware General-Utility Markov Decision Processes
Fictional Worldbuilding: Multi-Agent LLM Collaboration with Hierarchical Context Compress…
TrustX Agent Risk Classification Framework (ARC): Risk-Tiering Internally Created Agentic…
How Does Bayesian Causal Discovery Fail? Characterising Structural Consequences in Linear…
Blockchain-Linked Auditable Decision Management for Telecom/IoT Fraud-Control Requests
LLMs for health: Perceived benefits, risks, intention to use AI chatbots, and willingness…
ProofCouncil: An LLM Agent for Solving Open Mathematical Problems
L-MAD: A Systematic Evaluation of Multi-Agent Debate Structures in Legal Reasoning
All you need is SAMPAT
Git-Assistant: Planning-Based Support for Updating Git Repositories
Generative Communications: Overview, Technologies, and Trends
A Personalized Computational Framework for Assessing the Sufficiency of Partially Observe…
Embodied Multi-Agent Coordination by Aligning World Models Through Dialogue
IB-Flow: Information Bottleneck-Guided CFG Distillation for Few-Step Text-to-Image Genera…
Scoped Verification for Reliable Long-Horizon Agentic Context Evolution under Distributio…
Event Stream based Multi-Modal Video Anomaly Detection: A Benchmark Dataset and Algorithms
Integrating Large Language Models and Graph Convolutional Networks for Semi-Supervised Im…
Beyond Metadata: CAPRA for Hidden Subgroup Analysis under Missing Metadata in Medical Ima…
Beyond Fixed Representations: The Vocabulary and Verifier Gaps in Open-Ended AI
SAGEAgent: A Self-Evolving Agent for Cost-Aware Modality Acquisition in Multimodal Surviv…
H3Former: Hypergraph-based Semantic-Aware Aggregation via Hyperbolic Hierarchical Contras…
OmniMapBench: Benchmarking Visual-Centric Reasoning on Diverse Map Documents
Inside the Skill Market: From Software Engineering Activities to Reusable Agent Skills
CLAP: Direct VLM-to-VLA Adaptation via Language-Action Grounding
SCATE: Learning to Supervise Coding Agents for Cost-Effective Test Generation