Local verification cannot detect non-transportability: a cohomological theory of context …
Explorar
Noticias de IA
29343 elementos — filtrados, clasificados y sin duplicados
Deployment Decision Reliability: A Generalizability-Theory Framework for Sizing Long-Hori…
Is Per-Agent Policy Composition Safe? Rethinking Successor-Feature Transfer in Cooperativ…
Hybrid-Policy Self-Editing for Composable Unstructured Knowledge Editing
Physics-Informed Implicit Neural Representations for Improved Myocardial Perfusion MRI Qu…
Who Thinks Best Depends on How Long You Let Them: Budget-Dependent Rankings in LLM Evalua…
Low-Interaction-Rank Learning: Unifying Multiplicative Dual-Encoder Heads
Towards the Harness of Embodied Agents
Confidence Calibration of Deep Learning Systems
Reference-Free Post-Training of Open Large Language Models for Multilingual Machine Trans…
One Frozen Simulator Is Not Enough: Simulator Collapse in Multi-Agent RL
BEST-KAG: Enhancing Question Answering of Building Engineering Standards with Multimodal …
Distribird: Literature-Informed Prior Distribution Design for Bayesian Model Calibration
Dynamic Governance of Multi-LLM Agent Systems for Collaborative Conversational Outcomes
VICBench: A Multi-Language Benchmark for Code Vulnerability Detection
From Monolithic to Modular: Segment-level Automatic Prompt Optimization
Towards Query-Agnostic RAG Evaluation via Query Coverage and Claim Verifiability
When Self-Consistency Backfires: Majority Vote Hurts the Majority of Hard Science Problem…
XBridge: Entity-Grounded Latent Bridge for Heterogeneous LLM Communication
Logit-Boundary Geometric Belief Interfaces and Sparse Sheaf-Enclave Protocols: A Self-Con…
Evaluating LLM Generated Detection Rules in Cybersecurity
Federated Learning for Distributed CNC Tool Wear Prediction
EvoGraph-Mem: Failure-Aware Editable Graph Memory for Long-Term Language Agents
HyperANFIS: Enhancing Rule Representation and Interpretability in Adaptive Neuro-Fuzzy Sy…
Governing Agentic AI in FinTech
MaSRead: Content-Addressed Reading of Replicated Latent Stores
Representation Finetuning for Continual Learning
Beyond Fixed Luminance: Towards Panchromatic and Orthochromatic Image Colorization
Benchmarking LLM Judges for Mobile Agent Evaluation
Herding End-to-End Autonomous Driving via Neuro-Symbolic Safety Guards