ToolGate: An Executable Acceptance Pipeline for Tool-Dependent Scientific Benchmark Const…
Explorar
Noticias de IA
27413 elementos — filtrados, clasificados y sin duplicados
Codebook Agent: Amortized Topology Design for LLM Multi-Agent Systems
Do Large Language Models Capture the Diversity in their Training Data?
HeadWiseKV: Budgeted Per-Head Cache Residency for Hybrid Long-Context Language Models
Monitoring Web Agents Without Internal Signals: Observable Trajectories and Key-Step Supe…
ICE: Intervention-Consistent Explanation Evaluation with Statistical Grounding for LLMs
The Ceiling Is in the Channel: Auditing Learner Gaps and Measurement Frontiers in Clinica…
Belief-Calibrated Optimization: An Explicit World Model for Agentic Optimization
Competitive Market Behavior of LLMs
Automated Vulnerability Injection in Smart Contracts Using Large Language Models
Language Diffusion Models are Associative Memories Capable of Retrieving Unseen Data
Looped Transformers under the Jacobian Lens: Does the Global Workspace Survive Recurrence?
Post-Training Ternarization of Qwen3-4B Capability, Effective Bit Budget, Storage Compres…
Architecting Conversational Data Systems for Stateless LLM APIs: The Hydration Proxy Patt…
On-Policy Distillation Meets Off-Policy GRPO: Training Compact Instruction-Following Rera…
DocHop: Benchmarking Out-of-domain Multi-hop Reasoning in Information-Dense Documents
Deep denoising autoencoder-based non-invasive blood flow detection for arteriovenous fist…
The Memory Trust Gap: Capability-Dependent Failures in Persistent-Memory Agents
PolERo: Studying Political Evasion in Romanian
Inference-Time Optimization of Prompt Embeddings in Diffusion Models: A Comparison of sep…
MultiGhostBench: A Multilingual Benchmark for Long-Form LLM-Generated Text Attribution un…
Meta-ethics and AI: exploring the novel meta-ethical questions in the era of AI
ProbeMatchDTI: Probe-Driven Multi-Scale Biochemical Pattern Matching for Drug-Target Inte…
Discriminative World Models for Web Agents
Fine-Grained Anomaly Perception in Wild UGC-Enhanced Images: A Comprehensive Dataset and …
DiffuSearch: How Hybrid Trajectory Planning Benefits from Aligned Objectives in Diffusion…
Retrosynthesis of Synthetic Media for Explainable AI Provenance Forensics
Not All Agreement Counts as Corroboration: Provenance-Conserving Multi-View Fusion for Ty…
PaperCompiler: Faithful Paper-to-Code Generation via Repository-Level Specification Compi…
CrashDiffuser: VLM-Guided Collision Intent Reasoning for Fine-Grained Safety-Critical Tra…