Measuring Explainer Stability via Attribution Separability
Explorar
Noticias de IA
29627 elementos — filtrados, clasificados y sin duplicados
Less Traffic, Better Outcomes: Competition-Aware Request Dispatch in Real-Time Ad Exchang…
Oilbird: Training-Free Speculative Decoding with Keys the Verifier Already Computes
When Efficiency Becomes Fragility: Exploiting Dynamic Routing Vulnerabilities in Adaptive…
Knowing the Form, Not the Function: Automatically Auditing Answer--Authority Decoupling i…
A Theory of Conditional Collapse under Low-Rank Weight-Space Ablations: I. The Single-Blo…
Learning Music Style for Piano Arrangement Through Cross-Modal Bootstrapping
HyperAgent: Planning and Acting over Tool-Schema Hypergraphs for Tool-Use LLM Agents
Policy Fragmentation or Institutional Alignment? Institutional Governance of AI in Univer…
Large language models for partial differential equation workflows
When Teachers Mislead: Spurious-Signal-Aware On-Policy Distillation
Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks
Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents
When Many Answers Are Valid, Voting Fails: Symbolic Verification for Best-of-K Causal Rea…
Formal Verification of Agentic Systems over Operational Data
CT-HEG: A Bidirectional, Timestamp-Attributed Event Graph for ICU In-Hospital Mortality P…
Reversing Arrows in Large Language Models
When Correct Solutions Repeat: Rarity-Aware Credit Redistribution for GRPO
Enactive Artificial Intelligence: A Decision-Centric Architecture for Complex Systems
Towards Improving Sequential Decision-Making in LLM Agents via Experience Memory
UniGD: A Unified Generative-Discriminative Framework for Industrial Retrieval
AI World Cup 2026: Benchmarking Large Language Models for End-to-End Football Tournament …
UrbanAgent: A Tool-Augmented Agent for Cross-System Urban Tasks
Dr. AGENTONOMICS: A Didactic Experiment of AGENTONOMICS
LLaDA MoE v2: Scaling Mixture-of-Experts Diffusion Language Models
Instruction Stacking Collapse: A Benchmark and the Capability-Dependent Value of Prompt C…
IR2Solve: Structured Intermediate Representations for Cost-Efficient Optimization Autofor…
Permission Denied: Policy-Graded Evaluation of Coding Agents in Hardened Environments
TACT: Taxonomy-Aligned Post-Training for Pedagogically Adaptive English Tutoring
Agentic Reinforcement Learning with Self-Distilled Reward Shaping