Goose: Anisotropic Speculation Trees for Training-Free Speculative Decoding
Explorar
Noticias de IA
29341 elementos — filtrados, clasificados y sin duplicados
Not an A11y: How Android Accessibility Exposes Mobile AI Agents to Indirect Prompt Inject…
Search-G1: Grounded Search Agents via Representation-Based Intrinsic Rewards
MedPixel: A Unified Pixel-Language Model for Medical Reasoning and Segmentation
Ultraconstructive Model Theory via Bounded Adversarial Finite Structures
Different Feedback, Different Updates: Selective Self-Learning from User Interactions for…
ROM: Real-time Overthinking Mitigation via Streaming Detection and Intervention
SuperNeuroMAT: An Efficient Matrix-based Simulator for Spiking Neural Networks
CoRE: Consensus Rewards via Equilibrium for Test-Time Reinforcement Learning
C2L-Net: A Data-Driven Model for State-of-Charge Estimation of Lithium-Ion Batteries Duri…
Beyond Static Models: An Evolving Framework for Continual Learning in Large Language Mode…
Collaborative Multi-Agent Scripts Generation for Enhancing Imperfect-Information Reasonin…
Time-Series Forecasting in Safety-Critical Environments: An Open-Source Package for EU-AI…
DRBENCHER: Can Your Agent Identify the Entity, Retrieve Its Properties and Do the Math?
SkillClaw: Let Skills Evolve Collectively with Agentic Evolver
FinTrace: Holistic Trajectory-Level Evaluation of LLM Tool Calling for Long-Horizon Finan…
Mesh-Attention: A New Communication-Efficient Distributed Attention with Improved Data Lo…
A Statistical Framework for Auditing Behavioral Dependence and Induced Bias in LLM Judges
Temporal Sepsis Modeling: a Relational and Explainable-by-Design Framework
ZenBrain: A Neuroscience-Inspired 7-Layer Memory Architecture for Autonomous AI Systems
Reproducing and Stress-Testing Two Approaches to LLM Reasoning Reliability: Test-Time Pro…
NeuroAda: Activating Each Neuron's Potential for Parameter-Efficient Fine-Tuning
A Comparative Study in Surgical AI: Potential and Limitations of Data, Compute, and Scali…
MonitorBench: A Comprehensive Benchmark for Chain-of-Thought Monitorability in Large Lang…
Gaming Without an Attacker: Benchmark Fingerprinting in LLM-Driven Search Under Selection…
Hybrid Neural-Classical Correction for Frozen Time Series Foundation Models: A Comprehens…
Adaptive Symmetry Discovery for Dynamical System Identification
Continual Visual Anomaly Detection on the Edge: Benchmark and Efficient Solutions
ElasticBack: Stealthy Conditional Backdoor in LLM-Agent Skills via Coupled Trigger-Rule O…
Knowing You Is Everything: LLM Agents Achieve Near-Perfect Profile-Consistent Reaction Pr…