On Effectiveness and Efficiency of Agentic Tool-calling and RL Training
Explorar
Noticias de IA
29351 elementos — filtrados, clasificados y sin duplicados
Geodesics with Unified Tangent-constrained Priors and Curvature Regularization
Multi-Contrast MRI Motion Correction via Parameter-Informed Disentanglement and Adaptive …
Persona Attack: Incremental Memory Injection Jailbreak Attack against Large Language Mode…
PrivacyPeek: Auditing What LLM-Based Agents Acquire, Not Just What They Say
Digital-to-Physical Transfer of Adversarial Patches for Aerial Vehicle Detection
MyoSem: Aligning Electromyography to Natural-Language Action Semantics for Hand Action Un…
BAGEN: Are LLM Agents Budget-Aware?
Continuous Reasoning for Vision-Language-Action
ARCA: Adapter-Residual Credit Assignment When Token Signals Degenerate
Isolating LLM Lexical Bias: A Curation-Free Triangulated Metric for Preference-Stage Lear…
(HB-ARFM) History-Bootstrapped Flow Matching for Inverse Boiling Reconstruction
Detector-Evasive LLM Paraphrasing via Constrained Policy Optimization
PR2: Predictive Routing Replay for MoE-Based LLM Reinforcement Learning
CodeCytos: AI-assisted spatial molecular imaging analysis via code-augmented agent action…
Interpretable Policy Distillation for Power Grid Topology Control
Improving Visual Representation Alignment Generation with GRPO
SPADER: Step-wise Peer Advantage with Diversity-Aware Exploration Rewards for Multi-Answe…
LinguIUTics at PsyDefDetect: Iterative Imbalance-Aware Fine-tuning of Qwen3-8B for Psycho…
Demystifying the Optimal Fair Classifier in Multi-Class Classification
The Paradox of Outcome Optimization: A Causal Information-Theoretic Bound on Reasoning Sh…
Information-Theoretic Lower Bounds for Bit-Constrained Stochastic Optimization via a Redu…
SORA: Free Second-Order Attacks in Fast Adversarial Training
Behavior-Invariant Task Representation Learning with Transformer-based World Models for O…
Extending Causal Metamodeling to a non-Markovian Queue
Benchmarks for Vision-Language Models in Urban Perception Should Be Reliability-Aware and…
Dive into Waves: Morlet Spectral Transformer for Cross-Subject Emotion Decoding from EEG
Benchmarking Security Risk Detection and Verification in Open Agentic Skill Ecosystems
ProductWebGen: Benchmarking Multimodal Product Webpage Generation
Plausibility Is Not Prediction: Contrastive Evidence for LLM-Based Cellular Perturbation …