Can LLM Agents Price Competitively? A Dynamic Multi-Attribute Auction Benchmark for Agent…
Explorar
Noticias de IA
29647 elementos — filtrados, clasificados y sin duplicados
Co-evolution of social reward and punishment under institutional interventions
PATH-Bench: Path-Dependent Evaluation of Lifelong Agents
Perspectives on Tsallis Statistics for Artificial Intelligence
Inference-Time Policy Alignment for Fair Reinforcement Learning
Cost-Effective Automated Judging of Natural-Language Mathematical Proofs
MemoryForge: Synthesize Lifelong Memory for Human-Like LLM Agents
What Transfers from Text to Vision? Capability Scaling Laws and Transfer Dynamics for VLMs
Width, Memory, and Delay: A Resource Accounting for the Limits of Flat Multi-Agent Systems
Corrigible Assistance in One Round: Pragmatic-Pedagogic Best Response
Exploring More to Solve More: Boosting Diversity in Text Diffusion Models via Entropy-Bas…
Randomized Advantage Transformation (RAT): Computing Natural Policy Gradients via Direct …
SKT: Skill-Use Training at Scale via Verified Synthetic Data Generation
MechGeo: Autoformalizing and Proving Euclidean Geometry in Lean 4
Trajectories That Segment Themselves: Agent-Declared Boundaries as a Training Unit
Hard Constraints, Smooth Gradients: Learning Feasible Inventory Policies via Differentiab…
Self-Certification of Representation Adequacy: Sequential Certification at Minimum Task L…
Trustworthy AI in Digital Health: A Comprehensive Review of Robustness and Explainability
PosterMELD: Multi-Agent Paper-to-Poster Generation for Controllable Design Diversity with…
Fighting Fire with Fire: On the Feasibility of Protecting Exercises Against AI Cheating
Memory Reward Inflation in Self-Improving LLM Agents
Interpretability-Guided Soft Pruning of Attention Heads in Vision Transformers
ParEvalLayer: When Partial LLM-Agent Evaluations Support a Decision
Optimizing Minimax Regret in Uncertain MDPs with Small Sets of Policies
Long-term Measurements: Towards a Longitudinal Understanding of Human-AI Interactions
SkillTrace: Traversing a Query-Skill Graph for Composable LLM Agents
Mamba with Hierarchical Memory: Solving Representation Bottleneck in Long Sequence Modeli…
Instruction-Conditioned Exploration with Asymmetric Reinforcement Learning and Self-Disti…
Defending Membership Inference Attacks via Privacy-aware Sparsity Tuning
MonitrLLM: A Community-Centered Evaluation Infrastructure for Large Language Models