Instruction-Conditioned Exploration with Asymmetric Reinforcement Learning and Self-Disti…
Explorar
Noticias de IA
37834 elementos — filtrados, clasificados y sin duplicados
LLMBDC: Language Model for Biological Domains Oriented Clustering of Gene Ontology
SPARC-Rad: A Multimodal Benchmark Dataset and Evaluation Pipeline for Spatial and Anatomi…
Mamba with Hierarchical Memory: Solving Representation Bottleneck in Long Sequence Modeli…
SkillTrace: Traversing a Query-Skill Graph for Composable LLM Agents
MonitrLLM: A Community-Centered Evaluation Infrastructure for Large Language Models
ParEvalLayer: When Partial LLM-Agent Evaluations Support a Decision
Long-term Measurements: Towards a Longitudinal Understanding of Human-AI Interactions
Sweet Little Lies: Strategic Deception in AI Emotional Support Chatbots
Optimizing Minimax Regret in Uncertain MDPs with Small Sets of Policies
Magnet: Detecting Cross-Session AI Misuse Through Capability Accumulation
From Profiling to Synthesis: Benchmarking Implicit Behavioral Alignment in Personalized L…
PosterMELD: Multi-Agent Paper-to-Poster Generation for Controllable Design Diversity with…
Trustworthy AI in Digital Health: A Comprehensive Review of Robustness and Explainability
Self-Certification of Representation Adequacy: Sequential Certification at Minimum Task L…
SKT: Skill-Use Training at Scale via Verified Synthetic Data Generation
MechGeo: Autoformalizing and Proving Euclidean Geometry in Lean 4
Trajectories That Segment Themselves: Agent-Declared Boundaries as a Training Unit
Cloud to Edge: Benchmarking LLM Inference On Hardware-Accelerated Single-Board Computers
Hard Constraints, Smooth Gradients: Learning Feasible Inventory Policies via Differentiab…
Exploring More to Solve More: Boosting Diversity in Text Diffusion Models via Entropy-Bas…
Width, Memory, and Delay: A Resource Accounting for the Limits of Flat Multi-Agent Systems
Corrigible Assistance in One Round: Pragmatic-Pedagogic Best Response
Cost-Effective Automated Judging of Natural-Language Mathematical Proofs
Beyond the Mean: Multi-Moment Policy Optimization for LLM Reasoning
Judging Is Not Enumerating: Silent Omissions in LLM-Authored Acceptable Sets
Emergence Invariance: From Symbolized Thought to Interface Refinement
Beyond Solution-Centric Search: Adaptive Inquiry and Knowledge Revision for Autonomous ML…
MemArbiter: Decision-Time Memory Arbitration for Long-Horizon LLM Agents
From AI Technical Debt to Agentic Technical Debt: A Systematic Mapping of Root Causes and…