Honest Lying: Understanding Memory Confabulation in Reflexive Agents
Explorar
Noticias de IA
21272 elementos — filtrados, clasificados y sin duplicados
LLUMI: Improving LLM Writing Assistance for Mental Health Support with Online Community F…
KLAS: Using Similarity to Stitch Neural Networks for Improved Accuracy-Efficiency Tradeof…
Wait! There's a Way Out: A Decision Mechanism for Forecasting Conversational Derailment
Relevance as a Vulnerability: How Web Retrieval Degrades Safety Alignment in LLM Agents
Physics Is All You Need? A Case Study in Physicist-Supervised AI Development of Scientifi…
GPF-LiveNews: A Streaming Evaluation Protocol for Group-Conditioned Framing in Large Lang…
Self-Play Reinforcement Learning under Imperfect Information in Big 2
Emergent Semantic Representations in World Models through Physical Interaction without Li…
Balancing Multimodal Learning through Label Space Reshaping
MIRA: Mid-training Rubric Anchoring for Source-Aware Data Selection
Bridging the Sim-to-Real Gap in Reinforcement Learning-Based Industrial Dispatching throu…
TaxDistill: Improving Metagenomic Taxonomic Annotation via Distilled Genomic Foundation M…
Context Distillation as Latent Memory Management
Beyond Normalization: Rethinking the Partition Function as a Difficulty Scheduler for RLVR
GPS-Enhanced Tourist Mobility Modeling with Seasonal Spatial Priors and LLM-Based Activit…
ParaTool: Shifting Tool Representations from Context to Parameters
A Language-Guided Bayesian Optimization for Efficient LoRA Hyperparameter Search
Compass: Navigating Global Marine Lead Data Integration through Expert-Guided LLM Agent
Meta-Programming for Linear-time Temporal Answer Set Programming
A Survey on Recent Advances in Conversational Data Generation
DeepSurvey: Enhancing Analytical Depth and Citation Reliability in Automated Survey Gener…
It`s All About Speed: AI`s Impact on Workflow in Music Production
Redundant or Necessary? A Benchmark for Detecting Redundant Steps in Agent Trajectories
TRACE: Toulmin-based Reasoning Assessment through Constructive Elements for LLM CoT Evalu…
Towards Human-Like Interactive Speech Recognition With Agentic Correction and Semantic Ev…
Aligned but Fragile: Enhancing LLM Safety Robustness via Zeroth-Order Optimization
Dataset-Driven Channel Masks in Transformers for Multivariate Time Series
The Confidence Shortcut: A Reasoning Failure Mode of Masked Diffusion Models
Steering Language Models Before They Speak: Logit-Level Interventions