Beyond Retrieval: Query-Conditioned Reuse of Long-Horizon Agent Trajectories
Explorar
Noticias de IA
37834 elementos — filtrados, clasificados y sin duplicados
MOSAIC: Unveiling the Moral, Social and Individual Dimensions of Large Language Models
Designing AI Pipelines for Decision-Ready ITSM Intelligence
$\varepsilon$-MemEvo: Adaptive Cross-Task Memory Transfer for LLM Program Evolution
Don't Want Your LLM to Recommend Nuclear Strike? Try Asking It in Japanese
Position: Reasoning is a Learnable Rule-Based Process
CangjieBench: Benchmarking LLMs on a Low-Resource General-Purpose Programming Language
DiG-bench: Discovery in Games
Early Warning Signals for OpenVLA Failure under Visual Distribution Shift
Vibe to Code: Elucidating Strategic Oscillation of Tacit Knowledge in Generative AI Desig…
Commit Locally, Exit Globally: Coordinating Adaptive Sampling and Early Exit in Diffusion…
Critic-Free Pretraining for Efficient Online Reinforcement Learning Fine-Tuning
SPADE: Speculative Decoding for Precise and Low Cost Distributed Edge Cloud Inference
Research Assistant: AstraZeneca's Agentic System for R&D
Security and Detectability Analysis of Unicode Text Watermarking Methods against Large La…
StarEmbed: Benchmarking Time Series Foundation Models on Astronomical Observations of Var…
CityRiSE: Reasoning Urban Socio-Economic Status in Large Vision-Language Models via Reinf…
MindMemOS: A Portable and Self-Evolving Memory Operating Layer for AI Agents
SONIC: Supersizing Motion Tracking for Natural Humanoid Whole-Body Control
Automated Design Optimization via Strategic Search with Large Language Models
RadarGen: Automotive Radar Point Cloud Generation from Cameras
REHEARSE: Experiential Rehearsal for Verbal Confidence Calibration in Large Language Mode…
Diagnostic Foundation for Evaluating LLMs' Research Integrity as Co-Scientists
DiffGRM: Diffusion-based Generative Recommendation Model
Position: The Alignment Community is Unintentionally Building a Censor's Toolkit
Can Generalist Vision Language Models (VLMs) Rival Specialist Medical VLMs? Benchmarking …
How Significant Are the Real Performance Gains? An Unbiased Evaluation Framework for Grap…
Exploring Sparsity for Parameter Efficient Fine Tuning Using Wavelets for Vision
Enhancing In-Hospital Mortality Prediction Using Multi-Representational Learning with LLM…
Unmasking Conversational Bias in AI Multiagent Systems