Beyond Retrieval: Query-Conditioned Reuse of Long-Horizon Agent Trajectories
Explorar
Noticias de IA
37834 elementos — filtrados, clasificados y sin duplicados
Fast and Memory-Efficient Wavelet Convolutions via I/O-Aware Reformulation
REHEARSE: Experiential Rehearsal for Verbal Confidence Calibration in Large Language Mode…
Cat-DPO: Category-Adaptive Safety Alignment
IACDM: Interactive Adversarial Convergence Development Methodology -- A Structured Framew…
SAFE-SVD: Sensitivity-Aware Fidelity-Enforcing SVD for Physics Foundation Models
CangjieBench: Benchmarking LLMs on a Low-Resource General-Purpose Programming Language
Automatic Termination Strategy of Inelastic Neutron-scattering Measurement Using Bayesian…
MOSAIC: Unveiling the Moral, Social and Individual Dimensions of Large Language Models
Automated Design Optimization via Strategic Search with Large Language Models
LipCache: A Local Inference Proxy with Certified Caching for Edge Image Classification Se…
Gradual Code-Switching as Inference-Time Cross-Lingual Representational Alignment for LLMs
DiffGRM: Diffusion-based Generative Recommendation Model
Unlearning at Scale: State-Exact Trace-Preserving Deletion in Billion-Parameter Language …
Can Generalist Vision Language Models (VLMs) Rival Specialist Medical VLMs? Benchmarking …
Unmasking Conversational Bias in AI Multiagent Systems
Mimicry without understanding: the origins of decision bias in large language models
SONIC: Supersizing Motion Tracking for Natural Humanoid Whole-Body Control
StarEmbed: Benchmarking Time Series Foundation Models on Astronomical Observations of Var…
CityRiSE: Reasoning Urban Socio-Economic Status in Large Vision-Language Models via Reinf…
Exploring Sparsity for Parameter Efficient Fine Tuning Using Wavelets for Vision
Do LLMs Know Their Vulnerable Scenarios?
EEG-PRIME: Prototype-Aligned Representation Learning with Multi-Level Conditioning for EE…
Cueless EEG imagined speech for subject identification: dataset and benchmarks
Long-Horizon AI Research for Grothendieck Constant: A Case Study in Human-AI Mathematical…
TRAPSBench: Vision-Language Models Encode but Fail to Express Epistemic Restraint
How Significant Are the Real Performance Gains? An Unbiased Evaluation Framework for Grap…
The Impact of Generative AI on Collaborative Open-Source Software Development: Evidence f…
Auditable Agents
Rule of Thumb: Explaining Artificial Intelligence Systems using Partial Information