Efficient and Interpretable Body-Based Emotion Recognition with Lightweight Temporal Conv…
Explorar
Noticias de IA
22115 elementos — filtrados, clasificados y sin duplicados
Instruct-FD: Can Your Full-Duplex Speech System Follow Turn-Taking Instructions?
Enhancing Explainable Cardiac Diagnosis with Guide-Grounded Multimodal LLMs
Profiling Lightweight Large Language Models
Can an AI System Be Creative? A Critical Perspective from Art and Engineering
Learn2Zinc: Fine-tuning Small Language Models for Text-to-Model Translation in MiniZinc
A Knowledge-Injection Framework for Zero-Shot Adaptation of LLMs to Delirium Prediction
Marking the Wrong Symptoms: Evaluating LLM Watermarks in Medical Texts
Answer-then-Edit: Reasoning Skeleton Editing for Anti-Distillation with Preserved Utility
Preference Tuning as Spectral Update Reorganization
KeySI: An Interaction Framework for Tuning Text Embeddings Based on Human Feedback
Same Dangerous Objective, Opposite Advice: Direct Exposure versus Multi-Agent Mediation
GuardianAgentBench: Where Agents Fail and How to Guard Them
Beyond Independent Optimization: Compression, MoE Routing, and Quantization Interactions …
Delivery, Not Storage: Cue-Anchored Working Memory as a Harness Property for Coding Agents
From Scalars to Time Series: Rethinking Implicit Neural Representations for Time-Varying …
ArbiGraph: Arbitrarily Scalable Verifiable Task Graphs for Evaluating Context Management
NVIDIA-labs OO Agents: Native Python Object-Oriented Agents
SciExplore: Evaluating Autonomous Agents from Scientific Navigation to Information Integr…
PATS: Policy-Aware Training Scaffolding for Agentic Reinforcement Learning
Logical Regression for Planning with Axioms
Towards Faithful Graph Explanations with Synergistic Edge Effects via Granular Balls
AI-Driven Multi-Hop Relay Selection for Smart Urban NR-V2X Networks via Learning-to-Optim…
CMI-Mem: Toward Generalizable Long-Term Memory Management via CMI-Augmented Reinforcement…
StrideDiffusion: Accelerating Diffusion Models for Time-series Generation
AppWorld-UL: Benchmarking Diverse Agent-User Interactions for Tool-Use
DynamicMCPBench: A Trace-Grounded, Effect-Scored Benchmark for LLM Agents over Live MCP S…
DFAH-Bench: Benchmarking Observable Agent Instability in Financial Decision-Making
SafeStep: AI-powered Travel Assistance for Elderly People with Frailty or Dementia
ConfidenceBench: Evaluating Confidence Calibration in Large Language Models