Explorar

Noticias de IA

22115 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Efficient and Interpretable Body-Based Emotion Recognition with Lightweight Temporal Conv…
arXiv cs.AI Research & Papers
Instruct-FD: Can Your Full-Duplex Speech System Follow Turn-Taking Instructions?
arXiv cs.AI Research & Papers
Enhancing Explainable Cardiac Diagnosis with Guide-Grounded Multimodal LLMs
arXiv cs.AI Research & Papers
Profiling Lightweight Large Language Models
arXiv cs.AI Research & Papers
Can an AI System Be Creative? A Critical Perspective from Art and Engineering
arXiv cs.AI Research & Papers
Learn2Zinc: Fine-tuning Small Language Models for Text-to-Model Translation in MiniZinc
arXiv cs.AI Research & Papers
A Knowledge-Injection Framework for Zero-Shot Adaptation of LLMs to Delirium Prediction
arXiv cs.AI Research & Papers
Marking the Wrong Symptoms: Evaluating LLM Watermarks in Medical Texts
arXiv cs.AI Research & Papers
Answer-then-Edit: Reasoning Skeleton Editing for Anti-Distillation with Preserved Utility
arXiv cs.AI Research & Papers
Preference Tuning as Spectral Update Reorganization
arXiv cs.AI Research & Papers
KeySI: An Interaction Framework for Tuning Text Embeddings Based on Human Feedback
arXiv cs.AI Research & Papers
Same Dangerous Objective, Opposite Advice: Direct Exposure versus Multi-Agent Mediation
arXiv cs.AI Research & Papers
GuardianAgentBench: Where Agents Fail and How to Guard Them
arXiv cs.AI Research & Papers
Beyond Independent Optimization: Compression, MoE Routing, and Quantization Interactions …
arXiv cs.AI Research & Papers
Delivery, Not Storage: Cue-Anchored Working Memory as a Harness Property for Coding Agents
arXiv cs.AI Research & Papers
From Scalars to Time Series: Rethinking Implicit Neural Representations for Time-Varying …
arXiv cs.AI Research & Papers
ArbiGraph: Arbitrarily Scalable Verifiable Task Graphs for Evaluating Context Management
arXiv cs.AI Research & Papers
NVIDIA-labs OO Agents: Native Python Object-Oriented Agents
arXiv cs.AI Research & Papers
SciExplore: Evaluating Autonomous Agents from Scientific Navigation to Information Integr…
arXiv cs.AI Research & Papers
PATS: Policy-Aware Training Scaffolding for Agentic Reinforcement Learning
arXiv cs.AI Research & Papers
Logical Regression for Planning with Axioms
arXiv cs.AI Research & Papers
Towards Faithful Graph Explanations with Synergistic Edge Effects via Granular Balls
arXiv cs.AI Research & Papers
AI-Driven Multi-Hop Relay Selection for Smart Urban NR-V2X Networks via Learning-to-Optim…
arXiv cs.AI Research & Papers
CMI-Mem: Toward Generalizable Long-Term Memory Management via CMI-Augmented Reinforcement…
arXiv cs.AI Research & Papers
StrideDiffusion: Accelerating Diffusion Models for Time-series Generation
arXiv cs.AI Research & Papers
AppWorld-UL: Benchmarking Diverse Agent-User Interactions for Tool-Use
arXiv cs.AI Research & Papers
DynamicMCPBench: A Trace-Grounded, Effect-Scored Benchmark for LLM Agents over Live MCP S…
arXiv cs.AI Research & Papers
DFAH-Bench: Benchmarking Observable Agent Instability in Financial Decision-Making
arXiv cs.AI Research & Papers
SafeStep: AI-powered Travel Assistance for Elderly People with Frailty or Dementia
arXiv cs.AI Research & Papers
ConfidenceBench: Evaluating Confidence Calibration in Large Language Models