Explorar

Noticias de IA

21272 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Soft Guidance Starts to Outperform CoT Prompting as LLMs Improve
arXiv cs.AI Research & Papers
ToolLIFT: Lifting Tool-Specific Trajectories into Function-Level Graphs for Generalizable…
arXiv cs.AI Research & Papers
SKILL-KD: Contrastive Skill Distillation for LLM Agents
arXiv cs.AI Research & Papers
STREAM-VAE: Dual-Path Routing for Slow and Fast Dynamics in Vehicle Telemetry Anomaly Det…
arXiv cs.AI Research & Papers
Enhancing Tabular Learners with Context-Aware Semantic Embeddings
arXiv cs.AI Research & Papers
WeClawArena: An Auditable Sandbox and Benchmark for Cross-User Agents Collaboration and S…
arXiv cs.AI Research & Papers
Formal Verification of Agentic Systems over Operational Data
arXiv cs.AI Research & Papers
Distractor-Aware Truncation: Disentangling Context-Length Effects from Signal Loss in Lon…
arXiv cs.AI Research & Papers
Solver-Aware Decompositions for Programming-by-Example: When Dividing Requires Knowing ho…
arXiv cs.AI Research & Papers
AgentPanel: Toward a New Paradigm for Human--AI Collaboration in Exploring Scientific Que…
arXiv cs.AI Research & Papers
LeanMem: Simple and Efficient Long-Term Memory for LLM Agents
arXiv cs.AI Research & Papers
DocTrace: Towards Traceable Long Document VQA via Hierarchical Evidence Graph Reasoning
arXiv cs.AI Research & Papers
Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation
arXiv cs.AI Research & Papers
Surrogate Substitution Preserves PHI Detectability: A Multi-Detector Equivalence Study
arXiv cs.AI Research & Papers
Spatial proteomics guided by H&E-based AI reveals recurrence-risk niches in triple-negati…
arXiv cs.AI Research & Papers
Evidence-Grounded Multimodal Knowledge Graph Construction for Multi-Lecture Educational R…
arXiv cs.AI Research & Papers
TumorBoard: Evidence-Grounded Multi-Agent Decision Support for Longitudinal Neuro-Oncology
arXiv cs.AI Research & Papers
TaskPress: Query-Agnostic KV Cache Compression via Task-Guided Pruning
arXiv cs.AI Research & Papers
ChartAnno: Evaluating MLLMs for Chart Annotation Generation
arXiv cs.AI Research & Papers
AI Agent Economics: Can Autonomous Economic Behavior Emerge among AI Agents under Minimal…
arXiv cs.AI Research & Papers
Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning
arXiv cs.AI Research & Papers
Aligning Large Vision-Language Models at Test Time: A Trajectory-Guided Structured Sampli…
arXiv cs.AI Research & Papers
UHP Detection: LVLMs have their Unique Hallucination Pattern in the Consistency Space
arXiv cs.AI Research & Papers
SciRet: A Compute-Aware Empirical Study of Retrieval and Reranking for Scientific RAG
arXiv cs.AI Research & Papers
Beyond Average Performance: Dynamic Instance Clustering and Specialized Algorithm Design …
arXiv cs.AI Research & Papers
Patient-centered data science: an integrative framework for evaluating and predicting cli…
arXiv cs.AI Research & Papers
AI-Assisted Peer Review Across Research Communities: From Reviewer AI Policies to LLM Rev…
arXiv cs.AI Research & Papers
AI Sandbox: Technical Report
arXiv cs.AI Research & Papers
ValueFormer: A Causal Transformer Value Function with Stage-Aware Labels for Semi-Autonom…
arXiv cs.AI Research & Papers
HyperFL: Query-Adaptive Representation Learning for Software Fault Localization