Explorar

Noticias de IA

27413 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Can LLMs Time Travel? Enhancing Temporal Consistency in Legal Agentic Search through Rein…
arXiv cs.AI Research & Papers
AI-Assisted Systematization for Evaluating GenAI Systems
arXiv cs.AI Research & Papers
TIAR: Trajectory-Informed Advantage Reweighting for LLM Abstention Learning
arXiv cs.AI Research & Papers
Learning to Reason Efficiently with A* Post-Training
arXiv cs.AI Research & Papers
When Search Becomes Memory: Turning Robot Design Trials into Transferable Skills
arXiv cs.AI Research & Papers
Clarify, Abstain or Answer? Strategising in Conversation with Belief-Augmented Generation
arXiv cs.AI Research & Papers
Fine-Tuning Over Architectural Complexity: Broad-Coverage PII Detection on PIIBench with …
arXiv cs.AI Research & Papers
Parameter-Efficient VLMs for Gastrointestinal Endoscopy: Medical Image Generation and Cli…
arXiv cs.AI Research & Papers
Beyond Inference-Only Deployment: Comparing Weight-Based Consolidation Against Cascading …
arXiv cs.AI Research & Papers
MDGMIX: Boundary-Aware Subgraph Mixing for Multi-Domain Graph Pre-Training
arXiv cs.AI Research & Papers
Exploration of Perceptual Speech Features for Clinical Decision-Support in Mental Health …
arXiv cs.AI Research & Papers
Certified Robustness from Approximate Gaussian Mixture Structures in Pretrained Latent Sp…
arXiv cs.AI Research & Papers
Proper Scoring Rules for Agentic Uncertainty Quantification
arXiv cs.AI Research & Papers
Uncertainty Decomposition via Cyclical SG-MCMC and Soft-label Learning for Subjective NLP
arXiv cs.AI Research & Papers
CoRe-Code: Collaborative Reinforcement Learning for Code Generation
arXiv cs.AI Research & Papers
PANDO: Efficient Multimodal AI Agents via Online Skill Distillation
arXiv cs.AI Research & Papers
Test-Time Deep Thinking to Explore Implicit Rules
arXiv cs.AI Research & Papers
WorldGUI: An Interactive Benchmark for Desktop GUI Automation from Any Starting Point
arXiv cs.AI Research & Papers
Conditional KRR: Injecting Unpenalized Features into Kernel Methods with Applications to …
arXiv cs.AI Research & Papers
CausaLab: A Scalable Environment for Interactive Causal Discovery Toward AI Scientists
arXiv cs.AI Research & Papers
StakeBench: Evaluating Language Understanding Grounded in Market Commitment
arXiv cs.AI Research & Papers
When Gradients Collide: Failure Modes of Multi-Objective Prompt Optimization for LLM Judg…
arXiv cs.AI Research & Papers
CITYREP: A Unified Benchmark for Urban Representations Across Cities, Tasks, and Modaliti…
arXiv cs.AI Research & Papers
Aes3D: Aesthetic Assessment in 3D Gaussian Splatting
arXiv cs.AI Research & Papers
Efficient Preference Poisoning Attack on Offline RLHF
arXiv cs.AI Research & Papers
Leveraging Spreading Activation for Improved Document Retrieval in Knowledge-Graph-Based …
arXiv cs.AI Research & Papers
VeriTrace: Evolving Mental Models for Deep Research Agents
arXiv cs.AI Research & Papers
Chain-of-Thought Hijacking
arXiv cs.AI Research & Papers
Claw-Anything: Benchmarking Always-On Personal Assistants with Broader Access to User's D…
arXiv cs.AI Research & Papers
Optimizing Sensor Placement for Flow Reconstruction in Urban Drainage Networks: A Digital…