Explorar

Noticias de IA

37834 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Signal or Spurious Cue? A Randomized Audit of Survey-Country Metadata in LLM Social Infer…
arXiv cs.AI Research & Papers
Evaluating Investment Logic in Large Language Models: A Real-World Benchmark Towards Pers…
arXiv cs.AI Research & Papers
Temporal Bridges for Spatial Resolution: Enhancing Climate Data Super-Resolution with Bid…
arXiv cs.AI Research & Papers
Woodpecker Distillation: Weak Models Diagnose Reasoning Bugs in Strong Models
arXiv cs.AI Research & Papers
What Current AI Benchmarks Leave Unmeasured: Modality, Search, Citations, and Implication…
arXiv cs.AI Research & Papers
Depth-Guided Video Object Counting in Crowded Scenes
arXiv cs.AI Research & Papers
From Continuous Predictors to Clinical Thresholds: Early Evidence on Performance Trade-of…
arXiv cs.AI Research & Papers
Invariant Representation Learning for Source-Free Time Series Forecasting with LLM-Centri…
arXiv cs.AI Research & Papers
Abstract Event Causal Rules: Induction and Application
arXiv cs.AI Research & Papers
SearchAuditor: Auditing and Attributing Failures in Long-Horizon Search Agents
arXiv cs.AI Research & Papers
Innocent Panels, Hateful Stories: Evaluating and Detecting Hateful Intent in Multi-Turn V…
arXiv cs.AI Research & Papers
PD-GS: Phoneme-Driven 3DGS for Audio-Driven Talking Heads
arXiv cs.AI Research & Papers
When Privileged Guidance Misaligns: State-Matched Routing and Contextualized Self-Distill…
arXiv cs.AI Research & Papers
Small Foundation Models of Human Cognition and Behaviour
arXiv cs.AI Research & Papers
Project2Task: Graph-Guided Project-Level Planning for Autonomous Research
arXiv cs.AI Research & Papers
Bias Analysis of L2 Speaking Assessment Systems Using Concept Activation Vectors
arXiv cs.AI Research & Papers
Tracing the Heart: An Evidence-Linked Pipeline for Heart-Failure Feature Engineering
arXiv cs.AI Research & Papers
HoloCount: A Holistic Visual Counting Benchmark for MLLMs
arXiv cs.AI Research & Papers
Quality Diversity for Reliable Data Driven Time-Use Optimization
arXiv cs.AI Research & Papers
Shaping Human-AI Interactions to Provide Improvement Pathways and Balance Competing Objec…
arXiv cs.AI Research & Papers
RA-CAD: Learning Post-Execution Critique for State-Aware Text-to-CAD Generation
arXiv cs.AI Research & Papers
TriQua: Reconciling Granularity and Context in Factuality Evaluation
arXiv cs.AI Research & Papers
BlockPython: A Process-Aware Agent-Supported Platform for the Transition from Block-Based…
arXiv cs.AI Research & Papers
Subliminal Learning is Non-Semantic Distillation
arXiv cs.AI Research & Papers
When Do Prompt-Side Agent Playbooks Transfer? Accuracy, Cost, and Runtime Shift in Agent …
arXiv cs.AI Research & Papers
ChainClaw: A Layered Agent Framework for Reliable On-Chain Execution
arXiv cs.AI Research & Papers
SkillMOO: Multi-Objective Optimization of Agent Skills for Software Engineering
arXiv cs.AI Research & Papers
ECHO: A Locally-Deployable Agentic Health Assistant with Temporal Memory, Safety Guardrai…
arXiv cs.AI Research & Papers
ViSR-KGC: Visual Subgraph Reasoning with Vision-Language Models for Multimodal Knowledge …
arXiv cs.AI Research & Papers
Seeing Is Not Deciding: Can Multimodal LLMs Act as Effective CEOs?