Explorar

Noticias de IA

27413 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Beyond the Answer Key: Robustness Evaluation of Large Language Models for Step-Level Math…
arXiv cs.AI Research & Papers
RailSyn: Diagnosis-Guided Image Generation for Traceable Data Completion in Railway Forei…
arXiv cs.AI Research & Papers
Pro-Router: Token-Aware Progressive Model Routing with Adaptive Edge-Cloud Collaboration …
arXiv cs.AI Research & Papers
Learning Dynamics of Logits Debiasing for Long-Tailed Semi-Supervised Learning
arXiv cs.AI Research & Papers
How Language Models Choose Sides: Internal Representations of Instruction Hierarchy
arXiv cs.AI Research & Papers
Looking Again: Measuring Sycophancy in the Reasoning Chains of Multimodal Models Under Pr…
arXiv cs.AI Research & Papers
A Generalized Optimization Engine (GOE) for Edge AI Inference Acceleration
arXiv cs.AI Research & Papers
Evaluating the Hidden Costs of Personalization in Large Language Models
arXiv cs.AI Research & Papers
CrossAudit: A Git-Native, Cross-Vendor Audit Loop for Agentic Science
arXiv cs.AI Research & Papers
CDEP Agent: Connecting Meteorologically Detected Temporal Compound Events to Real-World D…
arXiv cs.AI Research & Papers
Self-Evolving Skills via Surrogate-Guided Solve-and-Reproduce
arXiv cs.AI Research & Papers
MM-BrowseComp: A Comprehensive Benchmark for Multimodal Browsing Agents
arXiv cs.AI Research & Papers
Machine Learning-Enhanced Tabu Search for Tactical Wireless Network Design
arXiv cs.AI Research & Papers
From Extraction to Governed Memory: Multi-Agent Knowledge Graph Construction with Domain-…
arXiv cs.AI Research & Papers
BiasMix-Finance: Post-Generation KYC Guardrails for LLM Portfolio Advice
arXiv cs.AI Research & Papers
BiG-SURE - Bipartite Graph for Semantic Uncertainty and Reliability Estimation of LLMs
arXiv cs.AI Research & Papers
Fine-Grained Multi Image Object Hallucination Benchmark
arXiv cs.AI Research & Papers
ShardMemo: Scope-Before-Routing for Agentic Memory Retrieval
arXiv cs.AI Research & Papers
Cost-efficient Active Learning for Referring Image Segmentation and Grounding
arXiv cs.AI Research & Papers
CoMPASS: Collaborative Molecular Property Prediction via Adaptive Small-Large Model Syner…
arXiv cs.AI Research & Papers
MineCEraft: Evaluating Language Models as Construction Engineers in the World of Minecraft
arXiv cs.AI Research & Papers
COMPASS: Grounding Composition-Intent Guidance in Unified Multimodal Models
arXiv cs.AI Research & Papers
DiffSAC: Diffusion-guided Sampling for Consensus-based Robust Estimation
arXiv cs.AI Research & Papers
CDPR: Counterfactual Advantage-based Credit Assignment for Cost-Aware Sequential Medical …
arXiv cs.AI Research & Papers
MobileDreamer: Generative Sketch World Model for GUI Agent
arXiv cs.AI Research & Papers
SHAPE of Chain-of-Thought in Math Reasoning
arXiv cs.AI Research & Papers
Not Your Typical Sycophant: The Elusive Nature of Sycophancy in Large Language Models
arXiv cs.AI Research & Papers
Paper Pilot: A Human-in-the-Loop Expert System for Evidence-Traceable Scientific Manuscri…
arXiv cs.AI Research & Papers
Disappearing Ink: Obfuscation Breaks N-gram Code Watermarks in Theory and Practice
arXiv cs.AI Research & Papers
C3-UniMM: Causal Cycle-Consistent Unified Multimodal Modeling via Super Alignment and Sha…