Explorar

Noticias de IA

27413 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
A Negative Result on Cross-Model Activation Transfer in a Pythia Multi-Hop Setting
arXiv cs.AI Research & Papers
CARVE: Certified Affordable Repair of Vetoed Maneuvers via Envelopes for Interactive Driv…
arXiv cs.AI Research & Papers
Lean-GAP: A Dataset of Formalized Graduate Algebra Problems
arXiv cs.AI Research & Papers
Closed-Loop Molecular Design with Calibrated Deference
arXiv cs.AI Research & Papers
TadA-Bench: A Million-Variant Benchmark for Future-Round Discovery Toward Agentic Protein…
arXiv cs.AI Research & Papers
Cross-Modal Contrastive Learning of ECG and Angiography Representations for Severe Stenos…
arXiv cs.AI Research & Papers
Entropy Is Not Enough: Unlocking Effective Reinforcement Learning for Visual Reasoning vi…
arXiv cs.AI Research & Papers
Imaginative Perception Tokens Enhance Spatial Reasoning in Multimodal Language Models
arXiv cs.AI Research & Papers
Cost-Aware Query Routing in RAG: Empirical Analysis of Retrieval Depth Tradeoffs
arXiv cs.AI Research & Papers
VistaHop: Benchmarking Multi-hop Visual Reasoning for Visual DeepSearch
arXiv cs.AI Research & Papers
IdiomX A Multilingual Benchmark for Idiom Understanding, Retrieval, and Interpretation
arXiv cs.AI Research & Papers
BigFinanceBench: A Workflow-Grounded Benchmark for Financial-Research Agents
arXiv cs.AI Research & Papers
PyraMathBench: Evaluating and Improving Mathematical Capability in Large Language Models
arXiv cs.AI Research & Papers
Reasoning Structure of Large Language Models
arXiv cs.AI Research & Papers
VeRO: A Harness for Agents to Optimize Agents
arXiv cs.AI Research & Papers
From Control Boundary to Insurance Claim: Reconstructing AI-Mediated Losses Through the C…
arXiv cs.AI Research & Papers
Leveraging BART to Assess CS1 C++ Programming Assignments using Rubric-based Criteria
arXiv cs.AI Research & Papers
Perceive Before Reasoning: A Pre-Reasoning Perception Framework for Efficient and Reliabl…
arXiv cs.AI Research & Papers
ConTraIRL: Factorized Contrastive Abstractions for Transferable IRL
arXiv cs.AI Research & Papers
From Context to Skills: Can Language Models Learn from Context Skillfully?
arXiv cs.AI Research & Papers
AUGUSTE: Online-Learning dApp for Predictive URLLC Scheduling
arXiv cs.AI Research & Papers
Staying Alive: Uncensored Survival Analysis with Tabular Foundation Models
arXiv cs.AI Research & Papers
NetKV: Network-Aware Decode Instance Selection for Disaggregated LLM Inference
arXiv cs.AI Research & Papers
FLARE: Fine-Grained Diagnostic Feedback for LLM Code Refinement
arXiv cs.AI Research & Papers
TurtleAI: Benchmarking Multimodal Models for Visual Programming in Turtle Graphics
arXiv cs.AI Research & Papers
Building Reliable Long-Form Generation via Hallucination Rejection Sampling
arXiv cs.AI Research & Papers
AnchorMoE: Interpretable Time Series Classification via Anchor-Routed MoE
arXiv cs.AI Research & Papers
Re-Evaluating Continual Learning with Few-Shot Adaptation
arXiv cs.AI Research & Papers
PHASER: Phase-Aware and Semantic Experience Replay for Vision-Language-Action Models
arXiv cs.AI Research & Papers
CauTion: Knowing When to Trust LLMs for Ensemble Causal Discovery