Explorar

Noticias de IA

27413 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
The First EgoCross Challenge at EgoVis 2026: Cross-Domain Egocentric Video Question Answe…
arXiv cs.AI Research & Papers
Revealed Rationality: Label-Free Evaluation and Regularization from Representation Theore…
arXiv cs.AI Research & Papers
ORACLE: A Multi-Objective Reinforcement Learning-Based Analog Circuit Design Optimizer wi…
arXiv cs.AI Research & Papers
When Does Latent Communication Pay? A Causal Audit of Relayed KV Caches in Multi-Agent LL…
arXiv cs.AI Research & Papers
Scrouting: Cost-Aware Routing of Coding Agents by Scouting the Repository First
arXiv cs.AI Research & Papers
COMPAS: Difficulty-Aware Joint Search for Optimizing Code Generation
arXiv cs.AI Research & Papers
Efficient Online Lexicographic Generalized Low-Rank Matrix Bandits
arXiv cs.AI Research & Papers
Compass: Continuously Aligning Social Media Feeds via In-Situ Reflections
arXiv cs.AI Research & Papers
A Unified Model for Cross-Domain Clone Detection via Model Merging
arXiv cs.AI Research & Papers
Visualizing Graph-to-Answer Mechanism Recovery in Materials-Science Hypothesis Generation
arXiv cs.AI Research & Papers
InsightEmb: Learning Action-Intent Embeddings for Agentic Insight Retrieval
arXiv cs.AI Research & Papers
Design Choices That Matter: A Functional ANOVA Analysis for Remote Sensing Multi-Label Cl…
arXiv cs.AI Research & Papers
Active-SWE: Benchmarking Coding Agents for Proactive Bug Fixing without Issue Reports
arXiv cs.AI Research & Papers
ABSeeker: Training Long-Horizon Search Agents via Answer-Backtracked Credit Assignment
arXiv cs.AI Research & Papers
NodeJEPA: Structure-Conditioned Latent Prediction for Node-Level Graph Self-Supervised Le…
arXiv cs.AI Research & Papers
A/B Agent: A Self-Evolving Agent for Strategy Iteration in Industrial A/B Testing
arXiv cs.AI Research & Papers
Leak-Resistant Unlearning: A New Benchmark for Evaluating Multi-Hop Reasoning Consistency…
arXiv cs.AI Research & Papers
Architectural Implications of Agentic AI Workflows
arXiv cs.AI Research & Papers
NeuMoSync: End-to-End Neuromodulatory Control for Plasticity and Adaptability in Continua…
arXiv cs.AI Research & Papers
AgentForge: An Immersive Role-Playing Platform for Learning Agentic Software Engineering
arXiv cs.AI Research & Papers
Perception Before Reasoning: Dynamic Latent Reasoning for Video Understanding and Questio…
arXiv cs.AI Research & Papers
Out-Of-The-Loop Multi-Fidelity Bayesian Optimization
arXiv cs.AI Research & Papers
Recurrent Residual Quantization: A Progressive Multi-Precision Representation for LLMs
arXiv cs.AI Research & Papers
FinPerMA: A Theory-Informed, Event-Grounded Personalized-Memory Benchmark for LLM Agents
arXiv cs.AI Research & Papers
FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Profe…
arXiv cs.AI Research & Papers
Chain-of-Thought Monitoring Can Be Unreliable in Implicit-Influence Settings
arXiv cs.AI Research & Papers
PhysMind: From Video to Executable Worlds for Training-Free Physical Reasoning
arXiv cs.AI Research & Papers
A Model Merging Approach for Continual MLLM Unlearning
arXiv cs.AI Research & Papers
GUARD: Grounding Uncertainty and Ablation-Based Risk Detection for Diffusion-Based VLAs
arXiv cs.AI Research & Papers
Beyond Linear Dynamics: Neural Bilinear Dynamical Models for Time Series Forecasting