Explorar

Noticias de IA

27413 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Foresight Without Seeing: Latent Futures for World Action Models
arXiv cs.AI Research & Papers
HUGIN: Enhancing Vision-Language Planning for Autonomous Logistics Sorting
arXiv cs.AI Research & Papers
FrontierFinance: A Challenging Benchmark for Measuring Frontier Intelligence of Finance A…
arXiv cs.AI Research & Papers
AgenticTwin: An Agentic LLM Framework Integrated with Digital Twin for Anomaly Detection
arXiv cs.AI Research & Papers
XBridge: Entity-Grounded Latent Bridge for Heterogeneous LLM Communication
arXiv cs.AI Research & Papers
The Sleeping Agent: What Gist-Based Context Compression Loses and Why
arXiv cs.AI Research & Papers
Harness-IF: Evaluating Instruction Following Across Instruction Surfaces in Coding Agents
arXiv cs.AI Research & Papers
Proportional Analogies on Probability Distributions via Bayesian Updating
arXiv cs.AI Research & Papers
Two-Stage Deformable-Convolutional Inverse Design of Nanophotonic Absorbers from Optical …
arXiv cs.AI Research & Papers
DexterSQL: Deep Schema Exploration and Rule-based Correction for Text-to-SQL Generation
arXiv cs.AI Research & Papers
DreamFly: Causal Memory and Receding-Horizon Diffusion Planning for Aerial Vision-Languag…
arXiv cs.AI Research & Papers
Causal Agent based on Large Language Model
arXiv cs.AI Research & Papers
OpenAg: Democratizing Agricultural Intelligence
arXiv cs.AI Research & Papers
User-Assisted Collaborative Distributed Inference for Efficient QoS-Aware Autoscaling
arXiv cs.AI Research & Papers
SteeringSafety: Benchmarking Representation Steering in LLMs Across Safety Perspectives
arXiv cs.AI Research & Papers
Credo: Declarative Control of LLM Pipelines via Beliefs and Policies
arXiv cs.AI Research & Papers
HexEval: An Evidence-Driven Hexagonal Framework for Multidimensional Scholar Assessment
arXiv cs.AI Research & Papers
Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams
arXiv cs.AI Research & Papers
A Forced-Structure Reduction and Verifiable Bounds for Conway's 99-Graph
arXiv cs.AI Research & Papers
Poor Man's Agentic Modeling: Simulating Large LLM-Agent Societies on a Laptop
arXiv cs.AI Research & Papers
Probably Approximately Correct Maximum A Posteriori Inference
arXiv cs.AI Research & Papers
Cavity-Enhanced Collective Quantum Processing with Polarization-Encoded Qubits
arXiv cs.AI Research & Papers
Post-Training with Policy Gradients: Optimality and the Base Model Barrier
arXiv cs.AI Research & Papers
Representation Finetuning for Continual Learning
arXiv cs.AI Research & Papers
VLM2Rec: Resolving Modality Collapse in Vision-Language Model Embedders for Multimodal Se…
arXiv cs.AI Research & Papers
REVERE: Reflective Evolving Research Engineer
arXiv cs.AI Research & Papers
Fingerprinting Text-to-Image Diffusion Models via Collapsed Generation
arXiv cs.AI Research & Papers
When the API Speaks the Wrong Language: Revisiting Post-Training for Multilingual Tool Use
arXiv cs.AI Research & Papers
High-dimensional Multi-objective Bayesian Optimization with Learned Variable Interactions
arXiv cs.AI Research & Papers
Robust and Efficient Noisy-Label Time-Series Classification via Dynamic Time Warping Base…