Explorar

Noticias de IA

27413 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
SPARC-Rad: A Multimodal Benchmark Dataset and Evaluation Pipeline for Spatial and Anatomi…
arXiv cs.AI Research & Papers
LLMBDC: Language Model for Biological Domains Oriented Clustering of Gene Ontology
arXiv cs.AI Research & Papers
GRAIN: Molecules Are Not the Right Granularity -- Active-Ingredient Modeling for Safe Med…
arXiv cs.AI Research & Papers
Conservation laws determine what physical learning remembers
arXiv cs.AI Research & Papers
ELECTRIC: Evidential Learning-Enhanced CT Reconstruction via Iterative Correction
arXiv cs.AI Research & Papers
Neural Circuit Function Inference with LLMs
arXiv cs.AI Research & Papers
Fast Generation of Representative Synthetic Dataset with Salsa to Train ATR Models with E…
arXiv cs.AI Research & Papers
Role Steering of Language Models for Social Simulations
arXiv cs.AI Research & Papers
Uncertainty-Aware Simulation-Based Inference for Operations Research with Large Language …
arXiv cs.AI Research & Papers
CITBench: A Comprehensive Benchmark for Interactive Tabular Data Processing with LLMs
arXiv cs.AI Research & Papers
Obshazard-bench: Benchmarking Multimodal Foundation Models for Real-Time Disaster Intelli…
arXiv cs.AI Research & Papers
DLLM-TTS: Block Discrete Diffusion Language Model for Text-to-Speech Synthesis
arXiv cs.AI Research & Papers
AgentMemBench: A Systematic Benchmark for Evaluating Long-Term Memory Management Strategi…
arXiv cs.AI Research & Papers
RubricReviewer: From Direct Critique to Objective and Comprehensive Rubric-Driven Peer Re…
arXiv cs.AI Research & Papers
Amplitude-Only FFN Intervention for Tool-Structured LLM Inference Method: Gated Evaluatio…
arXiv cs.AI Research & Papers
AtumAI: A Principled Framework for Agentic Generation of Datacenter Control-Plane Policies
arXiv cs.AI Research & Papers
A Taxonomy of Cognitive Capability Gaps in Generative and Agentic AI
arXiv cs.AI Research & Papers
Abduction Without a Body? Representational Grounding and the Abduction Loop for Scientifi…
arXiv cs.AI Research & Papers
CMuon: Accelerating and Stabilizing Diffusion Transformer Training via Chunked Momentum O…
arXiv cs.AI Research & Papers
Real-Time Detection and Repair of LLM Agent Failures
arXiv cs.AI Research & Papers
Infinite Trace Objectives with Finite Trace Techniques: Translating LTL to LTLf+
arXiv cs.AI Research & Papers
Right Answer, Wrong Method: Shortcut Hacking Misleads the Evaluation of LLM Reasoning on …
arXiv cs.AI Research & Papers
Agentic Commerce World: An Auditable and Verifiable Environment for Vibe Commerce
arXiv cs.AI Research & Papers
xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding
arXiv cs.AI Research & Papers
Cooperative Coevolution for Resource-Constrained Agentic LLM Post-Training
arXiv cs.AI Research & Papers
Chess on Ice: Curling Tactical Decision-Making via Backward Induction and Deep Reinforcem…
arXiv cs.AI Research & Papers
Faster-WAM: Do World Action Models Need Deep Action Modules?
arXiv cs.AI Research & Papers
KC-Agent: A Dual-Process Cognitive Architecture for Efficient ML Model Improvement
arXiv cs.AI Research & Papers
Shared Prefixes, Better Credit: Adaptive Routing for Multi-Agent Reasoning
arXiv cs.AI Research & Papers
Harness-R1: Learning to Edit Executable Runtime Harnesses from Agent Failure Trajectories