Explorar

Noticias de IA

30294 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
TerraNova: A Foundation Model for the Anthropocene
arXiv cs.AI Research & Papers
ARB: A Matched Authorship-Rewriting Benchmark Dataset for AI-Text Detector Evaluation
arXiv cs.AI Research & Papers
TraceViT: Grounded Trace Supervision for Visual Abstract Reasoning
arXiv cs.AI Research & Papers
SERUM: State Extraction and Refinement for User Modeling
arXiv cs.AI Research & Papers
Compiled AI: Deterministic Code Generation for LLM-Based Workflow Automation
arXiv cs.AI Research & Papers
The Theoretical Foundation of Socratic Tests: Dynamic, Multimodal, Conversational Examina…
arXiv cs.AI Research & Papers
Federated Foundation Models Fine-Tuning with Heterogeneous Compressed Clients
arXiv cs.AI Research & Papers
GeoRA: Geometry-Aware Low-Rank Adaptation for RLVR
arXiv cs.AI Research & Papers
Harnessing the Wisdom of LLM Crowds through Complementarity-Driven Iterative Collaboration
arXiv cs.AI Research & Papers
Knowledge Restoration-driven Prompt Optimization: Unlocking LLM Potential for Open-Domain…
arXiv cs.AI Research & Papers
WebCoderBench: Benchmarking Web Application Generation with Comprehensive and Interpretab…
arXiv cs.AI Research & Papers
Towards the Holographic Characteristic of LLMs for Efficient Short-text Generation
arXiv cs.AI Research & Papers
AREA3D: Active Reconstruction Agent with Unified Feed-Forward 3D Perception and Vision-La…
arXiv cs.AI Research & Papers
Evidence-Grounded Constraint Checking in Construction Documents
arXiv cs.AI Research & Papers
Learning Lookahead Lemmas for Neural Network Verification
arXiv cs.AI Research & Papers
Improving scDiffusion with Sparsity-Biased Classifier-Free Guidance
arXiv cs.AI Research & Papers
Auto-JEPA: A Latent World Model of Continuous Intent for End-to-End Autonomous Driving
arXiv cs.AI Research & Papers
Adjudicated Captioning: Multi-Agent Alignment Scoring and Consensus-Distilled Beam Arbitr…
arXiv cs.AI Research & Papers
MMShopBench: A Real-Log Benchmark for Multimodal, Multi-Turn Shopping Agents
arXiv cs.AI Research & Papers
MerchantBench: Benchmarking LLM Agents for Long-Term Coherence in E-Commerce Operations
arXiv cs.AI Research & Papers
What Makes a Sale? Simulating End-to-End Seller--Buyer Retail Dynamics with LLM Agents
arXiv cs.AI Research & Papers
Retrieval-Driven Training-Free AI-Generated Video Attribution
arXiv cs.AI Security & Safety
DiffAttack: Evasion Attacks Against Face Recognition via Latent Diffusion Models
arXiv cs.AI Research & Papers
Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowle…
arXiv cs.AI Research & Papers
Step-Level Visual Grounding Faithfulness Predicts Out-of-Distribution Generalization in L…
arXiv cs.AI Research & Papers
Wrong Code, Right Structure: Learning Netlist Representations from Imperfect LLM-Generate…
arXiv cs.AI Research & Papers
Preconditioned Test-Time Adaptation for Out-of-Distribution Debiasing in Narrative Genera…
arXiv cs.AI Research & Papers
MAGA: Multi-Platform Self-Fusion of GUI Agents via Structured Action Distillation
arXiv cs.AI Research & Papers
StaQ: a Finite Memory Approach to Discrete Action Policy Mirror Descent
arXiv cs.AI Research & Papers
Agentic Harness for Real-World Compilers