WISE: A World Knowledge-Informed Semantic Evaluation for Text-to-Image Generation
Explorar
Noticias de IA
21863 elementos — filtrados, clasificados y sin duplicados
Rex: A Family of Reversible Exponential (Stochastic) Runge-Kutta Solvers
Building Trust in Black-box Optimization: A Comprehensive Framework for Explainability
Generalizing Graph Foundation Models via Hyperbolic Retrieval-Augmented Generation
Assessing and Mitigating Miscalibration in LLM-Based Social Science Measurement
Done, But Not Sure: Disentangling World Completion from Self-Termination in Embodied Agen…
X-RAY: Mapping LLM Reasoning Capability via Formalized and Calibrated Probes
When Should LLMs Be Less Specific? Selective Abstraction for Reliable Long-Form Text Gene…
PieArena: Ranking and Profiling Language Agents in Realistic Negotiation Scenarios
Calibration Data Trade-offs Across Capability Dimensions: Why Multi-Source Mixing Matters…
Evaluating LLMs' Effectiveness on Real-World Consumer Device Repair Questions
Human-Like Goalkeeping in a Realistic Football Simulation: a Sample-Efficient Reinforceme…
Approximating Probabilistic Inference in Statistical EL with Knowledge Graph Embeddings
Planning with Uncertainty: Symmetries, Policy Inference, and Solution Compression
SynCred-Bench: Benchmarking Synthetic Credibility in AI-Generated Visual Misinformation
Language Models Need Sleep: Learning to Self-Modify and Consolidate Memories
Quantifying Faithful Confidence Expression in Large Reasoning Models
AlignAtt4LLM: Fast AlignAtt for Decoder-Only LLMs at IWSLT 2026 Simultaneous Speech Trans…
P\textsuperscript{2}-DPO: Grounding Hallucination in Perceptual Processing via Calibratio…
PRISM: Synergizing Vision Foundation Models via Self-organized Expert Specialization
q0: Primitives for Hyper-Epoch Pretraining
The Impact of Configuring Agentic AI Coding Tools on Build-vs-Buy Decisions: A Study Prot…
Scalable On-Hardware Training of Quantum Neural Networks and Application to Clinical Data…
\textsc{CR-Seg}: Attention-Guided and CoT-Enhanced Coarse-to-Refined Reasoning Segmentati…
LiveBand: Live Accompaniment Generation in the Audio Domain
Merit or networks? What decides where research is published
Tool-Aware Optimization with Entropy Guidance for Efficient Agentic Reinforcement Learning
CoEval: Ranking Language Models for Custom Tasks Without Labeled Data or Trustworthy Benc…
When Attention Collapses: Stage-Aware Visual Token Pruning from Structure to Semantics
Learned Non-Maximum Suppression for 3D Object Detection