Explorar

Noticias de IA

29341 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
BEST-KAG: Enhancing Question Answering of Building Engineering Standards with Multimodal …
arXiv cs.AI Research & Papers
VQ-bench: A Composable Vector Quantization Framework
arXiv cs.AI Research & Papers
Low-Interaction-Rank Learning: Unifying Multiplicative Dual-Encoder Heads
arXiv cs.AI Research & Papers
Hybrid-Policy Self-Editing for Composable Unstructured Knowledge Editing
arXiv cs.AI Research & Papers
The Wording Effect: Quantifying Two-Way Drift in LLM Benchmark Performance
arXiv cs.AI Research & Papers
REOPD: Reliability-Adaptive Reward Extrapolation for On-Policy Distillation
arXiv cs.AI Research & Papers
Detecting a Route Flip Is Easier Than Knowing Whether to Fix It: Causal Route-Mediated Da…
arXiv cs.AI Research & Papers
AutoWorldModel-Bench: A State-Centric Benchmark for Automated World-Model Research
arXiv cs.AI Research & Papers
A Conceptual Framework for Enhancing Workforce Readiness for Smart Manufacturing in the A…
arXiv cs.AI Research & Papers
Towards the Harness of Embodied Agents
arXiv cs.AI Research & Papers
Who Thinks Best Depends on How Long You Let Them: Budget-Dependent Rankings in LLM Evalua…
arXiv cs.AI Research & Papers
Reinforcement Learning based DBMS Buffer Pool Auto-Tuning for Optimal Memory Utilization
arXiv cs.AI Research & Papers
From Monolithic to Modular: Segment-level Automatic Prompt Optimization
arXiv cs.AI Research & Papers
Distribird: Literature-Informed Prior Distribution Design for Bayesian Model Calibration
arXiv cs.AI Research & Papers
Conformity Mitigations in Large Language Models Lie on a Single Resistance-Receptivity Fr…
arXiv cs.AI Research & Papers
Uncertainty-Aware and Explainable Ensemble Deep Learning Framework for Multi-Class Skin L…
arXiv cs.AI Security & Safety
SegPAR: Class-Centric Decision-Based Sparse Attack for Semantic Segmentation
arXiv cs.AI Research & Papers
Is Per-Agent Policy Composition Safe? Rethinking Successor-Feature Transfer in Cooperativ…
arXiv cs.AI Research & Papers
Dynamic Governance of Multi-LLM Agent Systems for Collaborative Conversational Outcomes
arXiv cs.AI Research & Papers
Conflict and Congruency Effects in Large Language Models: In-Weight and In-Context Compet…
arXiv cs.AI Research & Papers
TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs
arXiv cs.AI Research & Papers
GCPO: Diagnosing and Constraining Subspace Geometry in Rollout RL for LLMs
arXiv cs.AI Research & Papers
GRPO for Financial Advice Generation: Outperforming Commercial LLMs under CATE Evaluation
arXiv cs.AI Research & Papers
Toward Meaningful Transparency for AI Chatbots: Disclosing Persuasive Intent Reduces Pers…
arXiv cs.AI Research & Papers
Semantic Lenia: Emergence of Homeostatic Solitons within the Semantic Space of Large Lang…
arXiv cs.AI Research & Papers
Adaptive Hybrid Particle Swarm Optimization with Gradient Descent
arXiv cs.AI Research & Papers
LinearKV: One Cached State Suffices for Position-Independent Caching in Hybrid LLMs
arXiv cs.AI Research & Papers
Confidence Calibration of Deep Learning Systems
arXiv cs.AI Research & Papers
Fingerprinting Text-to-Image Diffusion Models via Collapsed Generation
arXiv cs.AI Research & Papers
Harness-IF: Evaluating Instruction Following Across Instruction Surfaces in Coding Agents