Explorar

Noticias de IA

22116 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Toward Generalist Autonomous Research via Hypothesis-Tree Refinement
arXiv cs.AI Research & Papers
Characterizing Software Aging in GPU-Based LLM Serving Systems
arXiv cs.AI Research & Papers
Agents All the Way Down; A Methodology for Building Custom AI Agents from Substrate to Pr…
arXiv cs.AI Research & Papers
Fine-tuning Multi-modal LLMs with ART: Art-based Reinforcement Training
arXiv cs.AI Research & Papers
LASA: A Weak Supervision Method for Open-Vocabulary Scene Sketch Semantic Segmentation
arXiv cs.AI Research & Papers
Architecture-Aware Reinforcement Learning Makes Sliding-Window Attention Competitive in M…
arXiv cs.AI Research & Papers
When Researchers Say Mental Model/Theory of Mind of AI, What Are They Really Talking Abou…
arXiv cs.AI Research & Papers
Causal Emotion Recognition in Conversation: Context Saturation and Discourse-Marker Evide…
arXiv cs.AI Research & Papers
To Intervene or Not: Guiding Inference-time Alignment with Probabilistic Model Blending
arXiv cs.AI Research & Papers
Sparsified Kolmogorov-Arnold Networks for Interpretable Quantum State Tomography
arXiv cs.AI Research & Papers
Certifiable Safe RLHF: Semantic Grounding and Fixed Penalty Constraint Optimization for S…
arXiv cs.AI Research & Papers
Dual-Stance Evaluation of Sycophancy: The Structure of Agreement and the Limits of Interv…
arXiv cs.AI Research & Papers
BioDivergence: A Benchmark and Evaluation Framework for Hidden Contextual Contradictions …
arXiv cs.AI Research & Papers
ProcessThinker: Enhancing Multi-modal Large Language Models Reasoning via Rollout-based P…
arXiv cs.AI Research & Papers
The Impossibility of Eliciting Latent Knowledge
arXiv cs.AI Research & Papers
The Environmental Cost of LLMs in AIED: Reporting and Practices
arXiv cs.AI Research & Papers
AnchorEdit: Maintaining Temporal Consistency in Multi-turn Image Editing via Causal Memory
arXiv cs.AI Research & Papers
Making Models Unmergeable via Scaling-Sensitive Loss Landscape
arXiv cs.AI Research & Papers
Calibration Drift Under Reasoning: How Chain-of-Thought Budgets Induce Overconfidence in …
arXiv cs.AI Research & Papers
SkillJuror: Measuring How Agent Skill Organization Changes Runtime Behavior
arXiv cs.AI Research & Papers
Hey Chat, Can You Teach Me? Structuring Socratic Dialogue for Human Learning in the Wild
arXiv cs.AI Research & Papers
Ouroboros-Spatial: Closing the Data-Model Loop for Spatial Reasoning
arXiv cs.AI Research & Papers
MedCTA: A Benchmark for Clinical Tool Agents
arXiv cs.AI Research & Papers
Noise-Aware Framework for Correcting Corrupted Labels
arXiv cs.AI Research & Papers
TokenRatio: Principled Token-Level Preference Optimization via Ratio Matching
arXiv cs.AI Research & Papers
Internet of Everything in the 6G Era: Paradigms, Enablers, Potentials and Future Directio…
arXiv cs.AI Research & Papers
Estimating Tail Risks in Language Model Output Distributions
arXiv cs.AI Research & Papers
Bimanual Robot Manipulation via Multi-Agent In-Context Learning
arXiv cs.AI Research & Papers
LaQual: An Automated Framework for LLM App Quality Evaluation
arXiv cs.AI Research & Papers
Cross-Layer Discrete Concept Discovery for Interpreting Language Models