Explorar

Noticias de IA

37834 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Towards Faithful Agentic XAI: A Verification Method and an Open-World Benchmark for Bette…
arXiv cs.AI Research & Papers
Singular Vectors of Attention Heads Align with Features
arXiv cs.AI Research & Papers
Dr-CiK: A Testbed for Foresight-Driven Agents
arXiv cs.AI Research & Papers
DiagramRAG: A Lightweight Framework to Retrieve Scientific Diagram for Figure Generation
arXiv cs.AI Research & Papers
The Shape of Overthinking: Backtracking Bursts in Long Reasoning Traces
arXiv cs.AI Research & Papers
Geometry of Human Perceptual Domains Emerges Transiently in LLM Representations
arXiv cs.AI Research & Papers
Do Agents Think Deeper? A Mechanistic Investigation of Layer-Wise Dynamics in Sequential …
arXiv cs.AI Research & Papers
Harness-Bench: Measuring Harness Effects across Models in Realistic Agent Workflows
arXiv cs.AI Research & Papers
Show, Don't TELL: Explainable AI-Generated Text Detection
arXiv cs.AI Research & Papers
SKILLC: Learning Autonomous Skill Internalization in LLM Agents via Contrastive Credit As…
arXiv cs.AI Research & Papers
LASER: Learning Active Sensing for Continuum Field Reconstruction
arXiv cs.AI Research & Papers
Compositional Consistency-Guided Decoding for Three-Way Logical Question Answering
arXiv cs.AI Research & Papers
PortBench: A Correlation-Aware, Full-Pipeline Benchmark for LLM-Driven Portfolio Manageme…
arXiv cs.AI Research & Papers
AIBuildAI-2: A Knowledge-Enhanced Agent for Automatically Building AI Models
arXiv cs.AI Research & Papers
Causal Direct Preference Optimization for Distributionally Robust Generative Recommendati…
arXiv cs.AI Research & Papers
When Context Flips, Safety Breaks: Diagnosing Brittle Safety in Aligned Language Models
arXiv cs.AI Research & Papers
Revealing Algorithmic Deductive Circuits for Logical Reasoning
arXiv cs.AI Research & Papers
Democratizing Large-Scale Re-Optimization with LLM-Guided Model Patches
arXiv cs.AI Research & Papers
Got a Secret? LLM Agents Can't Keep It: Evaluating Privacy in Multi-Agent Systems
arXiv cs.AI Research & Papers
The Well-Tempered Classifier: Some Elementary Properties of Temperature Scaling
arXiv cs.AI Research & Papers
The Script is All You Need: An Agentic Framework for Long-Horizon Dialogue-to-Cinematic V…
arXiv cs.AI Research & Papers
Differential syntactic and semantic encoding in LLMs
arXiv cs.AI Research & Papers
A Policy-Driven Runtime Layer for Agentic LLM Serving
arXiv cs.AI Research & Papers
JMedEthicBench: A Multi-Turn Conversational Benchmark for Evaluating Medical Safety in Ja…
arXiv cs.AI Research & Papers
Cyberbullying Governance on Social Media: A Unified Framework from Content Identification…
arXiv cs.AI Research & Papers
RULER: Representation-Level Verification of Machine Unlearning
arXiv cs.AI Research & Papers
HGMEM: Hypergraph-based Working Memory to Improve Multi-step RAG for Long-Context Complex…
arXiv cs.AI Research & Papers
Optimal and Diffusion Transports in Machine Learning
arXiv cs.AI Research & Papers
Why LLMs Fail at Causal Discovery and How Interventional Agents Escape
arXiv cs.AI Research & Papers
Behavioural Analysis of Alignment Faking