Explorar

Noticias de IA

37834 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Medical Causal Hypothesis Verification with Large Language Models
arXiv cs.AI Research & Papers
Residual Sparsification via Output Importance for Compressing Mixture-of-Experts LLMs
arXiv cs.AI Research & Papers
VoiceLongMemEval: Do Assistants Remember How You Sounded?
arXiv cs.AI Research & Papers
Same Request, Different Boundary: Evaluating Cybersecurity Assistance across Conversation…
arXiv cs.AI Research & Papers
SpecMind: Enabling Spectrum Intelligence via Multi-Agent Hybrid Retrieval-Augmented Gener…
arXiv cs.AI Research & Papers
REVISE: Validity-Guided Recovery for Online Revisions in Agent Workflows
arXiv cs.AI Security & Safety
Optimizing Byzantine Node Placement in Decentralized Federated Learning
arXiv cs.AI Research & Papers
SOVER: Formal Certification of Optimization Reformulations via LLM-Assisted SMT Verificat…
arXiv cs.AI Security & Safety
Defense-as-Skill: Evolving Runtime Guard Skill for Skill-Augmented Agents
arXiv cs.AI Research & Papers
One Policy, Any Budget: Internalizing Budget-Aware Search via Reinforcement Learning
arXiv cs.AI Research & Papers
Neurosymbolics for Data Engineering: Achieving Long Context Token Reduction Without Finet…
arXiv cs.AI Research & Papers
Self-Reports Are Not Verification: Environment-Grounded Auditing of LLM Operators in Evol…
arXiv cs.AI Research & Papers
Attention Sensitivity Is Not Enough: Dissociating Attention-Level and Behavioural In-Cont…
arXiv cs.AI Research & Papers
Recursive Criticality of AI Self-Improvement
arXiv cs.AI Research & Papers
AI Should Not Only Be Helpful. It Should Be Contingent. Artificial Intimacy, Sycophancy, …
arXiv cs.AI Research & Papers
Selective Agent Guidance via Entropy: Learning Autonomous Policies from Imperfect VLM Tea…
arXiv cs.AI Research & Papers
InteractBench: Benchmarking LLMs on Competitive Programming under Unrevealed Information
arXiv cs.AI Research & Papers
Towards a Belief-Based World Model for LLM Agents
arXiv cs.AI Research & Papers
SAGE: State-Grounded, Abstention-Aware Evaluation of Task-Oriented Dialogue Agents
arXiv cs.AI Research & Papers
RAPIDMap: Rapid Multi-Agent Pipeline for Interpretable Disaster Mapping from Satellite an…
arXiv cs.AI Research & Papers
Dr. Claw: An AI Scientist Workspace for Vibe Research
arXiv cs.AI Research & Papers
Conversation Coach: A Voice-enabled AI System that Helps Practice Difficult Workplace Con…
arXiv cs.AI Research & Papers
Human-AI Co-Interpretation for Responsible AI: A Hermeneutic Perspective
arXiv cs.AI Research & Papers
A Stable Aggregation Method for Quantum Federated Learning
arXiv cs.AI Research & Papers
Parsing the Stream: A Live Trace Model for Long-Horizon Agents and Their Observers
arXiv cs.AI Research & Papers
Superposed Latent Autoencoder
arXiv cs.AI Research & Papers
EdiTikZ: Scientific Figure Editing from Revision Trajectories
arXiv cs.AI Research & Papers
Can LLMs Discover Scientific Laws in Real and Parallel Worlds?
arXiv cs.AI Research & Papers
Neuro-Symbolic Geometric Abstraction (NeuSOGA): From Observations to Symbolic Mathematica…
arXiv cs.AI Research & Papers
ChatDev 2.0: A No-Code Multi-Agent Platform for Developing Everything