Explorar

Noticias de IA

27413 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Clark Hash: Stateless Sparse Johnson-Lindenstrauss Quantization for Neural Embeddings
arXiv cs.AI Research & Papers
Hierarchical Prompt-Domain Control and Learning for Resource-Constrained Agentic Language…
arXiv cs.AI Research & Papers
You Are in Control of Your State: Why Human Outcomes Are Controllable Through Causal Stat…
arXiv cs.AI Research & Papers
Confidence-Orchestrated Self-Evolution against Uncertain LLM Feedback
arXiv cs.AI Research & Papers
AsyncTool: Evaluating the Asynchronous Function Calling Capability under Multi-Task Scena…
arXiv cs.AI Research & Papers
Detecting and Mitigating the Correct-Answer Extinction Window in Test-Time Reinforcement …
arXiv cs.AI Research & Papers
Geometry of Human Perceptual Domains Emerges Transiently in LLM Representations
arXiv cs.AI Research & Papers
Do Agents Think Deeper? A Mechanistic Investigation of Layer-Wise Dynamics in Sequential …
arXiv cs.AI Research & Papers
Harness-Bench: Measuring Harness Effects across Models in Realistic Agent Workflows
arXiv cs.AI Research & Papers
Show, Don't TELL: Explainable AI-Generated Text Detection
arXiv cs.AI Research & Papers
Structured Belief State and the First Precision-Aware Benchmark for LLM Memory Retrieval
arXiv cs.AI Research & Papers
SKILLC: Learning Autonomous Skill Internalization in LLM Agents via Contrastive Credit As…
arXiv cs.AI Research & Papers
PortBench: A Correlation-Aware, Full-Pipeline Benchmark for LLM-Driven Portfolio Manageme…
arXiv cs.AI Research & Papers
AIBuildAI-2: A Knowledge-Enhanced Agent for Automatically Building AI Models
arXiv cs.AI Research & Papers
When Context Flips, Safety Breaks: Diagnosing Brittle Safety in Aligned Language Models
arXiv cs.AI Research & Papers
Revealing Algorithmic Deductive Circuits for Logical Reasoning
arXiv cs.AI Research & Papers
Got a Secret? LLM Agents Can't Keep It: Evaluating Privacy in Multi-Agent Systems
arXiv cs.AI Research & Papers
A Policy-Driven Runtime Layer for Agentic LLM Serving
arXiv cs.AI Research & Papers
Cyberbullying Governance on Social Media: A Unified Framework from Content Identification…
arXiv cs.AI Research & Papers
RULER: Representation-Level Verification of Machine Unlearning
arXiv cs.AI Research & Papers
MemGuard: Preventing Memory Contamination in Long-Term Memory-Augmented Large Language Mo…
arXiv cs.AI Research & Papers
An LLM-Based Assistance System for Intuitive and Flexible Capability-Based Planning
arXiv cs.AI Research & Papers
LACUNA: Safe Agents as Recursive Program Holes
arXiv cs.AI Research & Papers
Extracting Small Translation Specialists from LLMs by Aggressively Pruning Experts
arXiv cs.AI Research & Papers
Learning to Assign Prediction Tasks to Agents with Capacity Constraints
arXiv cs.AI Research & Papers
Semantic Flow Regularization: Teaching LLMs to Generate Diverse Yet Coherent Responses
arXiv cs.AI Research & Papers
When Think-with-Image Meets Safety: What Determines Multimodal Jailbreak Robustness?
arXiv cs.AI Research & Papers
Efficient Pre-Training of LLMs through Truncated SVD Layers
arXiv cs.AI Research & Papers
Snippet-Driven Supply Chain Discovery with LLMs: Scaling Visibility in China
arXiv cs.AI Research & Papers
Locality-Aware Redundancy Pruning for LLM Depth Compression