Explorar

Noticias de IA

29670 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
ASA: Backbone-Training-Free Representation Engineering for Tool-Calling Agents
arXiv cs.AI Research & Papers
MemCast: Memory-Driven Time Series Forecasting with Experience-Conditioned Reasoning
arXiv cs.AI Research & Papers
Structure-Preserving Learning Improves Geometry Generalization in Neural PDEs
arXiv cs.AI Research & Papers
Learning Evidence Highlighting for Frozen LLMs
arXiv cs.AI Research & Papers
Generating Concept Lexicalizations via Dictionary-Based Cross-Lingual Sense Projection
arXiv cs.AI Research & Papers
GRID: Scaling Task-Agnostic Inference in Continual Prompt Tuning
arXiv cs.AI Research & Papers
Quantifying Perception-Based Student Success with Generative AI: An Exploratory Monte Car…
arXiv cs.AI Research & Papers
ASyMOB: Algebraic Symbolic Mathematical Operations Benchmark
arXiv cs.AI Models & Releases
NuWa: Deriving Lightweight Class-Specific Vision Transformers for Edge Devices
arXiv cs.AI Research & Papers
When the Chain of Thought Knows Better: Failure Modes in Multi-Turn Reasoning Models
arXiv cs.AI Research & Papers
Learning What to Remember: Observability-Safe Memory Retention via Constrained Optimizati…
arXiv cs.AI Research & Papers
Expert-Level Crisis Detection in Mental Health Conversations
arXiv cs.AI Research & Papers
HIPIF: Hierarchical Planning and Information Folding for Long-Horizon LLM Agent Learning
arXiv cs.AI Research & Papers
A Reliable Fault Diagnosis Method Based on Belief Rule Base Consider Robustness Analysis
arXiv cs.AI Research & Papers
Recalling Too Well: Sycophancy Evaluation and Mitigation in Memory-Augmented Models
arXiv cs.AI Research & Papers
Null-Space Constrained Low-Rank Adaptation for Response-Specified Large Language Model Un…
arXiv cs.AI Research & Papers
Structure from Reasoning, Numbers from Search: On-Premise Open LLMs as Structural Priors …
arXiv cs.AI Research & Papers
CIAware-Bench: Benchmarking Control Intervention Awareness Across Frontier LLMs
arXiv cs.AI Research & Papers
A History-Aware Visually Grounded Critic for Computer Use Agents
arXiv cs.AI Research & Papers
ABC-Bench: An Agentic Bio-Capabilities Benchmark for Biosecurity
arXiv cs.AI Research & Papers
The Role of Feedback Alignment in Self-Distillation
arXiv cs.AI Research & Papers
More Human or More AI? Visualizing Human-AI Collaboration Disclosures in Journalistic New…
arXiv cs.AI Research & Papers
AI-Driven Analytics of Team-Teaching Talk: Acoustic Patterns across Experience, Cohorts a…
arXiv cs.AI Research & Papers
CollabSkill: Evaluating Human-Agent Collaboration On Real-World Tasks
arXiv cs.AI Research & Papers
Self-EmoQ: Plutchik-Guided Value-based Planning to Drive Streaming Emotional TTS
arXiv cs.AI Research & Papers
An LLM-Native Psychometric Instrument Does Not Predict LLM Behavior: Evidence Across 25 M…
arXiv cs.AI Research & Papers
LLM-Based Code Documentation Generation and Multi-Judge Evaluation
arXiv cs.AI Research & Papers
Can Multi-Agent LLMs Identify Their Peers? Stylometric Fingerprinting in Role-Constrained…
arXiv cs.AI Research & Papers
Using Probabilistic Programs to Train Inductive Reasoning in Large Language Models
arXiv cs.AI Research & Papers
Mitigating Manifold Departure: Uncertainty-Aware Subspace Rectification for Trustworthy M…