Explorar

Noticias de IA

29349 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Selective-Advantage Entropy-Adaptive Horizon GRPO: Asymmetric Token-Level Discounting for…
arXiv cs.AI Research & Papers
Willing but Unable: Separating Refusal from Capability in Code LLMs via Abliteration
arXiv cs.AI Developer Tooling
Evaluating CUDA Tile for AI Workloads on Hopper and Blackwell GPUs
arXiv cs.AI Research & Papers
PLAN-S: Bridging Planning with Latent Style Dynamics for Autonomous Driving World Models
arXiv cs.AI Research & Papers
Boosting Brain-to-Image Decoding with TRIBE v2 Data Augmentation
arXiv cs.AI Research & Papers
Memory is Reconstructed, Not Retrieved: Graph Memory for LLM Agents
arXiv cs.AI Research & Papers
RAS: a Reliability Oriented Metric for Automatic Speech Recognition
arXiv cs.AI Research & Papers
Evaluating Agentic Configuration Repair for Computer Networks
arXiv cs.AI Research & Papers
Executable Schema Contracts: From Automatic Ingestion to Multi-Source Retrieval
arXiv cs.AI Research & Papers
Bridging Domain Expertise and Generalization for Performance Estimation
arXiv cs.AI Research & Papers
Open-H-Embodiment: A Large-Scale Dataset for Enabling Foundation Models in Medical Roboti…
arXiv cs.AI Research & Papers
The Topological Trouble With Transformers
arXiv cs.AI Research & Papers
The Role of Instructional Guidance in Generative AI-Assisted Learning: Empirical Evidence…
arXiv cs.AI Research & Papers
The Score Hamiltonian: Mapping Diffusion Models to Adiabatic Transport
arXiv cs.AI Research & Papers
SoCRATES: Towards Reliable Automated Evaluation of Proactive LLM Mediation across Domains…
arXiv cs.AI Research & Papers
CausalPOI: Spatio-Temporal Graph-Based Causal Modeling for Cold-Start POI Check-in Foreca…
arXiv cs.AI Research & Papers
Benchmarking Emergent Coordination in Large-Scale LLM Populations: An Evaluation Framewor…
arXiv cs.AI Research & Papers
Towards Healthy Evolution: Exploring the Role and Mechanisms of Human-Agent Interaction i…
arXiv cs.AI Research & Papers
OneReason Technical Report
arXiv cs.AI Research & Papers
CogManip: Benchmarking Manipulative Behavior in Multi-Turn Interactions with Large Langua…
arXiv cs.AI Research & Papers
Soft Sequence Policy Optimization
arXiv cs.AI Research & Papers
When Tools Fail: Benchmarking Dynamic Replanning and Anomaly Recovery in LLM Agents
arXiv cs.AI Research & Papers
HANDOFF: Humanoid Agentic Task-Space Whole-Body Control via Distilled Complementary Teach…
arXiv cs.AI Research & Papers
Aligning Tree-Search Policies with Fixed Token Budgets in Test-Time Scaling of LLMs
arXiv cs.AI Research & Papers
SAGE: Scalable AI Governance & Evaluation
arXiv cs.AI Research & Papers
When Should Memory Stay Silent: Measuring Memory-Use Boundaries in Memory-Augmented Conve…
arXiv cs.AI Research & Papers
SpanNorm: Reconciling Training Stability and Performance in Deep Transformers
arXiv cs.AI Research & Papers
TAPO: Tool-Aware Policy Optimization via Credit Transfer for Multimodal Search Agents
arXiv cs.AI Research & Papers
EasyLens: A Training-Free Plug-and-Play Subtle-Lesion Representation Amplifier for Medica…
arXiv cs.AI Research & Papers
Microskill Architecture: A Modular Skill-Driven Framework for AI-Native Code Generation