Explorar

Noticias de IA

30329 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
From Representations to Behaviors: Exploring the Person-Situation-Behavior Triad in LLMs
arXiv cs.AI Research & Papers
A Graph-Native Bitemporal Memory Store for Conversational AI Agents
arXiv cs.AI Research & Papers
MultivationBench: A Benchmark for Multimodal Sequential Motivation Reasoning
arXiv cs.AI Security & Safety
The Capability Paradox: How Smarter Auditors Make Multi-Agent Systems Less Secure
arXiv cs.AI Research & Papers
HiFloat4 Format for End-To-End Reinforcement Learning Post-Training of Large Language Mod…
arXiv cs.AI Research & Papers
MathNet: a Global Multimodal Benchmark for Mathematical Reasoning and Retrieval
arXiv cs.AI Research & Papers
Position: Evaluation Scores Are Perishable Knowledge Claims
arXiv cs.AI Research & Papers
Think Short, Defer Smart, Act, and Repeat: Calibrated Reasoning and Uncertainty-Aware Def…
arXiv cs.AI Research & Papers
GoGoTB: Agentic RTL Verification with Specification-Grounded Coverage Closure
arXiv cs.AI Research & Papers
CaM-Wolf: Causal-Aware Multimodal Agents for Social Deduction Games
arXiv cs.AI Research & Papers
Misalignment Has a Personality: A Big Five Account of Emergent Misalignment
arXiv cs.AI Research & Papers
SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution
arXiv cs.AI Research & Papers
GuidedRAG: Semantic Steering of Retrieval-Augmented Generation
arXiv cs.AI Research & Papers
Model-Driven Requirements Configuration with Three-Valued Uncertainty Scoring
arXiv cs.AI Research & Papers
How does downsampling affect needle electromyography signals? A generalisable workflow fo…
arXiv cs.AI Research & Papers
FAS-R1: A Unified Multi-Task MLLM for Reasoning Face Anti-Spoofing
arXiv cs.AI Research & Papers
When benchmark inferences do not compose: Projectibility in AI evaluation
arXiv cs.AI Research & Papers
Even More Deception: Objective Misalignment in Mixed-Motive LLM Multi-Agent Systems
arXiv cs.AI Research & Papers
GuideSkill: Evolving Executable LLM Agent Skills for Guideline-Grounded Clinical Reasoning
arXiv cs.AI Research & Papers
Optimizing Sensor Placement for Hydrogen Leak Detection in Enclosed Infrastructure: A Com…
arXiv cs.AI Research & Papers
ClinLens: Towards Long-Horizon Coding Agents for Longitudinal Multimodal Clinical Data Sc…
arXiv cs.AI Research & Papers
HealthSLM-Bench: Benchmarking Small Language Models for Mobile and Wearable Healthcare Mo…
arXiv cs.AI Research & Papers
Decision-oriented joint optimization of evidence fusion based on event-conditioned credib…
arXiv cs.AI Research & Papers
Large-Scale ChatBot Validation Through Customer Digital Twin Simulations
arXiv cs.AI Research & Papers
DLAM: Distributional Latent Actions with Temporal Constraints
arXiv cs.AI Research & Papers
ReCo: Reweighting GRPO Against Distributional Concentration
arXiv cs.AI Research & Papers
Budget-Aware LLM Discovery via Cost-Calibrated Frontier Utility
arXiv cs.AI Research & Papers
Linguistic Monoculture in LLM-Assisted Language Use
arXiv cs.AI Research & Papers
AI as Friction for Reflection Support in Ideation
arXiv cs.AI Research & Papers
Crossing-Free Probabilistic K-Line Forecasts Without Retraining