Explorar

Noticias de IA

37834 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Benchmarking Positional Encoding Strategies for Transformer-Based EEG Foundation Models
arXiv cs.AI Research & Papers
Influence-Guided Symbolic Regression: Scientific Discovery via LLM-Driven Equation Search…
arXiv cs.AI Research & Papers
Mind-Omni: A Unified Multi-Task Framework for Brain-Vision-Language Modeling via Discrete…
arXiv cs.AI Research & Papers
Differentiable Belief-based Opponent Shaping
arXiv cs.AI Research & Papers
BlockBatch: Multi-Scale Consensus Decoding for Efficient Diffusion Language Model Inferen…
arXiv cs.AI Research & Papers
ProjectionBench: Evaluating Scientific Hypothesis Generation in LLMs Under Progressive In…
arXiv cs.AI Research & Papers
BEAMS: Benchmarking and Evaluating AI for Modeling and Simulation
arXiv cs.AI Research & Papers
Topological Order in Neural Wavefunctions
arXiv cs.AI Research & Papers
Mechanistic origins of catastrophic forgetting: why RL preserves circuits better than SFT?
arXiv cs.AI Research & Papers
DynSess: Dynamic Session-Level Evaluation and Optimization Framework for Role-Playing Age…
arXiv cs.AI Research & Papers
PrismFlow: Residual Dynamics for Flow Matching in Time-Series Generation
arXiv cs.AI Research & Papers
AgentDoG 1.5: A Lightweight and Scalable Alignment Framework for AI Agent Safety and Secu…
arXiv cs.AI Research & Papers
SURGENT: A Surgical Multi-Agent Assistance System Across the Perioperative Workflow
arXiv cs.AI Research & Papers
Locally Coherent, Globally Incoherent: Bounding Compositional Incoherence in Multi-Compon…
arXiv cs.AI Research & Papers
PRAIB: Peer Review AI Benchmark of Behaviour of LLM-Assisted Reviewing
arXiv cs.AI Research & Papers
OptSkills: Learning Generalizable Optimization Skills from Problem Archetypes via Cluster…
arXiv cs.AI Research & Papers
Hallucination Mitigation with Agentic AI, Nested Learning, and AI Sustainability via Sema…
arXiv cs.AI Research & Papers
Who can we trust? LLM-as-a-jury for Comparative Assessment
arXiv cs.AI Research & Papers
Continuity and Ordinality Matter: Constraining Time Series Tokens for Effective Time Seri…
arXiv cs.AI Research & Papers
TRACE: Toulmin-based Reasoning Assessment through Constructive Elements for LLM CoT Evalu…
arXiv cs.AI Research & Papers
Redundant or Necessary? A Benchmark for Detecting Redundant Steps in Agent Trajectories
arXiv cs.AI Research & Papers
LogDx-CI: Benchmarking Log Reduction Tools for LLM Root-Cause Diagnosis
arXiv cs.AI Research & Papers
It`s All About Speed: AI`s Impact on Workflow in Music Production
arXiv cs.AI Research & Papers
Meta-Programming for Linear-time Temporal Answer Set Programming
arXiv cs.AI Research & Papers
Compass: Navigating Global Marine Lead Data Integration through Expert-Guided LLM Agent
arXiv cs.AI Research & Papers
Practitioner Beliefs and Behaviors in AI-Enhanced Education: DOT Framework Survey Evidence
arXiv cs.AI Security & Safety
Measuring Real-World Prompt Injection Attacks in LLM-based Resume Screening
arXiv cs.AI Research & Papers
Ultra-Reduced-Impact-Encased-Logging (URIEL): propose a new method for selective sustaina…
arXiv cs.AI Research & Papers
Cookie-Bench: Continuous On-screen Key Interaction Evaluation for Web Generation
arXiv cs.AI Research & Papers
From GPS Points to Travel Patterns: Flexible and Semantic Trajectory Generation with LLMs