Explorar

Noticias de IA

27413 elementos — filtrados, clasificados y sin duplicados

Hugging Face Daily Papers Research & Papers
A Unified and Reproducible Experimentation Framework for Speech Understanding
arXiv cs.AI Research & Papers
Rooted Absorbed Prefix Trajectory Balance with Submodular Replay for GFlowNet Training
arXiv cs.AI Research & Papers
ReasonOps: Operator Segmentation for LLM Reasoning Traces
arXiv cs.AI Research & Papers
Rethinking Literature Search Evaluation: Deep Research Helps, and Human Citation Lists Ar…
arXiv cs.AI Research & Papers
Beyond Attack Success Rate: Temporal Logit Observability for LLM Safety Failures
arXiv cs.AI Research & Papers
Controlling the Risk of Corrupted Contexts for Language Models via Early-Exiting
arXiv cs.AI Research & Papers
VikingMem: A Memory Base Management System for Stateful LLM-based Applications
arXiv cs.AI Research & Papers
DLM-SWAI: Steering Diffusion Language Models Before They Unmask
arXiv cs.AI Research & Papers
From Prompts to Context: An Ontology-Driven Framework for Human-Generative AI Collaborati…
arXiv cs.AI Research & Papers
Unlocking the Working Memory of Large Language Models for Latent Reasoning
arXiv cs.AI Research & Papers
Think Fast, Talk Smart: Partitioning Deterministic and Neural Computation for Structured …
arXiv cs.AI Research & Papers
GRASP: Gated Regression-Aware Skill Proposer for Self-Improving LLM Agents
arXiv cs.AI Research & Papers
The Chain Holds, the Answer Folds: Trace-Answer Dissociation in Reasoning Models Under Ad…
arXiv cs.AI Research & Papers
UI-KOBE: Knowledge-Oriented Behavior Exploration for Lightweight Graph-Guided GUI Agents
arXiv cs.AI Research & Papers
Sustainable Metal-Organic Framework Water Harvesters in the Artificial Intelligence Era
arXiv cs.AI Research & Papers
Mitigating Stethoscope-Induced Shortcuts in Respiratory Sound Classification under Federa…
arXiv cs.AI Research & Papers
DeepTool: Scaling Interleaved Deliberation in Tool-Integrated Reasoning via Process-Super…
arXiv cs.AI Research & Papers
FinVerBench: Benchmark Validity and Calibration in Large Language Model Financial Stateme…
arXiv cs.AI Research & Papers
TIMEGATE: Sustainable Time-Boxed Promotion Gates for Continual ML Adaptation Under Resour…
arXiv cs.AI Research & Papers
Planning with the Views via Scene Self-Exploration
arXiv cs.AI Research & Papers
Why Specialist Models Still Matter: A Heterogeneous Multi-Agent Paradigm for Medical Arti…
arXiv cs.AI Research & Papers
Benchmarking Positional Encoding Strategies for Transformer-Based EEG Foundation Models
arXiv cs.AI Research & Papers
CB-SLICE: Concept-Based Interpretable Error Slice Discovery
arXiv cs.AI Research & Papers
Influence-Guided Symbolic Regression: Scientific Discovery via LLM-Driven Equation Search…
arXiv cs.AI Research & Papers
Mind-Omni: A Unified Multi-Task Framework for Brain-Vision-Language Modeling via Discrete…
arXiv cs.AI Research & Papers
Differentiable Belief-based Opponent Shaping
arXiv cs.AI Research & Papers
BEAMS: Benchmarking and Evaluating AI for Modeling and Simulation
arXiv cs.AI Research & Papers
Personalized Turn-Level User Conversation Satisfaction Benchmark
arXiv cs.AI Research & Papers
DynSess: Dynamic Session-Level Evaluation and Optimization Framework for Role-Playing Age…
arXiv cs.AI Research & Papers
Opt-Verifier: Unleashing the Power of LLMs for Optimization Modeling via Dual-Side Verifi…