Explorar

Noticias de IA

27413 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
ELBench: A Multi-Dimensional Benchmark for Education-Facing Large Language Models
arXiv cs.AI Research & Papers
Temporal Misgrounding in Legal RAG: A Versioned-Corpus Benchmark for French Tax Law
arXiv cs.AI Research & Papers
RangeFactory: Scalable Construction of Multi-Hop Cyber Ranges
arXiv cs.AI Research & Papers
Mitigating Gender Bias in English to Romanian Machine Translation
arXiv cs.AI Research & Papers
Mismatch Matters: On-Policy Distillation Beyond Token Agreement
arXiv cs.AI Research & Papers
Second-Order Muon Done Right: A Principled Marriage of Spectral Geometry and Curvature
arXiv cs.AI Research & Papers
CARD: Controlled Agentic Reddit Discussions for Credit Card Simulation
arXiv cs.AI Research & Papers
Enhancing Scientific Named Entity Recognition via Large Language Models: A Type-driven Mu…
arXiv cs.AI Research & Papers
Towards Expert-level Medical AI for Real-time Video Consultations
arXiv cs.AI Research & Papers
ArchAgent v2: A Case Study with the Data Prefetching Championship
arXiv cs.AI Research & Papers
Matryoshka Language Model Suites
arXiv cs.AI Research & Papers
Model Discovery Agent: LLM-assisted Bayesian experiment design for data-efficient discove…
arXiv cs.AI Research & Papers
When Is a Steerable Concept Representation Real? Measurement Confounds in a Cross-Family …
arXiv cs.AI Research & Papers
A Combined Feature-Based Framework for Disguise and Spoofing Detection in Face Recognitio…
arXiv cs.AI Research & Papers
Agentic AI-driven Immersive Simulation: A Knowledge-Aware Virtual Training Platform forHi…
arXiv cs.AI Research & Papers
Matching Supervision to the Student's Learning Capacity: A Unified Framework for On-Polic…
arXiv cs.AI Research & Papers
SHE: Trajectory-driven Safety Harness Evolution for LLM Agents
arXiv cs.AI Research & Papers
DSLE: A Learning Environment for Dark Souls Boss Encounters
arXiv cs.AI Research & Papers
Large Multimodal Agents for Intelligent Transportation Systems: Architectures, Evidence, …
arXiv cs.AI Research & Papers
Open Evaluation Agent: Efficient and Promptable Evaluation of Visual Generative Models
arXiv cs.AI Research & Papers
Second Order Drifting Models
arXiv cs.AI Research & Papers
Halpern Iteration Achieves $\tilde{\mathcal{O}}(\epsilon^{-1/p})$ $p$th-Order Oracle Comp…
arXiv cs.AI Research & Papers
Hidden Language Consistency Phenomena in Reasoning LLMs
arXiv cs.AI Research & Papers
A Unified Framework for Dynamic Reward Shaping in Reinforcement Learning
arXiv cs.AI Research & Papers
EasyBalance: Cross-Layer Load Balancing in Distributed MoE Inference
arXiv cs.AI Research & Papers
Hallucination-Free GUI Grounding via Regression-Free Layout-Aware Matching
arXiv cs.AI Research & Papers
Rethinking Self-Evolving Agents: Do We Still Need Prescribed Optimization Pipelines?
arXiv cs.AI Research & Papers
GENCO - A Unified Neural Solver Embedded in a Development Framework for Steady-State Grid…
arXiv cs.AI Research & Papers
Adaptive Sequential Test Planning for Multi-Mechanism Reliability Qualification via Bayes…
arXiv cs.AI Research & Papers
ElasticBack: Stealthy Conditional Backdoor in LLM-Agent Skills via Coupled Trigger-Rule O…