Explorar

Noticias de IA

22318 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
SleepLM: Natural-Language Intelligence for Human Sleep
arXiv cs.AI Research & Papers
ForAug: Mitigating Biases in Image Classification via Controlled Image Compositions
arXiv cs.AI Research & Papers
Evaluating Implicit Biases in LLM Reasoning through Logic Grid Puzzles
arXiv cs.AI Research & Papers
CoT-X: An Adaptive Framework for Cross-Model Chain-of-Thought Transfer and Optimization
arXiv cs.AI Research & Papers
Large language models replicate and predict human cooperation across experiments in game …
arXiv cs.AI Research & Papers
Verbosity Tradeoffs and the Impact of Scale on the Faithfulness of LLM Self-Explanations
arXiv cs.AI Research & Papers
From Silos to Systems: Process-Oriented Hazard Analysis for AI Systems
arXiv cs.AI Research & Papers
Measuring the Gap Between Human and LLM Research Ideas
arXiv cs.AI Research & Papers
scDataset: Scalable Data Loading for Deep Learning on Large-Scale Single-Cell Omics
arXiv cs.AI Research & Papers
FurnitureVLA: Learning Long-Horizon Bimanual Furniture Assembly with Vision-Language-Acti…
arXiv cs.AI Research & Papers
Distill to Detect: Exposing Stealth Biases in LLMs through Cartridge Distillation
arXiv cs.AI Research & Papers
GPU-Parallel Linearization Error Bounds for Real-Time Robust Optimal Control of Nonlinear…
arXiv cs.AI Research & Papers
Flow-Through Tensors: A Unified Computational Graph Architecture for Multi-Layer Transpor…
arXiv cs.AI Research & Papers
Fraud is Not Just Rarity: A Causal Prototype Attention Approach to Realistic Synthetic Ov…
arXiv cs.AI Research & Papers
Diffusion-GR2: Diffusion Generative Reasoning Re-ranker
arXiv cs.AI Research & Papers
Adversarial Pragmatics for AI Safety Evaluation: A Benchmark for Instruction Conflict, Em…
arXiv cs.AI Research & Papers
TANDEM: Temporal Attention-guided Neural Differential Equations for Missingness in Time S…
arXiv cs.AI Research & Papers
Predicting LLM Reasoning Performance with Small Proxy Model
arXiv cs.AI Research & Papers
Skills Are Not Islands: Measuring Dependency and Risk in Agent Skill Supply Chains
arXiv cs.AI Research & Papers
Autonomous Scientific Discovery via Iterative Meta-Reflection
arXiv cs.AI Research & Papers
Muon as a Residual Connection
arXiv cs.AI Research & Papers
K-Merge: Online Continual Merging of Adapters for On-device Large Language Models
arXiv cs.AI Research & Papers
Reasoning Up the Instruction Ladder for Controllable Language Models
arXiv cs.AI Research & Papers
CausalMix: Data Mixture as Causal Inference for Language Model Training
arXiv cs.AI Research & Papers
Cheap Code, Costly Judgment: A Case Study on Governable Agentic Software Engineering
arXiv cs.AI Research & Papers
LongVQUBench: Benchmarking Long-Term Video Quality Understanding of Vision-Language Models
arXiv cs.AI Research & Papers
FlowPath: Learning Data-Driven Manifolds with Invertible Flows for Robust Irregularly-sam…
arXiv cs.AI Research & Papers
NI-Tex: Non-isometric Image-based Garment Texture Generation
arXiv cs.AI Research & Papers
MemSyco-Bench: Benchmarking Sycophancy in Agent Memory
arXiv cs.AI Research & Papers
EchoRisk: A Multicentre Echocardiography Dataset and Benchmark for Cardio-Oncology