Explorar

Noticias de IA

37834 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Semantic and Visual Evidence for Efficient Long-Video Reasoning: A Solution for the HD-EP…
arXiv cs.AI Research & Papers
Projectional Decoding: Towards Semantic-Aware LLM Generation
arXiv cs.AI Research & Papers
ESPO: Early-Stopping Proximal Policy Optimization
arXiv cs.AI Research & Papers
Data filtering methods for training language models
arXiv cs.AI Research & Papers
A unified deeplearning framework for contrast-phase-specific virtual monochromatic imaging
arXiv cs.AI Research & Papers
VLA-Pro: Cross-Task Procedural Memory Transfer for Vision-Language-Action Models
arXiv cs.AI Research & Papers
Training Deliberative Monitors for Black-Box Scheming Detection
arXiv cs.AI Policy & Regulation
Does Distributed Training Undermine Compute Governance?
arXiv cs.AI Research & Papers
Code-QA-Bench: Separating Code Reasoning from Documentation Memorization in Repository-Le…
arXiv cs.AI Research & Papers
Discovering Cooperative Pipelines: Autoresearch for Sequential Social Dilemmas
arXiv cs.AI Research & Papers
Tailoring the Curriculum: Student-Centered Reasoning Distillation via Dynamic Data-Model …
arXiv cs.AI Research & Papers
Domain-Specific Data Synthesis for LLMs via Minimal Sufficient Representation Learning
arXiv cs.AI Security & Safety
Token Inflation: How Dishonest Providers Can Overcharge for Large Language Model Usage
arXiv cs.AI Research & Papers
When Cloud Agents Meet Device Agents: Lessons from Hybrid Multi-Agent Systems
arXiv cs.AI Research & Papers
MuPHI: Learning Implicit Multimodal Harm Reasoning via Semantically Grounded Reward Optim…
arXiv cs.AI Research & Papers
Neural Network Verification using Partial Multi-Neuron Relaxation
arXiv cs.AI Research & Papers
GEO-Bench: Benchmarking Ranking Manipulation in Generative Engine Optimization
arXiv cs.AI Research & Papers
OmniMatBench: A Human-Calibrated Multimodal Reasoning Benchmark Across 19 Materials Scien…
arXiv cs.AI Research & Papers
Harnessing non-adversarial robustness in large language models
arXiv cs.AI Research & Papers
MEMENTO: Leveraging Web as a Learning Signal for Low-Data Domains
arXiv cs.AI Research & Papers
LFQ: Logit-aware Final-block Quantization for Boosting the Generation Quality of Low-Bit …
arXiv cs.AI Research & Papers
HPO: Hysteretic Policy Optimization for Stable and Efficient Training under Sparse-Reward…
arXiv cs.AI Research & Papers
Unifying Temporal and Structural Credit Assignment in LLM-Based Multi-Agent Prompt Optimi…
arXiv cs.AI Research & Papers
Uncertainty-Aware Transfer Learning for Cross-Building Energy Forecasting: Toward Robust …
arXiv cs.AI Research & Papers
Who can we trust? LLM-as-a-jury for Comparative Assessment
arXiv cs.AI Research & Papers
PhyGenHOI: Physically-Aware 4D Generation of Dynamic Human-Object Interactions
arXiv cs.AI Research & Papers
Reducing Political Manipulation with Consistency Training
arXiv cs.AI Research & Papers
JMed48k: A Multi-Profession Japanese Medical Licensing Benchmark for Vision-Language Mode…
arXiv cs.AI Research & Papers
EvA: An Evidence-First Audio Understanding Paradigm for LALMs
arXiv cs.AI Research & Papers
Bridge-RAG: An Abstract Bridge Tree Based Retrieval Augmented Generation Algorithm