Explorar

Noticias de IA

37834 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
A Matter of TASTE: Improving Coverage and Difficulty of Agent Benchmarks
arXiv cs.AI Research & Papers
Voice "Cloning" is Style Transfer
arXiv cs.AI Research & Papers
NCSAM Noise-Compensated Sharpness-Aware Minimization for Noisy Label Learning
arXiv cs.AI Research & Papers
Refusal Before Decoding: Detecting and Exploiting Refusal Signals in Intermediate LLM Act…
arXiv cs.AI Research & Papers
Improving Evaluation of Recombination-based Cartesian Genetic Programming
arXiv cs.AI Research & Papers
Mechanistically Interpreting the Role of Sample Difficulty in RLVR for LLMs
arXiv cs.AI Research & Papers
Do readers prefer AI-generated Italian short stories?
arXiv cs.AI Research & Papers
Entropy-aware Masking for Masked Language Modeling
arXiv cs.AI Research & Papers
Rectified Schr\"odinger Bridge Matching for Few-Step Visual Navigation
arXiv cs.AI Research & Papers
Let Relations Speak: An End-to-End LLM-GNN Soft Prompt Framework for Fraud Detection
arXiv cs.AI Research & Papers
On the Intrinsic Limits of Transformer Image Embeddings in Non-Solvable Spatial Reasoning
arXiv cs.AI Research & Papers
Prompt Codebooks: Discrete Compositional Optimization for Language Model Instruction Refi…
arXiv cs.AI Research & Papers
Picid: A Modular Evaluation Infrastructure for Reproducible PHM Across Tasks and Domains
arXiv cs.AI Research & Papers
Cultural Fidelity in English-to-Hindi Translation: A Preservation-Fluency Frontier for Ge…
arXiv cs.AI Research & Papers
SAME: Stabilized Mixture-of-Experts for Multimodal Continual Instruction Tuning
arXiv cs.AI Research & Papers
Adapting, Fast and Slow: On Few-Shot Transportability of Compositions
arXiv cs.AI Research & Papers
Generic Interpretation Approach for Transformer Models Incorporating Heterogenous Attenti…
arXiv cs.AI Research & Papers
From Learning Resources to Competencies: LLM-Based Tagging with Evidence and Graph Constr…
arXiv cs.AI Research & Papers
Detecting and Mitigating the Correct-Answer Extinction Window in Test-Time Reinforcement …
arXiv cs.AI Research & Papers
Efficient Post-training of LLMs for Code Generation With Offline Reinforcement Learning
arXiv cs.AI Research & Papers
You Are in Control of Your State: Why Human Outcomes Are Controllable Through Causal Stat…
arXiv cs.AI Research & Papers
Hierarchical Prompt-Domain Control and Learning for Resource-Constrained Agentic Language…
arXiv cs.AI Research & Papers
Measuring Progress Toward AGI: A Cognitive Framework
arXiv cs.AI Research & Papers
HRBench: Benchmarking and Understanding Thinking-Mode Switch Strategies in Hybrid-Reasoni…
arXiv cs.AI Research & Papers
SkillGrad: Optimizing Agent Skills Like Gradient Descent
arXiv cs.AI Research & Papers
GraD-IBD: Graph Representation Learning from Diagnosis Trajectories for Early Detection o…
arXiv cs.AI Research & Papers
RAGe: A Retrieval-Augmented Generation Evaluation Framework
arXiv cs.AI Research & Papers
CyberJurors: A Multi-Agent Simulation Task for E-Commerce Disputes Verdict
arXiv cs.AI Research & Papers
Risk-Controlled Lean-as-Judge for Natural-Language Mathematical Reasoning
arXiv cs.AI Research & Papers
C-MIG: Multi-view Information Gain-based Retrieval-Augmented Generation for Clinical Diag…