Explorar

Noticias de IA

29349 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
The Ringelmann Effect in Multi-Agent LLM Systems: A Scaling Law for Effective Team Size
arXiv cs.AI Research & Papers
SegTune: Structured and Fine-Grained Control for Song Generation
arXiv cs.AI Research & Papers
Sparse-View Lung Nodule Volumetry from Digitally Reconstructed Radiographs via AReT: Anat…
arXiv cs.AI Security & Safety
D-Judge: Disrupting Multi-Turn Jailbreaks using Semantics-Preserving Output Rewriting
arXiv cs.AI Research & Papers
CARVE: Certified Affordable Repair of Vetoed Maneuvers via Envelopes for Interactive Driv…
arXiv cs.AI Security & Safety
MultiTurnPSB: Evaluating Multi-Turn Jailbreak Attacks an dClassifier-Based Defenses for M…
arXiv cs.AI Opinion & Editorial
Position: Prioritize Identifying Structure, Not Complex Models, for Scientific Discovery
arXiv cs.AI Research & Papers
Closed-Loop Molecular Design with Calibrated Deference
arXiv cs.AI Research & Papers
TadA-Bench: A Million-Variant Benchmark for Future-Round Discovery Toward Agentic Protein…
arXiv cs.AI Research & Papers
Cross-Modal Contrastive Learning of ECG and Angiography Representations for Severe Stenos…
arXiv cs.AI Research & Papers
Entropy Is Not Enough: Unlocking Effective Reinforcement Learning for Visual Reasoning vi…
arXiv cs.AI Research & Papers
Imaginative Perception Tokens Enhance Spatial Reasoning in Multimodal Language Models
arXiv cs.AI Research & Papers
Cost-Aware Query Routing in RAG: Empirical Analysis of Retrieval Depth Tradeoffs
arXiv cs.AI Research & Papers
IdiomX A Multilingual Benchmark for Idiom Understanding, Retrieval, and Interpretation
arXiv cs.AI Research & Papers
BigFinanceBench: A Workflow-Grounded Benchmark for Financial-Research Agents
arXiv cs.AI Research & Papers
PyraMathBench: Evaluating and Improving Mathematical Capability in Large Language Models
arXiv cs.AI Research & Papers
Reasoning Structure of Large Language Models
arXiv cs.AI Research & Papers
From Control Boundary to Insurance Claim: Reconstructing AI-Mediated Losses Through the C…
arXiv cs.AI Research & Papers
Leveraging BART to Assess CS1 C++ Programming Assignments using Rubric-based Criteria
arXiv cs.AI Research & Papers
Unveiling the Structure of Do-Calculus Reasoning via Derivation Graphs
arXiv cs.AI Research & Papers
When to Re-Plan: Subgoal Persistence in Hierarchical Latent Reasoning
arXiv cs.AI Research & Papers
LAP: An Agent-to-Instrument Protocol for Autonomous Science
arXiv cs.AI Research & Papers
From Answers to States: Verifiable Process-Level Evaluation of Chemical Reasoning in Larg…
arXiv cs.AI Research & Papers
The DeepSpeak-Agentic Dataset
arXiv cs.AI Research & Papers
From Prompt to Service: An SLM-Based Agent Orchestration Gateway for AI-Driven Virtual Wo…
arXiv cs.AI Research & Papers
Cross-Lingual Token Arbitrage: Optimizing Code Agent Context Windows via Local LLM Prepro…
arXiv cs.AI Research & Papers
Gender-Dependent Diagnostic Substitution in LLM Medical Triage: Same Symptoms, Unequal Ur…
arXiv cs.AI Research & Papers
StepFinder: A Temporal Semantic Framework for Failure Attribution in Multi-Agent Systems
arXiv cs.AI Research & Papers
A formal definition and meta-model for a machine theory of mind
arXiv cs.AI Research & Papers
ThoughtFold: Folding Reasoning Chains via Introspective Preference Learning