Explorar

Noticias de IA

37834 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Solver-Aware Decompositions for Programming-by-Example: When Dividing Requires Knowing ho…
arXiv cs.AI Research & Papers
LeanMem: Simple and Efficient Long-Term Memory for LLM Agents
arXiv cs.AI Research & Papers
ChartAnno: Evaluating MLLMs for Chart Annotation Generation
arXiv cs.AI Research & Papers
When Correct Solutions Repeat: Rarity-Aware Credit Redistribution for GRPO
arXiv cs.AI Research & Papers
ToolLIFT: Lifting Tool-Specific Trajectories into Function-Level Graphs for Generalizable…
arXiv cs.AI Research & Papers
WeClawArena: An Auditable Sandbox and Benchmark for Cross-User Agents Collaboration and S…
arXiv cs.AI Research & Papers
Can LLM design high-quality experiments? A Comprehensive and Systematic Benchmark on Auto…
arXiv cs.AI Research & Papers
Interpreting Black-Box Large Language Models with Sentence-Level Energy Landscapes
arXiv cs.AI Research & Papers
Behaviorally Adaptive Visual Diversion for Inclusive and Resilient Digital Assessment Del…
arXiv cs.AI Research & Papers
Soft Guidance Starts to Outperform CoT Prompting as LLMs Improve
arXiv cs.AI Research & Papers
Enhancing Tabular Learners with Context-Aware Semantic Embeddings
arXiv cs.AI Research & Papers
Adversarial Fast-Moving Real-World Domains as Test Beds for Benchmarking AI Scientist Cap…
arXiv cs.AI Research & Papers
From Social Coding to Agentic Coding: Productivity and Relational Reconfiguration in Open…
arXiv cs.AI Research & Papers
FOUND-AF: Benchmarking ECG Foundation Models for Atrial Fibrillation Detection
arXiv cs.AI Research & Papers
FraQ: Efficient Coordinate-Space Recompression for Federated Low-Rank Adaptation
arXiv cs.AI Research & Papers
Formal Verification of Agentic Systems over Operational Data
arXiv cs.AI Research & Papers
Rethinking Modality Reliability in Multimodal Sentiment Analysis with Incomplete Observat…
arXiv cs.AI Research & Papers
Unequal Verdicts: Investigating Gender Bias in LLM-Based Fake News Detection
arXiv cs.AI Research & Papers
Cross-Layer Interaction under Weight-Space Ablation: A Closed-Form Attention Jacobian Bou…
arXiv cs.AI Research & Papers
AutoSND: From Execution Evidence to Structural Policies for Automated Network Dismantling…
arXiv cs.AI Research & Papers
Shielding for Higher-Order Safety
arXiv cs.AI Research & Papers
PhyAI: Real-Time Physical AI at the Edge, Scalable Rollouts in the Cloud
arXiv cs.AI Research & Papers
TARL: Transaction-Aware Reliable Ledgers for Executable Memory Management in Long-Term Ag…
arXiv cs.AI Research & Papers
When Outputs Disperse, Does Epistemic Revision Follow? A Black-Box Diagnostic for Machine…
arXiv cs.AI Research & Papers
SAT-Edge-Agent: Hardware-in-the-Loop Edge-Agent Orchestration for Onboard Satellite Intel…
arXiv cs.AI Research & Papers
CARE-Bench: Benchmarking Patient-Facing LLM Triage
arXiv cs.AI Research & Papers
Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improve…
arXiv cs.AI Research & Papers
AgenticECO: An Agentic Framework for ECO on 3D Integrated Circuits
arXiv cs.AI Security & Safety
MissClick: Exploiting Digit-Serialized Coordinates to Attack GUI Grounding Models
arXiv cs.AI Security & Safety
Agents Catching Agents: Shortcut Cascades and Benchmark Gaming in Clinical Multi-Agent Sy…