Explorar

Noticias de IA

29627 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Characterizing Web Search in The Age of Generative AI
arXiv cs.AI Research & Papers
Rethinking RL Evaluation: Can Benchmarks Truly Reveal Failures of RL Methods?
arXiv cs.AI Research & Papers
Make a Video Call with LLM: A Measurement Campaign over Six Mainstream Apps
arXiv cs.AI Research & Papers
End-to-End Deep Learning for Predicting Metric Space-Valued Outputs
arXiv cs.AI Research & Papers
Position: Beyond Sensitive Attributes, ML Fairness Should Quantify Structural Injustice v…
arXiv cs.AI Research & Papers
Beyond Model Base Retrieval: Weaving Knowledge to Master Fine-grained Neural Network Desi…
arXiv cs.AI Models & Releases
DetailMaster: Can Your Text-to-Image Model Handle Long Prompts?
arXiv cs.AI Research & Papers
A Lightweight Context-Driven Training-Free Network for Scene Text Segmentation and Recogn…
arXiv cs.AI Models & Releases
EuroBERT: Scaling Multilingual Encoders for European Languages
arXiv cs.AI Research & Papers
Efficient Weighted Sampling via Score-based Generative Models
arXiv cs.AI Research & Papers
Score Function Gradient Estimation to Widen the Applicability of Decision-Focused Learning
arXiv cs.AI Research & Papers
Coding Agent Is Good As World Simulator
arXiv cs.AI Research & Papers
Agricultural Landscape Understanding At Country-Scale
arXiv cs.AI Research & Papers
KnowledgeBerg: Evaluating Systematic Knowledge Coverage and Compositional Reasoning in La…
arXiv cs.AI Research & Papers
RadAgent: A tool-using AI agent for stepwise interpretation of chest computed tomography
arXiv cs.AI Research & Papers
Rashomon Memory: Towards Argumentation-Driven Retrieval for Multi-Perspective Agent Memory
arXiv cs.AI Research & Papers
Model Parallelism With Subnetwork Data Parallelism
arXiv cs.AI Research & Papers
On Information Self-Locking in Reinforcement Learning for Active Reasoning of LLM agents
arXiv cs.AI Research & Papers
LLM-WikiRace Benchmark: How Far Can LLMs Plan over Real-World Knowledge Graphs?
arXiv cs.AI Research & Papers
MulFeRL: Enhancing Reinforcement Learning with Verbal Feedback in a Multi-turn Loop
arXiv cs.AI Research & Papers
Safety Alignment of LMs via Non-cooperative Games
arXiv cs.AI Research & Papers
MobiBench: Multi-Branch, Modular Benchmark for Mobile GUI Agents
arXiv cs.AI Research & Papers
A Unified Evaluation-Instructed Framework for Query-Dependent Prompt Optimization
arXiv cs.AI Research & Papers
ACON: Optimizing Context Compression for Long-horizon LLM Agents
arXiv cs.AI Research & Papers
Taming System Complexity: Demystifying Software Engineering Agents in Diagnosing Linux Ke…
arXiv cs.AI Research & Papers
Safety Mirage: How Spurious Correlations Undermine VLM Safety Fine-Tuning and Can Be Miti…
arXiv cs.AI Research & Papers
Learning to Reduce Search Space for Generalizable Neural Routing Solver
arXiv cs.AI Research & Papers
Mitigating Perceptual Judgment Bias in Multimodal LLM-as-a-Judge via Perceptual Perturbat…
arXiv cs.AI Research & Papers
Permissive Safety Through Trusted Inference: Verifiable Belief-Space Neural Safety Filter…
arXiv cs.AI Research & Papers
Modeling Depth Ambiguity: A Mixture-Density Representation for Flying-Point-Free Depth Es…