Position: Fairness Failure in Generative Models is an Evaluation Problem
Explorar
Noticias de IA
27413 elementos — filtrados, clasificados y sin duplicados
LLM-Derived Preference Judgments Are Not Self-Consistent
Efficient Dynamic Shielding for Parametric Safety Specifications
MoRA: Mobility as the Backbone for Geospatial Representation Learning at Scale
FedPref: Federated Preference Learning for Structured Radiology Report Extraction
Audio Physical Dynamics Inspired Deepfake Detection for Voice Authentication Systems
FairNVT: Fair Classification via Noise Injection in Vision Transformers
Self-Distillation as a Performance Recovery Mechanism for LLMs: Counteracting Compression…
KnowSim: Evaluating Information Calibration in LLM Assistants with User Simulators that L…
Protect the Brain When Treating the Heart: Feasibility of 2.5D U-Net for Real-Time Gaseou…
Attention Flows: Tracing LLM Conceptual Engagement via Story Summaries
Supporting Calibrated Reliance in Human-AI Collaboration: Different Strategies for Differ…
Adversarial Data Modeling in Epidemiology
Language Family Matters: Evaluating LLM-Based ASR Across Linguistic Boundaries
Exploring Efficient Open-Vocabulary Segmentation in the Remote Sensing
Visual Prompting for Robotic Manipulation with Annotation-Guided Pick-and-Place Using ACT
When to Review: Spaced Repetition for Continual Pre-Training of Language Models
Beyond the Trace: Coupling an Interpretable Reasoning-State Readout to Native MoE Routing
Quantifying Risk Under Evolving Uncertainty: Belief-Dependent Robustness for Safe Sequent…
GxP-Agent: Process-DAG Topology for Reliable Clinical Trial Programming with LLM Agents
The Price of Thinking: Reasoning Effort as a Model-Specific API Contract
Wuying-Browser-Agent: Real-World Centric Fundamental Long-Horizon Browser Agents
Synthesizing Feature Extractors: An Agentic Approach for Algorithm Selection
SAGE: Self-Evolving Storyboard Skills via Attribution-Guided Rule Evolution
ChannelFlow-Tools: A Configuration-Driven Pipeline for Generating Machine-Learning-Ready …
Structure-Internalized Rule Language Model for Faithful Knowledge Graph Reasoning
ASI-Bench: At the Dawn of Artificial Superintelligence
LSem2Vec: A Simple yet Effective Two-Stage Approach for Source Code Embedding
Fool's Gold: Defensive Deception Against Safety-Removal Attacks on Open-Weight Models
M3TR: Temporal Retrieval Enhanced Multi-Modal Micro-video Popularity Prediction