When Gradients Collide: Failure Modes of Multi-Objective Prompt Optimization for LLM Judg…
Explorar
Noticias de IA
21052 elementos — filtrados, clasificados y sin duplicados
Break the Brake, Not the Wheel: Untargeted Jailbreak via Entropy Maximization
PASA: A Principled Embedding-Space Watermarking Approach for LLM-Generated Text under Sem…
SURGE: Surrogate Gradient Adaptation in Binary Neural Networks
StakeBench: Evaluating Language Understanding Grounded in Market Commitment
Memorize Theorems, Not Instances: Probing SFT Generalization through Mathematical Reasoni…
Flow-OPD: On-Policy Distillation for Flow Matching Models
PACZero: PAC-Private Fine-Tuning of Language Models via Sign Quantization
Conditional KRR: Injecting Unpenalized Features into Kernel Methods with Applications to …
Mitigating Label Shift in Tabular In-Context Learning via Test-Time Posterior Adjustment
WorldGUI: An Interactive Benchmark for Desktop GUI Automation from Any Starting Point
Multi-Modal Cross-Domain Alignment Network for Video Moment Retrieval
From Muscle Bursts to Motor Intent: Self-Supervised Token Modeling for Heterogeneous EMG
Auditing Stealth Sycophancy in Mental-Health Dialogue: Structured Clinical-State Diagnost…
BFORE: Butterfly-Firefly Optimized Retinex Enhancement for Low-Light Image Quality Improv…
ClawTrace: Cost-Aware Tracing for LLM Agent Skill Distillation
Shepherd: A Runtime Substrate Empowering Meta-Agents with a Formalized Execution Trace
ScrapMem: A Bio-inspired Framework for On-device Personalized Agent Memory via Optical Fo…
Talking Slide Avatars: Open-Source Multimodal Communication Approach for Teaching
ESIA: An Energy-Based Spatiotemporal Interaction-Aware Framework for Pedestrian Intention…
Chain of Evidence: Pixel-Level Visual Attribution for Iterative Retrieval-Augmented Gener…
VILAS: A VLA-Integrated Low-cost Architecture with Soft Grasping for Robotic Manipulation
Is VLA Reasoning Faithful? Probing Safety of Chain-of-Causation in Autonomous Driving Mod…
ECUAS$_n$: A family of metrics for principled evaluation of uncertainty-augmented systems
Federation over Text: Insight Sharing for Multi-Agent Reasoning
Depth Registers Unlock W4A4 on SwiGLU: A Reader/Generator Decomposition
Copy-as-Decode: Grammar-Constrained Parallel Prefill for LLM Editing
Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training
From Reasoning to Code: GRPO Optimization for Underrepresented Languages
Beyond Static Uncertainty: Modeling Temporal Uncertainty Dynamics for Probabilistic Time …