Barzilai-Borwein Fails Superlinear Convergence on an Open Set of Quadratics for Every Dim…
Explorar
Noticias de IA
27413 elementos — filtrados, clasificados y sin duplicados
A Counterfactual Cause in Situation Calculus
Fragile Preferences: A Deep Dive Into Order Effects in Large Language Models
WebCoach: Self-Evolving Web Agents with Cross-Session Memory Guidance
StackingNet: Collective Inference Across Independent AI Foundation Models
Diagnosing Pathological Chain-of-Thought in Reasoning Models
Evaluating Risks in Weak-to-Strong Alignment: A Bias-Variance Perspective
From Noise to Diversity: Random Embedding Injection in LLM Reasoning
EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based D…
Autonomous disproofs of the sum-product conjecture over $\mathbb R$ with GPT-5.5 Pro
Evaluating and Guarding Citation Faithfulness in Agentic Scientific Synthesis
Directional Hallucinations: Ideological Drift in News-Grounded LLM Question Answering
PromptPack: Scaling LLM Annotation Agents for Online Recommendation
KeySI: An Interaction Framework for Tuning Text Embeddings Based on Human Feedback
Routing Without Training: Controllable-Ratio LLM Offloading via Reliability Gating
Benchmarking Large Language Models on Multi-Sensor Physical Hazard Assessment
SonicSampler: Unified Tile-Aware Kernels for LLM Sampling and Speculative Verification
VeriSimpl: Robust Optimization Modeling from Natural Language using Simplification-based …
Traceable Scholarship: Page Anchors and Ariadne's Thread for Humanistic Inquiry in the Ag…
Auditing Provenance Sensitivity in LLM Agent Action Selection
The Human-AI Substitution Principle: When will you be replaced by AI in your organization?
Expectation Alignment of Language Models for Real-World User Expectations
Representing Entity Importance in AI Knowledge Systems: A Dual-Signal Framework of Audien…
VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory
What Matters for Simulation to Online Reinforcement Learning on Real Robots
TOPReward: Token Probabilities as Hidden Zero-Shot Rewards for Robotics
Self-Evolving Recommendation System: End-To-End Autonomous Model Optimization With LLM Ag…
PILD: Physics-Informed Learning via Diffusion
Stochastic Sampling is Epistemically Shallow: The Dimensionality Gap Between Temperature …
ClickGuard: Detecting and Spoiling Clickbait News with Informativeness Measures and Large…