Enhancing LLMs through human feedback: a journey towards self-improvement
Explorar
Noticias de IA
22318 elementos — filtrados, clasificados y sin duplicados
Bringing Back Rule Induction to Fluid Intelligence Research? An Initial Validation of the…
Evaluating Nonuniform Dependability Across Response Conditions: A Conditional Generalizab…
DeepBias: Adaptive In-depth Probing of Social Biases in LVLMs
HandFlow: Fully Generative 4D Hand Recovery with Flow Matching
When the Target Domain Changes: AI-Mediated Construct Drift in High-Stakes English Langua…
What We Talk About When We Talk About LLM Planning: Evidence for Two Distinct Planning Ab…
Amplitude-Only FFN Intervention for Tool-Structured LLM Inference Method: Gated Evaluatio…
LP Mining with LP2Graph: A Use Case for Railway Rescheduling
The Hidden Footprint: Making Storage a First-Class Metric for LLM Agent Evaluation
Learning Subgroup Relations Using Siamese Graph Neural Networks
Simple Features and Honest Calibration for Ambivalence and Hesitancy Recognition in Video
MusicMark: A Robust Generative Watermarking Framework for Music Generation
The Equilibrium Is the Initialization: Lazy Identity Collapse in Physics-Structured Deep …
Generative Chinese Statute Retrieval
A Novel Graph Fraud Detector via Grouped Attribute Completion and Confidence-Aware Contra…
Why Low-Light Cameras Go Color Blind: Removing Color Bias in Raw Denoising
OS-Pruner: Pruning Chains-of-Thought of Reasoning Models via Optimal Stopping
Do Video-LLMs Actually Watch? Diagnosing Character-Tracking Failures in Long-Form Video
Link Adaptation Using Joint-Thompson Sampling
SCATE: Learning to Supervise Coding Agents for Cost-Effective Test Generation
CLAP: Direct VLM-to-VLA Adaptation via Language-Action Grounding
Eluna: An Agentic LLM System for Automating Warehouse Operations with Reasoning and Task …
Augmenting Fundamental Analysis with Large Language Models: A RAG-Based System for Genera…
A Coreset Selection Framework with Ensemble Aggregation for Image Classification
PRecG: Legal Precedent Retrieval with Graph Neural Networks and Rhetorical Role Segmentat…
A Unified Approach to Interpreting Knowledge Distillation for Large Language Models via I…
Minimal Decision Dynamics and Contextual Probability: A Quantum Tug-of-War Model
ConceptSMILE: Auditing the Trustworthiness of Concept-Based Explainable AI
Agora: Enhancing LLM Agent Reasoning Via Auction-Based Task Allocation